Hari ini, Brethof Voice Pro v1.0 tersedia untuk dimuat turun pada Windows 10/11 dan Linux (Ubuntu, Fedora, Arch). Ia merupakan aplikasi desktop yang menangkap audio daripada mikrofon anda serta menjalankan model ASR berasaskan Qwen. secara tempatan pada CPU atau GPU anda, dan menaip teks transkripsi ke dalam tetingkap yang sedang difokuskan.
Apa yang disertakan dalam v1.0
- 30 bahasa transkripsi ditambah 38 bahasa terjemahan — Arab, Kantonis, Cina, Czech, Denmark, Belanda, Inggeris, Filipina, Finland, Perancis, Jerman, Yunani, Hindi, Kroasia, Hungaria, Indonesia, Itali, Jepun, Korea, Makedonia, Melayu, Parsi, Poland, Portugis, Romania, Rusia, Serbia, Slovakia, Slovenia, Sepanyol, Sweden, Thailand, Turki, Ukraine, Vietnam, Bulgaria.
- Dikte kunci pintas global — tekan kekunci panas anda di mana-mana, bercakap, lepaskan, dan teks ditaip ke dalam aplikasi yang difokuskan.
- 100% luar talian — tiada awan, tiada telemetri, tiada akaun diperlukan untuk transkripsi.
- Tiga tahap model — asas (cepat, 0.6B parameter), sederhana (1.7B), besar (3B). Pilih berdasarkan perkakasan anda.
- Pengurangan bunyi bising melalui DeepFilterNet dan pengesanan aktiviti suara melalui Silero VAD, kedua-duanya berjalan secara tempatan.
- Kata panas — suntikkan nama, singkatan, dan istilah domain sebagai petunjuk semasa inferensi (tiada latihan semula diperlukan).
Satu perkara tidak dalam v1.0: penalaan model. Binaan sebelumnya memilikinya melalui PyTorch, tetapi apabila kami beralih kepada inferens GGUF, kami merosakkan landasan latihan dan kami tidak akan menghantarnya sehingga langkah penukaran kukuh. Lihat pos landasan penalaan halus.
Harga
Pembelian sekali sahaja, tiada langganan:
- Personal — 2 mesin, sesuai untuk penggunaan secara individu dan untuk kerja bebas dalam bidang komersial. Lihat harga.
- Business — Penggunaan oleh pasukan/organisasi dengan diskaun kuantiti bermula dari 10 tempat. Lihat harga.
- Percubaan percuma 14 hari — tiada kad kredit, semua ciri dibuka.
Harga akan disesuaikan secara automatik mengikut wilayah: jika anda berada di Eropah Timur, Asia Tenggara, Amerika Latin, atau Afrika, anda akan melihat harga yang disesuaikan mengikut pariti kuasa beli.
Apa yang kami lakukan dengan betul
Perkara yang paling membuat kami gembira ialah masa ke kata pertama. Buka aplikasi, tekan kekunci panas anda, bercakap. Tiada pendaftaran. Tiada pelayar web. Tiada muat naik. Tiada menunggu pusingan awan. Pada komputer riba sederhana, Voice Pro mentranskripsi ayat lima saat dalam masa kurang daripada 400 ms dengan model asas. Kelajuan itulah intipatinya.
Apa yang seterusnya
- binaan macOS — sedang dalam proses, sasaran suku ketiga 2026.
- Penalaan halus pada suara dan perbendaharaan kata anda — akan hadir sebaik sahaja saluran penukaran PyTorch ke GGUF sedia. Sasaran S3 2026.
- Mod penstriman masa nyata — perkataan muncul semasa anda bercakap, bukan selepas anda melepaskan kekunci pancing.
- Lebih banyak tahap model — model peranti tepi yang sangat kecil untuk perkakasan rendah, dan model 7B untuk mesin yang lebih serius.
Jika anda telah menunggu alat imlak yang menghormati privasi, hari ini ialah harinya. Muat turun percubaan, imlak selama 14 hari, beritahu kami di mana ia gagal. Kami membaca setiap e-mel.