Ngayon, ang Brethof Voice Pro v1.0 ay maaari nang i-download para sa Windows 10/11 at Linux (Ubuntu, Fedora, Arch). Ito ay isang desktop application na nakakakuha ng audio mula sa iyong mikropono at gumagamit ng ASR model na batay sa Qwen. lokal sa iyong CPU o GPU, at i-type ang transcribed na teksto sa anumang window na pinagfo-focus mo.
Ano ang isinasama sa v1.0
- 30 wika para sa transkripsyon at 38 wika para sa pagsasalin — Arabe, Kantonese, Tsino, Tseko, Danes, Olandes, Ingles, Pilipino, Finnish, Pranses, Aleman, Griyego, Hindi, Croatiano, Hunggaro, Indonesyo, Italyano, Hapones, Koreano, Macedonio, Malay, Persyano, Polako, Portuges, Rumaniano, Ruso, Serbiano, Slovak, Sloveniano, Espanyol, Swediko, Thai, Turko, Ukranyano, Vietnamese, Bulgaro.
- Pagdidikta gamit ang global na hotkey — Pindutin ang iyong hotkey kahit saan, magsalita, bitawan, at ang teksto ay i-type sa focused na app.
- 100% offline — Walang cloud, walang telemetry, walang account na kailangan para sa transkripsyon.
- Tatlong antas ng modelo — Base (mabilis, 0.6B na parameter), medium (1.7B), large (3B). Pumili ayon sa iyong hardware.
- Pagbawas ng ingay sa pamamagitan ng DeepFilterNet at pagtukoy sa aktibidad ng boses sa pamamagitan ng Silero VAD, parehong tumatakbo nang lokal.
- Mga Hotword — Ilagay ang mga pangalan, acronyms, at domain terms bilang mga pahiwatig sa panahon ng inference (hindi kailangan ng retraining).
Isang bagay hindi Sa v1.0: model fine-tuning. Ang mga naunang builds ay gumagamit ng PyTorch para dito, ngunit nang ilipat namin ang inference sa GGUF, nasira ang training pipeline, kaya hindi namin ito ilalabas hanggang maging matatag ang conversion step. Tingnan ang Fine-tuning roadmap post.
Presyo
Isang beses na pagbili, walang subscription:
- Personal — 2 makina, angkop para sa solong paggamit at freelance na komersyal na paggamit. Tingnan ang presyo.
- Business — Paggamit ng team/organisasyon na may diskwento sa dami mula sa 10 upuan. Tingnan ang presyo.
- Libreng pagsubok sa loob ng 14 na araw — Walang credit card, lahat ng feature ay na-unlock.
Ang mga presyo ay awtomatikong ina-adjust ayon sa rehiyon: kung nasa Silangang Europa, Timog-Silangang Asya, Latin America, o Africa ka, makikita mo ang presyo base sa purchasing-power-parity.
Ano ang tama nating nagawa
Ang bagay na pinakamagpapasaya sa amin ay time-to-first-word. Buksan ang app, pindutin ang hotkey mo, at magsalita. Walang signup. Walang browser. Walang pag-upload. Walang paghihintay sa cloud round-trip. Sa isang mid-range na laptop, nakakapag-transcribe ang Voice Pro ng pangungusap na limang segundo ang haba sa loob ng mas mababa sa 400 ms gamit ang base model. Ang bilis na iyon ang siyang layunin nito.
Ano ang susunod
- Build para sa macOS — Nasa proseso, target sa Q3 2026.
- Pag-fine-tune sa iyong boses at bokabularyo — Ito ay mangyayari kapag handa na ang proseso ng pag-convert mula PyTorch patungo GGUF. Target sa Q3 2026.
- Mode ng real-time streaming — Lumalabas ang mga salita habang ikaw ay nagsasalita, hindi matapos mong pindutin ang hotkey.
- Mas maraming antas ng modelo — Isang napakaliit na edge-device na modelo para sa low-end na hardware, at isang 7B na modelo para sa mga seryosong makina.
Kung naghihintay ka ng tool para sa pagdidikta na gumagalang sa privacy, ngayon na ang araw na iyon. I-download ang trial, magdikta sa loob ng 14 na araw, sabihin sa amin kung saan ito nasisira. Binabasa namin ang bawat email.