Nag-uusap ka. Ang mga salita ay napupunta sa editor mo, sa terminal mo, sa chat box, sa form, kung saan man naroon ang Cursor. At bawat isa sa mga ito ay nananatili sa makina kung saan mo ito sinabi.
Ang Brethof Voice Pro ay isang tool para sa pag-convert ng boses sa teksto at pagsasalin na gumagana nang buo sa iyong sariling kompyuter. Hindi iyan isang tampok para sa proteksyon ng privacy; iyan ang buong produkto.
Isang programa, gawa ng apat. Ito ay nagtatala ng iyong boses, nagsasalin nito sa 38 wika, naglalagay ng subtitle sa iyong mga video, at nagta-type para sa iyo kung saanman kinakailangan ang keyboard. Gumagana ito offline—sa eroplano, sa hotel na may mahinang wifi, sa loob ng tunnel—at sa laptop na mayroon ka na, may o walang graphics card. Walang subscription. Walang singil bawat minuto. Walang pag-upload. Bigyan din ng pandinig ang iyong AI agent: kaya nitong magtala, magsalin, at irekord ang isang pulong anumang haba sa pamamagitan ng MCP, sa iyong makina, nang wala nang API key. Bilhin mo ito minsan, at patuloy itong gagana.
Hindi kailanman lumalabas ang iyong boses mula sa kompyuter mo. Tumpak iyang pahayag. Tatlong bagay lamang ang nakararating sa network kapag ito ay inilunsad: ang pag-verify sa lisensya, ang pag-verify sa mga update, at ang mga modelo na iyong ini-download. Ang pag-verify sa lisensya ay nagpapadala ng key para sa lisensya, habang ang pag-verify sa mga update naman ay nagpapadala ng impormasyon tungkol sa bersyon – wala talagang audio o teksto. Kung patitigilin mo ang pag-verify sa mga update, at kapag nasa disk na ang mga modelo, wala nang anumang bagay na lalabas.
Transkripsyon sa mahigit 30 wika, at 22 rehiyonal na diyalekto ng Tsino na nauunawaan nang kusa — walang pag-set up, walang pagsasanay. At hindi na mali ang pagbigkas mo. Natututuhan ng Brethof Voice Pro ang iyong boses, mga terminong ginagamit mo, at mga pangalan ng tao, sa mismong makina mo. Kung magsasalita ka sa diyalektong Sichuan ng lola mo, tama pa rin ang paglabas nito.
Magsalita ng Polish, magbasa ng Ingles. Magsalita ng Ingles, magbasa ng Hapon. O sabihin ito nang isang beses at ipapasulat ito sa Ingles, Hapon, Pranses, at Espanyol nang sabay-sabay — isa bawat linya, o magkatabi sa iisang linya. Pumili ng kahit gaano karaming target na wika; mayroong 38, at 23 dito ay gumagana sa parehong direksyon. Ang pagsasalin ay nangyayari rin sa iyong aparato, gamit ang Tencent’s Hunyuan MT2. Sa antas ng kalidad, naaabot nito ang 97.9% ng performance ng Google’s Gemini 3.1 Pro sa FLORES-200 benchmark, at nalalampasan pa nito ito sa pagsasalin ng mga wika sa totoong buhay at mga minoryang wika. Mayroong dalawang bersyon, kapwa opsyonal na mai-download: isang mabilis para sa pang-araw-araw na paggamit, at isang de-kalidad para sa mga mahahalagang salita. Mayroon ding mga subtitle. Maaaring plain text o SRT, ayon sa takdang oras ng bawat pangungusap, o salita-bayan salita kung kailangan mong mag-edit nang tumpak. Isalin ang isang file ng subtitle at mananatili ang takdang oras ng bawat bahagi. Maglagay ng subtitle sa sarili mong video sa 38 wika nang hindi kailangang magbayad ayon sa bawat minuto.
Iyan ang dahilan kung bakit ito gumagana kung saan hindi gumagana ang iba. Isang eroplano. Isang hotel na may mahinang wifi. Isang tren na dumadaan sa tunnel. Walang lugar kung saan mapupunta ang rekord mo, kaya hindi nito kailangang pumunta kahit saan. Ilagay mo lang ang rekord ng dalawang oras na pulong at pumunta ka munang gumawa ng kape; nandoon na ang transkripsyon kapag ikaw ay bumalik. Makakalimutan mo na nagrekord ka pala nito at wala namang mawawala — kusang natatapos nito ang trabaho at nananatili ang transkripsyon.
Dalawang modelo ng transkripsyon, at ito ay isang pagpili, hindi isang antas — maaari kang magpalit anumang oras.
Karamihan sa mga software para sa boses ay humihiling sa iyo na basahin ang mga halimbawang pangungusap sa panahon ng pag-set up. Hindi naman ito ginagawa ng software na ito. Natututo ito mula sa mga pagwawasto na iyong ginagawa: kapag itinuwid mo ang isang maling salita, ang pagwawastong iyon ang nagiging halimbawa para sa pagsasanay. Kapag nailagay mo na ang mga pangalan ng iyong brand, mga terminolohiyang ginagamit mo, at mga pangalan ng iyong mga kasamahan, hindi na sila magkakamali—sa transcript man o sa pagsasalin, dahil parehong ginagamit ang parehong listahan. Ang isang pangalan ay hindi kailanman nagkakamali nang hindi sinasadya. Ang proseso ng pagsasanay ay nangangailangan lamang ng isang klik; tumatakbo ito sa iyong hardware, at handa na ang bagong modelo kapag tapos na ito.
Bilhin mo ito minsan at magiging sa iyo na ito. Isang permanenteng lisensya na may kasamang isang taong pag-update.
Ang maingay na silid ay hindi na nagiging problema. Mayroong built-in na function para sa pagbawas ng ingay, lalo na sa mga recording na ginagawa sa kapihan, sa mga exhibition hall, o sa loob ng sasakyan. Ito ay nakapatay nang default, dahil nasubukan namin ito: sa mga maikling clip ng mikropono, lalong lumalala ang kalidad ng tunog. Para sa dalawang oras na pagpupulong kung saan may espresso machine sa likuran mo, buksan mo ito.
Ang voice keyboard ay nakakapag-type kahit saan man naroon ang Cursor mo — sa browser, IDE, chat app, o anumang field na tumatanggap ng keyboard. At kaya nitong mag-type ng pagsasalin sa halip na transkripsyon. Sabihin mo ang pangungusap sa iyong wika, at ang tamang mga salita ang lalabas sa format, sa wika na kailangan ng format. Isang linya lamang, walang pag-cut at paste.
Ang 0.6B ay ang karaniwang bersyon. Gumagana ito sa anumang graphics card na may 4 GB na memorya, sa mga integrated graphics, at pati na rin sa mga laptop na wala talagang graphics card. Mabilis, magaan, at handa kapag kailanganin mo ito.
Ang 1.7B ang pinakamainam para sa mga audio na may diin o ingay, pati na rin sa mga dalaw-oras na pagpupulong kung saan mahalaga ang bawat salita. Nangangailangan ito ng humigit-kumulang 6 GB ng VRAM, o 8 GB kung gagamitin din ang modelong mas mataas ang kalidad para sa pagsasalin.
Wala talagang GPU? Nagpapatuloy pa rin itong gumana. Ang sistema na CPU lamang ay nangangailangan ng 8 GB ng RAM, isang processor na may apat na core, at mga 5 GB ng libreng espasyo sa disk; ang iba pang mga pangangailangan ay nasa pagitan ng 7–9 GB. Ang anumang card na sumusunod sa Vulkan 1.2+ ay maaaring gamitin — NVIDIA, AMD, Intel Arc. At ang proseso ng transcription at translation ay bawat isa ay gumagamit ng sarili nilang processor, kaya maaaring tumakbo ang isa sa graphics card habang ang isa naman ay sa CPU.
Ang mga opsyonal na add-on ay dina-download on demand mula sa Settings → Models:
Forced Aligner (~540 MB) para sa word-level timestamps · Hunyuan MT2 Fast (~1 GB) o Kalidad (~4.3 GB) para sa translation.
| Katangian | Brethof Voice Pro | Dragon | Google STT | Otter.ai | Whisper (OSS) |
|---|---|---|---|---|---|
| 100% pagproseso sa lokal na aparato | ✓ | ✓ | ✗ | ✗ | ✓ |
| Perpetual na lisensya | ✓ | ~ | ✗ | ✗ | ✓ |
| Native na Suporta para sa Linux | ✓ | ✗ | ~ | ✗ | ✓ |
| Native na Suporta para sa Windows | ✓ | ✓ | ~ | ✗ | ~ |
| 30 ASR na wika + auto-detect | ✓ | ✗ | ✓ | ~ | ✓ |
| Offline na translation (38 wika) | ✓ | ✗ | ✗ | ✗ | ✗ |
| Pagpapabilis ng GPU (NVIDIA + AMD + Intel) | ✓ | ✗ | N/A | N/A | ~ |
| Personal na model fine-tuning (LoRA) | ✓ | ✓ | ✗ | ✗ | ✗ |
| MCP server para sa mga AI agent | ✓ | ✗ | ✗ | ✗ | ✗ |
| Built-in na noise reduction | ✓ | ✓ | ✓ | ✓ | ✗ |
| Direktang paglalagay ng teksto | ✓ | ✓ | ✗ | ✗ | ✗ |
| Napakinis na desktop GUI | ✓ | ✓ | ✗ | ✓ | ✗ |
| Karaniwang gastos | $49 isang beses | $350+/taon | $17/buwan | $17/buwan | Libre |
Walang buwanang bayad. Walang limitasyon sa paggamit. Perpetual na lisensya na may kasamang 1 taong update.
Hindi Kinakailangan ng Credit Card. Sapat na ang Isang Email Upang Patunayan ang Iyong Trial.
Perpetual na lisensya. 2 personal na aparato. Kasama ang 1 taong pag-update.
Ang mga presyo ay hindi kasama ang buwis. Pagkatapos, $20 kada taon para sa mga update (opsyonal).
Lisensyang panghabambuhay per seat. Para sa paggamit ng team at organisasyon. May 1 taon ng mga update.
Ang mga presyo ay hindi kasama ang buwis. Pagkatapos, $20/seat/year para sa mga update (opsyonal)
Hindi. Ang Brethof Voice Pro ay nagpoproseso ng lahat ng bagay nang lokal sa iyong aparato. Walang anumang data ng audio o teksto ang lumalabas sa iyong kompyuter. Walang bahaging nakabase sa cloud, walang telemetry, at walang analytics.
Gumagana ang anumang modernong GPU. Ang NVIDIA, AMD, at Intel Arc ay lahat gumagamit ng Vulkan acceleration. Maaari ka ring tumakbo sa CPU lamang, bagama't mas mabagal ang transcription. Ang 0.6B model ay kumportableng tumatakbo sa integrated graphics o anumang 4 GB+ Vulkan card.
Magsimula sa 0.6B model — Ito ang inirerekomendang default at gumagana nang maayos sa karamihan ng GPU (at maging sa CPU sa karamihan ng modernong makina). Kung kailangan mo ng mas mataas na katumpakan sa audio na may diin o ingay, lumipat sa 1.7B model (kailangan ng 6 GB+ VRAM). Maaari kang lumipat ng laki anumang oras mula sa Settings → Models nang hindi muling dina-download.
Oo. Ang Brethof Voice Pro ay sumusuporta nang natural sa kapwa Linux at Windows. Sa Linux, gumagana ito sa X11 at Wayland. Sa Windows, tumatakbo ito bilang isang karaniwang desktop application.
Ang iyong Lisensya ay perpetual — patuloy na gagana ang app magpakailanman, anumang bersyon man nito. Ang opsyonal na Update Pass na nagkakahalaga ng $20 kada taon ay nagbibigay sa iyo ng access sa mga bagong feature at pagpapabuti sa modelo. Kung wala ito, mananatili ka lamang sa kasalukuyan mong bersyon.
Oo — kasama sa v2.0.0 ang personal na pagsasanay sa boses, at ito ay isinasagawa nang buo sa iyong aparato. Sa bawat pagwasto mo sa maling kinilalang salita, ang pares na {clip, correction} ay awtomatikong na-iimbak sa iyong lokal na dataset para sa pagsasanay. Ang kard ng pagsasanay sa pangunahing bintana ay nagpapakita agad ng kabuuang bilang ng mga sample at minuto na nakolekta — i-click ang “Start training” sa tab na Training upang i-tune ang LoRA ayon sa iyong accent. Ang resulta ay awtomatikong na-e-export sa format na GGUF, at maaari mo itong gamitin sa isang klik lamang. Libre ito para sa bawat bayad na lisensya, at ang iyong datos sa boses ay hindi kailanman lumalabas sa iyong aparato.
14-araw na Libreng Pagsubok. Walang Credit Card. Walang Cloud. Walang Kompromiso.
Lokal na speech-to-text na natututo sa iyong boses. Perpetual na lisensya. Ang aming flagship.
Bayad · flagship
Memoria sa pangmatagalan para sa iyong mga AI agent — buong teksto + vector + graph. Ibinibigay ang impormasyon sa simula ng sesyon, naaalala sa bawat kahilingan, at awtomatikong iniimbak.
Nabayaran · libreng antas
Mga digital na modelong handa nang i-print. Kasama ang GLB at OBJ. Lifetime access.
Bayad · digital na katalogo
Lima pang printer at tunay na kapasidad. Wala pang self-service na tindahan — sabihin sa amin kung ano ang kailangan mo at bibigyan ka namin ng presyo sa pamamagitan ng email.
Sa pamamagitan ng pag-uusap · i-email kami
Ang aming YouTube channel. Isang host na parang “cyber-tiger” ang nagpapaliwanag tungkol sa mga lokal na tool sa AI at kung ano talaga ang ginagawa ng mga ito.
CHANNEL · live
Mga piniling listahan sa GitHub para sa mga AI coding agent, mga MCP server, lokal na AI, at Linux para sa AI. Bawat entry ay may kasamang link sa pinagmulan.
LIBRE · curated
Mga detalyadong gabay kung paano gamitin ang lokal na AI sa Linux, Windows, at macOS, kasama ang mga file para sa configuration.
LIBRE · nang live
Negatibong kurasyon: mga pamamaraan at kasangkapan na nag-aaksaya ng iyong oras, na nakaayos ayon sa ranggo. Kinakailangan ang mga resibo.
LIBRE · nang live
Sino kami, bakit kami lumilikha ng AI na nagbibigay-prayoridad sa privacy, at ano ang hindi namin gagawin.