100% Tempatan — Suara anda tidak pernah meninggalkan mesin anda

Suara ke teks yang tidak pernah pergi komputer anda

Anda sedang bercakap. Perkataan-perkataan tersebut akan muncul — di editor anda, terminal anda, kotak sembang, borang, di mana sahaja Cursor berada. Dan setiap satu daripadanya akan kekal di komputer tempat anda mengucapkannya.

Brethof Voice Pro ialah alat penukaran suara kepada teks dan terjemahan yang beroperasi sepenuhnya pada komputer anda sendiri. Itu bukan ciri privasi; itulah fungsi utama produk tersebut.

100% Lokal — Tiada awan sama sekali
30 ASR + 38 Terjemahan bahasa
Dipercepatkan GPU — NVIDIA, AMD, Intel
Linux & Windows
Berfungsi Luar Talian

Segala yang anda perlukan, tiada yang tidak diperlukan.

Satu program, hasil kerja empat orang. Ia menyalin suara anda, menterjemahkannya ke 38 bahasa, menambah sarikata pada video anda, dan menaip untuk anda di mana-mana sahaja yang memerlukan papan kunci. Ia berfungsi tanpa sambungan internet — di dalam kapal terbang, di hotel dengan wifi yang lemah, melalui terowong — serta pada komputer riba yang sudah anda miliki, sama ada ada kad grafik atau tidak. Tiada langganan. Tiada caj mengikut minit. Tiada penghantaran data. Berikan juga “telinga” kepada ejen AI anda: ia boleh menyalin, menterjemah, dan merakam mesyuarat sepanjang mana-mana sahaja melalui MCP, pada mesin anda, tanpa memerlukan kunci API. Beli sekali, dan ia akan terus berfungsi.

Tiga perkara sahaja yang bersentuhan dengan rangkaian, dan tiada apa-apa lagi.

Suara anda tidak akan keluar dari komputer anda. Ayat tersebut sangat tepat. Tiga perkara sahaja yang akan dihantar ke rangkaian semasa proses pelancaran, iaitu pemeriksaan lesen, pemeriksaan kemas kini, dan muat turun model yang dilakukan oleh pengguna sendiri. Pemeriksaan lesen akan menghantar kunci lesen, manakala pemeriksaan kemas kini akan menghantar rentetan versi – tiada audio, tiada teks, sama sekali. Jika pemeriksaan kemas kini dimatikan, setelah model-model tersebut disimpan dalam cakera, tiada apa-apa yang akan dihantar lagi.

30 bahasa, 22 dialek, dan loghat anda tidak akan menjadi masalah lagi.

Transkripsi dalam lebih daripada 30 bahasa, serta 22 dialek serantau Cina yang dapat difahami secara automatik — tanpa persiapan, tanpa latihan. Dan sebutan anda tidak akan lagi salah. Brethof Voice Pro akan mempelajari suara, istilah khusus, dan nama-nama khas anda pada mesin anda sendiri. Ucapkan bahasa Sichuan milik nenek anda, dan ia akan dihasilkan dengan betul.

Bercakap sekali, bacanya dalam 38 bahasa.

Bercakap dalam bahasa Poland, membaca dalam bahasa Inggeris. Bercakap dalam bahasa Inggeris, membaca dalam bahasa Jepun. Atau ucapkan sekali sahaja dan ia akan ditulis dalam bahasa Inggeris, Jepun, Perancis, dan Sepanyol pada masa yang sama — satu setiap baris, atau sebelah menyebelah dalam satu baris. Pilih sebanyak mana bahasa sasaran yang anda mahu; terdapat 38 bahasa, dan 23 daripadanya boleh digunakan untuk terjemahan dua hala. Proses terjemahan juga berlaku di komputer anda, menggunakan Hunyuan MT2 dari Tencent. Dari segi kualiti, ia mencapai 97.9% daripada prestasi Gemini 3.1 Pro dari Google pada ujian FLORES-200, dan lebih unggul dalam terjemahan dunia sebenar serta bahasa-bahasa minoriti. Terdapat dua versi, kedua-duanya boleh dimuat turun secara pilihan: versi pantas untuk kegunaan harian, dan versi berkualiti tinggi untuk teks yang penting. Sari kata juga disokong. Bentuk teks biasa atau SRT, dengan penentuan masa mengikut ayat, atau perkataan demi perkataan jika anda perlu membuat editan yang tepat. Terjemahkan fail sari kata dan semua tetapan masa akan kekal. Buat sari kata untuk video anda sendiri dalam 38 bahasa tanpa perlu membayar mengikut minit.

Sepenuhnya luar talian

Itulah sebabnya ia berfungsi di tempat-tempat di mana cara lain tidak akan berkesan. Sebuah kapal terbang, sebuah hotel dengan sambungan Wi-Fi yang lemah, kereta api yang melalui terowong. Tiada tempat untuk rakaman tersebut disimpan, jadi ia tidak perlu dihantar ke mana-mana. Letakkan sahaja rakaman mesyuarat selama dua jam dan pergi buat kopi; transkripsi akan ada apabila anda kembali. Lupakan saja bahawa anda telah merakamnya, dan tiada apa yang akan hilang — ia akan menyelesaikan tugasnya sendiri dan menyimpan transkripsi tersebut.

Dua saiz model

Dua model transkripsi; ia merupakan pilihan, bukan tahap tertentu — anda boleh bertukar bila-bila masa.

Ia belajar daripada pembetulan yang telah anda lakukan.

Kebanyakan perisian suara memerlukan pengguna untuk membaca ayat-ayat contoh semasa proses penyetempatan. Perisian ini pula tidak memerlukannya. Ia belajar daripada pembetulan yang dilakukan oleh pengguna; apabila anda membetulkan kata yang disalah dengar, pembetulan tersebut akan dijadikan sebagai contoh latihan. Setelah nama jenama, istilah khusus, dan nama rakan sekerja ditetapkan sekali, ia tidak akan muncul secara salah lagi—sama ada dalam transkrip mahupun terjemahan, kerana senarai yang sama digunakan untuk kedua-duanya. Nama-nama tersebut tidak akan disesuaikan secara kebetulan. Proses latihan hanya memerlukan satu klik sahaja, ia berjalan pada peranti anda, dan model baru akan siap untuk digunakan setelah proses latihan selesai.

Bayar sekali, miliki selamanya

Belilah sekali sahaja, dan ia akan menjadi milik anda. Ia merupakan lesen seumur hidup yang disertakan dengan kemas kini selama setahun.

Pengurangan bunyi, hanya bila diperlukan.

Bilik yang bising tidak lagi menjadi masalah. Ciri pengurangan bunyi telah disertakan secara terbina dalam, untuk rakaman yang dibuat di kafe, di dewan pameran, atau dalam kereta. Ciri ini ditutup secara lalai, kerana setelah kami mengujinya, ia memburukkan keadaan pada klip mikrofon yang pendek dan bersih. Untuk mesyuarat selama dua jam dengan mesin espresso di belakang anda, hidupkan ciri ini.

Papan kekunci yang sedang anda gunakan untuk menaip

Papan kekunci suara boleh menaip di mana sahaja cursor berada — sama ada dalam pelayar, IDE, aplikasi sembang, atau sebarang medan yang menerima input papan kekunci. Ia juga boleh menaip terjemahan daripada transkripsi. Ucapkan ayat tersebut dalam bahasa anda, dan kata-kata yang tepat akan muncul dalam format yang dikehendaki, dalam bahasa yang sesuai untuk format tersebut. Satu baris sahaja, tanpa perlu memotong atau menyalin.

Dua saiz, pilihan anda

0.6B merupakan versi yang digunakan setiap hari. Ia boleh berfungsi pada sebarang kad grafik berkapasiti 4 GB, pada grafik terbina dalam, serta pada komputer riba yang tidak mempunyai kad grafik sama sekali. Cepat, ringan, dan tersedia bila diperlukan.

1.7B

Besar · Vulkan / CPU
~2–3 GB

Tiada GPU langsung? Ia masih boleh berfungsi. Sistem yang hanya menggunakan CPU memerlukan 8 GB RAM, pemproses empat teras, dan kira-kira 5 GB ruang cakera kosong; baki keperluan adalah 7–9 GB. Sebarang kad Vulkan 1.2+ boleh digunakan — NVIDIA, AMD, Intel Arc. Proses transkripsi dan terjemahan masing-masing menggunakan pemproses tersendiri, jadi satu boleh dijalankan pada kad grafik manakala yang satu lagi pada CPU.

Muat turun add-on pilihan mengikut keperluan melalui Settings → Models:

Forced Aligner (~540 MB) untuk cap masa pada peringkat perkataan · Hunyuan MT2 Fast (~1 GB) atau Kualiti (~4.3 GB) untuk terjemahan.

Bagaimana kami membandingkan

Ciri Brethof Voice Pro Dragon Google STT Otter.ai Whisper (OSS)
Pemprosesan 100% setempat
Lesen kekal ~
Sokongan Linux natif ~
Sokongan Windows natif ~ ~
30 bahasa ASR + pengesanan automatik ~
Terjemahan luar talian (38 bahasa)
Pecutan GPU (NVIDIA + AMD + Intel) N/A N/A ~
Penalaan model peribadi (LoRA)
Pelayan MCP untuk ejen AI
Pengurangan hingar terbina dalam
Suntikan teks terus
GUI desktop yang digilap
Kos biasa $49 sekali $350+/tahun $17/bulan $17/bulan Gratis

Bayar sekali. Miliki selamanya.

Tiada yuran bulanan. Tiada had penggunaan. Lesen kekal dengan 1 tahun kemas kini termasuk.

Percubaan Percuma
$ 0

Tiada kad kredit diperlukan. Cukup berikan e-mel untuk mengesahkan percubaan anda.

  • Kedua-dua saiz model (0.6B + 1.7B)
  • Pengaktifan GPU
  • 30 ASR + 38 bahasa terjemahan
  • Pengurangan bunyi bising
  • × Tiada latihan peribadi (hanya untuk pelan berbayar)
  • × Tiada pelayan MCP (hanya untuk pelan berbayar)
  • × Had 14 hari
Mula Percubaan Percuma
Business
$ 249 /pengguna

Lesen kekal setiap tempat duduk. Penggunaan pasukan & organisasi. 1 tahun kemas kini.

  • Lesen kekal (setiap tempat duduk)
  • Penggunaan oleh pasukan dan organisasi
  • Kedua-dua saiz ASR (0.6B + 1.7B)
  • Terjemahan luar talian (38 bahasa)
  • Latihan suara peribadi (LoRA)
  • Pelayan MCP untuk ejen AI
  • Sokongan keutamaan
  • Diskaun volum (10+ tempat duduk)
Beli Lesen Perniagaan

Harga tidak termasuk cukai. Kemudian $20/tempat duduk/tahun untuk kemas kini (pilihan)

Soalan lazim

Tidak. Brethof Voice Pro memproses segala-galanya secara tempatan pada peranti anda. Tiada data audio atau teks yang keluar dari komputer anda. Tidak terdapat komponen awan, tiada telemetri, dan tiada analitik.

Sebarang GPU moden boleh digunakan. NVIDIA, AMD, dan Intel Arc semuanya menggunakan pecutan Vulkan. Anda juga boleh menjalankannya hanya pada CPU, walaupun transkripsi akan menjadi lebih perlahan. Model 0.6B berjalan dengan lancar pada grafik bersepadu atau sebarang kad Vulkan 4 GB+.

Mulakan dengan Model 0.6B — Ia adalah lalai yang disyorkan dan berfungsi dengan baik pada kebanyakan GPU (dan juga pada CPU pada kebanyakan mesin moden). Jika anda memerlukan ketepatan lebih tinggi pada audio beraksen atau bising, tukar kepada Model 1.7B (memerlukan VRAM 6 GB+). Anda boleh menukar saiz pada bila-bila masa melalui Tetapan → Model tanpa memuat turun semula.

Ya. Brethof Voice Pro menyokong Linux dan Windows secara semula jadi. Pada Linux, ia berfungsi dengan X11 dan Wayland. Pada Windows, ia berjalan sebagai aplikasi desktop biasa.

Lesen anda adalah kekal — aplikasi ini akan terus berfungsi selamanya tanpa mengira versi yang anda gunakan. Pass Kemas Kini berharga $20 setahun secara pilihan memberikan akses kepada ciri-ciri baru serta penambahbaikan model. Tanpanya, anda akan tetap menggunakan versi semasa.

Ya — latihan suara peribadi disertakan dalam v2.0.0 dan berjalan sepenuhnya pada mesin anda. Setiap kali anda membetulkan perkataan yang salah dikenal pasti, pasangan {klip, pembetulan} akan disimpan secara automatik ke dalam set data latihan tempatan anda. Kad latihan di tetingkap utama menunjukkan jumlah sampel dan minit yang dirakam sepintas lalu — klik "Start training" dalam tab Training untuk melaraskan LoRA mengikut loghat anda. Hasilnya dieksport secara automatik ke GGUF dan anda boleh bertukar kepadanya dengan satu klik. Percuma untuk setiap lesen berbayar, data suara anda tidak akan pernah meninggalkan mesin anda.

Sudah bersedia untuk mencubanya?

Ujian percuma 14 hari. Tiada kad kredit. Tiada awan. Tiada kompromi.

Dengarnya bila ia dihantar

Baru dikeluarkan, penanda aras sebenar, dan ulasan terperinci sekali-sekala. Tiada spam, boleh berhenti langganan dengan satu klik sahaja.

Segala yang kami bina

Luaran: YouTube · GitHub