Prinsip 4 April 2026

Mengapa Voice Pro berjalan 100% luar talian

Suara anda ialah data peribadi paling peribadi yang anda hasilkan. Ia tidak sepatutnya meninggalkan mesin anda melainkan anda secara eksplisit menghantarnya ke suatu tempat.

Setiap produk transkripsi suara utama — Dragon, Otter, transkripsi Google, transkripsi Apple, setiap SaaS transkripsi awan — menghantar suara anda melalui pelayan orang lain. Audio dirakam pada mesin anda, dihantar secara strim melalui HTTPS ke pusat data, ditranskripsi di sana, dan teks dikembalikan. Kadang-kadang audio disimpan. Kadang-kadang ia digunakan untuk melatih model. Kadang-kadang ia "dianonimkan", yang merupakan perkataan yang telah kehilangan sebahagian besar maknanya.

Kami fikir itu adalah tetapan lalai yang salah.

Apa yang sebenarnya ditaip oleh orang ramai

Apabila anda mula menonton penggunaan sebenar, kandungan diktasi hampir tidak pernah bersifat santai. Ia adalah:

  • Catatan perubatan — seorang doktor yang menyalin teks perundingan.
  • Draf undang-undang — seorang peguam mendiktekan usul atau surat klien.
  • Kewartawanan — temu bual dengan sumber bernama yang menganggap rakaman tidak akan keluar daripada mesin wartawan.
  • Catatan terapi – ringkasan sesi yang ditulis oleh seorang ahli psikologi.
  • Strategi perniagaan — seorang eksekutif yang menyusun memo mengenai urusan, orang, dan wang.
  • Jurnal peribadi — perkara yang sebenarnya difikirkan oleh orang, yang tidak sepatutnya dibaca oleh sesiapa pun.

Semua itu biasanya dimuat naik ke perkhidmatan awan secara automatik. Ini seringkali melanggar HIPAA, GDPR, hak kerahsiaan antara peguam dan klien, atau prinsip kesopanan asas — kerana pengguna tidak menyedarinya atau tiada pilihan lain.

Apa yang dilakukan Voice Pro secara berbeza

  • Tiada mod awan, titik. Tidak terdapat pilihan untuk “hantar ke pelayan demi ketepatan yang lebih baik”. Model tersebut berjalan pada CPU atau GPU anda. Itulah satu-satunya pilihan yang ada.
  • Tiada telemetri. Aplikasi ini tidak menghubungi rumah dengan statistik penggunaan, laporan kerosakan, atau apa-apa pun. Panggilan rangkaian yang dilakukan hanyalah (a) semakan lesen pada permulaan, (b) semakan kemas kini, (c) muat turun model manual pilihan. Ketiga-tiganya didokumentasikan dan boleh dinyahaktifkan.
  • Tiada akaun diperlukan untuk transkripsi. Anda boleh menggunakan percubaan 14 hari tanpa membuat akaun. E-mel hanya diperlukan jika anda ingin membeli lesen.
  • Audio tidak pernah disimpan ke cakera. Penimbal audio kekal dalam RAM semasa transkripsi dan dibebaskan serta-merta apabila teks dihasilkan. Tiada kebocoran, tiada pemulihan forensik.

Bolehkah model tempatan benar-benar menandingi awan?

Dua tahun lalu, tidak. Model tempatan 100 MB pada CPU komputer riba tidak mampu menandingi apa yang dilakukan pusat data Google dengan model 200 GB dan 40 GPU.

Hari ini, ya. Qwen3-ASR 3B yang berjalan pada CPU kelas pertengahan mencapai kadar ralat perkataan dalam lingkungan 2% berbanding penyedia awan terkemuka untuk kebanyakan bahasa, dan mengatasi pada bahasa sumber rendah di mana penyedia awan mempunyai kurang data latihan. Untuk diktasi khususnya — ucapan pendek dan disengajakan — jurangnya hampir 0%. ASR tempatan telah menjadi cukup baik secara senyap, dan ia terus menjadi lebih baik. Kita hanyalah yang memilih untuk menyediakannya.

Prinsipnya

Suara anda ialah data peribadi paling peribadi yang anda hasilkan. Ia membawa identiti anda, pemikiran anda, orang yang anda bincangkan, kata-kata yang anda pilih ketika tiada sesiapa menyunting. Ia tidak sepatutnya meninggalkan mesin anda melainkan anda secara eksplisit dan sedar menghantarnya ke suatu tempat.

Itu bukan slogan pemasaran. Itulah sebab utama kewujudan produk ini.

Cuba Voice Pro Lihat bagaimana ia berfungsi

Dengarnya bila ia dihantar

Baru dikeluarkan, penanda aras sebenar, dan ulasan terperinci sekali-sekala. Tiada spam, boleh berhenti langganan dengan satu klik sahaja.

Segala yang kami bina

Luaran: YouTube · GitHub