Pelatihan suara pribadi telah dirilis di Brethof Voice Pro. Sesuaikan model pengenalan suara dengan suara Anda sendiri secara lokal, hanya dengan satu klik — tanpa baris perintah, tanpa cloud. Berikut cara kerjanya.
Cara kerjanya
Setiap kali Anda mengoreksi kata yang salah dikenali, aplikasi menyimpan klip audio dan koreksi Anda ke dalam dataset pelatihan lokal. Kartu pelatihan di jendela utama menunjukkan berapa banyak sampel dan menit yang telah Anda kumpulkan — klik untuk menelusuri, memutar, atau menghapus entri. Saat Anda siap, tab Pelatihan akan menyetel halus adapter LoRA pada suara Anda.
Pipeline memilih backend-nya secara otomatis: sebuah NVIDIA CUDA build (cu128 PyTorch, diinstal otomatis ke venv yang di-cache pada eksekusi pertama) ketika GPU yang kompatibel hadir, jika tidak maka CPU fallback. Setelah pelatihan selesai, LoRA digabungkan dengan model dasar dan diekspor ke GGUF agar llama.cpp dapat memuatnya—beralih ke model pribadi Anda dari Settings → Models. Konversi PyTorch-ke-GGUF yang sebelumnya menghalangi hal ini telah selesai dan berjalan end-to-end.
Apa yang Anda dapatkan
- Pengumpulan data di dalam aplikasi. Koreksi secara otomatis menjadi data pelatihan — cukup terus menggunakan aplikasi.
- Fine-tuning LoRA satu klik. Latih di GPU (NVIDIA CUDA) atau CPU Anda. Bilah kemajuan, bukan file log.
- Ekspor GGUF otomatis. Model yang telah dilatih akan digabungkan dan dikonversi untuk Anda—tanpa langkah manual.
- Versi model. Simpan model stok di samping model yang telah disesuaikan dan beralih di antara keduanya di pengaturan.
- Kata kunci untuk kosakata. Tambahkan nama, akronim, dan istilah produk di dialog Hotwords — diterapkan secara instan, tanpa perlu pelatihan ulang.
Siapa yang terpengaruh oleh hal ini
- Penutur non-penutur asli. Aksen yang berat saat ini sudah memiliki akurasi dasar yang solid, tetapi penyesuaian pada suara Anda sendiri akan meningkatkannya ke kisaran di atas 95%.
- Pengguna di bidang medis, hukum, dan teknis. Nama obat, kutipan putusan pengadilan, identifikasi kode program — semuanya sangat diuntungkan oleh penggunaan kosakata khusus.
- Pengguna dengan gangguan bicara. Penyetelan halus pada ucapan disartria atau atipikal adalah salah satu penggunaan pelatihan lokal yang paling bernilai. Layanan cloud komersial tidak menawarkannya.
- Bahasa dengan sumber daya terbatas. Model dasar bagus dalam bahasa populer dan lemah dalam bahasa yang kurang umum. Fine-tune pada beberapa jam audio Anda sendiri dan kesenjangan menutup dengan cepat.
Apa yang tidak berubah
- Pelatihan berjalan secara lokal. Contoh suara tidak pernah meninggalkan mesin Anda. Itulah intinya.
- Model yang telah Anda fine-tune adalah milik Anda. Kami tidak mengunggahnya. Kami juga tidak menggabungkannya ke dalam model “terbagi”. File tersebut tetap berada di disk Anda.
- Gratis dengan lisensi berbayar apa pun. Bukan pembaruan terpisah. Jika Anda memiliki versi Personal atau Business saat ini, Anda akan mendapatkan antarmuka pelatihan dalam pembaruan yang menyertainya.
Ketersediaan
Tersedia sekarang — pelatihan suara pribadi dikirim dalam build saat ini dan berjalan end-to-end di Linux dan Windows. Gratis dengan lisensi berbayar apa pun; data suara Anda tidak pernah keluar dari mesin Anda.
Apakah Anda memiliki kasus penggunaan penyesuaian khusus — kosakata terspesialisasi, aksen yang tidak biasa, atau gaya bicara atipikal? Beri tahu kami agar kami dapat terus meningkatkannya: [email protected].