Antrenarea vocală personalizată a fost inclusă în Brethof Voice Pro. Ajustați modelul de recunoaștere pe vocea dumneavoastră, local, cu un singur clic – fără linie de comandă, fără cloud. Iată cum funcționează.
Cum funcționează
De fiecare dată când corectați un cuvânt recunoscut incorect, aplicația salvează clipul audio și corecția dumneavoastră într-un set de date local pentru antrenare. Cardul de antrenare din fereastra principală arată câte eșantioane și minute ați capturat — dați clic pe el pentru a naviga, a reda sau a șterge intrările. Când sunteți gata, fila Antrenare ajustează fin un adaptor LoRA pe vocea dumneavoastră.
Pipeline-ul selectează automat backend-ul: un NVIDIA CUDA build (cu128 PyTorch, instalat automat într-un venv cache la prima execuție) atunci când este prezentă o GPU compatibilă, altfel un CPU fallback. Când antrenamentul se termină, LoRA-ul este fuzionat cu modelul de bază și exportat în GGUF astfel încât llama.cpp să îl poată încărca — comutați la modelul dumneavoastră personal din Setări → Modele. Conversia PyTorch-to-GGUF care bloca anterior acest lucru este acum finalizată și rulează end-to-end.
Ce primiți
- Colectarea de date în aplicație. Corecturile devin automat date de antrenament — trebuie doar să continuați să folosiți aplicația.
- Ajustare fină LoRA cu un singur clic. Antrenează pe GPU-ul tău (NVIDIA CUDA) sau CPU. Bară de progres, nu fișier de jurnal.
- Export GGUF automat. Modelul antrenat este fuzionat și convertit pentru tine — fără pași manuali.
- Versionarea modelelor. Păstrați modelul standard alături de cel fine-tuned și comutați între ele în setări.
- Cuvinte cheie pentru vocabular. Adaugă nume, acronime și termeni de produs în dialogul Hotwords – se aplică instantaneu, fără a fi nevoie de reantrenare.
Pentru cine este relevant
- Vorbitori non-nativi. Astăzi, accentele puternice au o acuratețe de bază solidă, dar fine-tuning-ul pe propria voce este cel care duce acuratețea peste 95%.
- Utilizatori medicali, juridici și tehnici. Numele medicamentelor, citatele din jurisprudență, identificatorii din baza de cod — toate beneficiază enorm de un vocabular personalizat.
- Utilizatori cu tulburări de vorbire. Fine-tuning-ul pe vorbirea disartrică sau atipică este unul dintre cele mai valoroase utilizări ale antrenării locale. Serviciile comerciale din cloud nu îl oferă.
- Limbi cu resurse limitate. Modelele de bază sunt bune în limbile populare și mai slabe în cele mai puțin comune. Fine-tuning pe câteva ore de audio propriu și diferența se reduce rapid.
Ce nu se schimbă
- Antrenamentul rulează local. Eșantioanele de voce nu părăsesc niciodată mașina dumneavoastră. Acesta este întregul scop.
- Modelul dumneavoastră fine-tuned este al dumneavoastră. Nu îl încărcăm. Nu îl agregăm într-un model „partajat“. Rămâne pe discul tău.
- Gratuit cu orice licență plătită. Nu este o actualizare separată. Dacă dețineți acum Personal sau Business, veți primi interfața de antrenament în actualizarea care o include.
Disponibilitate
Disponibil acum — antrenamentul vocal personal este inclus în build-ul curent și funcționează end-to-end pe Linux și Windows. Gratuit cu orice licență plătită; datele vocale nu părăsesc niciodată mașina dvs.
Aveți un caz de utilizare specific pentru fine-tuning – vocabulare specializate, accente neobișnuite, vorbire atipică? Spuneți-ne pentru a continua îmbunătățirea: [email protected].