Osobní trénink hlasu je součástí balení Brethof Voice Pro. Na jediné kliknutí můžete lokálně doladit model rozpoznávání svého vlastního hlasu – bez příkazového řádku, bez cloudu. Zde je vysvětlení, jak to funguje.
Jak to funguje
Pokaždé, když opravíte špatně rozpoznané slovo, aplikace uloží zvukový úryvek a vaši opravu do místní trénovací datové sady. Karta trénování v hlavním okně ukazuje, kolik vzorků a minut jste zachytili – kliknutím na ni můžete procházet, přehrávat nebo mazat záznamy. Až budete připraveni, karta Trénování doladí adaptér LoRA na vašem hlasu.
Pipeline si automaticky vybírá svůj backend: NVIDIA CUDA sestavit (cu128 PyTorch, automaticky nainstalováno do uloženého venv při prvním spuštění), pokud je k dispozici kompatibilní GPU, jinak CPU Náhradní možnost. Po dokončení trénování se LoRA sloučí se základním modelem a exportuje do GGUF, aby ho mohl načíst llama.cpp – přejděte ke svému osobnímu modelu v Nastavení → Modely. Převod z PyTorch do GGUF, který dříve tuto operaci bránil, je nyní možný a probíhá od začátku do konce.
Co získáte
- Sběr dat v aplikaci. Opravy se automaticky stávají trénovacími daty – stačí aplikaci nadále používat.
- Jednoklikové doladění pomocí LoRA. Trénujte na své GPU (NVIDIA CUDA) nebo CPU. Zobrazuje se ukazatel průběhu, nikoli soubor protokolu.
- Automatický export do GGUF. Vycvičený model je pro vás sloučen a převeden – bez ručních kroků.
- Verzování modelů. Udržujte stock model vedle svého fine-tuned modelu a přepínejte mezi nimi v nastavení.
- Hotwords pro slovní zásobu. Přidejte názvy, zkratky a produktové termíny do dialogu Hotwords – aplikují se okamžitě, není třeba přeškolování.
Pro koho je to důležité
- Nerodilí mluvčí. Silné akcenty dosahují dnes solidní úrovně přesnosti, ale teprve fine-tuning na vašem vlastním hlasu posune přesnost nad 95 %.
- Lékařští, právní a techničtí uživatelé. Názvy léků, odkazy na judikaturu, identifikátory v kódu – vše výrazně těží z vlastní slovní zásoby.
- Uživatelé s postižením řeči. Doladění (Fine-tuning) pro dysartrickou nebo atypickou řeč je jedním z nejcennějších využití lokálního trénování. Komerční cloudové služby to nenabízejí.
- Jazyky s omezenými zdroji. Základní modely jsou dobré v populárních jazycích a slabší v méně běžných. Doladěním na několika hodinách vlastního zvuku se tento rozdíl rychle zmenšuje.
Co se nemění
- Trénink běží lokálně. Vzorky hlasu nikdy neopouštějí vaše zařízení. V tom spočívá celý smysl.
- Váš doladěný model je váš. Neuploadujeme ho. Neslučujeme ho do „sdíleného“ modelu. Žije na vašem disku.
- Zdarma s jakoukoli placenou licencí. Není to samostatný upgrade. Pokud již vlastníte verzi Personal nebo Business, získáte uživatelské rozhraní pro trénink v aktualizaci, která jej přináší.
Dostupnost
K dispozici nyní — trénink osobního hlasu je součástí aktuální sestavy a běží end-to-end na Linuxu i Windows. Zdarma s jakoukoli placenou licencí; vaše hlasová data nikdy neopustí váš počítač.
Máte konkrétní use case pro fine-tuning – specializované slovníky, neobvyklé akcenty, atypickou řeč? Dejte nám vědět, abychom ji mohli dále vylepšovat: [email protected].