Produkt 20. května 2026

Doladění (Fine-tuning) je zde

Osobní trénink hlasu je nyní k dispozici v Brethof Voice Pro – pomocí LoRA můžete doladit model rozpoznávání na svůj vlastní hlas, a to výhradně na svém počítači. Zde je vysvětlení, jak to funguje.

Osobní trénink hlasu je součástí balení Brethof Voice Pro. Na jediné kliknutí můžete lokálně doladit model rozpoznávání svého vlastního hlasu – bez příkazového řádku, bez cloudu. Zde je vysvětlení, jak to funguje.

Jak to funguje

Pokaždé, když opravíte špatně rozpoznané slovo, aplikace uloží zvukový úryvek a vaši opravu do místní trénovací datové sady. Karta trénování v hlavním okně ukazuje, kolik vzorků a minut jste zachytili – kliknutím na ni můžete procházet, přehrávat nebo mazat záznamy. Až budete připraveni, karta Trénování doladí adaptér LoRA na vašem hlasu.

Pipeline si automaticky vybírá svůj backend: NVIDIA CUDA sestavit (cu128 PyTorch, automaticky nainstalováno do uloženého venv při prvním spuštění), pokud je k dispozici kompatibilní GPU, jinak CPU Náhradní možnost. Po dokončení trénování se LoRA sloučí se základním modelem a exportuje do GGUF, aby ho mohl načíst llama.cpp – přejděte ke svému osobnímu modelu v Nastavení → Modely. Převod z PyTorch do GGUF, který dříve tuto operaci bránil, je nyní možný a probíhá od začátku do konce.

Co získáte

  • Sběr dat v aplikaci. Opravy se automaticky stávají trénovacími daty – stačí aplikaci nadále používat.
  • Jednoklikové doladění pomocí LoRA. Trénujte na své GPU (NVIDIA CUDA) nebo CPU. Zobrazuje se ukazatel průběhu, nikoli soubor protokolu.
  • Automatický export do GGUF. Vycvičený model je pro vás sloučen a převeden – bez ručních kroků.
  • Verzování modelů. Udržujte stock model vedle svého fine-tuned modelu a přepínejte mezi nimi v nastavení.
  • Hotwords pro slovní zásobu. Přidejte názvy, zkratky a produktové termíny do dialogu Hotwords – aplikují se okamžitě, není třeba přeškolování.

Pro koho je to důležité

  • Nerodilí mluvčí. Silné akcenty dosahují dnes solidní úrovně přesnosti, ale teprve fine-tuning na vašem vlastním hlasu posune přesnost nad 95 %.
  • Lékařští, právní a techničtí uživatelé. Názvy léků, odkazy na judikaturu, identifikátory v kódu – vše výrazně těží z vlastní slovní zásoby.
  • Uživatelé s postižením řeči. Doladění (Fine-tuning) pro dysartrickou nebo atypickou řeč je jedním z nejcennějších využití lokálního trénování. Komerční cloudové služby to nenabízejí.
  • Jazyky s omezenými zdroji. Základní modely jsou dobré v populárních jazycích a slabší v méně běžných. Doladěním na několika hodinách vlastního zvuku se tento rozdíl rychle zmenšuje.

Co se nemění

  • Trénink běží lokálně. Vzorky hlasu nikdy neopouštějí vaše zařízení. V tom spočívá celý smysl.
  • Váš doladěný model je váš. Neuploadujeme ho. Neslučujeme ho do „sdíleného“ modelu. Žije na vašem disku.
  • Zdarma s jakoukoli placenou licencí. Není to samostatný upgrade. Pokud již vlastníte verzi Personal nebo Business, získáte uživatelské rozhraní pro trénink v aktualizaci, která jej přináší.

Dostupnost

K dispozici nyní — trénink osobního hlasu je součástí aktuální sestavy a běží end-to-end na Linuxu i Windows. Zdarma s jakoukoli placenou licencí; vaše hlasová data nikdy neopustí váš počítač.

Máte konkrétní use case pro fine-tuning – specializované slovníky, neobvyklé akcenty, atypickou řeč? Dejte nám vědět, abychom ji mohli dále vylepšovat: [email protected].

Sdílejte svůj případ použití Zpět k aktualizacím

Uslyšíte to, až to vyjde

Nové verze, skutečné benchmarky a občasný hlubší ponor. Žádný spam, odhlášení jedním kliknutím.

Vše, co vytváříme

Externí: YouTube · GitHub