Personlig röstträning finns i Brethof Voice Pro. Finjustera igenkänningsmodellen för din egen röst lokalt med ett klick – inget kommandotolk, inget moln. Så här fungerar det.
Så här fungerar det
Varje gång du korrigerar ett feligenkänt ord sparar appen ljudklippet och din korrigering i en lokal träningsdatauppsättning. Träningskortet i huvudfönstret visar hur många prover och minuter du har samlat in – klicka på det för att bläddra, spela upp eller ta bort poster. När du är redo finjusterar fliken Träning en LoRA-adapter på din röst.
Pipelinen väljer sin backend automatiskt: en NVIDIA CUDA byggs (cu128 PyTorch, installeras automatiskt till en cachad venv vid första körningen) när en kompatibel GPU finns, annars en CPU fallback. När träningen är klar slås LoRA samman med basmodellen och exporteras till GGUF så att llama.cpp kan ladda den – byt till din personliga modell från Inställningar → Modeller. Konverteringen från PyTorch till GGUF som tidigare blockerade detta är klar och körs end-to-end.
Vad du får
- Datainsamling i appen. Korrigeringar blir automatiskt träningsdata – fortsätt bara att använda appen.
- Enklicksfinjustering av LoRA. Träna på din GPU (NVIDIA CUDA) eller CPU. Framstegsfält, inte en loggfil.
- Auto GGUF-export. Den tränade modellen slås samman och konverteras åt dig – inga manuella steg krävs.
- Modellversionering. Behåll standardmodellen bredvid din finjusterade modell och växla mellan dem i inställningarna.
- Nyckelord för ordförrådet. Lägg till namn, akronymer och produkttermer i dialogrutan Hotwords – tillämpas omedelbart, ingen omträning krävs.
Vem detta gäller för
- Personer som inte är modersmålstalare. Starka accenter ger idag god grundnoggrannhet, men finjustering med din egen röst är vad som lyfter noggrannheten till över 95 %.
- Medicinska, juridiska och tekniska användare. Läkemedelsnamn, rättsfallsreferenser och kodbasidentifierare – allt gynnas kraftigt av ett anpassat ordförråd.
- Användare med talstörningar. Finjustering av dysartriskt eller atypiskt tal är en av de mest värdefulla användningarna av lokal träning. Kommersiella molntjänster erbjuder det inte.
- Språk med låga resurser. Basmodeller är bra på populära språk och svagare på mindre vanliga. Finjustera på några timmars av ditt eget ljudmaterial så sluts gapet snabbt.
Vad som inte ändras
- Träningen körs lokalt. Röstprover lämnar aldrig din maskin. Det är hela poängen.
- Din finjusterade modell är din. Vi laddar inte upp det. Vi samlar inte in det i en "delad" modell. Det finns kvar på din disk.
- Gratis med vilken betald licens som helst. Ingen separat uppgradering. Om du äger Personal eller Business nu får du träningsgränssnittet i uppdateringen som levererar den.
Tillgänglighet
Tillgänglig nu — personlig röstträning ingår i den nuvarande versionen och körs end-to-end på Linux och Windows. Gratis med vilken betald licens som helst; dina röstdata lämnar aldrig din dator.
Har du ett specifikt finjusteringsfall – specialiserade ordförråd, ovanliga accenter, atypiskt tal? Berätta för oss så att vi kan fortsätta förbättra det: [email protected].