Persönliches Stimmtraining ist in Brethof Voice Pro enthalten. Feinabstimmen Sie das Erkennungsmodell mit nur einem Klick lokal auf Ihre eigene Stimme – ohne Kommandozeile, ohne Cloud. So funktioniert es.
Wie es funktioniert
Jedes Mal, wenn Sie ein falsch erkanntes Wort korrigieren, speichert die App den Audiodatenclip und Ihre Korrektur in einem lokalen Trainingsdatensatz. Die Trainingskarte im Hauptfenster zeigt an, wie viele Samples und Minuten Sie bereits erfasst haben – klicken Sie darauf, um Einträge anzusehen, abzuspielen oder zu löschen. Wenn Sie bereit sind, passt das Register „Training“ einen LoRA-Adapter an Ihre Stimme an.
Die Pipeline wählt automatisch ihr Backend aus: ein NVIDIA CUDA Build (cu128 PyTorch, automatisch in ein zwischengespeichertes venv beim ersten Start installiert), wenn eine kompatible GPU vorhanden ist, andernfalls ein CPU Fallback. Wenn das Training abgeschlossen ist, wird die LoRA mit dem Basis-Modell zusammengeführt und als GGUF exportiert, damit llama.cpp sie laden kann – wechseln Sie zu Ihrem persönlichen Modell unter Einstellungen → Modelle. Die PyTorch-zu-GGUF-Konvertierung, die dies zuvor blockierte, ist erledigt und läuft Ende-zu-Ende.
Was Sie erhalten
- Datenerfassung in der App. Korrekturen werden automatisch zu Trainingsdaten – nutzen Sie die App einfach weiter.
- LoRA-Fine-Tuning mit einem Klick. Trainieren Sie auf Ihrer GPU (NVIDIA CUDA) oder CPU. Fortschrittsbalken, keine Protokolldatei.
- Auto-GGUF-Export. Das trainierte Modell wird für Sie gemerged und konvertiert – keine manuellen Schritte.
- Modellversionierung. Bewahren Sie das Standardmodell neben Ihrem feinabgestimmten Modell auf und wechseln Sie in den Einstellungen zwischen ihnen.
- Hotwords für das Vokabular. Fügen Sie Namen, Akronyme und Produktbegriffe im Hotwords-Dialog hinzu – sie werden sofort angewendet, kein Neutraining erforderlich.
Für wen das relevant ist
- Nicht-Muttersprachler. Starke Akzente erzielen heute bereits eine solide Basisgenauigkeit, doch das Feintuning auf die eigene Stimme bringt die Genauigkeit in den Bereich von über 95 %.
- Medizinische, juristische und technische Nutzer. Medikamentennamen, Rechtsprechungszitate und Codebase-Bezeichner profitieren alle enorm von einem benutzerdefinierten Vokabular.
- Nutzer mit Sprachbeeinträchtigungen. Das Feintuning auf dysarthrische oder atypische Sprache ist eine der wertvollsten Anwendungen des lokalen Trainings. Kommerzielle Cloud-Dienste bieten dies nicht an.
- Sprachen mit geringen Ressourcen. Basismodelle sind in populären Sprachen gut und in weniger gebräuchlichen schwächer. Feintuning mit ein paar Stunden Ihres eigenen Audiomaterials schließt die Lücke schnell.
Was sich nicht ändert
- Das Training läuft lokal. Sprachproben verlassen niemals Ihren Rechner. Das ist der ganze Sinn.
- Ihr fein abgestimmtes Modell gehört Ihnen. Wir laden es nicht hoch. Wir fassen es nicht in ein „gemeinsames“ Modell zusammen. Es bleibt auf Ihrer Festplatte.
- Kostenlos mit jeder bezahlten Lizenz. Kein separates Upgrade. Wenn Sie Personal oder Business bereits besitzen, erhalten Sie die Schulungsoberfläche im Update, das sie ausliefert.
Verfügbarkeit
Jetzt verfügbar — Das persönliche Stimmtraining ist im aktuellen Build enthalten und läuft End-to-End unter Linux und Windows. Kostenlos mit jeder bezahlten Lizenz; Ihre Stimmdaten verlassen niemals Ihr Gerät.
Haben Sie einen spezifischen Feintuning-Anwendungsfall – spezialisierte Vokabulare, ungewöhnliche Akzente, atypische Sprache? Teilen Sie es uns mit, damit wir es weiter verbessern können: [email protected].