Du sprichst. Die Wörter landen – in deinem Editor, deiner Terminal, in einem Chatfeld, in einem Formular, überall dort, wo sich der Cursor befindet. Und jedes einzelne von ihnen bleibt auf dem Gerät, auf dem du sie ausgesprochen hast.
Brethof Voice Pro ist eine Sprach-zu-Text- und Übersetzungsfunktion, die vollständig auf Ihrem eigenen Computer läuft. Das ist keine Datenschutzfunktion – es ist das gesamte Produkt.
Ein Programm – die Leistung von vier Personen. Es transkribiert Ihre Stimme, übersetzt sie in 38 Sprachen, fügt Ihren Videos Untertitel hinzu und tippt für Sie dort, wo ein Keyboard benötigt wird. Es funktioniert offline – im Flugzeug, in einem Hotel mit schlechtem WLAN, durch einen Tunnel – sowie auf dem Laptop, den Sie bereits besitzen, mit oder ohne Grafikkarte. Keine Abonnementgebühren. Keine Gebühren pro Minute. Keine Hochläadungen. Geben Sie Ihrem KI-Assistenten auch „Ohren“: Es kann mithilfe von MCP, auf Ihrem Gerät und ohne API-Schlüssel, Transkripte erstellen, übersetzen und Meetings jeder Länge aufzeichnen. Kaufen Sie es einmal – und es funktioniert weiterhin.
Ihre Stimme verlässt niemals Ihren Computer. Dieser Satz ist präzise – und er beschreibt genau die Situation. Beim Start erreichen das Netzwerk nur drei Dinge: eine Lizenzprüfung, eine Aktualisierungsprüfung sowie die von Ihnen heruntergeladenen Modelle. Bei der Lizenzprüfung wird eine Lizenzschlüssel gesendet, bei der Aktualisierungsprüfung eine Versionsangabe – weder Audio noch Text, niemals. Deaktivieren Sie die Aktualisierungsprüfung, und sobald die Modelle auf der Festplatte sind, wird überhaupt nichts mehr gesendet.
Transkription in über 30 Sprachen – sowie 22 chinesischen Dialekten, die ohne weitere Einstellungen oder Schulung verstanden werden. Ihr Akzent wird nicht mehr falsch wiedergegeben. Brethof Voice Pro lernt Ihre Stimme, Ihren Fachjargon sowie Eigennamen direkt auf Ihrem Gerät. Sprechen Sie im Sichuan-Dialekt Ihrer Großmutter – es wird korrekt wiedergegeben.
Sprechen Sie Polnisch, lesen Sie Englisch. Sprechen Sie Englisch, lesen Sie Japanisch. Oder sagen Sie es einmal und lassen Sie es gleichzeitig auf Englisch, Japanisch, Französisch und Spanisch tippen – jeweils in einer Zeile oder nebeneinander in derselben Zeile. Wählen Sie so viele Zielsprachen aus, wie Sie möchten; es gibt 38, wobei 23 in beide Richtungen funktionieren. Die Übersetzung erfolgt ebenfalls auf Ihrem Gerät, mithilfe von Tencent’s Hunyuan MT2. Bei der gewählten Qualität erreicht es 97,9 % der Leistung von Google’s Gemini 3.1 Pro im FLORES-200-Benchmark und übertrifft es bei der Übersetzung in Alltagssituationen sowie bei Minderheitensprachen. Es gibt zwei Versionen, beide als optionale Downloads verfügbar: eine schnelle für den täglichen Gebrauch und eine hochwertige für die wichtigen Texte. Auch Untertitel sind möglich – als reiner Text oder in SRT-Format, zeitgesteuert nach Sätzen oder Wort für Wort, wenn eine präzise Bearbeitung erforderlich ist. Übersetzen Sie eine Untertiteldatei – die Zeitangaben bleiben dabei erhalten. Erstellen Sie Untertitel für Ihr eigenes Video in 38 Sprachen, ohne pro Minute bezahlen zu müssen.
Deshalb funktioniert es dort, wo nichts anderes funktioniert. Ein Flugzeug. Ein Hotel mit schlechtem WLAN. Ein Zug durch einen Tunnel. Es gibt keinen Ort, wohin die Aufnahme gesendet werden könnte – daher muss sie auch nirgendwohin gesendet werden. Legen Sie eine zweistündige Meeting-Aufnahme ab und gehen Sie Kaffee holen; die Transkription ist bereits vorhanden, wenn Sie zurückkommen. Vergessen Sie, dass Sie die Aufnahme gestartet haben – nichts geht verloren. Die Aufnahme erledigt ihre Arbeit von selbst und speichert die Transkription.
Zwei Transkriptionsmodelle – es handelt sich dabei um eine Wahl, nicht um verschiedene Ebenen; Sie können jederzeit wechseln.
Die meisten Sprachsoftware-Programme verlangen bei der Einrichtung, dass man Beispielsätze vorliest. Dieses Programm tut das nicht. Es lernt aus den Korrekturen, die man vornimmt: Wenn man ein falsch verstandenes Wort korrigiert, wird diese Korrektur zum Trainingsbeispiel. Legen Sie einmal Ihre Markennamen, Ihren Fachjargon sowie die Namen Ihrer Kollegen fest – dann werden sie weder im Transkript noch in der Übersetzung falsch dargestellt, denn dieselbe Liste steuert beides. Ein Name wird niemals versehentlich lokalisiert. Das Training erfolgt mit nur einem Klick, es läuft auf Ihrer Hardware, und das neue Modell ist bereit, sobald es fertig ist.
Kaufen Sie es einmal – dann gehört es Ihnen. Eine lebenslange Lizenz mit einem Jahr Updates inbegriffen.
Ein lauter Raum ist dann kein Problem mehr. Die Geräuschreduzierung ist bereits integriert – für Aufnahmen, die in einem Café, auf einer Messe oder im Auto gemacht werden. Sie ist standardmäßig ausgeschaltet, denn wir haben es getestet: Bei kurzen, klaren Mikrofonaufnahmen verschlechtert sie die Qualität. Für das zweistündige Treffen mit der Espressomaschine hinter Ihnen sollten Sie sie einschalten.
Die Sprachtastatur tippt an jedem Ort, an dem sich der Cursor befindet – in einem Browser, einer IDE, einer Chat-App oder in jedem Feld, das eine Tastatur akzeptiert. Sie kann außerdem die Übersetzung statt der Transkription eingeben. Sagen Sie den Satz in Ihrer Sprache, und die richtigen Wörter werden in der vom Formular benötigten Sprache eingegeben – in einer einzigen Zeile, ohne Ausschneiden und Einfügen.
Die 0,6-B-Version ist die alltägliche Variante. Sie funktioniert mit jeder Grafikkarte mit 4 GB Speicher, mit integrierten Grafiken sowie in Laptops ohne Grafikkarte. Schnell, leicht – immer zur Stelle, wenn man sie braucht.
Die Version mit 1,7 Milliarden Parametern ist die sorgfältigere – für akzentuierten Audioinhalt, störanfälligen Audioinhalt sowie bei zweistündigen Besprechungen, in denen die Wortwahl wichtig ist. Sie benötigt etwa 6 GB VRAM, oder 8 GB, wenn zusätzlich das hochwertige Übersetzungsmodell geladen wird.
Keine GPU überhaupt? Es funktioniert trotzdem. Eine reine CPU-Beschleunigung erfordert 8 GB RAM, einen Vierkernprozessor sowie etwa 5 GB freien Speicherplatz; für alles Weitere sind 7–9 GB erforderlich. Jede Karte mit Vulkan 1.2+ eignet sich – NVIDIA, AMD, Intel Arc. Sowohl die Transkription als auch die Übersetzung nutzen jeweils ihren eigenen Prozessor, sodass eine Aufgabe auf der Grafikkarte und die andere auf der CPU ausgeführt werden kann.
Optionale Zusatzmodule werden bei Bedarf über Einstellungen → Modelle heruntergeladen:
Forced Aligner (~540 MB) für Wort-Zeitstempel · Hunyuan MT2 Fast (~1 GB) oder Qualität (~4,3 GB) für Übersetzung.
| Feature | Brethof Voice Pro | Dragon | Google STT | Otter.ai | Whisper (OSS) |
|---|---|---|---|---|---|
| 100 % lokale Verarbeitung | ✓ | ✓ | ✗ | ✗ | ✓ |
| Ewige Lizenz | ✓ | ~ | ✗ | ✗ | ✓ |
| Native Linux-Unterstützung | ✓ | ✗ | ~ | ✗ | ✓ |
| Native Windows-Unterstützung | ✓ | ✓ | ~ | ✗ | ~ |
| 30 ASR-Sprachen + automatische Erkennung | ✓ | ✗ | ✓ | ~ | ✓ |
| Offline-Übersetzung (38 Sprachen) | ✓ | ✗ | ✗ | ✗ | ✗ |
| GPU-Beschleunigung (NVIDIA + AMD + Intel) | ✓ | ✗ | N/A | N/A | ~ |
| Persönliche Modell-Feinabstimmung (LoRA) | ✓ | ✓ | ✗ | ✗ | ✗ |
| MCP-Server für KI-Agenten | ✓ | ✗ | ✗ | ✗ | ✗ |
| Integrierte Geräuschreduzierung | ✓ | ✓ | ✓ | ✓ | ✗ |
| Direkte Texteinbettung | ✓ | ✓ | ✗ | ✗ | ✗ |
| Überarbeitete Desktop-GUI | ✓ | ✓ | ✗ | ✓ | ✗ |
| Typische Kosten | $49 einmal | 350 $/Jahr | 17 $/Monat | 17 $/Monat | Kostenlos |
Keine monatlichen Gebühren. Keine Nutzungsgrenzen. Ewige Lizenz mit 1 Jahr Updates inklusive.
Keine Kreditkarte erforderlich. Nur eine E-Mail zur Verifizierung der Testversion.
Ewige Lizenz. 2 persönliche Geräte. 1 Jahr Updates inklusive.
Preise zzgl. MwSt. Zusätzlich 20 US-Dollar/Jahr für Updates (optional).
Dauerhafte Lizenz (pro Seat). Team- & Organisationsnutzung. 1 Jahr Updates.
Preise zzgl. MwSt. Danach 20 $/Seat/Jahr für Updates (optional)
Nein. Brethof Voice Pro verarbeitet alles lokal auf Ihrem Gerät. Keine Audiodaten und keine Textdaten verlassen jemals Ihren Computer. Es gibt weder einen Cloud-Anteil noch Telemetriedaten oder Analysefunktionen.
Jede moderne GPU funktioniert. NVIDIA, AMD und Intel Arc nutzen alle Vulkan-Beschleunigung. Sie können auch nur mit der CPU arbeiten, wobei die Transkription dann langsamer ist. Das 0,6B-Modell läuft problemlos auf integrierter Grafik oder jeder Vulkan-Karte mit 4 GB+ Speicher.
Beginnen Sie mit dem 0,6B-Modell — Es ist die empfohlene Standardoption und läuft auf den meisten GPUs hervorragend (sogar auf der CPU der meisten modernen Geräte). Wenn Sie eine höhere Genauigkeit bei akzentbehaftetem oder verrauschtem Audio benötigen, wechseln Sie zu 1,7B-Modell (benötigt 6 GB+ VRAM). Sie können die Größe jederzeit unter Einstellungen → Modelle wechseln, ohne sie erneut herunterzuladen.
Ja. Brethof Voice Pro unterstützt sowohl Linux als auch Windows nativ. Unter Linux funktioniert es mit X11 und Wayland. Unter Windows läuft es als herkömmliche Desktop-Anwendung.
Ihre Lizenz ist dauerhaft – die App funktioniert mit der Version, die Sie haben, unbegrenzt weiter. Der optionale Update-Pass für 20 US-Dollar pro Jahr gibt Ihnen Zugang zu neuen Funktionen und Modellverbesserungen. Ohne ihn bleiben Sie einfach bei Ihrer aktuellen Version.
Ja – das persönliche Stimmtraining ist in v2.0.0 enthalten und wird vollständig auf Ihrem Gerät ausgeführt. Jedes Mal, wenn Sie ein falsch erkanntes Wort korrigieren, wird das {Clip, Korrektur}-Paar automatisch in Ihren lokalen Trainingsdatensatz gespeichert. Auf der Trainingskarte im Hauptfenster werden die Gesamtanzahl der Samples sowie die aufgenommene Zeit auf einen Blick angezeigt – klicken Sie im Reiter „Training“ auf „Training starten“, um eine LoRA an Ihrem Akzent anzupassen. Das Ergebnis wird automatisch in GGUF exportiert, und Sie können es mit einem Klick verwenden. Kostenlos für jede bezahlte Lizenz, Ihre Stimmdaten verlassen niemals Ihr Gerät.
14-tägige kostenlose Testversion. Keine Kreditkarte nötig. Kein Cloud-Dienst. Keine Kompromisse.
Lokale Speech-to-Text, die Ihre Stimme lernt. Lebenslange Lizenz. Unser Flaggschiff.
BEZAHLT · Flaggschiff
Langfristige Speicherung für Ihre KI-Agenten – Volltext + Vektoren + Graphen. Bei Sitzungsstart informiert, bei jeder Anfrage abgerufen, automatisch archiviert.
Bezahlt · kostenlose Version
Druckfertige digitale Modelle. GLB und OBJ enthalten. Lebenslanger Zugang.
BEZAHLT · digitaler Katalog
Fünf Drucker mit echter Kapazität. Noch kein Selbstbedienungsladen – teilen Sie uns mit, was Sie benötigen, und wir senden Ihnen ein Angebot per E-Mail.
Nach Absprache · Schreiben Sie uns per E-Mail
Unser YouTube-Kanal. Ein Cyber-Tiger-Moderator führt durch lokale KI-Tools und erklärt, was sie tatsächlich tun.
KANAL · LIVE
Ausgewählte GitHub-Listen für KI-Code-Agenten, MCP-Server, lokale KI-Lösungen und Linux für KI. Jeder Eintrag enthält einen Quelllink.
KOSTENLOS · kuratiert
Ausführliche Anleitungen zur Nutzung lokaler KI unter Linux, Windows und macOS, inklusive der Konfigurationsdateien.
KOSTENLOS · LIVE
Negative Curation: Praktiken und Tools, die Ihre Zeit verschwenden, bewertet. Belege erforderlich.
KOSTENLOS · LIVE
Wer wir sind, warum wir datenschutzorientierte KI entwickeln und was wir nicht tun werden.