Die aktuelle Version dieser App wird schrittweise veröffentlicht. Wenn Sie die neueste Version verwenden, ist dies die Liste dessen, was Sie bereits haben – und die Anmerkungen unter dem Changelog erklären die Entscheidungen hinter einigen Änderungen.
Eine Regression in der vorherigen Version führte dazu, dass Konten mit Zwei-Faktor-Authentifizierung nicht mehr zum Anmelden zugänglich waren. v2.3.1 behebt dieses Problem. Wenn Sie betroffen sind: Geben Sie Ihre Anmeldeinformationen ein, geben Sie Ihren Code ein – und Sie sind drin. Ansonsten hat sich nichts geändert.
Die Übersetzung einer Untertitelfdatei dauert jetzt etwa die Hälfte der Zeit wie früher. Die Zeitangaben bleiben unverändert – jede Zeitstempelangabe landet genau dort, wo sie im Original war, egal ob man eine Übersetzung auf Satz- oder Wortebene wünscht. Wenn man seinen Lebensunterhalt mit der Erstellung von Untertiteln bestritt, dann ist dies die Version, bei der die Wartezeit deutlich kürzer geworden ist.
Auch in v2.2.2:
translate_batch MCP-Tool — Übersetzen Sie viele Zeichenketten in einem Aufruf – mit einem Batch-Größen-Parameter, der automatisch zurückfährt, wenn der VRAM knapp wird.Brethof Voice Pro gehört Ihnen, sobald Sie es kaufen, und die Version 2.2.1 sorgt dafür, dass nichts zwischen Ihnen und dem Programm kommt. Die Lizenzprüfung beim Start funktionierte früher wie ein Hindernis: Keine Internetverbindung, ein überlasteter Server oder eine Firewall, die den Zugang verweigerte, konnten dazu führen, dass man den für Geld gekauften Software nicht nutzen konnte. Jetzt wird diese Prüfung einfach umgangen – wenn sie nicht durchgeführt werden kann, öffnet sich die App trotzdem. Software, die Ihnen gehört, sollte keine Genehmigung zum Start anfordern. Das tut sie jetzt auch nicht mehr.
Lange Aufnahmen werden nun als Hintergrundaufgaben abgewickelt. Geben Sie eine Datei mit einer zweistündigen Besprechung weiter und gehen Sie Kaffee kochen – es gibt keine Längenbeschränkung und nichts, was man im Auge behalten muss. Lassen Sie die Aufnahme einfach laufen und vergessen Sie sie; sie wird von selbst abgeschlossen und hinterlegt Ihnen die Transkript. Ein dreistündiger Anruf unterscheidet sich nicht von einem dreiminütigen – er dauert nur länger.
list_loopback_sources Werkzeug, um zu sehen, was verfügbar ist.Ein Agent auf demselben Rechner kann nun über MCP Brethof Voice Pro nutzen – zum Transkribieren, Übersetzen und Aufnehmen. Es funktioniert über lokalen HTTP, sodass ein Agent, der nur über URLs auf Ressourcen zugreifen kann, es ohne API-Schlüssel und ohne dass etwas den Rechner verlässt, verwenden kann. Ein Token schützt den Zugang, und der Server weigert sich, ohne dieses zu starten. Für diese Version ist eine kostenpflichtige Lizenz erforderlich.
Die leistungsstärkste Variante. Die Übersetzung erfolgt nun vollständig auf Ihrem Gerät in 38 Sprachen. Sprechen Sie einmal – und der Text wird gleichzeitig in Englisch, Japanisch, Französisch und Spanisch eingegeben, entweder jeweils in einer eigenen Zeile oder nebeneinander in derselben Zeile. Der Einsatzmotor ist Tencent’s Hunyuan MT2, erhältlich in zwei Größen nach Ihrem Wunsch: schnell für den täglichen Gebrauch, hochwertig für entscheidende Anwendungen. Bei der hochwertigen Variante liegen laut den von Tencent veröffentlichten Messungen 97,9 Prozent der Leistung im Vergleich zu Google Gemini 3.1 Pro auf dem FLORES-200-Test, und sie übertrifft diese Version bei der Übersetzung in Alltagssprachen sowie Minderheitensprachen. Alles läuft offline – keine Daten werden an Dritte übermittelt.
Was ist neu in v2.0.0:
EN: … || PL: …), oder nur das erste Ziel.translate_text, translate_srt, list_compute_devices, set_compute_device. Die Gesamtzahl der Werkzeuge beträgt nun 19.Die Linux-Binärdatei ist 161 MB groß, der Windows-Installer 118 MB. Bestehende Lizenzen werden übernommen – einfach Download v2.0.0 und die Übersetzungsmodelle erscheinen unter Einstellungen → Modelle.
Download v2.0.0 →Brethof Voice Pro trainiert nun mit Ihrer Stimme. Die Trainingsdaten sind die Korrekturen, die Sie bereits vornehmen – korrigieren Sie ein falsch verstandenes Wort einmal, und das wird zum Beispiel. Es wird nie von Ihnen verlangt, Beispielsätze vorzulesen. Das Training erfolgt mit nur einem Klick, läuft auf Ihrer eigenen Hardware, und sobald es abgeschlossen ist, ist das neue Modell bereit zum Wechseln.
Die Testversion gibt Zugang zu allem außer zum persönlichen Training und zur Verbindung mit einem Agenten; diese Funktion ist für Personen bestimmt, die die App täglich nutzen.
Zwei Dinge: Die Transkription kann nun als asynchrone Aufgabe ausgeführt werden – man lädt das Audio hoch, holt sich die Transkription, sobald sie fertig ist, und muss nicht davor sitzen.
Und die Zeitsteuerung der Untertitel: Jetzt können Sie die Zeit für jedes Wort einzeln festlegen anstelle von Satz für Satz – gerade dann, wenn eine präzise Bearbeitung erforderlich ist. Wenn Sie Untertitel erstellen, wissen Sie bereits, warum das wichtig ist.
Der ONNX-Runtime existiert nicht mehr. Das gesamte Produkt läuft nun unter Verwendung von llama.cpp sowie unserer eigenen Übersetzungsbibliothek – ein einziger Runtime, kleiner auf der Festplatte, schneller zum Starten und einfacher zu verbreiten.
Die Modelle sind einzelne GGUF-Bündel – genau das ermöglicht es dem kleineren Modell, auf jeder Grafikkarte mit 4 GB Speicher zu laufen. Weiter unten finden Sie eine ausführlichere Erklärung dafür, warum wir diesen Schritt unternommen haben.
Zwei Neuheiten. Der MCP-Server feiert hier seine Premiere – die erste Möglichkeit, einem Agenten „Ohren“ zu verleihen, und das ganz auf Ihrem eigenen Rechner.
Und der Geräteauswähler: Transkription und Übersetzung können nun jeweils ihren eigenen Prozessor wählen, sodass die eine Aufgabe auf der Grafikkarte ausgeführt werden kann, während die andere auf der CPU arbeitet. Ein Laptop mit einer einfachen GPU kann beides ohne erhebliche Verlangsamungen ausführen.
macOS befindet sich derzeit in der Entwicklung, zunächst für Apple Silicon. Es gibt noch keinen genauen Termin, und wir werden keinen nennen, bis die Version tatsächlich verfügbar ist. In der Zwischenzeit sind Linux und Windows dasselbe Produkt mit denselben Funktionen – es wird nichts zurückgehalten, um das eine gegen das andere zu verkaufen. Sobald die Mac-Version verfügbar ist, wird diese Seite dies angeben.
Beitrag lesen →Ihr Akzent ist kein Problem, das man umgehen muss – er ist vielmehr ein Modell, das trainiert werden kann. Brethof Voice Pro lernt aus den Korrekturen, die Sie bereits vornehmen – korrigieren Sie ein falsch verstandenes Wort einmal, und diese Korrektur wird zu einem Beispiel. Keine Beispielsätze, kein Kalibrierungsprogramm, keine stundenlange Aufnahme ins Mikrofon. Die von Ihnen bereits festgelegten Wörter – Markennamen, Fachbegriffe, Namen von Kollegen – leiten sowohl die Transkription als auch die Übersetzung, sodass ein Name niemals versehentlich lokalisiert wird. Das Training erfolgt mit nur einem Klick, läuft auf Ihrer eigenen Hardware und das neue Modell ist nach Abschluss bereit zum Einsatz. Die Korrekturen, die Sie bereits vorgenommen haben, waren stets Lehrmaterial – nun dienen sie dazu, das Modell zu trainieren.
Beitrag lesen →Die erste Version. Sprechen statt tippen – in alles: Ihren Editor, Ihre Terminal, ein Chatfeld, ein Formular – und die Wörter landen dort, wo sich der Cursor befindet. Die Transkription erfolgt vollständig auf Ihrem eigenen Gerät, unter Verwendung von Alibaba’s Qwen3-ASR in Kombination mit DeepFilterNet3 zur Reduzierung von Störgeräuschen sowie Silero VAD zur Stimmenerkennung. Alles läuft lokal. Der Anruf bei Ihrem Anwalt, das noch nicht veröffentlichte Produkt, die Patientennotizen – nichts davon verlässt den Computer, auf dem es verarbeitet wird, denn es gibt keinen Ort, wohin es gehen könnte. Es funktioniert im Flugzeug, im Zug durch einen Tunnel, in einem Hotel mit schlechtem WLAN. 30 Sprachen, darunter 22 chinesische Dialekte. Es läuft auf dem Laptop, den Sie bereits besitzen – mit oder ohne Grafikkarte; bei Verwendung einer Grafikkarte gilt: Jede Vulkan 1.2+-GPU von NVIDIA, AMD oder Intel Arc. Unter Linux wird es als einzelnes tragbares Dateiformat bereitgestellt, erfordert glibc 2.38 oder neuer, und unter Windows handelt es sich um einen normalen Installer, der keine Administratorrechte benötigt. 14-tägige Testversion – ohne Karte, nur per E-Mail.
Beitrag lesen →Die Einzellizenz umfasst nun sowohl selbstständige Geschäftstätigkeiten als auch freiberufliche Tätigkeiten. Wenn Sie Einzelunternehmer, Ein-Mann-Studio oder Auftragnehmer sind, deckt die von Ihnen gekaufte Lizenz Ihre Arbeit ab. Es gibt keine Abrechnung pro Benutzer und keinen separaten Geschäftskanal. Eine Lizenz für zwei Geräte – einmalig zu kaufen. Sie beinhaltet ein Jahr lang Updates; danach sind Updates optional, und die App funktioniert weiterhin auf der vorhandenen Version, unbegrenzt. Die Software, für die Sie bezahlt haben, bleibt Ihr Eigentum.
Beitrag lesen →Brethof Voice Pro kann in 30 Sprachen transkribieren, erkennt 22 chinesische Dialekte und übersetzt in 38 Sprachen. Zudem ist die Benutzeroberfläche vollständig in all diesen 30 Sprachen übersetzt – von Menschen, die das Produkt nutzen, und nicht durch maschinelle Übersetzung erstellt. Sie können die App auf Ihre Sprache einstellen, und sie liest sich, als wäre sie dort geschrieben worden, denn das ist sie auch.
Beitrag lesen →Die ersten Builds wurden mit ONNX Runtime ausgeführt. Es funktionierte zwar, war aber ressourcenhungrig, schwierig zu verteilen und ließ das Produkt größer werden, als nötig. In Version 1.5.0 wurde dies durch einen einzigen Laufzeitmechanismus ersetzt – llama.cpp für die Transkription sowie unsere eigene Bibliothek für die Übersetzung – und die Modelle wurden zu einzelnen GGUF-Bündeln. Die Vorteile sind kleinere Downloads, schnellere Startzeiten sowie ein Produkt, das besser auf einem Laptop Platz findet. Es gibt zwei Modellgrößen – eine Wahl statt einer Hierarchie: die kleinere für Laptops mit integrierter Grafik und die größere für audio mit Akzenten oder Störgeräuschen. Sie können jederzeit wechseln, und es ist überhaupt keine Grafikkarte erforderlich, wenn Sie das nicht möchten.
Beitrag lesen →Drei Dinge erreichen das Netzwerk – und nichts anderes. Eine Lizenzprüfung beim Start der App. Eine Aktualisierungsprüfung beim Start der App. Und die Modelle, die man selbst herunterlädt. Die Lizenzprüfung sendet einen Lizenzschlüssel; die Aktualisierungsprüfung sendet eine Versionsangabe. Keines von beidem sendet jemals Audio oder Text. Sobald die Modelle auf der Festplatte gespeichert sind und die Aktualisierungsprüfung deaktiviert ist, wird überhaupt nichts mehr ausgesendet. Das ist keine Marketingaussage – ein Firewall-Log wird es zeigen. Der Grund, alles auf dem eigenen Rechner auszuführen, liegt nicht darin, dass der Cloud-Service eine Besonderheit ist. Es geht vielmehr darum, dass Ihre Stimme etwas ist, was man nicht rückgängig machen kann: das Gespräch mit Ihrem Anwalt, das noch nicht veröffentlichte Produkt, die Patientenakten. Ein Tool, das damit umgehen soll, benötigt keine Netzwerkverbindung, um seine Aufgabe zu erfüllen. Es sollte auch in einem Flugzeug funktionieren – und darf keine Daten durchsickern lassen. Das ist die ganze Idee – und es handelt sich dabei um eine Designentscheidung, nicht um eine Funktion.
Beitrag lesen →Eine E-Mail pro Veröffentlichung, mit dem oben stehenden Changelog. Kein Spam, keine Tipps, kein wöchentlicher Newsletter. Abmelden in einem Klick, jederzeit.
Konto erstellenLokale Speech-to-Text, die Ihre Stimme lernt. Lebenslange Lizenz. Unser Flaggschiff.
BEZAHLT · Flaggschiff
Langfristige Speicherung für Ihre KI-Agenten – Volltext + Vektoren + Graphen. Bei Sitzungsstart informiert, bei jeder Anfrage abgerufen, automatisch archiviert.
Bezahlt · kostenlose Version
Druckfertige digitale Modelle. GLB und OBJ enthalten. Lebenslanger Zugang.
BEZAHLT · digitaler Katalog
Fünf Drucker mit echter Kapazität. Noch kein Selbstbedienungsladen – teilen Sie uns mit, was Sie benötigen, und wir senden Ihnen ein Angebot per E-Mail.
Nach Absprache · Schreiben Sie uns per E-Mail
Unser YouTube-Kanal. Ein Cyber-Tiger-Moderator führt durch lokale KI-Tools und erklärt, was sie tatsächlich tun.
KANAL · LIVE
Ausgewählte GitHub-Listen für KI-Code-Agenten, MCP-Server, lokale KI-Lösungen und Linux für KI. Jeder Eintrag enthält einen Quelllink.
KOSTENLOS · kuratiert
Ausführliche Anleitungen zur Nutzung lokaler KI unter Linux, Windows und macOS, inklusive der Konfigurationsdateien.
KOSTENLOS · LIVE
Negative Curation: Praktiken und Tools, die Ihre Zeit verschwenden, bewertet. Belege erforderlich.
KOSTENLOS · LIVE
Wer wir sind, warum wir datenschutzorientierte KI entwickeln und was wir nicht tun werden.