Brethof Voice Pro — Was gibt’s Neues?

Die aktuelle Version dieser App wird schrittweise veröffentlicht. Wenn Sie die neueste Version verwenden, ist dies die Liste dessen, was Sie bereits haben – und die Anmerkungen unter dem Changelog erklären die Entscheidungen hinter einigen Änderungen.

Veröffentlichung 14. August 2026

v2.3.1 – Zwei-Faktor-Konten können erneut einloggen

Eine Regression in der vorherigen Version führte dazu, dass Konten mit Zwei-Faktor-Authentifizierung nicht mehr zum Anmelden zugänglich waren. v2.3.1 behebt dieses Problem. Wenn Sie betroffen sind: Geben Sie Ihre Anmeldeinformationen ein, geben Sie Ihren Code ein – und Sie sind drin. Ansonsten hat sich nichts geändert.

Veröffentlichung 6. August 2026

v2.2.2 – Untertiteldateien, etwa doppelt so schnell

Die Übersetzung einer Untertitelfdatei dauert jetzt etwa die Hälfte der Zeit wie früher. Die Zeitangaben bleiben unverändert – jede Zeitstempelangabe landet genau dort, wo sie im Original war, egal ob man eine Übersetzung auf Satz- oder Wortebene wünscht. Wenn man seinen Lebensunterhalt mit der Erstellung von Untertiteln bestritt, dann ist dies die Version, bei der die Wartezeit deutlich kürzer geworden ist.

Auch in v2.2.2:

  • Korrektur des Mikrofon-Eingangs – und das war besonders bei guten Mikrofonen wichtig.. Die Audio-Pegelanpassung konnte die lautesten Momente einer sauberen Aufnahme über den Vollausschlag hinaus anheben und sie beschneiden. Je besser Ihr Mikrofon ist, desto größer ist die Lücke zwischen seinen Spitzenwerten und seinem Durchschnittspegel, und desto wahrscheinlicher war dieser Effekt – ein komprimiertes, verrauschtes Eingangssignal kam unversehrt durch, während ein ruhiger Raum und ein ordentliches Kondensatormikrofon beschnitten wurden. Die Pegelanpassung lässt nun stattdessen Headroom, sodass Konsonanten und harte Einschwingvorgänge intakt bleiben.
  • Neu translate_batch MCP-Tool — Übersetzen Sie viele Zeichenketten in einem Aufruf – mit einem Batch-Größen-Parameter, der automatisch zurückfährt, wenn der VRAM knapp wird.
Download v2.2.2 →
Veröffentlichung 11. Juli 2026

v2.2.1 – Die App, die Ihnen gehört, bleibt Ihr Eigentum.

Brethof Voice Pro gehört Ihnen, sobald Sie es kaufen, und die Version 2.2.1 sorgt dafür, dass nichts zwischen Ihnen und dem Programm kommt. Die Lizenzprüfung beim Start funktionierte früher wie ein Hindernis: Keine Internetverbindung, ein überlasteter Server oder eine Firewall, die den Zugang verweigerte, konnten dazu führen, dass man den für Geld gekauften Software nicht nutzen konnte. Jetzt wird diese Prüfung einfach umgangen – wenn sie nicht durchgeführt werden kann, öffnet sich die App trotzdem. Software, die Ihnen gehört, sollte keine Genehmigung zum Start anfordern. Das tut sie jetzt auch nicht mehr.

  • Schaltfläche „Lizenz erneut prüfen“ Im Lizenzdialog – zwingt zu einer erneuten Überprüfung und startet weiterhin Bei Erfolg. Früher waren die einzigen Möglichkeiten Kauf oder Aufhören.
  • Keine Testablauf-Kennzeichnung für zahlende Kunden — Dialoge sagen nun, was tatsächlich passiert ist, statt allen dieselbe Meldung zu zeigen.
  • Keine UI-Einfrierungen mehr — Modell-Downloads laufen außerhalb des Interface-Threads mit prozentualem Fortschritt, und Lizenzprüfungen beim Start blockieren das Fenster bei langsamer Verbindung nicht mehr.
  • Keine verlorenen Diktate — Wenn beim Beenden des Sprechens noch eine Transkription läuft, wird das neue Audio in die Warteschlange gestellt, statt stillschweigend verworfen zu werden, und ein blockierter Worker kann keinen verspäteten Text mehr in Ihre nächste Aufnahme tippen.
  • Offline ist leise. — Keine wiederholten Netzwerkwartezeiten, wenn keine Verbindung besteht.
Herunterladen →
Veröffentlichung 4. Juni 2026

v2.2.0 – Aufnehmen des gesamten Meetings, nicht nur der ersten fünf Minuten

Lange Aufnahmen werden nun als Hintergrundaufgaben abgewickelt. Geben Sie eine Datei mit einer zweistündigen Besprechung weiter und gehen Sie Kaffee kochen – es gibt keine Längenbeschränkung und nichts, was man im Auge behalten muss. Lassen Sie die Aufnahme einfach laufen und vergessen Sie sie; sie wird von selbst abgeschlossen und hinterlegt Ihnen die Transkript. Ein dreistündiger Anruf unterscheidet sich nicht von einem dreiminütigen – er dauert nur länger.

  • Mikrofon oder Systemaudio — Nehmen Sie Ihre eigene Stimme auf oder erfassen Sie per Loopback alles, was auf Ihrem Gerät abgespielt wird: Besprechungen, Browser-Tabs, alles, was über Ihre Lautsprecher läuft. Neu list_loopback_sources Werkzeug, um zu sehen, was verfügbar ist.
  • Nichts wird verworfen. — Wenn eine Aufnahme abgebrochen wird, transkribiert der Watchdog sie nun in einen abrufbaren Job, anstatt sie zu verwerfen.
  • Ehrliche Grenzen — Der kurze Instant-Transkriptionsmodus wurde auf eine Obergrenze von 10 Minuten angehoben; bei einer Anfrage für mehr als er verarbeiten kann, wird nun ein klarer Fehler zurückgegeben, der auf das Langform-Tool verweist. Er kürzt Ihr Audio nicht mehr stillschweigend und liefert keine Teilantwort mehr zurück.
  • Korrektur der Linux-Übersetzung — Eine fehlende Abhängigkeit führte dazu, dass die Übersetzung in allen Linux-Builds seit v1.7.0 defekt war. Gefunden durch ein neues End-to-End-Release-Gate, das die echte, gebaute Binärdatei vor jeder Veröffentlichung testet.
Herunterladen →
Aktualisierung 4. Juni 2026

v2.1.0 – Ihr Agent erhält eine Verbindung über HTTP

Ein Agent auf demselben Rechner kann nun über MCP Brethof Voice Pro nutzen – zum Transkribieren, Übersetzen und Aufnehmen. Es funktioniert über lokalen HTTP, sodass ein Agent, der nur über URLs auf Ressourcen zugreifen kann, es ohne API-Schlüssel und ohne dass etwas den Rechner verlässt, verwenden kann. Ein Token schützt den Zugang, und der Server weigert sich, ohne dieses zu starten. Für diese Version ist eine kostenpflichtige Lizenz erforderlich.

  • Standardmäßig privat — Es lauscht nur auf Ihrem eigenen Rechner, sofern Sie das nicht bewusst ändern, und eine breitere Bindung weigert sich zu starten ohne Authentifizierungs-Token. Wenn ein Token gesetzt ist, muss jede Anfrage ihn vorlegen.
  • Keine unterbrochene Arbeit — Modelle, die bei Inaktivität entladen werden, können nicht mehr mitten in einem langen Auftrag entladen werden. Ein Timeout, das laufende Arbeit ignoriert, wird irgendwann etwas Legitimes beenden, daher pausiert die Inaktivitätsuhr nun, solange etwas läuft.
Herunterladen →
Veröffentlichung 21. Mai 2026

v2.0.0 – Übersetzung, die niemals das Haus verlässt

Die leistungsstärkste Variante. Die Übersetzung erfolgt nun vollständig auf Ihrem Gerät in 38 Sprachen. Sprechen Sie einmal – und der Text wird gleichzeitig in Englisch, Japanisch, Französisch und Spanisch eingegeben, entweder jeweils in einer eigenen Zeile oder nebeneinander in derselben Zeile. Der Einsatzmotor ist Tencent’s Hunyuan MT2, erhältlich in zwei Größen nach Ihrem Wunsch: schnell für den täglichen Gebrauch, hochwertig für entscheidende Anwendungen. Bei der hochwertigen Variante liegen laut den von Tencent veröffentlichten Messungen 97,9 Prozent der Leistung im Vergleich zu Google Gemini 3.1 Pro auf dem FLORES-200-Test, und sie übertrifft diese Version bei der Übersetzung in Alltagssprachen sowie Minderheitensprachen. Alles läuft offline – keine Daten werden an Dritte übermittelt.

Was ist neu in v2.0.0:

  • Transkribieren + Übersetzen — Das Transcribe-Popup hat ein Dropdown „Übersetzen in:“. ASR transkribiert, MT übersetzt, beide werden nebeneinander angezeigt. Funktioniert mit Dateien, Mikrofon und System-Audio-Loopback (Aufzeichnung von Meeting-Anrufen, Browsertabs, alles, was auf Ihren Lautsprechern wiedergegeben wird).
  • Mehrsprachige Sprachtastatur — Der neue Übersetzungschip in der Hauptzeile öffnet ein 3-spaltiges Sprachgitter. Wählen Sie eine oder mehrere Zielsprachen aus, die Tastatur gibt die Übersetzung ein. Layoutmodi: eine pro Zeile, inline (EN: … || PL: …), oder nur das erste Ziel.
  • SRT-/VTT-Untertitelübersetzer — Erhält Zeitangaben und Cue-Indizes, unterstützt den zweisprachigen Modus (Quellzeile + Übersetzung pro Cue). Verfügbar über MCP für KI-Agenten-Automatisierung.
  • Mehrere GPUs pro Engine — Einstellungen → Modelle verfügt über einen separaten Geräteauswähler für jede Engine. Führen Sie ASR auf Vulkan 0 und die Übersetzung auf Vulkan 1 aus, oder binden Sie Hunyuan MT2 7B bei Laptops mit begrenztem VRAM an die CPU.
  • Persönliches Stimmtraining ist vollständig live — LoRA-Feinabstimmung mit Ihrer eigenen Stimme, End-to-End auf Ihrem Gerät. Die Trainingskarte im Hauptfenster zeigt die Gesamtanzahl der Samples sowie die aufgenommene Zeit auf einen Blick; „Training starten“ im Tab Training wählt automatisch NVIDIA CUDA oder CPU aus und exportiert das trainierte Modell anschließend als GGUF. Im Lieferumfang jeder kostenpflichtigen Lizenz enthalten.
  • 4 neue MCP-Toolstranslate_text, translate_srt, list_compute_devices, set_compute_device. Die Gesamtzahl der Werkzeuge beträgt nun 19.
  • Ehrliche Sprachtrennung — ASR: 30 auswählbare Sprachen + Auto-Erkennung + 22 chinesische Dialekte (insgesamt 52). Übersetzung: 38 Sprachen (33 Hauptsprachen + 5 Minderheitensprachen aus dem chinesischen Sprachraum). 23 davon funktionieren in beide Richtungen.

Die Linux-Binärdatei ist 161 MB groß, der Windows-Installer 118 MB. Bestehende Lizenzen werden übernommen – einfach Download v2.0.0 und die Übersetzungsmodelle erscheinen unter Einstellungen → Modelle.

Download v2.0.0 →
Veröffentlichung 20. Mai 2026

v1.6.16 – Ihre Stimme wird zu ihrem eigenen Modell

Brethof Voice Pro trainiert nun mit Ihrer Stimme. Die Trainingsdaten sind die Korrekturen, die Sie bereits vornehmen – korrigieren Sie ein falsch verstandenes Wort einmal, und das wird zum Beispiel. Es wird nie von Ihnen verlangt, Beispielsätze vorzulesen. Das Training erfolgt mit nur einem Klick, läuft auf Ihrer eigenen Hardware, und sobald es abgeschlossen ist, ist das neue Modell bereit zum Wechseln.

Die Testversion gibt Zugang zu allem außer zum persönlichen Training und zur Verbindung mit einem Agenten; diese Funktion ist für Personen bestimmt, die die App täglich nutzen.

Engineering 15. Mai 2026

v1.6.0 – In Betrieb setzen, später zurückkehren

Zwei Dinge: Die Transkription kann nun als asynchrone Aufgabe ausgeführt werden – man lädt das Audio hoch, holt sich die Transkription, sobald sie fertig ist, und muss nicht davor sitzen.

Und die Zeitsteuerung der Untertitel: Jetzt können Sie die Zeit für jedes Wort einzeln festlegen anstelle von Satz für Satz – gerade dann, wenn eine präzise Bearbeitung erforderlich ist. Wenn Sie Untertitel erstellen, wissen Sie bereits, warum das wichtig ist.

Engineering 15. Mai 2026

v1.5.0 – eine Laufzeitumgebung, und ONNX ist weg

Der ONNX-Runtime existiert nicht mehr. Das gesamte Produkt läuft nun unter Verwendung von llama.cpp sowie unserer eigenen Übersetzungsbibliothek – ein einziger Runtime, kleiner auf der Festplatte, schneller zum Starten und einfacher zu verbreiten.

Die Modelle sind einzelne GGUF-Bündel – genau das ermöglicht es dem kleineren Modell, auf jeder Grafikkarte mit 4 GB Speicher zu laufen. Weiter unten finden Sie eine ausführlichere Erklärung dafür, warum wir diesen Schritt unternommen haben.

Engineering 14. Mai 2026

v1.4.0 – Ihre erste Verbindung zum Agenten sowie ein Tool zur Auswahl Ihrer GPUs

Zwei Neuheiten. Der MCP-Server feiert hier seine Premiere – die erste Möglichkeit, einem Agenten „Ohren“ zu verleihen, und das ganz auf Ihrem eigenen Rechner.

Und der Geräteauswähler: Transkription und Übersetzung können nun jeweils ihren eigenen Prozessor wählen, sodass die eine Aufgabe auf der Grafikkarte ausgeführt werden kann, während die andere auf der CPU arbeitet. Ein Laptop mit einer einfachen GPU kann beides ohne erhebliche Verlangsamungen ausführen.

Roadmap 16. April 2026

macOS – in Bearbeitung, zunächst für Apple Silicon

macOS befindet sich derzeit in der Entwicklung, zunächst für Apple Silicon. Es gibt noch keinen genauen Termin, und wir werden keinen nennen, bis die Version tatsächlich verfügbar ist. In der Zwischenzeit sind Linux und Windows dasselbe Produkt mit denselben Funktionen – es wird nichts zurückgehalten, um das eine gegen das andere zu verkaufen. Sobald die Mac-Version verfügbar ist, wird diese Seite dies angeben.

Beitrag lesen →
Produkt 16. April 2026

Trainieren Sie es mit Ihrer eigenen Stimme.

Ihr Akzent ist kein Problem, das man umgehen muss – er ist vielmehr ein Modell, das trainiert werden kann. Brethof Voice Pro lernt aus den Korrekturen, die Sie bereits vornehmen – korrigieren Sie ein falsch verstandenes Wort einmal, und diese Korrektur wird zu einem Beispiel. Keine Beispielsätze, kein Kalibrierungsprogramm, keine stundenlange Aufnahme ins Mikrofon. Die von Ihnen bereits festgelegten Wörter – Markennamen, Fachbegriffe, Namen von Kollegen – leiten sowohl die Transkription als auch die Übersetzung, sodass ein Name niemals versehentlich lokalisiert wird. Das Training erfolgt mit nur einem Klick, läuft auf Ihrer eigenen Hardware und das neue Modell ist nach Abschluss bereit zum Einsatz. Die Korrekturen, die Sie bereits vorgenommen haben, waren stets Lehrmaterial – nun dienen sie dazu, das Modell zu trainieren.

Beitrag lesen →
Ankündigung 16. April 2026

Brethof Voice Pro ist live

Die erste Version. Sprechen statt tippen – in alles: Ihren Editor, Ihre Terminal, ein Chatfeld, ein Formular – und die Wörter landen dort, wo sich der Cursor befindet. Die Transkription erfolgt vollständig auf Ihrem eigenen Gerät, unter Verwendung von Alibaba’s Qwen3-ASR in Kombination mit DeepFilterNet3 zur Reduzierung von Störgeräuschen sowie Silero VAD zur Stimmenerkennung. Alles läuft lokal. Der Anruf bei Ihrem Anwalt, das noch nicht veröffentlichte Produkt, die Patientennotizen – nichts davon verlässt den Computer, auf dem es verarbeitet wird, denn es gibt keinen Ort, wohin es gehen könnte. Es funktioniert im Flugzeug, im Zug durch einen Tunnel, in einem Hotel mit schlechtem WLAN. 30 Sprachen, darunter 22 chinesische Dialekte. Es läuft auf dem Laptop, den Sie bereits besitzen – mit oder ohne Grafikkarte; bei Verwendung einer Grafikkarte gilt: Jede Vulkan 1.2+-GPU von NVIDIA, AMD oder Intel Arc. Unter Linux wird es als einzelnes tragbares Dateiformat bereitgestellt, erfordert glibc 2.38 oder neuer, und unter Windows handelt es sich um einen normalen Installer, der keine Administratorrechte benötigt. 14-tägige Testversion – ohne Karte, nur per E-Mail.

Beitrag lesen →
Lizenzierung 16. April 2026

Ihre eigene Lizenz deckt nun Ihr eigenes Business ab.

Die Einzellizenz umfasst nun sowohl selbstständige Geschäftstätigkeiten als auch freiberufliche Tätigkeiten. Wenn Sie Einzelunternehmer, Ein-Mann-Studio oder Auftragnehmer sind, deckt die von Ihnen gekaufte Lizenz Ihre Arbeit ab. Es gibt keine Abrechnung pro Benutzer und keinen separaten Geschäftskanal. Eine Lizenz für zwei Geräte – einmalig zu kaufen. Sie beinhaltet ein Jahr lang Updates; danach sind Updates optional, und die App funktioniert weiterhin auf der vorhandenen Version, unbegrenzt. Die Software, für die Sie bezahlt haben, bleibt Ihr Eigentum.

Beitrag lesen →
Produkt 12. April 2026

Dreißig Sprachen und eine Benutzeroberfläche, die so aussieht, als hätte sie ein Mensch geschrieben.

Brethof Voice Pro kann in 30 Sprachen transkribieren, erkennt 22 chinesische Dialekte und übersetzt in 38 Sprachen. Zudem ist die Benutzeroberfläche vollständig in all diesen 30 Sprachen übersetzt – von Menschen, die das Produkt nutzen, und nicht durch maschinelle Übersetzung erstellt. Sie können die App auf Ihre Sprache einstellen, und sie liest sich, als wäre sie dort geschrieben worden, denn das ist sie auch.

Beitrag lesen →
Engineering 8. April 2026

Warum wir von ONNX zu GGUF gewechselt haben

Die ersten Builds wurden mit ONNX Runtime ausgeführt. Es funktionierte zwar, war aber ressourcenhungrig, schwierig zu verteilen und ließ das Produkt größer werden, als nötig. In Version 1.5.0 wurde dies durch einen einzigen Laufzeitmechanismus ersetzt – llama.cpp für die Transkription sowie unsere eigene Bibliothek für die Übersetzung – und die Modelle wurden zu einzelnen GGUF-Bündeln. Die Vorteile sind kleinere Downloads, schnellere Startzeiten sowie ein Produkt, das besser auf einem Laptop Platz findet. Es gibt zwei Modellgrößen – eine Wahl statt einer Hierarchie: die kleinere für Laptops mit integrierter Grafik und die größere für audio mit Akzenten oder Störgeräuschen. Sie können jederzeit wechseln, und es ist überhaupt keine Grafikkarte erforderlich, wenn Sie das nicht möchten.

Beitrag lesen →
Prinzipien 4. April 2026

Was „100 % offline“ genau bedeutet

Drei Dinge erreichen das Netzwerk – und nichts anderes. Eine Lizenzprüfung beim Start der App. Eine Aktualisierungsprüfung beim Start der App. Und die Modelle, die man selbst herunterlädt. Die Lizenzprüfung sendet einen Lizenzschlüssel; die Aktualisierungsprüfung sendet eine Versionsangabe. Keines von beidem sendet jemals Audio oder Text. Sobald die Modelle auf der Festplatte gespeichert sind und die Aktualisierungsprüfung deaktiviert ist, wird überhaupt nichts mehr ausgesendet. Das ist keine Marketingaussage – ein Firewall-Log wird es zeigen. Der Grund, alles auf dem eigenen Rechner auszuführen, liegt nicht darin, dass der Cloud-Service eine Besonderheit ist. Es geht vielmehr darum, dass Ihre Stimme etwas ist, was man nicht rückgängig machen kann: das Gespräch mit Ihrem Anwalt, das noch nicht veröffentlichte Produkt, die Patientenakten. Ein Tool, das damit umgehen soll, benötigt keine Netzwerkverbindung, um seine Aufgabe zu erfüllen. Es sollte auch in einem Flugzeug funktionieren – und darf keine Daten durchsickern lassen. Das ist die ganze Idee – und es handelt sich dabei um eine Designentscheidung, nicht um eine Funktion.

Beitrag lesen →

Erhalten Sie Updates in Ihrem Posteingang.

Eine E-Mail pro Veröffentlichung, mit dem oben stehenden Changelog. Kein Spam, keine Tipps, kein wöchentlicher Newsletter. Abmelden in einem Klick, jederzeit.

Konto erstellen

Hören Sie es, wenn es erscheint

Neue Versionen, echte Benchmarks und gelegentlich ein Deep-Dive. Kein Spam, Abmeldung mit einem Klick.

Alles, was wir bauen

Extern: YouTube · GitHub