I dag er Brethof Voice Pro v1.0 tilgængelig til download på Windows 10/11 og Linux (Ubuntu, Fedora, Arch). Det er en desktop-applikation, der optager lyd fra din mikrofon og kører en Qwen-baseret ASR-model lokalt på din CPU eller GPU og skriver den transskriberede tekst ind i det vindue, du har fokus på.
Hvad der leveres i v1.0
- 30 transkriptionssprog plus 38 oversættelsessprog — Arabisk, kantonesisk, kinesisk, tjekkisk, dansk, nederlandsk, engelsk, filippinsk, finsk, fransk, tysk, græsk, hindi, kroatisk, ungarsk, indonesisk, italiensk, japansk, koreansk, makedonsk, malajisk, persisk, polsk, portugisisk, rumænsk, russisk, serbisk, slovakisk, slovensk, spansk, svensk, thailandsk, tyrkisk, ukrainsk, vietnamesisk, bulgarsk.
- Global hotkey-diktation — tryk på din genvejstast et vilkårligt sted, tal, slip, og teksten skrives ind i den aktive app.
- 100% offline — Ingen cloud, ingen telemetri, ingen konto kræves for at transkribere.
- Tre modellag — base (hurtig, 0,6B parametre), medium (1,7B), large (3B). Vælg baseret på din hardware.
- Støjreduktion via DeepFilterNet og stemmeaktivitetsdetektion via Silero VAD, begge kører lokalt.
- Hotwords — indsprøjt navne, akronymer og fagtermer som hints ved inferenstid (ingen omtræning nødvendig).
Én ting ikke i v1.0: model-fine-tuning. Tidligere builds havde det via PyTorch, men da vi flyttede inferens til GGUF, ødelagde vi træningspipelinen, og vi sender det ikke, før konverteringstrinnet er solidt. Se indlæg om fine-tuning-roadmap.
Priser
Engangskøb, intet abonnement:
- Personal — 2 maskiner, dækker solo- og freelance-kommerciel brug. Se priser.
- Business — brug i teams/organisationer med volumenrabatter fra 10 pladser. Se priser.
- 14 dages gratis prøveperiode — Intet kreditkort, alle funktioner er låst op.
Priserne justeres automatisk efter region: Hvis du befinder dig i Østeuropa, Sydøstasien, Latinamerika eller Afrika, vil du se priser baseret på købekraftsparitet.
Hvad vi gjorde rigtigt
Det, vi er mest glade for, er tid til første ord. Åbn appen, tryk på din genvej, tal. Ingen tilmelding. Ingen browser. Ingen upload. Ingen ventetid på en cloud-rundtur. På en mellemklasse-laptop transskriberer Voice Pro en femsekunders sætning på under 400 ms med basismodellen. Den hastighed var hele pointen.
Hvad er det næste
- macOS-build — undervejs, mål Q3 2026.
- Finjustering på din stemme og dit ordforråd — kommer, når konverteringspipelinen fra PyTorch til GGUF er klar. Mål: Q3 2026.
- Real-time streaming-tilstand — ordene vises, mens du taler, ikke efter du har sluppet genvejen.
- Flere modelniveauer — En ultralille edge-device-model til lavpris-hardware og en 7B-model til de seriøse maskiner.
Hvis du har ventet på et dikteringsværktøj, der respekterer privatlivet, er i dag dagen. Download prøveversionen, dikter i 14 dage, og fortæl os, hvor det svigter. Vi læser hver e-mail.