Idag är Brethof Voice Pro v1.0 tillgänglig för nedladdning på Windows 10/11 och Linux (Ubuntu, Fedora, Arch). Det är en skrivbordsapplikation som fångar ljud från din mikrofon och kör en Qwen-baserad ASR-modell lokalt på din CPU eller GPU, och skriver in den transkriberade texten i det fönster du har fokus på.
Vad som ingår i v1.0
- 30 transkriptionsspråk plus 38 översättningsspråk — arabiska, kantonesiska, kinesiska, tjeckiska, danska, nederländska, engelska, filippinska, finska, franska, tyska, grekiska, hindi, kroatiska, ungerska, indonesiska, italienska, japanska, koreanska, makedonska, malajiska, persiska, polska, portugisiska, rumänska, ryska, serbiska, slovakiska, slovenska, spanska, svenska, thailändska, turkiska, ukrainska, vietnamesiska, bulgariska.
- Global diktering med snabbtangent — tryck på din snabbtangent var som helst, tala, släpp – och texten skrivs in i den aktiva appen.
- 100 % offline — Inget moln, ingen telemetri, inget konto krävs för transkribering.
- Tre modellnivåer — bas (snabb, 0,6B parametrar), medel (1,7B), stor (3B). Välj baserat på din hårdvara.
- Bullerreducering via DeepFilterNet och voice activity detection via Silero VAD, båda körs lokalt.
- Nyckelord — injicera namn, akronymer och domäntermer som ledtrådar vid inferenstid (ingen omträning krävs).
En sak inte i v1.0: modellfinjustering. Tidigare byggen hade detta via PyTorch, men när vi flyttade inferensen till GGUF bröt vi träningspipelinen och vi levererar inte detta förrän konverteringssteget är stabilt. Se inlägget om färdplanen för finjustering.
Priser
Engångsköp, ingen prenumeration:
- Personal — 2 maskiner, täcker solo- och frilanskommersiellt bruk. Se priser.
- Business — team-/organisationsanvändning med volymrabatter från 10 platser. Se priser.
- Gratis 14-dagars testperiod — Inget kreditkort krävs, alla funktioner är upplåsta.
Priserna justeras automatiskt efter region: om du befinner dig i Östeuropa, Sydostasien, Latinamerika eller Afrika kommer du att se priser baserade på köpkraftsparitet.
Vad vi gjorde rätt
Det vi är mest nöjda med är tid till första ordet. Öppna appen, tryck på din snabbtangent, tala. Ingen registrering. Ingen webbläsare. Ingen uppladdning. Inget väntande på en rundtur till molnet. På en medelklasslaptop transkriberar Voice Pro en mening på fem sekunder på under 400 ms med basmodellen. Den hastigheten var hela poängen.
Vad som kommer härnäst
- macOS-bygge — pågående, mål Q3 2026.
- Finjustering av din röst och ditt ordförråd — kommer när konverteringspipelinen från PyTorch till GGUF är klar. Mål: Q3 2026.
- Realtidsströmningsläge — ord dyker upp medan du pratar, inte efter att du har släppt genvägen.
- Fler modellnivåer — en ultraliten modell för kantenheter för lågpresterande hårdvara, samt en 7B-modell för de kraftfulla maskinerna.
Om du har väntat på ett dikteringsverktyg som respekterar integriteten, så är idag den dagen. Ladda ner provversionen, diktera i 14 dagar och berätta för oss var det brister. Vi läser varje e-postmeddelande.