Du talar. Orden landar – i din redigerare, din terminal, en chattruta, ett formulär, var som helst där cursorn befinner sig. Och var och en av dem stannar kvar på maskinen där du sa dem.
Brethof Voice Pro är en röst-till-text- och översättningstjänst som kör helt på din egen dator. Det är inte en sekretessfunktion – det är hela produkten.
Ett program, arbete för fyra. Det transkriver din röst, översätter den till 38 språk, lägger undertitlar till dina videor och skriver för dig där som helst en tangentbord skulle användas. Det fungerar offline – på ett plan, i ett hotell med dåligt wifi, genom en tunnel – och på den laptop du redan har, med eller utan grafikkort. Inga prenumerationer. Inga avgifter per minut. Inga uppladdningar. Ge din AI-agent också öron: den kan transkribera, översätta och spela in möten av vilken längd som helst via MCP, på din dator, utan API-nyckel. Köp den en gång, och den fortsätter att fungera.
Din röst lämnar aldrig din dator. Den meningen är exakt, och det är just den tonen. Tre saker når nätverket vid lanseringen – och endast tre: en licenskontroll, en uppdateringskontroll samt de modeller du själv laddar ner. Licenskontrollen skickar en licensnyckel, uppdateringskontrollen en versionssträng – inget ljud, inget text, aldrig. Stäng av uppdateringskontrollen, och när modellerna har lagts på disk går ingenting ut alls.
Transkribering på över 30 språk, samt 22 kinesiska regionaldialekter som förstårs direkt – inget inställning, inget träningsarbete. Och din accent kommer inte längre att bli felaktig. Brethof Voice Pro lär sig din röst, din jargong och dina egennamn direkt på din egen dator. Tala i din mormors syczuanska och det kommer att komma ut korrekt.
Tal polska, läs engelska. Tal engelska, läs japanska. Eller säg det en gång och låt det skrivas ut på engelska, japanska, franska och spanska samtidigt – ett per rad, eller sida vid sida i samma rad. Välj så många mål språk du vill; det finns 38, och 23 fungerar i båda riktningarna. Översättningen sker också på din dator, i Tencents Hunyuan MT2. Vid den aktuella kvalitetsnivån uppnår det 97,9% av Googles Gemini 3.1 Pro på FLORES-200-benchmarken, och överträffar det vid översättningar i verkliga sammanhang samt för minoritetsspråk. Två storlekar, båda valfria nedladdningar: en snabb för vardaglig användning, en av hög kvalitet för de viktiga orden. Undertitlar också. Vanlig text eller SRT, tidsstämplad per mening, eller ord för ord när du behöver justera exakt. Översätt en undertitelfil och all tidsstämpning förblir kvar. Lägg till undertitlar på ditt eget video i 38 språk utan att betala per minut.
Det är därför det fungerar där inget annat gör det. En flygplan. En hotel med dåligt wifi. En tåg genom en tunnel. Det finns ingen plats för din inspelning att gå till, så den behöver inte gå någonstans. Lägg ner en tvåtimmar lång mötesinspelning och gå och göra kaffe; transkriptet finns där när du kommer tillbaka. Glöm att du lämnade den på inspelning – ingenting går förlorat. Den slutar arbetet på egen hand och behåller transkriptet.
Två transkriptionsmodeller, och det är en valmöjlighet, inte en nivå – du kan byta när som helst.
De flesta röstprogram kräver att man läser fram exempelmeningar vid inställning. Detta gör inte det. Det lär sig av de korrigeringar man redan gör: När man rätter en felhörd ord blir just den korrigeringen träningsexempel. Annotera dina varumärkesnamn, din jargong, dina kollegors namn en gång – och de kommer inte längre att stämmas fel, varken i transkriptet eller i översättningen, eftersom samma lista styrs av båda. Ett namn lokaliseras aldrig av slump. Träning sker med en enda klick, det körs på din hårdvara, och det nya modellen är redo att användas när det är klart.
Köp det en gång och det tillhör dig. Ett permanent licensbillett med ett år uppdateringar inkluderat.
En bullrig rumstil är inte längre ett problem. Ljudreducering är inbyggd för inspelningar gjorda i en kafé, på en utställningsplats eller i en bil. Den är avstängd som standard, eftersom vi har mätit den – på korta, rena mikrofoninspelningar gör den saker värre. För det tvåtimmar långa mötet med espressomaskinen bakom dig, aktivera den.
Röstklaviaturen skriver var som helst där din cursor befinner sig – i en webbläsare, en IDE, en chattapp, vilket fält som helst som tar emot inmatning via klaviatur. Och den kan skriva översättningen istället för transkriptionen. Säg meningen på ditt språk, och rätt orden hamnar i formuläret, på det språk formuläret kräver. En rad, inget klippande eller klistring.
0,6 B är den vanliga versionen. Den fungerar med vilken 4 GB-grafikkort som helst, med integrerad grafik samt i bärbara datorer utan grafikkort alls. Snabb, lätt – där när du behöver den.
1,7 miljarder är den noggranna varianten – för ljud med accent, bullrigt ljud, samt tvåtimmar långa möten där orden är viktiga. Den kräver cirka 6 GB VRAM, eller 8 GB om det högkvalitativa översättningsmodellen laddas samtidigt.
Ingen GPU alls? Det fungerar fortfarande. En CPU-enda system kräver 8 GB RAM, en fyra-kärnig processor och cirka 5 GB ledig plats på disken; allt annat kräver 7–9 GB. Vilken Vulkan 1.2+-kort som helst fungerar – NVIDIA, AMD, Intel Arc. Och både transkribering och översättning använder sin egen processor, så den ena kan köras på grafikkortet medan den andra körs på CPU:n.
Valfria tillägg laddas ner på begäran från Inställningar → Modeller:
Forced Aligner (~540 MB) för tidsstämplar på ordnivå · Hunyuan MT2 Fast (~1 GB) eller Kvalitet (~4,3 GB) för översättning.
| Funktion | Brethof Voice Pro | Dragon | Google STT | Otter.ai | Whisper (OSS) |
|---|---|---|---|---|---|
| 100 % lokal bearbetning | ✓ | ✓ | ✗ | ✗ | ✓ |
| Permanent licens | ✓ | ~ | ✗ | ✗ | ✓ |
| Inbyggt stöd för Linux | ✓ | ✗ | ~ | ✗ | ✓ |
| Inbyggt stöd för Windows | ✓ | ✓ | ~ | ✗ | ~ |
| 30 ASR-språk + automatisk detektering | ✓ | ✗ | ✓ | ~ | ✓ |
| Offline-översättning (38 språk) | ✓ | ✗ | ✗ | ✗ | ✗ |
| GPU-acceleration (NVIDIA + AMD + Intel) | ✓ | ✗ | N/A | N/A | ~ |
| Finjustering av personlig modell (LoRA) | ✓ | ✓ | ✗ | ✗ | ✗ |
| MCP-server för AI-agenter | ✓ | ✗ | ✗ | ✗ | ✗ |
| Inbyggd brusreducering | ✓ | ✓ | ✓ | ✓ | ✗ |
| Direkt textinjektion | ✓ | ✓ | ✗ | ✗ | ✗ |
| Polerat skrivbordsgränssnitt | ✓ | ✓ | ✗ | ✓ | ✗ |
| Typisk kostnad | $49 en en gång | $350+/år | $17/månad | $17/månad | Rajat |
Inga månadsavgifter. Inga användningsgränser. Livstidslicens med 1 års uppdateringar ingående.
Inget kreditkort krävs. Endast en e-post för att verifiera din provperiod.
Permanent licens. 2 personliga enheter. 1 års uppdateringar ingår.
Priser exkl. skatt. Därefter 20 dollar/år för uppdateringar (valfritt)
Permanenta licenser per användare. Används av team och organisationer. 1 års uppdateringar.
Priser exklusive skatt. Därefter 20 US-dollar per användare per år för uppdateringar (valfritt).
Nej. Brethof Voice Pro bearbetar allt lokalt på din enhet. Ingen ljud- eller textdata lämnar någonsin din dator. Det finns ingen molnkomponent, ingen telemetri och ingen analys.
En modern GPU fungerar. NVIDIA, AMD och Intel Arc använder alla Vulkan-acceleration. Du kan också köra endast på CPU, men transkriberingen kommer att vara långsammare. 0,6B-modellen fungerar smidigt med integrerad grafik eller vilket Vulkan-kort med minst 4 GB minne som helst.
Starta med 0,6B-modell — Det är den rekommenderade standardinställningen och fungerar utmärkt på de flesta GPU:er (och till och med på CPU i de flesta moderna datorer). Om du behöver högre noggrannhet för ljud med accent eller brus, byt till 1,7B-modellen (kräver 6 GB+ VRAM). Du kan växla storlek när som helst från Inställningar → Modeller utan att behöva ladda ner om.
Ja. Brethof Voice Pro stöder både Linux och Windows inbyggt. På Linux fungerar det med X11 och Wayland. På Windows körs det som en vanlig skrivbordsapplikation.
Din licens är evig – appen fortsätter att fungera för alltid med vilken version du än har. Det valfria Update Pass för 20 $/år ger dig tillgång till nya funktioner och modellförbättringar. Utan den stannar du helt enkelt på din nuvarande version.
Ja – personlig röstträning ingår i v2.0.0 och körs end-to-end på din dator. Varje gång du korrigerar ett felaktigt igenkänt ord sparas {clip, correction}-paren automatiskt i ditt lokala träningsdataset. Träningskortet i huvudfönstret visar totalt antal prover och minuter som har spelats in på en gång – klicka på "Start training" i fliken Training för att finjustera en LoRA anpassad till din accent. Resultatet exporteras automatiskt till GGUF och du kan växla till det med ett enda klick. Det är gratis med varje betald licens, och dina röstdata lämnar aldrig din dator.
14 dagars gratis provperiod. Inget kreditkort. Inget moln. Inga kompromisser.
Lokal tal-till-text som lär sig din röst. Evig licens. Vårt flaggskepp.
Betald · flaggskepp
Långsiktig minne för dina AI-agenter – fulltext + vektor + graf. Informeras vid sessionsstart, hämtas upp vid varje fråga, arkiveras automatiskt.
Betald · gratis nivå
Utskriftsklara digitala modeller. GLB och OBJ ingår. Livstidsåtkomst.
Betald · digital katalog
Fem skrivare med verklig kapacitet. Ingen självbetjningsbutik än – berätta vad du behöver och vi ger en prissiffror per e-post.
Enligt överenskommelse · mejla oss
Vår YouTube-kanal. En cybertiger-värd visar upp lokala AI-verktyg och vad de faktiskt gör.
KANAL · live
Utvalda GitHub-listor för AI-kodningsagenter, MCP-server, lokala AI-lösningar samt Linux för AI. Varje post innehåller en länk till källan.
GRATIS · kuraterad
Utdödlade guideer för lokalt AI på Linux, Windows och macOS, med inkluderade konfigurationsfiler.
GRATIS · direktsänd
Negativ kuration: metoder och verktyg som slösar din tid, rankade. Kvitto krävs.
GRATIS · direktsänd
Vem vi är, varför vi bygger AI som prioriterar integritet, och vad vi inte kommer att göra.