100% Locale — La tua voce non lascia mai il tuo dispositivo

Voce in testo che non se ne va mai il tuo computer

Stai parlando. Le parole vengono visualizzate nel tuo editor, nella tua terminale, in una finestra di chat, in un modulo, ovunque si trovi il Cursor. E ognuna di esse rimane sulla macchina su cui sono state pronunciate.

Brethof Voice Pro è un strumento di conversione voce in testo e traduzione che funziona interamente sul proprio computer. Non si tratta di una funzione per la protezione della privacy: è l’intero prodotto.

100% locale — Mai su cloud
30 ASR + 38 Traduzione lingue
Accelerato da GPU — NVIDIA, AMD, Intel
Linux e Windows
Funziona offline

Tutto ciò di cui hai bisogno, niente di superfluo

Un unico programma, frutto del lavoro di quattro persone. Trascrive la tua voce, la traduce in 38 lingue, aggiunge sottotitoli ai tuoi video e digita al posto tuo ovunque serva una tastiera. Funziona offline: su un aereo, in un hotel con rete Wi-Fi scarsa, attraverso un tunnel, e sul laptop che già possiedi, con o senza scheda grafica. Nessuna sottoscrizione. Nessun costo per minuto. Nessuna necessità di caricare file. Dà anche alle tue intelligenze artificiali la capacità di ascoltare: possono trascrivere, tradurre e registrare riunioni di qualsiasi durata tramite MCP, sul tuo dispositivo, senza alcuna chiave API. Acquistalo una volta e continuerà a funzionare.

Tre cose entrano in contatto con la rete, e nient’altro.

La tua voce non esce mai dal computer. Quella frase è precisa, ed è proprio così che funziona. Al momento del lancio, solo tre elementi vengono inviati alla rete: una verifica della licenza, una verifica delle aggiornamenti e i modelli che si scaricano manualmente. La verifica della licenza invia una chiave di licenza, quella delle aggiornamenti una stringa di versione; nessun audio, nessun testo, mai. Disattivando la verifica delle aggiornamenti, una volta che i modelli sono sul disco, nulla viene più inviato.

30 lingue, 22 dialetti: il tuo accento non sarà più un problema

Trascrizione in oltre 30 lingue, con comprensione automatica di 22 dialetti regionali cinesi: nessuna configurazione, nessun addestramento necessario. Inoltre, il tuo accento non verrà più distorto. Brethof Voice Pro impara la tua voce, il tuo gergo e i tuoi nomi propri direttamente sul tuo dispositivo. Parla in dialetto Sichuan di tua nonna e il risultato sarà corretto.

Parla una volta, leggilo in 38 lingue

Parla polacco, leggi inglese. Parla inglese, leggi giapponese. Oppure dicilo una volta e farlo digitare in inglese, giapponese, francese e spagnolo contemporaneamente: uno per riga o uno accanto all’altro nella stessa riga. Scegli quante lingue di destinazione vuoi; ce ne sono 38, e 23 funzionano in entrambe le direzioni. La traduzione avviene anche sul tuo dispositivo, grazie a Hunyuan MT2 di Tencent. Con questa qualità raggiunge il 97,9% di quella di Gemini 3.1 Pro di Google sul benchmark FLORES-200, superandolo nelle traduzioni nel mondo reale e per lingue minoritarie. Ci sono due versioni, entrambe scaricabili opzionalmente: una veloce per l’uso quotidiano, una di qualità per le parole importanti. Anche i sottotitoli: testo semplice o SRT, sincronizzati per frase o parola per parola quando è necessario un editing preciso. Traduci un file di sottotitoli e tutti i tempi di sincronizzazione rimarranno intatti. Aggiungi sottotitoli al tuo video in 38 lingue senza pagare per minuto.

Completamente offline

Ecco perché funziona lì dove nient’altro funzionerebbe. Un aereo, un hotel con una connessione Wi-Fi scarsa, un treno che attraversa un tunnel: non c’è alcun posto dove la registrazione possa andare, quindi non ha bisogno di andare da nessuna parte. Lasciate lì la registrazione di una riunione di due ore e andate a preparare il caffè; la trascrizione sarà già pronta al vostro ritorno. Dimenticatevi che avete lasciato in funzione la registrazione e niente andrà perduto: il programma svolge il lavoro da solo e conserva la trascrizione.

Due dimensioni del modello

Due modelli di trascrizione: si tratta di una scelta, non di un livello diverso; è possibile passare da uno all’altro in qualsiasi momento.

Impara dalle correzioni che hai già apportato.

La maggior parte dei software per la sintesi vocale richiede di leggere frasi di esempio durante la configurazione. Questo no: impara dalle correzioni che si effettuano già; se si corregge una parola malintesa, quella correzione diventa un esempio di addestramento. Una volta inseriti i nomi del proprio marchio, il gergo utilizzato e i nomi dei colleghi, tali elementi non verranno più pronunciati correttamente, né nella trascrizione né nella traduzione, poiché è lo stesso elenco a guidare entrambi i processi. Un nome non viene mai localizzato per caso. L’addestramento avviene con un solo clic, avviene sul proprio hardware, e il nuovo modello è pronto per essere utilizzato non appena l’addestramento è completato.

Paghi una volta, possiedi per sempre

Acquistatelo una volta e sarà vostro. Una licenza perpetua con un anno di aggiornamenti inclusi.

Riduzione del rumore, solo quando è necessario

Una stanza rumorosa smette di essere un problema. La riduzione del rumore è integrata, per le registrazioni effettuate in un caffè, in una fiera o in auto. È disattivata per impostazione predefinita, perché l’abbiamo testata: su brevi clip audio registrate con il microfono, peggiora la qualità del suono. Per le riunioni di due ore con la macchina per l’espresso alle spalle, attivala.

La tastiera su cui stai già digitando

La tastiera vocale digita ovunque si trovi il Cursor: in un browser, in un IDE, in un’app di chat, in qualsiasi campo che accetti l’input da tastiera. Può anche digitare la traduzione invece della trascrizione. Dite la frase nella vostra lingua e le parole corrette verranno inserite nel modulo, nella lingua richiesta dal modulo. Una sola riga, senza tagli o incollaggi.

Due dimensioni, a tua scelta

Il 0,6B è quello da utilizzo quotidiano. Funziona con qualsiasi scheda grafica da 4 GB, con le schede grafiche integrate e anche sui laptop che non dispongono affatto di scheda grafica. Veloce, leggero, sempre pronto quando ne hai bisogno.

1,7 miliardi

Grande · Vulkan / CPU
~2–3 GB

Nessuna GPU? Funziona comunque. Una configurazione basata esclusivamente sul CPU richiede 8 GB di RAM, un processore a quattro core e circa 5 GB di spazio libero sul disco; per il resto servono 7–9 GB. Qualsiasi scheda compatibile con Vulkan 1.2+ andrà bene: NVIDIA, AMD, Intel Arc. Inoltre, la trascrizione e la traduzione utilizzano ciascuna il proprio processore, quindi una può essere eseguita sulla scheda grafica mentre l’altra sul CPU.

Download opzionale di componenti aggiuntivi su richiesta da Impostazioni → Modelli:

Forced Aligner (~540 MB) per i timestamp a livello di parola · Hunyuan MT2 Fast (~1 GB) o Qualità (~4,3 GB) per la traduzione.

Come effettuiamo il confronto

Funzionalità Brethof Voice Pro Dragon Google STT Otter.ai Whisper (OSS)
Elaborazione 100% locale
Licenza perpetua ~
Supporto nativo per Linux ~
Supporto nativo per Windows ~ ~
30 lingue ASR + rilevamento automatico ~
Traduzione offline (38 lingue)
Accelerazione GPU (NVIDIA + AMD + Intel) N/A N/A ~
Addestramento personalizzato del modello (LoRA)
Server MCP per agenti AI
Riduzione del rumore integrata
Iniezione diretta di testo
Interfaccia desktop rifinita
Costo tipico $49 una volta 350$/anno 17$/mese 17$/mese Gratuito

Paga una volta. Possiedi per sempre.

Nessun canone mensile. Nessun limite di utilizzo. Licenza perpetua con 1 anno di aggiornamenti inclusi.

Prova gratuita
$ 0

Nessuna carta di credito richiesta. Basta un'email per verificare la prova.

  • Entrambe le dimensioni del modello (0,6B + 1,7B)
  • Accelerazione GPU
  • 30 sistemi ASR + 38 lingue di traduzione
  • Riduzione del rumore
  • × Nessun addestramento personale (solo piani a pagamento)
  • × Nessun server MCP (solo piani a pagamento)
  • × Limite di 14 giorni
Inizia la prova gratuita
Business
$ 249 /utente

Licenza perpetua per utente. Utilizzo per team e organizzazioni. 1 anno di aggiornamenti.

  • Licenza perpetua (per utente)
  • Uso per team e organizzazioni
  • Entrambe le dimensioni dell'ASR (0,6B + 1,7B)
  • Traduzione offline (38 lingue)
  • Addestramento vocale personale (LoRA)
  • Server MCP per agenti AI
  • Supporto prioritario
  • Sconti per grandi quantità (10+ utenti)
Acquista la licenza Business

I prezzi non includono tasse. Successivamente, 20 $/utente/anno per gli aggiornamenti (opzionali)

Domande frequenti

No. Brethof Voice Pro elabora tutto localmente sul tuo dispositivo. Nessun dato audio o testuale lascia mai il tuo computer. Non c'è alcun componente cloud, né telemetria, né analisi.

Qualsiasi GPU moderna funziona. NVIDIA, AMD e Intel Arc utilizzano tutti l'accelerazione Vulkan. È anche possibile eseguire il programma soltanto sulla CPU, sebbene la trascrizione avvenga più lentamente. Il modello da 0,6B funziona senza problemi con le schede grafiche integrate o con qualsiasi scheda Vulkan da almeno 4 GB.

Inizia con il Modello da 0,6B — È il valore predefinito consigliato e funziona alla grande sulla maggior parte delle GPU (e persino sulla CPU sui dispositivi più moderni). Se hai bisogno di una maggiore precisione con audio accentato o rumoroso, passa a Modello da 1,7B (richiede 6 GB+ di VRAM). È possibile cambiare le dimensioni in qualsiasi momento da Impostazioni → Modelli senza doverle scaricare nuovamente.

Sì. Brethof Voice Pro supporta nativamente sia Linux che Windows. Su Linux funziona con X11 e Wayland. Su Windows funziona come applicazione desktop standard.

La tua licenza è perpetua: l'app continua a funzionare per sempre con la versione che hai. L'Update Pass facoltativo da 20$/anno ti dà accesso a nuove funzionalità e miglioramenti dei modelli. Senza di esso, resti semplicemente sulla versione attuale.

Sì — la formazione vocale personalizzata è inclusa in v2.0.0 e viene eseguita interamente sul tuo dispositivo. Ogni volta che correggi una parola riconosciuta erroneamente, la coppia {clip, correzione} viene salvata automaticamente nel tuo dataset di addestramento locale. La scheda relativa all'addestramento nella finestra principale mostra in un colpo d'occhio il numero totale di campioni e i minuti registrati; fai clic su "Inizia addestramento" nella scheda Addestramento per ottimizzare un modello LoRA in base al tuo accento. Il risultato viene esportato automaticamente in formato GGUF, che puoi utilizzare con un semplice clic. Gratuito con ogni licenza a pagamento, i tuoi dati vocali non lasciano mai il tuo dispositivo.

Pronto a provarlo?

Prova gratuita di 14 giorni. Nessuna carta di credito. Nessun cloud. Nessun compromesso.

Ascoltatelo quando sarà disponibile.

Nuove versioni, benchmark reali e occasionali approfondimenti. Niente spam, disiscrizione con un clic.

Tutto ciò che creiamo

Esterno: YouTube · GitHub