Stai parlando. Le parole vengono visualizzate nel tuo editor, nella tua terminale, in una finestra di chat, in un modulo, ovunque si trovi il Cursor. E ognuna di esse rimane sulla macchina su cui sono state pronunciate.
Brethof Voice Pro è un strumento di conversione voce in testo e traduzione che funziona interamente sul proprio computer. Non si tratta di una funzione per la protezione della privacy: è l’intero prodotto.
Un unico programma, frutto del lavoro di quattro persone. Trascrive la tua voce, la traduce in 38 lingue, aggiunge sottotitoli ai tuoi video e digita al posto tuo ovunque serva una tastiera. Funziona offline: su un aereo, in un hotel con rete Wi-Fi scarsa, attraverso un tunnel, e sul laptop che già possiedi, con o senza scheda grafica. Nessuna sottoscrizione. Nessun costo per minuto. Nessuna necessità di caricare file. Dà anche alle tue intelligenze artificiali la capacità di ascoltare: possono trascrivere, tradurre e registrare riunioni di qualsiasi durata tramite MCP, sul tuo dispositivo, senza alcuna chiave API. Acquistalo una volta e continuerà a funzionare.
La tua voce non esce mai dal computer. Quella frase è precisa, ed è proprio così che funziona. Al momento del lancio, solo tre elementi vengono inviati alla rete: una verifica della licenza, una verifica delle aggiornamenti e i modelli che si scaricano manualmente. La verifica della licenza invia una chiave di licenza, quella delle aggiornamenti una stringa di versione; nessun audio, nessun testo, mai. Disattivando la verifica delle aggiornamenti, una volta che i modelli sono sul disco, nulla viene più inviato.
Trascrizione in oltre 30 lingue, con comprensione automatica di 22 dialetti regionali cinesi: nessuna configurazione, nessun addestramento necessario. Inoltre, il tuo accento non verrà più distorto. Brethof Voice Pro impara la tua voce, il tuo gergo e i tuoi nomi propri direttamente sul tuo dispositivo. Parla in dialetto Sichuan di tua nonna e il risultato sarà corretto.
Parla polacco, leggi inglese. Parla inglese, leggi giapponese. Oppure dicilo una volta e farlo digitare in inglese, giapponese, francese e spagnolo contemporaneamente: uno per riga o uno accanto all’altro nella stessa riga. Scegli quante lingue di destinazione vuoi; ce ne sono 38, e 23 funzionano in entrambe le direzioni. La traduzione avviene anche sul tuo dispositivo, grazie a Hunyuan MT2 di Tencent. Con questa qualità raggiunge il 97,9% di quella di Gemini 3.1 Pro di Google sul benchmark FLORES-200, superandolo nelle traduzioni nel mondo reale e per lingue minoritarie. Ci sono due versioni, entrambe scaricabili opzionalmente: una veloce per l’uso quotidiano, una di qualità per le parole importanti. Anche i sottotitoli: testo semplice o SRT, sincronizzati per frase o parola per parola quando è necessario un editing preciso. Traduci un file di sottotitoli e tutti i tempi di sincronizzazione rimarranno intatti. Aggiungi sottotitoli al tuo video in 38 lingue senza pagare per minuto.
Ecco perché funziona lì dove nient’altro funzionerebbe. Un aereo, un hotel con una connessione Wi-Fi scarsa, un treno che attraversa un tunnel: non c’è alcun posto dove la registrazione possa andare, quindi non ha bisogno di andare da nessuna parte. Lasciate lì la registrazione di una riunione di due ore e andate a preparare il caffè; la trascrizione sarà già pronta al vostro ritorno. Dimenticatevi che avete lasciato in funzione la registrazione e niente andrà perduto: il programma svolge il lavoro da solo e conserva la trascrizione.
Due modelli di trascrizione: si tratta di una scelta, non di un livello diverso; è possibile passare da uno all’altro in qualsiasi momento.
La maggior parte dei software per la sintesi vocale richiede di leggere frasi di esempio durante la configurazione. Questo no: impara dalle correzioni che si effettuano già; se si corregge una parola malintesa, quella correzione diventa un esempio di addestramento. Una volta inseriti i nomi del proprio marchio, il gergo utilizzato e i nomi dei colleghi, tali elementi non verranno più pronunciati correttamente, né nella trascrizione né nella traduzione, poiché è lo stesso elenco a guidare entrambi i processi. Un nome non viene mai localizzato per caso. L’addestramento avviene con un solo clic, avviene sul proprio hardware, e il nuovo modello è pronto per essere utilizzato non appena l’addestramento è completato.
Acquistatelo una volta e sarà vostro. Una licenza perpetua con un anno di aggiornamenti inclusi.
Una stanza rumorosa smette di essere un problema. La riduzione del rumore è integrata, per le registrazioni effettuate in un caffè, in una fiera o in auto. È disattivata per impostazione predefinita, perché l’abbiamo testata: su brevi clip audio registrate con il microfono, peggiora la qualità del suono. Per le riunioni di due ore con la macchina per l’espresso alle spalle, attivala.
La tastiera vocale digita ovunque si trovi il Cursor: in un browser, in un IDE, in un’app di chat, in qualsiasi campo che accetti l’input da tastiera. Può anche digitare la traduzione invece della trascrizione. Dite la frase nella vostra lingua e le parole corrette verranno inserite nel modulo, nella lingua richiesta dal modulo. Una sola riga, senza tagli o incollaggi.
Il 0,6B è quello da utilizzo quotidiano. Funziona con qualsiasi scheda grafica da 4 GB, con le schede grafiche integrate e anche sui laptop che non dispongono affatto di scheda grafica. Veloce, leggero, sempre pronto quando ne hai bisogno.
Il modello da 1,7 miliardi di parametri è quello più adatto: per audio con accenti, audio rumorosi, o per riunioni di due ore in cui le parole hanno grande importanza. Richiede circa 6 GB di VRAM, oppure 8 GB se viene caricato anche il modello di traduzione ad alta qualità.
Nessuna GPU? Funziona comunque. Una configurazione basata esclusivamente sul CPU richiede 8 GB di RAM, un processore a quattro core e circa 5 GB di spazio libero sul disco; per il resto servono 7–9 GB. Qualsiasi scheda compatibile con Vulkan 1.2+ andrà bene: NVIDIA, AMD, Intel Arc. Inoltre, la trascrizione e la traduzione utilizzano ciascuna il proprio processore, quindi una può essere eseguita sulla scheda grafica mentre l’altra sul CPU.
Download opzionale di componenti aggiuntivi su richiesta da Impostazioni → Modelli:
Forced Aligner (~540 MB) per i timestamp a livello di parola · Hunyuan MT2 Fast (~1 GB) o Qualità (~4,3 GB) per la traduzione.
| Funzionalità | Brethof Voice Pro | Dragon | Google STT | Otter.ai | Whisper (OSS) |
|---|---|---|---|---|---|
| Elaborazione 100% locale | ✓ | ✓ | ✗ | ✗ | ✓ |
| Licenza perpetua | ✓ | ~ | ✗ | ✗ | ✓ |
| Supporto nativo per Linux | ✓ | ✗ | ~ | ✗ | ✓ |
| Supporto nativo per Windows | ✓ | ✓ | ~ | ✗ | ~ |
| 30 lingue ASR + rilevamento automatico | ✓ | ✗ | ✓ | ~ | ✓ |
| Traduzione offline (38 lingue) | ✓ | ✗ | ✗ | ✗ | ✗ |
| Accelerazione GPU (NVIDIA + AMD + Intel) | ✓ | ✗ | N/A | N/A | ~ |
| Addestramento personalizzato del modello (LoRA) | ✓ | ✓ | ✗ | ✗ | ✗ |
| Server MCP per agenti AI | ✓ | ✗ | ✗ | ✗ | ✗ |
| Riduzione del rumore integrata | ✓ | ✓ | ✓ | ✓ | ✗ |
| Iniezione diretta di testo | ✓ | ✓ | ✗ | ✗ | ✗ |
| Interfaccia desktop rifinita | ✓ | ✓ | ✗ | ✓ | ✗ |
| Costo tipico | $49 una volta | 350$/anno | 17$/mese | 17$/mese | Gratuito |
Nessun canone mensile. Nessun limite di utilizzo. Licenza perpetua con 1 anno di aggiornamenti inclusi.
Nessuna carta di credito richiesta. Basta un'email per verificare la prova.
Licenza perpetua. 2 dispositivi personali. 1 anno di aggiornamenti inclusi.
Prezzi IVA esclusa. Poi 20$/anno per gli aggiornamenti (facoltativo)
Licenza perpetua per utente. Utilizzo per team e organizzazioni. 1 anno di aggiornamenti.
I prezzi non includono tasse. Successivamente, 20 $/utente/anno per gli aggiornamenti (opzionali)
No. Brethof Voice Pro elabora tutto localmente sul tuo dispositivo. Nessun dato audio o testuale lascia mai il tuo computer. Non c'è alcun componente cloud, né telemetria, né analisi.
Qualsiasi GPU moderna funziona. NVIDIA, AMD e Intel Arc utilizzano tutti l'accelerazione Vulkan. È anche possibile eseguire il programma soltanto sulla CPU, sebbene la trascrizione avvenga più lentamente. Il modello da 0,6B funziona senza problemi con le schede grafiche integrate o con qualsiasi scheda Vulkan da almeno 4 GB.
Inizia con il Modello da 0,6B — È il valore predefinito consigliato e funziona alla grande sulla maggior parte delle GPU (e persino sulla CPU sui dispositivi più moderni). Se hai bisogno di una maggiore precisione con audio accentato o rumoroso, passa a Modello da 1,7B (richiede 6 GB+ di VRAM). È possibile cambiare le dimensioni in qualsiasi momento da Impostazioni → Modelli senza doverle scaricare nuovamente.
Sì. Brethof Voice Pro supporta nativamente sia Linux che Windows. Su Linux funziona con X11 e Wayland. Su Windows funziona come applicazione desktop standard.
La tua licenza è perpetua: l'app continua a funzionare per sempre con la versione che hai. L'Update Pass facoltativo da 20$/anno ti dà accesso a nuove funzionalità e miglioramenti dei modelli. Senza di esso, resti semplicemente sulla versione attuale.
Sì — la formazione vocale personalizzata è inclusa in v2.0.0 e viene eseguita interamente sul tuo dispositivo. Ogni volta che correggi una parola riconosciuta erroneamente, la coppia {clip, correzione} viene salvata automaticamente nel tuo dataset di addestramento locale. La scheda relativa all'addestramento nella finestra principale mostra in un colpo d'occhio il numero totale di campioni e i minuti registrati; fai clic su "Inizia addestramento" nella scheda Addestramento per ottimizzare un modello LoRA in base al tuo accento. Il risultato viene esportato automaticamente in formato GGUF, che puoi utilizzare con un semplice clic. Gratuito con ogni licenza a pagamento, i tuoi dati vocali non lasciano mai il tuo dispositivo.
Prova gratuita di 14 giorni. Nessuna carta di credito. Nessun cloud. Nessun compromesso.
Trascrizione vocale locale che impara la tua voce. Licenza perpetua. Il nostro prodotto di punta.
A pagamento · modello di punta
Memoria a lungo termine per i tuoi agenti AI: testo integrale + vettori + grafi. Informazioni fornite all’inizio della sessione, richiamate ad ogni richiesta, archiviate automaticamente.
A pagamento · piano gratuito
Modelli digitali pronti per la stampa. GLB e OBJ inclusi. Accesso a vita.
A pagamento · catalogo digitale
Cinque stampanti e capacità reale. Non c’è ancora un negozio self-service: dirci di cosa ha bisogno e le faremo un preventivo per email.
Su richiesta · inviateci un’e-mail
Il nostro canale YouTube. Un presentatore “tigre cibernetica” illustra gli strumenti di intelligenza artificiale disponibili e ciò che fanno effettivamente.
CANALE · in diretta
Elenchi curati su GitHub per agenti di programmazione AI, server MCP, AI locale e Linux per l’AI. Ogni voce include un link di origine.
GRATIS · curato
Guide dettagliate per l’utilizzo di intelligenza artificiale locale su Linux, Windows e macOS, con i file di configurazione inclusi.
GRATIS · in diretta
Curatela negativa: pratiche e strumenti che sprecano il tuo tempo, classificati. Ricevute richieste.
GRATIS · in diretta
Chi siamo, perché creiamo intelligenze artificiali che danno priorità alla privacy, e cosa non faremo.