Brethof Voice Pro — C’è qualcosa di nuovo?

La storia di questa applicazione si sviluppa man mano, con nuove versioni rilasciate una dopo l’altra. Se si è sulla versione più recente, questa è l’elenco di ciò che si possiede già; le note presenti sotto il registro delle modifiche spiegano le decisioni alla base di alcune di esse.

Rilascio 14 agosto 2026

v2.3.1 — i account a due fattori possono effettuare nuovamente l’accesso

Una regressione nella versione precedente aveva causato il blocco degli account dotati di autenticazione a due fattori per l’accesso. La versione v2.3.1 risolve questo problema. Se si tratta del vostro caso: inserite le vostre credenziali e il codice di autenticazione, e sarete dentro. Nient’altro è cambiato.

Rilascio 6 agosto 2026

v2.2.2 — file sottotitoli, circa il doppio della velocità

Ora la traduzione di un file di sottotitoli richiede circa la metà del tempo precedente. I tempi di elaborazione rimangono invariati: ogni data e ora viene posizionata esattamente dove si trovava nell’originale, indipendentemente dal fatto che si richieda la traduzione a livello di frase o di parola. Se si fa il lavoro di sottotitolatore come professione, questa è sicuramente la versione che riduce notevolmente i tempi di attesa.

Anche in v2.2.2:

  • Correzione dell’ingresso del microfono: era particolarmente importante per i microfoni di qualità.. La regolazione del livello audio può portare i momenti più intensi di una registrazione pulita al di sopra della scala massima, causandone la distorsione. Più è buono il microfono, maggiore è lo scarto tra i suoi picchi e il livello medio, e maggiore è la probabilità che si verifichi questa distorsione: un segnale compresso e rumoroso passa inalterato, mentre in una stanza silenziosa e con un microfono a condensatore di qualità si verifica la distorsione. La regolazione del livello, invece, lascia spazio di manovra, permettendo così che consonanti e suoni intensi rimangano intatti.
  • Nuovo translate_batch Strumento MCP — Traduci molte stringhe in una sola chiamata, con un parametro di dimensione del lotto che riduce automaticamente la quantità da tradurre se la VRAM diventa insufficiente.
Scarica v2.2.2 →
Rilascio 11 luglio 2026

v2.2.1 — l’app che possiedi rimane tua

Brethof Voice Pro diventa di tua proprietà non appena lo acquisti, e la versione 2.2.1 assicura che nulla possa mettersi tra te e esso. Il controllo della licenza all’avvio funzionava in passato come una barriera: senza rete, con un server occupato o un firewall che rifiutava l’accesso, era possibile essere esclusi dal software per il quale si era pagato. Ora invece funziona in modo diverso: se il controllo non riesce a raggiungerci, l’applicazione si avvia comunque. Un software di cui si è in possesso non dovrebbe chiedere il permesso per avviarsi. Ora non lo fa più.

  • Pulsante Verifica licenza Nel dialogo di licenza: forza un controllo aggiornato e Continua a lanciare In caso di successo. In precedenza le uniche opzioni erano Acquistare o Abbandonare.
  • Nessun marchio di scadenza di prova per i clienti paganti — I dialoghi ora indicano ciò che è realmente accaduto, invece di mostrare a tutti lo stesso messaggio.
  • Niente più blocchi dell’interfaccia utente — Il download dei modelli avviene sul thread dell’interfaccia, con indicazione della percentuale di avanzamento; inoltre, i controlli della licenza di avvio non bloccano più la finestra in caso di connessione lenta.
  • Nessun dettato perso — Se la trascrizione è ancora in corso al termine della registrazione, il nuovo audio viene messo in coda invece di essere ignorato silenziosamente, e il processo bloccato non può più inserire testo aggiuntivo nella prossima registrazione.
  • Senza connessione è silenzioso. — Nessuna attesa ripetuta della rete quando non c’è connessione.
Scarica →
Rilascio 4 giugno 2026

v2.2.0 — registrare l’intera riunione, non i primi cinque minuti

Le registrazioni lunghe vengono ora eseguite in background. Date un file relativo a una riunione di due ore e andate a preparare il caffè: non c’è limite di durata e non è necessario supervisionarle. Lasciatele in funzione e dimenticatevene: si concluderanno da sole e vi conserveranno la trascrizione. Una chiamata di tre ore non è diversa da una di tre minuti; richiede semplicemente più tempo.

  • Microfono o audio del sistema — Registra la tua stessa voce, o utilizza la funzione di ripresa in loop di ciò che viene riprodotto sul tuo dispositivo: chiamate di lavoro, schede del browser, qualsiasi cosa proveniente dagli altoparlanti. Nuovo list_loopback_sources Strumento per vedere cosa è disponibile.
  • Niente viene gettato via. — Se una registrazione viene abbandonata, il watchdog la trascrive ora in un lavoro recuperabile invece di scartarla.
  • Limiti onesti — La modalità di trascrizione istantanea a breve durata ha ora un limite massimo di 10 minuti; richiedere un periodo di tempo superiore a questo genera un errore chiaro che indica l’uso dello strumento per la trascrizione a lungo termine. Non limita più silenziosamente l’audio e non restituisce una risposta parziale.
  • Correzione della traduzione di Linux — Una dipendenza mancante ha causato il malfunzionamento della traduzione in tutte le build di Linux a partire da v1.7.0. È stata individuata grazie a un nuovo sistema di controllo end-to-end che verifica il binario effettivamente compilato prima che qualsiasi versione venga rilasciata.
Scarica →
Aggiornamento 4 giugno 2026

v2.1.0 — il tuo agente riceve un’ascolto, via HTTP

Un agente sulla stessa macchina può ora utilizzare Brethof Voice Pro — per trascrivere, tradurre, registrare — tramite MCP. Funziona tramite HTTP locale, quindi un agente che può accedere alle risorse solo tramite URL può utilizzarlo senza una chiave API e senza che nulla esca dalla macchina. Un token protegge l’accesso, e il server rifiuta di avviarsi senza di esso. Questa versione richiede una licenza a pagamento.

  • Privato per impostazione predefinita — Ascolta solo sul tuo computer, a meno che tu non lo modifichi intenzionalmente, e questo rappresenta un limite più ampio. rifiuta di partire Senza un token di autenticazione. Quando è impostato un token, ogni richiesta deve presentarlo.
  • Lavoro ininterrotto — I modelli che vengono disattivati quando sono inattivi non possono più essere disattivati a metà di un lavoro lungo. Un timeout che ignora il lavoro in corso finirà per interrompere anche processi legittimi; pertanto, ora il cronometro relativo allo stato di inattività si ferma mentre c’è qualcosa in esecuzione.
Scarica →
Rilascio 21 maggio 2026

v2.0.0 — traduzione che non esce mai di casa

La soluzione migliore. La traduzione avviene interamente sul tuo dispositivo, in 38 lingue. Parla una volta e il testo verrà digitato simultaneamente in inglese, giapponese, francese e spagnolo: uno per riga o uno accanto all’altro nella stessa riga. Il motore utilizzato è Hunyuan MT2 di Tencent, disponibile in due versioni a scelta: una veloce per l’uso quotidiano e una di qualità superiore per situazioni importanti. Nella versione di qualità, secondo le misurazioni pubblicate da Tencent, raggiunge il 97,9% delle prestazioni di Google Gemini 3.1 Pro nel benchmark FLORES-200, superandolo anche nelle traduzioni in contesti reali e in lingue minoritarie. Tutto avviene offline: nessuna informazione viene inviata da nessuna parte.

Novità nella v2.0.0:

  • Trascrivi + traduci — Il popup Trascrivi ha un menu a tendina "Traduci in:". L'ASR trascrive, il MT traduce, ed entrambi vengono visualizzati fianco a fianco. Funziona con file, microfono e audio di sistema (cattura loopback di chiamate di riunione, schede del browser, qualsiasi cosa in riproduzione sui tuoi altoparlanti).
  • Tastiera vocale multilingue — Il nuovo chip di traduzione nella riga principale apre una griglia linguistica a 3 colonne. Scegli una o più lingue di destinazione, la tastiera digita la traduzione. Modalità di layout: uno per riga, inline (EN: … || PL: …), o solo il primo obiettivo.
  • Traduttore di sottotitoli SRT / VTT — conserva i tempi e gli indici dei cue, supporta la modalità bilingue (riga sorgente + traduzione per ogni cue). Esposto tramite MCP per l'automazione degli agenti AI.
  • Multi-GPU per motore — Impostazioni → Modelli dispone di un selettore dispositivo indipendente per ciascun motore. Esegui l'ASR su Vulkan 0 e la traduzione su Vulkan 1, oppure vincola Hunyuan MT2 7B alla CPU sui laptop con poca VRAM.
  • L'addestramento vocale personale è ora completamente disponibile — Fine-tuning LoRA sulla tua voce, end-to-end sulla tua macchina. La scheda di training nella finestra principale mostra il numero totale di campioni e i minuti catturati a colpo d'occhio; "Start training" nella scheda Training seleziona automaticamente NVIDIA CUDA o CPU, poi esporta automaticamente il modello addestrato in GGUF. Gratuito con ogni licenza a pagamento.
  • 4 nuovi strumenti MCPtranslate_text, translate_srt, list_compute_devices, set_compute_device. Il conteggio totale degli strumenti è ora 19.
  • Suddivisione onesta delle lingue — ASR: 30 lingue selezionabili + rilevamento automatico + 22 dialetti cinesi (52 in totale). Traduzione: 38 lingue (33 principali + 5 minoranze delle aree cinesi). 23 funzionano in entrambe le direzioni.

Il file binario di Linux ha una dimensione di 161 MB, mentre l’installer di Windows è di 118 MB. Le licenze esistenti vengono trasferite — semplicemente Scarica v2.0.0 e i modelli di traduzione appariranno in Impostazioni → Modelli.

Scarica v2.0.0 →
Rilascio 20 maggio 2026

v1.6.16 — la tua voce diventa il proprio modello

Brethof Voice Pro ora si addestra sulla tua voce. I dati di addestramento sono le correzioni che effettui già: correggi una parola malintesa una volta, e quella diventa un esempio. Non ti verrà mai chiesto di leggere frasi di esempio. L’addestramento richiede un solo clic, avviene sul tuo hardware e, una volta completato, il nuovo modello è pronto per essere utilizzato.

La prova sblocca tutto tranne l’allenamento personale e la connessione con l’agente; quest’ultima è destinata a coloro che utilizzano l’app ogni giorno.

Ingegneria 15 maggio 2026

v1.6.0 — mettilo in funzione, torna più tardi

Due cose. La trascrizione può ora essere eseguita come lavoro asincrono: carica l’audio, recupera la trascrizione una volta completata, senza dover rimanere ad aspettare.

E per quanto riguarda il sincronismo dei sottotitoli: ora è possibile impostare il tempo parola per parola, invece che frase per frase, nei momenti in cui è necessario effettuare modifiche precise. Se create sottotitoli, sapete già perché questo sia importante.

Ingegneria 15 maggio 2026

v1.5.0 — un singolo ambiente di esecuzione, e ONNX è stato rimosso

Il runtime ONNX non esiste più. Ora l’intero prodotto funziona su llama.cpp e sulla nostra libreria di traduzione: un unico runtime, più piccolo su disco, più veloce da avviare e più semplice da distribuire.

I modelli sono pacchetti GGUF singoli, ed è proprio questo che permette al modello più piccolo di funzionare su qualsiasi scheda grafica da 4 GB. Più in basso nella pagina troverete una spiegazione più dettagliata sul motivo per cui abbiamo preso questa decisione.

Ingegneria 14 maggio 2026

v1.4.0 — la tua prima connessione con l’agente, e uno strumento per selezionare le tue GPU

Due primati. Il server MCP fa il suo debutto qui: il primo modo per dotare un agente di “orecchie”, tutto sulla propria macchina.

E il selezionatore di dispositivi: la trascrizione e la traduzione possono ora scegliere ciascuna il proprio processore, in modo che una possa funzionare sulla scheda grafica mentre l’altra opera sulla CPU. Un laptop con una GPU modesta può eseguire entrambe le attività senza rallentamenti eccessivi.

Roadmap 16 aprile 2026

macOS: in fase di sviluppo, prima su Apple Silicon

macOS è ancora in fase di sviluppo, inizialmente su Apple Silicon. Non c’è una data precisa, e non la comunicheremo finché il prodotto non sarà pronto. Nel frattempo, Linux e Windows sono lo stesso prodotto con le stesse funzionalità: nulla viene trattenuto in uno per favorire la vendita dell’altro. Quando il modello per Mac sarà disponibile, questa pagina lo indicherà.

Leggi l’articolo →
Prodotto 16 aprile 2026

Addestrarlo con la tua voce.

Il tuo accento non è un problema da superare, ma un modello su cui lavorare. Brethof Voice Pro impara dalle correzioni che già effettui: correggi una parola malintesa una volta, e quella correzione diventa un esempio. Nessuna frase di esempio, nessun script di calibrazione, nessuna ora di lettura nel microfono. Le parole definite come prioritarie che hai già impostato – nomi di marchi, gergo, nomi di colleghi – guidano sia la trascrizione che la traduzione, in modo che un nome non venga mai localizzato per errore. L’addestramento richiede un solo clic, avviene sul tuo hardware e il nuovo modello è pronto per essere utilizzato non appena termina. Le correzioni che effettuavi già costituivano sempre materiale didattico; ora servono per addestrare il modello.

Leggi l’articolo →
Annuncio 16 aprile 2026

Brethof Voice Pro è attivo

La prima versione. Parlate invece di digitare, in qualsiasi cosa: il vostro editor, il terminale, una finestra di chat, un modulo, e le parole appariranno dove si trova il Cursor. La trascrizione avviene interamente sul vostro computer, utilizzando Qwen3-ASR di Alibaba insieme a DeepFilterNet3 per eliminare i rumori e Silero VAD per la rilevazione della voce. Tutto avviene localmente. La chiamata con il vostro avvocato, il prodotto ancora non rilasciato, le note dei pazienti: niente di tutto ciò esce dal computer su cui viene eseguito, perché non c’è alcun posto dove possa andare. Funziona su un aereo, su un treno che attraversa un tunnel, in un hotel con una connessione Wi-Fi scarsa. Trenta lingue, 22 dialetti cinesi separatamente. Funziona sul portatile che già possedete: con o senza scheda grafica; se presente, qualsiasi GPU Vulkan 1.2+ di NVIDIA, AMD o Intel Arc. Su Linux è fornito come un singolo file portabile, richiede glibc 2.38 o successiva, mentre su Windows è un normale installer che non necessita di privilegi amministrativi. Una prova di 14 giorni, senza carta di credito: basta un indirizzo email.

Leggi l’articolo →
Licenze 16 aprile 2026

La tua licenza personale copre ora la tua attività commerciale.

La licenza individuale copre ora sia il lavoro autonomo che quello da libero professionista. Se sei un imprenditore individuale, uno studio a conduzione singola o un appaltatore, la licenza che acquisti copre il tuo lavoro. Nessuna contabilità per utente, nessun livello di abbonamento specifico per le aziende. Una sola licenza per due dispositivi, da acquistare una sola volta. È inclusa un’annualità di aggiornamenti; dopo quell’anno gli aggiornamenti diventano opzionali e l’app continuerà a funzionare con la versione che possiedi, indefinitamente. Il software per cui hai pagato rimane di tua proprietà.

Leggi l’articolo →
Prodotto 12 aprile 2026

Trenta lingue e un interfaccia utente che sembra scritta da una persona.

Brethof Voice Pro permette la trascrizione in 30 lingue, riconosce 22 dialetti regionali cinesi e traduce in 38 lingue diverse. Inoltre, l’interfaccia è completamente tradotta in ciascuna di queste 30 lingue: la traduzione è stata effettuata da persone che utilizzano il prodotto, e non tramite traduzione automatica. È possibile impostare l’app sulla propria lingua preferita, e il testo verrà visualizzato come se fosse stato scritto proprio in quella lingua, perché infatti è così.

Leggi l’articolo →
Ingegneria 8 aprile 2026

Perché siamo passati da ONNX a GGUF

Le prime versioni sono state sviluppate utilizzando ONNX Runtime. Funzionava, ma era pesante, difficile da distribuire e rendeva il prodotto più grande del necessario. La versione 1.5.0 ne ha sostituito l’uso con un unico ambiente di esecuzione: llama.cpp per la trascrizione e la nostra libreria per la traduzione; inoltre, i modelli sono diventati file GGUF singoli. I vantaggi sono: download più piccoli, avvio più rapido e un prodotto che occupa meno spazio su un laptop. Ci sono due dimensioni di modelli, una scelta piuttosto che una gerarchia: quello più piccolo per laptop e schede grafiche integrate, quello più grande per audio con accenti o rumori di fondo. È possibile passare da uno all’altro in qualsiasi momento, e non è affatto necessaria una scheda grafica se si preferisce.

Leggi l’articolo →
Principi 4 aprile 2026

Cosa significa esattamente “100% offline”?

Tre elementi raggiungono la rete, e nient’altro. Una verifica della licenza quando l’app viene avviata. Una verifica delle aggiornamenti quando l’app viene avviata. E il download del modello, che si effettua manualmente. La verifica della licenza invia una chiave di licenza; la verifica delle aggiornamenti invia una stringa di versione. Nessuno dei due invia audio, né testo, mai. Una volta che i modelli sono sul disco e la verifica delle aggiornamenti è disattivata, non viene trasmesso assolutamente nulla. Questo non è un claim di marketing: i log del firewall lo dimostreranno. Il motivo per cui tutto deve essere eseguito sulla propria macchina non è legato alle funzionalità offerte dalla cloud, ma al fatto che la voce è qualcosa che non si può ritirare: le chiamate con l’avvocato, i prodotti ancora non rilasciati, le note sui pazienti. Uno strumento incaricato di gestire queste informazioni non dovrebbe aver bisogno di una connessione alla rete per svolgere il proprio lavoro. Dovrebbe funzionare anche su un aereo, e non dovrebbe poter “filtrare” alcuna informazione. Questo è l’obiettivo principale, ed è una decisione di progettazione, non una funzionalità.

Leggi l’articolo →

Ricevi gli aggiornamenti nella tua casella di posta

Un’e-mail per ogni rilascio, con l’elenco delle modifiche sopra indicato. Niente spam, niente consigli, nessuna newsletter settimanale. Iscriversi/iscriversi a meno richieste con un clic, in qualsiasi momento.

Crea account

Ascoltatelo quando sarà disponibile.

Nuove versioni, benchmark reali e occasionali approfondimenti. Niente spam, disiscrizione con un clic.

Tutto ciò che creiamo

Esterno: YouTube · GitHub