Oggi Brethof Voice Pro v1.0 è disponibile per il download su Windows 10/11 e Linux (Ubuntu, Fedora, Arch). È un'applicazione desktop che cattura l'audio dal tuo microfono, esegue un modello ASR basato su Qwen localmente sulla tua CPU o GPU, e digita il testo trascritto nella finestra su cui sei focalizzato.
Cosa include la v1.0
- 30 lingue di trascrizione più 38 lingue di traduzione — Arabo, cantonese, cinese, ceco, danese, olandese, inglese, filippino, finlandese, francese, tedesco, greco, hindi, croato, ungherese, indonesiano, italiano, giapponese, coreano, macedone, malese, persiano, polacco, portoghese, rumeno, russo, serbo, slovacco, sloveno, spagnolo, svedese, thailandese, turco, ucraino, vietnamita, bulgaro.
- Dettatura tramite tasto di scelta rapida globale — premi il tuo tasto di scelta rapida ovunque, parla, rilascia, e il testo viene digitato nell'app focalizzata.
- 100% offline — Nessun cloud, nessuna telemetria, nessun account richiesto per la trascrizione.
- Tre livelli di modello — base (veloce, 0,6B parametri), medium (1,7B), large (3B). Scegli in base al tuo hardware.
- Riduzione del rumore tramite DeepFilterNet e rilevamento dell’attività vocale tramite Silero VAD, entrambi in esecuzione locale.
- Parole chiave per il vocabolario. — iniettare nomi, acronimi e termini di dominio come hint in fase di inferenza (nessun riaddestramento necessario).
Una cosa no in v1.0: fine-tuning del modello. Le build precedenti lo avevano tramite PyTorch, ma quando abbiamo spostato l'inferenza su GGUF abbiamo interrotto la pipeline di addestramento e non lo rilasceremo finché il passaggio di conversione non sarà solido. Vedi post sulla roadmap del fine-tuning.
Prezzi
Acquisto unico, nessun abbonamento:
- Personal — 2 macchine, copre l'uso commerciale individuale e freelance. Vedi i prezzi.
- Business — Utilizzo da parte di team/organizzazioni con sconti per volumi a partire da 10 posti. Vedi i prezzi.
- Prova gratuita di 14 giorni — Nessuna carta di credito, tutte le funzionalità sbloccate.
I prezzi si adattano automaticamente in base alla regione: se ti trovi nell’Europa orientale, nel Sud-est asiatico, in America Latina o in Africa, vedrai i prezzi basati sulla parità di potere d’acquisto.
Cosa abbiamo fatto correttamente
La cosa di cui siamo più felici è tempo alla prima parola. Apri l’app, premi la tua combinazione di tasti, parla. Nessuna registrazione. Nessun browser. Nessun caricamento. Nessuna attesa per un round-trip cloud. Su un laptop di fascia media, Voice Pro trascrive una frase di cinque secondi in meno di 400 ms con il modello base. Questa velocità era l’obiettivo principale.
Prossimi passi
- Build di macOS — in corso, obiettivo Q3 2026.
- Fine-tuning sulla tua voce e sul tuo vocabolario — disponibile non appena il pipeline di conversione da PyTorch a GGUF sarà pronto. Obiettivo Q3 2026.
- Modalità streaming in tempo reale — le parole appaiono mentre parli, non dopo aver rilasciato il tasto di scelta rapida.
- Più livelli di modello — un modello edge-device ultra-piccolo per hardware di fascia bassa, e un modello da 7B per le macchine più potenti.
Se hai aspettato uno strumento di dettatura che rispetti la privacy, oggi è il giorno giusto. Scarica la versione di prova, detta per 14 giorni e dicci dove presenta problemi. Leggiamo ogni email.