Aujourd’hui, Brethof Voice Pro v1.0 est disponible au téléchargement sur Windows 10/11 et Linux (Ubuntu, Fedora, Arch). C’est une application de bureau qui capture l’audio de votre microphone, exécute un modèle ASR basé sur Qwen localement Sur votre CPU ou GPU, et saisit le texte transcrit dans la fenêtre sur laquelle vous êtes concentré.
Ce qui est livré dans la v1.0
- 30 langues de transcription et 38 langues de traduction — Arabe, cantonais, chinois, tchèque, danois, néerlandais, anglais, philippin, finnois, français, allemand, grec, hindi, croate, hongrois, indonésien, italien, japonais, coréen, macédonien, malais, persan, polonais, portugais, roumain, russe, serbe, slovaque, slovène, espagnol, suédois, thaï, turc, ukrainien, vietnamien, bulgare.
- Dictée par raccourci global — Appuyez sur votre raccourci n'importe où, parlez, relâchez, et le texte est saisi dans l'application active.
- 100 % hors ligne — Pas de cloud, pas de télémétrie, aucun compte requis pour la transcription.
- Trois niveaux de modèles — base (rapide, 0,6 milliard de paramètres), medium (1,7 milliard), large (3 milliards). Choisissez en fonction de votre matériel.
- Réduction du bruit via DeepFilterNet et détection d'activité vocale via Silero VAD, tous deux exécutés localement.
- Mots-clés — injecter des noms, acronymes et termes de domaine en tant qu’indices au moment de l’inférence (pas de réentraînement nécessaire).
Une chose non dans la v1.0 : fine-tuning du modèle. Les builds antérieurs l’avaient via PyTorch, mais lorsque nous avons déplacé l’inférence vers GGUF, nous avons cassé le pipeline d’entraînement et nous ne le livrons pas tant que l’étape de conversion n’est pas solide. Voir la publication sur la feuille de route de fine-tuning.
Tarifs
Achat unique, sans abonnement :
- Personal — 2 machines, couvre l'usage commercial en solo et en freelance. Voir les prix.
- Business — utilisation par équipe/organisation avec remises sur volume à partir de 10 places. Voir les prix.
- Essai gratuit de 14 jours — Pas de carte de crédit, toutes les fonctionnalités débloquées.
Les prix s'ajustent automatiquement selon la région : si vous êtes en Europe de l'Est, en Asie du Sud-Est, en Amérique latine ou en Afrique, vous verrez des prix basés sur la parité de pouvoir d'achat.
Ce que nous avons bien fait
Ce qui nous rend le plus heureux, c’est temps jusqu'au premier mot. Ouvrez l'application, appuyez sur votre raccourci, parlez. Pas d'inscription. Pas de navigateur. Pas de téléchargement. Pas d'attente pour un aller-retour cloud. Sur un ordinateur portable milieu de gamme, Voice Pro transcrit une phrase de cinq secondes en moins de 400 ms avec le modèle de base. Cette vitesse était tout l'intérêt.
Et ensuite
- Build macOS — en cours, objectif T3 2026.
- Affinage sur votre voix et votre vocabulaire — disponible une fois que la pipeline de conversion PyTorch vers GGUF sera prête. Objectif T3 2026.
- Mode de diffusion en temps réel — Les mots apparaissent au fur et à mesure que vous parlez, et non après avoir relâché la touche de raccourci.
- Plus de niveaux de modèles — Un modèle pour appareil périphérique ultra-léger pour le matériel entrée de gamme, et un modèle de 7 milliards de paramètres pour les machines sérieuses.
Si vous attendiez un outil de dictée respectueux de la vie privée, le moment est venu. Téléchargez l’essai, dictez pendant 14 jours, et dites-nous où il échoue. Nous lisons chaque e-mail.