Vous parlez. Les mots apparaissent — dans votre éditeur, votre terminal, une boîte de chat, un formulaire, là où se trouve le curseur. Et chacun d’eux reste sur la machine où vous les avez prononcés.
Brethof Voice Pro est un outil de reconnaissance vocale et de traduction qui fonctionne entièrement sur votre propre ordinateur. Ce n’est pas une fonction de protection de la vie privée ; c’est l’essence même du produit.
Un programme, le travail de quatre personnes. Il transcrit votre voix, la traduit dans 38 langues, ajoute des sous-titres à vos vidéos et tape à votre place là où un clavier serait nécessaire. Il fonctionne hors ligne — dans un avion, dans un hôtel avec un mauvais réseau Wi-Fi, à travers un tunnel — et sur l’ordinateur portable que vous possédez déjà, avec ou sans carte graphique. Aucune abonnement. Aucun comptage par minute. Aucune transmission de données. Donnez également à votre agent IA des capacités auditives : il peut transcrire, traduire et enregistrer une réunion de n’importe quelle durée via MCP, sur votre appareil, sans clé API. Achetez-le une fois, et il continuera de fonctionner.
Votre voix ne quitte jamais votre ordinateur. Cette phrase est précise, et c’est là l’essentiel. Trois éléments seulement sont envoyés sur le réseau au moment du démarrage : une vérification de licence, une vérification des mises à jour, et les modèles que vous téléchargez vous-même. La vérification de licence envoie une clé de licence, la vérification des mises à jour envoie une chaîne de version — jamais d’audio, jamais de texte. Désactivez la vérification des mises à jour, et une fois que les modèles sont sur le disque, rien n’est envoyé du tout.
Transcription dans plus de 30 langues, ainsi que compréhension de 22 dialectes régionaux chinois sans aucune configuration ni formation nécessaire. Votre accent ne sera plus mal interprété. Brethof Voice Pro apprend votre voix, votre jargon et vos noms propres directement sur votre appareil. Parlez en dialecte du Sichuan de votre grand-mère, et la transcription sera correcte.
Parlez polonais, lisez en anglais. Parlez en anglais, lisez en japonais. Ou dites-le une fois et faites-le taper en anglais, japonais, français et espagnol en même temps — un par ligne, ou côte à côte dans la même ligne. Choisissez autant de langues cibles que vous le souhaitez ; il y en a 38, et 23 fonctionnent dans les deux sens. La traduction s’effectue également sur votre appareil, grâce à Hunyuan MT2 de Tencent. Avec ce niveau de qualité, elle atteint 97,9 % de celui de Gemini 3.1 Pro de Google sur le benchmark FLORES-200, et le dépasse pour la traduction dans des contextes réels et en langues minoritaires. Deux versions, toutes deux téléchargeables sur demande : une rapide pour l’usage quotidien, une de haute qualité pour les mots importants. Il existe aussi des sous-titres. En texte brut ou au format SRT, synchronisés par phrase, ou mot par mot lorsque vous avez besoin d’une précision maximale. Traduisez un fichier de sous-titres et tous les calages seront conservés. Ajoutez des sous-titres à votre propre vidéo en 38 langues sans payer par minute.
C’est pourquoi cela fonctionne là où rien d’autre ne le fera. Un avion. Un hôtel avec un mauvais Wi-Fi. Un train à l’intérieur d’un tunnel. Il n’y a nulle part où votre enregistrement puisse aller, donc il n’a pas besoin d’aller nulle part. Enregistrez une réunion de deux heures et allez préparer du café ; la transcription sera prête à votre retour. Oubliez que vous l’avez laissé enregistrer, rien ne sera perdu — il termine le travail tout seul et conserve la transcription.
Deux modèles de transcription, et c’est un choix, pas un niveau — vous pouvez les changer à tout moment.
La plupart des logiciels de voix vous demandent de lire des phrases d’exemple lors de la configuration. Celui-ci ne le fait pas. Il apprend à partir des corrections que vous effectuez : vous corrigez un mot mal entendu, et cette correction devient un exemple d’entraînement. Une fois que vous avez enregistré les noms de vos marques, votre jargon ainsi que les noms de vos collègues, ils ne seront plus prononcés incorrectement – ni dans la transcription ni dans la traduction, car la même liste guide les deux processus. Un nom n’est jamais localisé par hasard. L’entraînement ne nécessite qu’un clic, il s’exécute sur votre matériel, et le nouveau modèle est prêt à être activé une fois l’opération terminée.
Achetez-le une fois et il vous appartiendra. Une licence perpétuelle incluant un an de mises à jour.
Une pièce bruyante cesse d’être un problème. La réduction du bruit est intégrée, que ce soit pour des enregistrements faits dans un café, sur un stand de foire ou dans une voiture. Elle est désactivée par défaut, car nous l’avons testée : sur de courtes séquences audio prises avec un micro, elle aggrave la situation. Pour une réunion de deux heures avec une machine à espresso derrière vous, activez-la.
Le clavier vocal tape partout où se trouve votre curseur — dans un navigateur, un IDE, une application de messagerie, n’importe quel champ acceptant un clavier. Il peut également taper la traduction au lieu de la transcription. Dites la phrase dans votre langue, et les mots appropriés apparaîtront dans le formulaire, dans la langue requise par ce dernier. Une seule ligne, sans couper ni coller.
Le 0,6 B est le modèle courant. Il fonctionne avec n’importe quelle carte graphique de 4 Go, avec des graphiques intégrés, ainsi que sur des ordinateurs portables ne disposant pas du tout de carte graphique. Rapide, léger, prêt quand vous en avez besoin.
Le modèle de 1,7 milliard d’unités est le plus prudent : il convient pour l’audio accentué, l’audio bruyant, ainsi que pour les réunions de deux heures où le sens des mots est crucial. Il nécessite environ 6 Go de VRAM, ou 8 Go si le modèle de traduction de haute qualité est également chargé.
Pas de GPU du tout ? Ça fonctionne quand même. Une configuration uniquement basée sur le CPU nécessite 8 Go de RAM, un processeur à quatre cœurs et environ 5 Go d’espace disque libre ; pour le reste, il faut 7–9 Go. Toute carte compatible Vulkan 1.2+ convient — NVIDIA, AMD, Intel Arc. La transcription et la traduction utilisent chacune leur propre processeur, ce qui permet à l’une de s’exécuter sur la carte graphique tandis que l’autre s’exécute sur le CPU.
Téléchargement optionnel d’extensions sur demande depuis Paramètres → Modèles :
Forced Aligner (~540 Mo) pour les horodatages au niveau des mots · Hunyuan MT2 Fast (~1 Go) ou Qualité (~4,3 Go) pour la traduction.
| Fonctionnalité | Brethof Voice Pro | Dragon | Google STT | Otter.ai | Whisper (OSS) |
|---|---|---|---|---|---|
| Traitement 100 % local | ✓ | ✓ | ✗ | ✗ | ✓ |
| Licence perpétuelle | ✓ | ~ | ✗ | ✗ | ✓ |
| Support natif pour Linux | ✓ | ✗ | ~ | ✗ | ✓ |
| Support natif pour Windows | ✓ | ✓ | ~ | ✗ | ~ |
| 30 langues ASR + détection automatique | ✓ | ✗ | ✓ | ~ | ✓ |
| Traduction hors ligne (38 langues) | ✓ | ✗ | ✗ | ✗ | ✗ |
| Accélération GPU (NVIDIA + AMD + Intel) | ✓ | ✗ | N/A | N/A | ~ |
| Ajustement fin du modèle personnel (LoRA) | ✓ | ✓ | ✗ | ✗ | ✗ |
| Serveur MCP pour agents IA | ✓ | ✗ | ✗ | ✗ | ✗ |
| Réduction du bruit intégrée | ✓ | ✓ | ✓ | ✓ | ✗ |
| Injection directe de texte | ✓ | ✓ | ✗ | ✗ | ✗ |
| Interface graphique de bureau soignée | ✓ | ✓ | ✗ | ✓ | ✗ |
| Coût typique | $49 une fois | 350 $+/an | 17 $/mois | 17 $/mois | Gratuit |
Aucun frais mensuel. Aucune limite d’utilisation. Licence perpétuelle incluant 1 an de mises à jour.
Aucune carte de crédit n’est requise. Il suffit d’un e-mail pour valider votre essai.
Licence perpétuelle. 2 appareils personnels. Mises à jour pendant 1 an incluses.
Prix hors taxes. Ensuite, 20 $ par an pour les mises à jour (facultatif).
Licence perpétuelle par siège. Utilisation en équipe et au sein d’une organisation. 1 an de mises à jour.
Prix hors taxes. Ensuite, 20 $/siège/an pour les mises à jour (en option)
Non. Brethof Voice Pro traite tout localement sur votre appareil. Aucune donnée audio ou texte ne quitte jamais votre ordinateur. Il n’y a ni composant cloud, ni télémétrie, ni analyse.
Toute carte graphique moderne convient. NVIDIA, AMD et Intel Arc utilisent toutes l’accélération Vulkan. Il est également possible de fonctionner uniquement avec le CPU, bien que la transcription soit plus lente. Le modèle 0,6B fonctionne parfaitement avec des graphiques intégrés ou toute carte Vulkan de 4 Go ou plus.
Commencez par le Modèle 0,6B — C’est la valeur par défaut recommandée et elle fonctionne très bien sur la plupart des GPU (et même sur le CPU de la plupart des ordinateurs modernes). Si vous avez besoin d’une plus grande précision pour des audio avec accents ou bruités, passez à Modèle 1,7B (nécessite 6 Go+ de VRAM). Vous pouvez changer de taille à tout moment depuis Paramètres → Modèles sans avoir à les télécharger à nouveau.
Oui. Brethof Voice Pro prend en charge nativement à la fois Linux et Windows. Sur Linux, il fonctionne avec X11 et Wayland. Sur Windows, il s’exécute en tant qu’application de bureau standard.
Votre licence est perpétuelle : l’application continuera de fonctionner indéfiniment, quelle que soit la version que vous possédez. Le forfait de mise à jour optionnel de 20 $/an vous donne accès à de nouvelles fonctionnalités et à des améliorations des modèles. Sans lui, vous restez simplement sur votre version actuelle.
Oui — l’entraînement vocal personnel est inclus dans la version 2.0.0 et s’exécute en intégralité sur votre ordinateur. Chaque fois que vous corrigez un mot mal reconnu, le couple {clip, correction} est automatiquement enregistré dans votre ensemble de données d’entraînement local. La carte d’entraînement de la fenêtre principale affiche d’un coup d’œil le nombre total d’échantillons et les minutes enregistrées — cliquez sur « Commencer l’entraînement » dans l’onglet Entraînement pour affiner un modèle LoRA adapté à votre accent. Le résultat est exporté automatiquement au format GGUF, que vous pouvez utiliser avec un seul clic. Offert gratuitement avec chaque licence payante, vos données vocales ne quittent jamais votre ordinateur.
Essai gratuit de 14 jours. Pas de carte de crédit nécessaire. Pas de service cloud. Aucun compromis.
Reconnaissance vocale locale qui apprend votre voix. Licence perpétuelle. Notre produit phare.
Payant · modèle phare
Mémoire à long terme pour vos agents IA — texte intégral + vecteurs + graphes. Informations fournies au début de la session, rappelées à chaque demande, archivées automatiquement.
Payant · version gratuite
Modèles numériques prêts à l’impression. GLB et OBJ inclus. Accès à vie.
Payant · catalogue numérique
Cinq imprimantes et une capacité réelle. Aucun point de vente sans intervention humaine pour l’instant — dites-nous ce dont vous avez besoin et nous vous enverrons un devis par e-mail.
Sur demande · envoyez-nous un e-mail
Notre canal YouTube. Un présentateur en forme de tigre cybernétique présente les outils d’IA locaux et leur fonctionnement réel.
CANAL · en direct
Listes sélectionnées sur GitHub pour les agents de codage IA, les serveurs MCP, l’IA locale et Linux pour l’IA. Chaque entrée comprend un lien vers la source.
GRATUIT · sélectionné avec soin
Guides détaillés pour l’utilisation d’IA locale sous Linux, Windows et macOS, incluant les fichiers de configuration.
GRATUIT · en direct
Curation négative : pratiques et outils qui vous font perdre du temps, classés. Justificatifs requis.
GRATUIT · en direct
Qui nous sommes, pourquoi nous développons de l’IA axée sur la confidentialité, et ce que nous ne ferons pas.