Hoy Brethof Voice Pro v1.0 está disponible para descargar en Windows 10/11 y Linux (Ubuntu, Fedora, Arch). Es una aplicación de escritorio que captura audio de tu micrófono, ejecuta un modelo de ASR basado en Qwen localmente en su CPU o GPU, y escribe el texto transcrito en la ventana en la que esté enfocado.
Qué incluye la v1.0
- 30 idiomas de transcripción más 38 idiomas de traducción — Árabe, cantonés, chino, checo, danés, holandés, inglés, filipino, finlandés, francés, alemán, griego, hindi, croata, húngaro, indonesio, italiano, japonés, coreano, macedonio, malayo, persa, polaco, portugués, rumano, ruso, serbio, eslovaco, esloveno, español, sueco, tailandés, turco, ucraniano, vietnamita, búlgaro.
- Dictado con tecla de acceso rápido global — Presione su tecla de acceso rápido en cualquier lugar, hable, suelte el botón y el texto se escribirá en la aplicación seleccionada.
- 100 % sin conexión — Sin nube, sin telemetría, no se requiere cuenta para transcribir.
- Tres niveles de modelo — base (rápido, 0,6B parámetros), medio (1,7B), grande (3B). Elija según su hardware.
- Reducción de ruido a través de DeepFilterNet y detección de actividad de voz a través de Silero VAD, ambos ejecutándose localmente.
- Palabras clave — inyecte nombres, acrónimos y términos de dominio como pistas en tiempo de inferencia (no se necesita reentrenamiento).
Una cosa no en la v1.0: fine-tuning del modelo. Las compilaciones anteriores lo tenían vía PyTorch, pero cuando pasamos la inferencia a GGUF rompimos el pipeline de entrenamiento y no lo enviaremos hasta que el paso de conversión sea sólido. Consulte el publicación sobre la hoja de ruta del fine-tuning.
Precios
Compra única, sin suscripción:
- Personal — 2 máquinas, adecuado para uso comercial individual y freelance. Ver precios.
- Business — uso por equipos/organizaciones con descuentos por volumen a partir de 10 asientos. Ver precios.
- Prueba gratuita de 14 días — Sin tarjeta de crédito, todas las funciones desbloqueadas.
Los precios se ajustan automáticamente por región: si está en Europa del Este, el Sudeste Asiático, América Latina o África, verá precios basados en la paridad del poder adquisitivo.
Lo que hicimos bien
Lo que más nos alegra es tiempo hasta la primera palabra. Abra la aplicación, pulse su tecla de acceso rápido y hable. Sin registro. Sin navegador. Sin subida de archivos. Sin esperar a una ida y vuelta a la nube. En un portátil de gama media, Voice Pro transcribe una oración de cinco segundos en menos de 400 ms con el modelo base. Esa velocidad era el objetivo principal.
¿Qué viene después?
- Compilación de macOS — en curso, objetivo T3 2026.
- Ajuste fino de su voz y vocabulario — disponible una vez que el pipeline de conversión de PyTorch a GGUF esté listo. Objetivo: T3 2026.
- Modo de transmisión en tiempo real — Las palabras aparecen mientras habla, no después de soltar la tecla de acceso rápido.
- Más niveles de modelo — un modelo ultraligero para dispositivos de borde de gama baja, y un modelo de 7B para equipos potentes.
Si has estado esperando una herramienta de dictado que respete la privacidad, hoy es el día. Descarga la prueba, dicta durante 14 días, dinos dónde falla. Leemos cada correo.