Estás hablando. Las palabras se van apareciendo: en tu editor, en tu terminal, en un cuadro de chat, en un formulario, dondequiera que esté el Cursor. Y cada una de ellas permanece en la máquina desde donde las dijiste.
Brethof Voice Pro es una herramienta de conversión de voz a texto y traducción que funciona íntegramente en su propio ordenador. Eso no es una característica de privacidad; es el producto en sí.
Un programa, el trabajo de cuatro personas. Transcribe tu voz, la traduce a 38 idiomas, agrega subtítulos a tus videos y escribe por ti dondequiera que haga falta un teclado. Funciona sin conexión: en un avión, en un hotel con mala señal Wi-Fi, incluso dentro de un túnel; además, funciona en la computadora portátil que ya posees, con o sin tarjeta gráfica. Sin suscripción. Sin cobro por minuto. Sin necesidad de subir archivos. Dale también oídos a tu agente de inteligencia artificial: puede transcribir, traducir y grabar reuniones de cualquier duración a través de MCP, en tu propia máquina, sin necesidad de clave API. Cómpralo una vez y seguirá funcionando.
Su voz nunca sale de su computadora. Esa frase es precisa, y ese es el punto clave. Tres cosas llegan a la red al iniciar el proceso: una verificación de licencia, una verificación de actualizaciones y las descargas de modelos que usted mismo inicia. La verificación de licencia envía una clave de licencia; la verificación de actualizaciones, una cadena de versión. Nunca hay audio ni texto. Si desactiva la verificación de actualizaciones, una vez que los modelos estén en el disco, nada más se enviará.
Transcripción en más de 30 idiomas, y 22 dialectos regionales chinos que se entienden por sí solos: sin configuración, sin entrenamiento. Además, su acento ya no se pronunciará incorrectamente. Brethof Voice Pro aprende su voz, su jerga y sus nombres propios en su propia máquina. Hable en el dialecto de Sichuan de su abuela y se pronunciará correctamente.
Habla polaco, lee en inglés. Habla inglés, lee en japonés. O dilo una vez y que se escriba al mismo tiempo en inglés, japonés, francés y español: uno por línea o uno al lado del otro en la misma línea. Elige tantos idiomas de destino como desees; hay 38, y 23 funcionan en ambas direcciones. La traducción también se realiza en tu propia máquina, con Hunyuan MT2 de Tencent. En cuanto a calidad, alcanza el 97,9% de Gemini 3.1 Pro de Google en la prueba FLORES-200, y lo supera en traducciones del mundo real y de lenguas minoritarias. Hay dos versiones, ambas descargas opcionales: una rápida para el uso diario y otra de alta calidad para las palabras importantes. También hay subtítulos, en texto plano o en formato SRT, sincronizados por oración o palabra por palabra cuando necesitas editar con precisión. Traduce un archivo de subtítulos y toda la sincronización se mantendrá. Añade subtítulos a tu propio video en 38 idiomas sin pagar por minuto.
Por eso funciona donde nada más lo hará. Un avión. Un hotel con mala conexión a Wi-Fi. Un tren que atraviesa un túnel. No hay dónde ir con la grabación, así que no necesita ir a ningún lado. Deja allí una grabación de una reunión de dos horas y ve a preparar café; la transcripción estará lista cuando regreses. Olvídate de que dejaste la grabación en marcha y nada se perderá: termina el trabajo por sí sola y guarda la transcripción.
Dos modelos de transcripción; se trata de una elección, no de un nivel diferente: puede cambiarlos en cualquier momento.
La mayoría de los programas de voz te obligan a leer frases de ejemplo durante la configuración. Este no lo hace. Aprende de las correcciones que ya realizas: si corriges una palabra mal pronunciada, esa corrección se convierte en un ejemplo de entrenamiento. Una vez que indiques tus nombres de marca, tu jerga y los nombres de tus colegas, dejarán de aparecer incorrectamente, tanto en la transcripción como en la traducción, ya que la misma lista se utiliza para ambos casos. Un nombre nunca se localiza por casualidad. El entrenamiento se realiza con un solo clic; funciona en tu hardware, y el nuevo modelo está listo para ser utilizado una vez que termine el proceso.
Cómpralo una vez y será suyo. Una licencia perpetua con un año de actualizaciones incluidas.
Una habitación ruidosa deja de ser un problema. La reducción de ruido está integrada, para grabaciones hechas en una cafetería, en un salón de exposiciones o en un coche. Está desactivada por defecto, ya que lo hemos probado: en grabaciones cortas y sin interferencias, empeora la calidad del sonido. Para las reuniones de dos horas con una máquina de espresso detrás de usted, actívela.
El teclado de voz escribe dondequiera que se encuentre el cursor: en un navegador, una IDE, una aplicación de chat, cualquier campo que acepte texto por teclado. Puede escribir la traducción en lugar de la transcripción. Diga la oración en su idioma, y las palabras correctas aparecerán en el formulario, en el idioma que este requiere. Una sola línea, sin cortar ni pegar.
El 0.6B es el modelo para uso diario. Funciona con cualquier tarjeta gráfica de 4 GB, con gráficos integrados y en portátiles que no cuenten con tarjeta gráfica alguna. Rápido, ligero, siempre listo cuando lo necesitas.
La versión de 1.7 mil millones es la más cuidadosa: para audio con acentos, audio ruidoso, y en reuniones de dos horas donde las palabras son importantes. Requiere unos 6 GB de VRAM, o 8 GB si se carga además el modelo de traducción de alta calidad.
¿Sin GPU en absoluto? Aún así funciona. La versión solo con CPU necesita 8 GB de RAM, un procesador de cuatro núcleos y unos 5 GB de espacio libre en el disco; para todo lo demás se requieren entre 7 y 9 GB. Cualquier tarjeta compatible con Vulkan 1.2+ sirve: NVIDIA, AMD e Intel Arc. Además, la transcripción y la traducción utilizan cada una su propio procesador, por lo que una puede ejecutarse en la tarjeta gráfica mientras la otra lo hace en la CPU.
Complementos opcionales que se descargan bajo demanda desde Ajustes → Modelos:
Forced Aligner (~540 MB) para marcas de tiempo a nivel de palabra · Hunyuan MT2 Fast (~1 GB) o Calidad (~4,3 GB) para traducción.
| Característica | Brethof Voice Pro | Dragon | Google STT | Otter.ai | Whisper (OSS) |
|---|---|---|---|---|---|
| Procesamiento 100 % local | ✓ | ✓ | ✗ | ✗ | ✓ |
| Licencia perpetua | ✓ | ~ | ✗ | ✗ | ✓ |
| Soporte nativo para Linux | ✓ | ✗ | ~ | ✗ | ✓ |
| Soporte nativo para Windows | ✓ | ✓ | ~ | ✗ | ~ |
| 30 idiomas de ASR + detección automática | ✓ | ✗ | ✓ | ~ | ✓ |
| Traducción sin conexión (38 idiomas) | ✓ | ✗ | ✗ | ✗ | ✗ |
| Aceleración por GPU (NVIDIA + AMD + Intel) | ✓ | ✗ | N/A | N/A | ~ |
| Ajuste fino personal del modelo (LoRA) | ✓ | ✓ | ✗ | ✗ | ✗ |
| Servidor MCP para agentes de IA | ✓ | ✗ | ✗ | ✗ | ✗ |
| Reducción de ruido integrada | ✓ | ✓ | ✓ | ✓ | ✗ |
| Inyección directa de texto | ✓ | ✓ | ✗ | ✗ | ✗ |
| Interfaz gráfica de escritorio pulida | ✓ | ✓ | ✗ | ✓ | ✗ |
| Costo típico | $49 una vez | 350 $/año | 17 $/mes | 17 $/mes | Gratis |
Sin tarifas mensuales. Sin límites de uso. Licencia perpetua con 1 año de actualizaciones incluidas.
No se requiere tarjeta de crédito. Solo se necesita un correo electrónico para verificar su prueba.
Licencia perpetua. 2 dispositivos personales. 1 año de actualizaciones incluido.
Los precios no incluyen impuestos. Luego, 20 dólares/año por actualizaciones (opcional).
Licencia perpetua (por asiento). Uso para equipos y organizaciones. 1 año de actualizaciones.
Precios excl. impuestos. Luego $20/asiento/año por actualizaciones (opcional)
No. Brethof Voice Pro procesa todo localmente en su dispositivo. Ningún dato de audio o texto sale jamás de su computadora. No hay componente en la nube, ni telemetría, ni análisis.
Cualquier GPU moderna funciona. NVIDIA, AMD e Intel Arc usan aceleración Vulkan. También puede ejecutarse solo con CPU, aunque la transcripción será más lenta. El modelo de 0.6B funciona cómodamente en gráficos integrados o en cualquier tarjeta Vulkan de 4 GB o más.
Empiece con el modelo de 0.6B — Es la opción predeterminada recomendada y funciona muy bien en la mayoría de las GPUs (e incluso en la CPU de la mayoría de las computadoras modernas). Si necesita mayor precisión con audio con acentos o ruidoso, cámbielo a modelo de 1.7B (necesita 6 GB+ de VRAM). Puede cambiar de tamaño en cualquier momento desde Ajustes → Modelos sin volver a descargar.
Sí. Brethof Voice Pro es compatible de forma nativa con Linux y Windows. En Linux funciona con X11 y Wayland. En Windows se ejecuta como una aplicación de escritorio estándar.
Su licencia es perpetua: la aplicación seguirá funcionando para siempre con la versión que tenga. El pase de actualización opcional de 20 $/año le da acceso a nuevas funciones y mejoras de los modelos. Sin él, simplemente se queda en su versión actual.
Sí: el entrenamiento personal de voz está incluido en la v2.0.0 y se ejecuta de principio a fin en su equipo. Cada vez que corrige una palabra mal reconocida, el par {clip, corrección} se guarda automáticamente en su conjunto de datos de entrenamiento local. La tarjeta de entrenamiento de la ventana principal muestra de un vistazo el total de muestras y minutos capturados: haga clic en «Iniciar entrenamiento» en la pestaña Entrenamiento para ajustar un LoRA según su acento. El resultado se exporta automáticamente a GGUF y puede cambiar a él con un clic. Gratis para cada licencia de pago; sus datos de voz nunca salen de su equipo.
Prueba gratuita de 14 días. Sin tarjeta de crédito. Sin nube. Sin concesiones.
Sistema local de voz a texto que aprende tu voz. Licencia perpetua. Nuestro producto estrella.
PAID · modelo estrella
Memoria a largo plazo para tus agentes de IA: texto completo + vectores + grafos. Se proporciona información al inicio de la sesión, se recupera en cada solicitud y se archiva automáticamente.
Pagado · plan gratuito
Modelos digitales listos para imprimir. GLB y OBJ incluidos. Acceso de por vida.
PAID · catálogo digital
Cinco impresoras y capacidad real. Aún no hay tienda de autoservicio: díganos qué necesita y le haremos una cotización por correo electrónico.
Por acuerdo previo · escríbanos por correo electrónico
Nuestro canal de YouTube. Un presentador en forma de tigre cibernético explica las herramientas de IA locales y qué hacen realmente.
CANAL · en vivo
Listas seleccionadas en GitHub para agentes de programación por IA, servidores MCP, IA local y Linux para IA. Cada entrada incluye un enlace de origen.
GRATIS · curado
Guías detalladas para utilizar inteligencia artificial local en Linux, Windows y macOS, que incluyen los archivos de configuración.
GRATIS · en vivo
Curación negativa: prácticas y herramientas que desperdician tu tiempo, clasificadas. Se requieren comprobantes.
GRATIS · en vivo
Quiénes somos, por qué desarrollamos inteligencia artificial centrada en la privacidad, y qué no haremos.