100 % local: su voz nunca abandona su equipo

Voz a texto que nunca se va tu computadora

Estás hablando. Las palabras se van apareciendo: en tu editor, en tu terminal, en un cuadro de chat, en un formulario, dondequiera que esté el Cursor. Y cada una de ellas permanece en la máquina desde donde las dijiste.

Brethof Voice Pro es una herramienta de conversión de voz a texto y traducción que funciona íntegramente en su propio ordenador. Eso no es una característica de privacidad; es el producto en sí.

100% local — Nunca en la nube
30 ASR + 38 Traducción idiomas
Aceleración por GPU — NVIDIA, AMD, Intel
Linux y Windows
Funciona sin conexión

Todo lo que necesita, nada que no necesite.

Un programa, el trabajo de cuatro personas. Transcribe tu voz, la traduce a 38 idiomas, agrega subtítulos a tus videos y escribe por ti dondequiera que haga falta un teclado. Funciona sin conexión: en un avión, en un hotel con mala señal Wi-Fi, incluso dentro de un túnel; además, funciona en la computadora portátil que ya posees, con o sin tarjeta gráfica. Sin suscripción. Sin cobro por minuto. Sin necesidad de subir archivos. Dale también oídos a tu agente de inteligencia artificial: puede transcribir, traducir y grabar reuniones de cualquier duración a través de MCP, en tu propia máquina, sin necesidad de clave API. Cómpralo una vez y seguirá funcionando.

Tres cosas entran en contacto con la red, y nada más.

Su voz nunca sale de su computadora. Esa frase es precisa, y ese es el punto clave. Tres cosas llegan a la red al iniciar el proceso: una verificación de licencia, una verificación de actualizaciones y las descargas de modelos que usted mismo inicia. La verificación de licencia envía una clave de licencia; la verificación de actualizaciones, una cadena de versión. Nunca hay audio ni texto. Si desactiva la verificación de actualizaciones, una vez que los modelos estén en el disco, nada más se enviará.

30 idiomas, 22 dialectos, y su acento deja de ser un problema

Transcripción en más de 30 idiomas, y 22 dialectos regionales chinos que se entienden por sí solos: sin configuración, sin entrenamiento. Además, su acento ya no se pronunciará incorrectamente. Brethof Voice Pro aprende su voz, su jerga y sus nombres propios en su propia máquina. Hable en el dialecto de Sichuan de su abuela y se pronunciará correctamente.

Habla una vez, léelo en 38 idiomas

Habla polaco, lee en inglés. Habla inglés, lee en japonés. O dilo una vez y que se escriba al mismo tiempo en inglés, japonés, francés y español: uno por línea o uno al lado del otro en la misma línea. Elige tantos idiomas de destino como desees; hay 38, y 23 funcionan en ambas direcciones. La traducción también se realiza en tu propia máquina, con Hunyuan MT2 de Tencent. En cuanto a calidad, alcanza el 97,9% de Gemini 3.1 Pro de Google en la prueba FLORES-200, y lo supera en traducciones del mundo real y de lenguas minoritarias. Hay dos versiones, ambas descargas opcionales: una rápida para el uso diario y otra de alta calidad para las palabras importantes. También hay subtítulos, en texto plano o en formato SRT, sincronizados por oración o palabra por palabra cuando necesitas editar con precisión. Traduce un archivo de subtítulos y toda la sincronización se mantendrá. Añade subtítulos a tu propio video en 38 idiomas sin pagar por minuto.

Completamente sin conexión

Por eso funciona donde nada más lo hará. Un avión. Un hotel con mala conexión a Wi-Fi. Un tren que atraviesa un túnel. No hay dónde ir con la grabación, así que no necesita ir a ningún lado. Deja allí una grabación de una reunión de dos horas y ve a preparar café; la transcripción estará lista cuando regreses. Olvídate de que dejaste la grabación en marcha y nada se perderá: termina el trabajo por sí sola y guarda la transcripción.

Dos tamaños de modelo

Dos modelos de transcripción; se trata de una elección, no de un nivel diferente: puede cambiarlos en cualquier momento.

Aprende de las correcciones que ya realizas.

La mayoría de los programas de voz te obligan a leer frases de ejemplo durante la configuración. Este no lo hace. Aprende de las correcciones que ya realizas: si corriges una palabra mal pronunciada, esa corrección se convierte en un ejemplo de entrenamiento. Una vez que indiques tus nombres de marca, tu jerga y los nombres de tus colegas, dejarán de aparecer incorrectamente, tanto en la transcripción como en la traducción, ya que la misma lista se utiliza para ambos casos. Un nombre nunca se localiza por casualidad. El entrenamiento se realiza con un solo clic; funciona en tu hardware, y el nuevo modelo está listo para ser utilizado una vez que termine el proceso.

Pague una vez, posea para siempre.

Cómpralo una vez y será suyo. Una licencia perpetua con un año de actualizaciones incluidas.

Reducción de ruido, solo cuando lo necesite.

Una habitación ruidosa deja de ser un problema. La reducción de ruido está integrada, para grabaciones hechas en una cafetería, en un salón de exposiciones o en un coche. Está desactivada por defecto, ya que lo hemos probado: en grabaciones cortas y sin interferencias, empeora la calidad del sonido. Para las reuniones de dos horas con una máquina de espresso detrás de usted, actívela.

El teclado en el que ya estás escribiendo

El teclado de voz escribe dondequiera que se encuentre el cursor: en un navegador, una IDE, una aplicación de chat, cualquier campo que acepte texto por teclado. Puede escribir la traducción en lugar de la transcripción. Diga la oración en su idioma, y las palabras correctas aparecerán en el formulario, en el idioma que este requiere. Una sola línea, sin cortar ni pegar.

Dos tamaños, usted elige

El 0.6B es el modelo para uso diario. Funciona con cualquier tarjeta gráfica de 4 GB, con gráficos integrados y en portátiles que no cuenten con tarjeta gráfica alguna. Rápido, ligero, siempre listo cuando lo necesitas.

1.7B

Grande · Vulkan / CPU
~2–3 GB

¿Sin GPU en absoluto? Aún así funciona. La versión solo con CPU necesita 8 GB de RAM, un procesador de cuatro núcleos y unos 5 GB de espacio libre en el disco; para todo lo demás se requieren entre 7 y 9 GB. Cualquier tarjeta compatible con Vulkan 1.2+ sirve: NVIDIA, AMD e Intel Arc. Además, la transcripción y la traducción utilizan cada una su propio procesador, por lo que una puede ejecutarse en la tarjeta gráfica mientras la otra lo hace en la CPU.

Complementos opcionales que se descargan bajo demanda desde Ajustes → Modelos:

Forced Aligner (~540 MB) para marcas de tiempo a nivel de palabra · Hunyuan MT2 Fast (~1 GB) o Calidad (~4,3 GB) para traducción.

Cómo realizamos la comparación

Característica Brethof Voice Pro Dragon Google STT Otter.ai Whisper (OSS)
Procesamiento 100 % local
Licencia perpetua ~
Soporte nativo para Linux ~
Soporte nativo para Windows ~ ~
30 idiomas de ASR + detección automática ~
Traducción sin conexión (38 idiomas)
Aceleración por GPU (NVIDIA + AMD + Intel) N/A N/A ~
Ajuste fino personal del modelo (LoRA)
Servidor MCP para agentes de IA
Reducción de ruido integrada
Inyección directa de texto
Interfaz gráfica de escritorio pulida
Costo típico $49 una vez 350 $/año 17 $/mes 17 $/mes Gratis

Paga una vez. Posee para siempre.

Sin tarifas mensuales. Sin límites de uso. Licencia perpetua con 1 año de actualizaciones incluidas.

Prueba gratuita
$ 0

No se requiere tarjeta de crédito. Solo se necesita un correo electrónico para verificar su prueba.

  • Ambos tamaños de modelo (0.6B + 1.7B)
  • Aceleración por GPU
  • 30 idiomas de ASR + 38 de traducción
  • Reducción de ruido
  • × Sin entrenamiento personal (solo planes de pago)
  • × Sin servidor MCP (solo planes de pago)
  • × Límite de 14 días
Iniciar prueba gratuita
Business
$ 249 /usuario

Licencia perpetua (por asiento). Uso para equipos y organizaciones. 1 año de actualizaciones.

  • Licencia perpetua (por asiento)
  • Uso por equipos y organizaciones
  • Ambos tamaños de ASR (0.6B + 1.7B)
  • Traducción sin conexión (38 idiomas)
  • Entrenamiento personal de voz (LoRA)
  • Servidor MCP para agentes de IA
  • Soporte prioritario
  • Descuentos por volumen (10+ asientos)
Comprar licencia Business

Precios excl. impuestos. Luego $20/asiento/año por actualizaciones (opcional)

Preguntas frecuentes

No. Brethof Voice Pro procesa todo localmente en su dispositivo. Ningún dato de audio o texto sale jamás de su computadora. No hay componente en la nube, ni telemetría, ni análisis.

Cualquier GPU moderna funciona. NVIDIA, AMD e Intel Arc usan aceleración Vulkan. También puede ejecutarse solo con CPU, aunque la transcripción será más lenta. El modelo de 0.6B funciona cómodamente en gráficos integrados o en cualquier tarjeta Vulkan de 4 GB o más.

Empiece con el modelo de 0.6B — Es la opción predeterminada recomendada y funciona muy bien en la mayoría de las GPUs (e incluso en la CPU de la mayoría de las computadoras modernas). Si necesita mayor precisión con audio con acentos o ruidoso, cámbielo a modelo de 1.7B (necesita 6 GB+ de VRAM). Puede cambiar de tamaño en cualquier momento desde Ajustes → Modelos sin volver a descargar.

Sí. Brethof Voice Pro es compatible de forma nativa con Linux y Windows. En Linux funciona con X11 y Wayland. En Windows se ejecuta como una aplicación de escritorio estándar.

Su licencia es perpetua: la aplicación seguirá funcionando para siempre con la versión que tenga. El pase de actualización opcional de 20 $/año le da acceso a nuevas funciones y mejoras de los modelos. Sin él, simplemente se queda en su versión actual.

Sí: el entrenamiento personal de voz está incluido en la v2.0.0 y se ejecuta de principio a fin en su equipo. Cada vez que corrige una palabra mal reconocida, el par {clip, corrección} se guarda automáticamente en su conjunto de datos de entrenamiento local. La tarjeta de entrenamiento de la ventana principal muestra de un vistazo el total de muestras y minutos capturados: haga clic en «Iniciar entrenamiento» en la pestaña Entrenamiento para ajustar un LoRA según su acento. El resultado se exporta automáticamente a GGUF y puede cambiar a él con un clic. Gratis para cada licencia de pago; sus datos de voz nunca salen de su equipo.

¿Listo para probarlo?

Prueba gratuita de 14 días. Sin tarjeta de crédito. Sin nube. Sin concesiones.

Escúchalo cuando se envíe.

Nuevas publicaciones, pruebas reales y análisis en profundidad de vez en cuando. Sin spam, cancelar la suscripción con un solo clic.

Todo lo que construimos

Externo: YouTube · GitHub