Brethof Voice Pro — ¿Qué hay de nuevo?

La historia continua de esta aplicación, versión tras versión. Si está en la versión más reciente, esta es la lista de lo que ya tiene; las notas debajo del registro de cambios explican las decisiones detrás de algunos de ellos.

Lanzamiento 14 de agosto de 2026

v2.3.1 — las cuentas de dos factores pueden iniciar sesión nuevamente

Una regresión en la versión anterior dejó las cuentas con autenticación de dos factores sin poder iniciar sesión. La versión 2.3.1 lo soluciona. Si te pasó a ti: ingresa tus credenciales, ingresa tu código y ya estás dentro. Nada más cambió.

Lanzamiento 6 de agosto de 2026

v2.2.2 — archivos de subtítulos, aproximadamente el doble de rápido

Ahora, traducir un archivo de subtítulos lleva aproximadamente la mitad del tiempo que antes. El tiempo de procesamiento no ha cambiado: cada marca de tiempo se coloca exactamente donde estaba en el original, ya sea a nivel de oración o de palabra. Si se trabaja como traductor de subtítulos, esta es la versión en la que el tiempo de espera se ha reducido notablemente.

También en v2.2.2:

  • Corrección de la entrada del micrófono: era algo crucial, sobre todo con micrófonos de buena calidad.. La nivelación de audio podría hacer que los momentos más fuertes de una grabación nítida superen el rango máximo y se distorsionen. Cuanto mejor sea su micrófono, mayor será la diferencia entre sus picos y su nivel promedio, y mayor será la probabilidad de que esto ocurra: una señal comprimida y ruidosa pasa sin ser afectada, mientras que en una habitación silenciosa y con un micrófono de condensador decente, la señal se distorsiona. La nivelación actual deja espacio adicional, de modo que las consonantes y los sonidos intensos permanecen intactos.
  • Nuevo translate_batch Herramienta MCP — Traduzca muchas cadenas en una sola llamada, con un parámetro de tamaño de lote que retrocede automáticamente si la VRAM escasea.
Descargar v2.2.2 →
Lanzamiento 11 de julio de 2026

v2.2.1: la aplicación que posees sigue siendo tuya

Brethof Voice Pro le pertenece una vez que lo compre, y la versión 2.2.1 se asegura de que nada se interponga entre usted y él. La verificación de licencia al iniciar el programa solía funcionar como una barrera: sin conexión a red, servidor ocupado o firewall que lo bloqueara, era posible quedar excluido del software por el que se había pagado. Ahora en cambio permite el acceso sin problemas: si la verificación no puede conectarse con nosotros, la aplicación se abre de todos modos. El software que uno posee no debería necesitar permiso para iniciarse. Ya no es así.

  • Botón Revisar licencia En el diálogo de licencia: fuerza una nueva comprobación y Continúa lanzándose En caso de éxito. Anteriormente, las únicas salidas eran Comprar o Salir.
  • Sin marca de vencimiento de prueba para clientes de pago — Los diálogos ahora indican lo que realmente sucedió, en lugar de mostrar el mismo mensaje para todos.
  • Ya no hay congelamientos de la interfaz de usuario. — Las descargas de modelos se realizan en el hilo de la interfaz, mostrando un porcentaje de progreso, y las verificaciones de licencia al iniciar ya no bloquean la ventana en conexiones lentas.
  • Dictado no perdido — Si la transcripción aún está en curso cuando terminas de hablar, el nuevo audio se coloca en cola en lugar de descartarse silenciosamente, y un proceso atascado ya no puede ingresar texto posterior a tu próxima grabación.
  • Sin conexión, está en silencio. — No hay esperas repetidas de red cuando no hay conexión.
Descargar →
Lanzamiento 4 de junio de 2026

v2.2.0: grabar toda la reunión, no solo los primeros cinco minutos

Las grabaciones largas ahora se ejecutan como tareas en segundo plano. Pásale un archivo de una reunión de dos horas y ve a preparar café: no hay límite de duración ni nada que vigilar. Déjalo funcionando y olvídate de él; se completará por sí solo y te guardará la transcripción. Una llamada de tres horas no es diferente a una de tres minutos; simplemente lleva más tiempo.

  • Micrófono o audio del sistema — Grabe su propia voz o capture en bucle lo que se esté reproduciendo en su equipo: llamadas de reunión, pestañas del navegador, cualquier cosa que salga por sus altavoces. Nuevo list_loopback_sources Herramienta para ver qué hay disponible.
  • Nada se tira. — Si una grabación se abandona, el sistema de monitoreo ahora la transcribe a un trabajo recuperable en lugar de descartarla.
  • Límites honestos — El modo de transcripción instantánea de corta duración ahora tiene un límite de 10 minutos; pedir más de lo que puede admitir devuelve un error claro que señala la herramienta de transcripción en formato largo. Ya no recorta silenciosamente el audio y entrega una respuesta parcial.
  • Corrección de la traducción de Linux — Una dependencia faltante causó que la traducción fallara en todas las compilaciones de Linux desde la versión 1.7.0. Fue detectada gracias a una nueva puerta de control de lanzamiento de extremo a extremo que verifica el binario realmente compilado antes de que se envíe cualquier versión.
Descargar →
Actualizar 4 de junio de 2026

v2.1.0: su agente recibe información por HTTP

Un agente en la misma máquina ahora puede utilizar Brethof Voice Pro —para transcribir, traducir y grabar— a través de MCP. Funciona mediante HTTP local, por lo que un agente que solo pueda acceder a los recursos por URL puede usarlo sin una clave API y sin que nada salga de la máquina. Un token protege el acceso, y el servidor se niega a iniciarse sin él. Esta versión requiere una licencia de pago.

  • Privado por defecto — Solo escucha en tu propia máquina, a menos que lo cambies deliberadamente, y eso es un límite más estricto. Se niega a iniciar. Sin un token de autenticación. Cuando se establece un token, cada solicitud debe presentarlo.
  • Trabajo sin interrupciones — Los modelos que se descargan cuando están inactivos ya no pueden ser descargados en medio de una tarea larga. Un tiempo de espera que ignora el trabajo en curso acabará afectando negativamente a procesos legítimos; por eso, el temporizador de inactividad ahora se pausa mientras haya algo en ejecución.
Descargar →
Lanzamiento 21 de mayo de 2026

v2.0.0 — traducción que nunca sale de casa

La mejor opción. La traducción se realiza completamente en su propia máquina, a 38 idiomas. Diga algo una vez y obtendrá la traducción al inglés, japonés, francés y español al mismo tiempo: una por línea o una al lado de la otra en la misma línea. El motor utilizado es Hunyuan MT2 de Tencent, disponible en dos versiones según sus necesidades: una rápida para el uso diario y otra de mayor calidad para situaciones importantes. Según las pruebas realizadas por Tencent, en el benchmark FLORES-200, la versión de calidad alcanza un 97,9% de la precisión de Gemini 3.1 Pro de Google, y supera a esta última en la traducción de lenguas minoritarias y en contextos reales. Todo esto se hace sin conexión a Internet; ninguna información se envía a ningún lugar.

Novedades en la v2.0.0:

  • Transcribe y traduce — El menú emergente de Transcribir cuenta con un desplegable de “Traducir a:”. La ASR realiza la transcripción, mientras que la MT se encarga de la traducción; ambas funciones se muestran una al lado de la otra. Funciona con archivos, el micrófono y el audio del sistema (grabación en bucle de llamadas de reuniones, pestañas del navegador, cualquier cosa que se reproduzca en los altavoces).
  • Teclado de voz multilingüe — El nuevo chip de traducción en la fila principal abre una cuadrícula de idiomas de 3 columnas. Elija uno o más destinos; el teclado escribe la traducción. Modos de disposición: uno por línea, en línea.EN: … || PL: …), o solo el primer objetivo.
  • Traductor de subtítulos SRT / VTT — Mantiene los tiempos y los índices de indicación; admite el modo bilingüe (línea de origen + traducción por cada indicación). Se expone a través de MCP para la automatización con agentes de IA.
  • Múltiples GPU por motor — Ajustes → Modelos tiene un selector de dispositivo independiente para cada motor. Ejecuta el ASR en Vulkan 0 y la traducción en Vulkan 1, o fija Hunyuan MT2 7B a la CPU en portátiles con poca VRAM.
  • El entrenamiento de voz personal ya está activo — Ajuste fino de LoRA con tu propia voz, de extremo a extremo en tu máquina. La tarjeta de entrenamiento de la ventana principal muestra de un vistazo el número total de muestras y los minutos capturados; «Iniciar entrenamiento» en la pestaña de Entrenamiento selecciona automáticamente NVIDIA CUDA o CPU, y luego exporta automáticamente el modelo entrenado a GGUF. Gratis con cada licencia de pago.
  • 4 nuevas herramientas MCPtranslate_text, translate_srt, list_compute_devices, set_compute_device. El recuento total de herramientas ahora es 19.
  • División honesta de idiomas — ASR: 30 idiomas seleccionables + detección automática + 22 dialectos chinos (52 en total). Traducción: 38 idiomas (33 principales + 5 minorías de la región china). 23 funcionan en ambas direcciones.

El binario de Linux tiene 161 MB, mientras que el instalador de Windows tiene 118 MB. Las licencias existentes se transfieren; simplemente descargar v2.0.0 y los modelos de traducción aparecerán en Configuración → Modelos.

Descargar v2.0.0 →
Lanzamiento 20 de mayo de 2026

v1.6.16 — tu voz se convierte en su propio modelo

Brethof Voice Pro ahora se entrena con tu voz. Los datos de entrenamiento son las correcciones que ya realizas: al corregir una palabra mal escuchada, esa se convierte en un ejemplo. Nunca se te pedirá que leas frases de ejemplo. El entrenamiento se realiza con un solo clic, funciona en tu propio hardware, y cuando termine, el nuevo modelo estará listo para usarlo.

La prueba desbloquea todo excepto el entrenamiento personal y la conexión con el agente; esta opción está destinada a las personas que usan la aplicación a diario.

Ingeniería 15 de mayo de 2026

v1.6.0 — haz que funcione, vuelve más tarde

Dos cosas. La transcripción ahora puede ejecutarse como una tarea asíncrona: se inserta el audio, se recoge la transcripción cuando está lista, sin necesidad de quedarse frente a ella.

Y el sincronización de los subtítulos: ahora puede sincronizar palabra por palabra en lugar de frase por frase, para aquellos momentos en que necesita editar con precisión. Si crea subtítulos, ya sabe por qué eso es importante.

Ingeniería 15 de mayo de 2026

v1.5.0: un entorno de ejecución único, y ONNX ya no está presente

El motor de ejecución ONNX ya no existe. Ahora todo el producto funciona con llama.cpp y nuestra propia biblioteca de traducción: un único motor de ejecución, más pequeño en disco, más rápido para iniciarse y más fácil de distribuir.

Los modelos son paquetes GGUF individuales, y eso es lo que permite que el modelo más pequeño funcione en cualquier tarjeta gráfica de 4 GB. Hay una explicación más detallada sobre por qué tomamos esta decisión más abajo en la página.

Ingeniería 14 de mayo de 2026

v1.4.0: su primera conexión con un agente, y una herramienta para seleccionar sus GPUs

Dos primeros logros. Aquí hace su debut el servidor MCP: la primera forma de dotar a un agente de capacidades auditivas, todo en tu propia máquina.

Y el selector de dispositivos: la transcripción y la traducción ahora pueden elegir cada una su propio procesador, de modo que una puede ejecutarse en la tarjeta gráfica mientras la otra funciona en la CPU. Una laptop con una GPU modesta puede ejecutar ambas tareas sin que se detengan por completo.

Hoja de ruta 16 de abril de 2026

macOS: en desarrollo, primero para Apple Silicon

macOS se encuentra en desarrollo, primero con Apple Silicon. No hay fecha establecida, y no le daremos ninguna hasta que la versión final esté lista. Mientras tanto, Linux y Windows son el mismo producto con las mismas funciones; no se retiene nada en uno para vender el otro. Cuando esté disponible la versión para Mac, esta página lo indicará.

Leer publicación →
Producto 16 de abril de 2026

Entrenéelo con tu propia voz.

Su acento no es un problema que haya que solucionar; es un modelo que se puede entrenar. Brethof Voice Pro aprende de las correcciones que ya realiza: al corregir una palabra mal entendida una vez, esa corrección se convierte en un ejemplo. Sin frases de ejemplo, sin script de calibración, sin horas de lectura por el micrófono. Las palabras marcadas que ya ha definido —nombres de marcas, jerga, nombres de colegas— guían tanto la transcripción como la traducción, de modo que un nombre nunca se localice por error. El entrenamiento se realiza con un solo clic, funciona en su propio hardware, y el nuevo modelo está listo para usarse una vez finalice. Las correcciones que ya realizaba siempre fueron material didáctico; ahora sirven para entrenar el modelo.

Leer publicación →
Anuncio 16 de abril de 2026

Brethof Voice Pro ya está en funcionamiento.

La primera versión. Hable en lugar de escribir, en cualquier lugar: su editor, su terminal, un cuadro de chat, un formulario… y las palabras aparecerán donde se encuentre el Cursor. La transcripción se realiza íntegramente en su propia máquina, utilizando Qwen3-ASR de Alibaba junto con DeepFilterNet3 para eliminar ruidos y Silero VAD para la detección de voz. Todo es procesado localmente. La llamada con su abogado, el producto aún no lanzado, las notas del paciente: nada de esto sale de la computadora en la que se procesa, porque no hay a dónde ir. Funciona en avión, en tren dentro de un túnel, en un hotel con mala conexión Wi-Fi. Treinta idiomas, incluyendo 22 dialectos chinos por separado. Funciona en la laptop que ya posee: con tarjeta gráfica o sin ella; si cuenta con una, cualquier GPU compatible con Vulkan 1.2+ de NVIDIA, AMD o Intel Arc. En Linux se entrega como un único archivo portátil, requiere glibc 2.38 o superior, mientras que en Windows es un instalador normal que no necesita derechos de administrador. Prueba de 14 días, sin necesidad de tarjeta: solo se necesita un correo electrónico.

Leer publicación →
Licencias 16 de abril de 2026

Su propia licencia ahora cubre su propio negocio.

La licencia individual ahora cubre el trabajo por cuenta propia y como freelancer. Si eres un empresario individual, un estudio de una sola persona o un contratista, la licencia que compras cubre tu trabajo. No hay contabilidad por usuario, ni niveles distintos para empresas. Una licencia para dos dispositivos, de pago único. Incluye actualizaciones durante un año; después de ese tiempo, las actualizaciones son opcionales, y la aplicación seguirá funcionando con la versión que tengas, de forma indefinida. El software por el que pagaste sigue siendo tuyo.

Leer publicación →
Producto 12 de abril de 2026

Treinta idiomas, y una interfaz de usuario que parece haber sido escrita por un ser humano.

Brethof Voice Pro permite transcribir en 30 idiomas, reconoce 22 dialectos regionales chinos y traduce entre 38 idiomas más. Además, la interfaz está completamente traducida a cada uno de esos 30 idiomas; las traducciones fueron realizadas por personas que utilizan el producto, y no mediante traducción automática. Puedes configurar la aplicación en tu idioma preferido, y el texto se leerá como si estuviera escrito allí, porque así es.

Leer publicación →
Ingeniería 8 de abril de 2026

Por qué pasamos de ONNX a GGUF

Las primeras versiones se ejecutaron con ONNX Runtime. Funcionaba, pero era pesado, complicado de distribuir y hacía que el producto fuera más grande de lo necesario. La versión 1.5.0 lo reemplazó por un único entorno de ejecución: llama.cpp para la transcripción y nuestra propia biblioteca para la traducción; además, los modelos pasaron a ser paquetes GGUF únicos. Lo que se nota es una descarga más pequeña, un inicio más rápido y un producto que cabe mejor en una computadora portátil. Hay dos tamaños de modelo, una elección en lugar de diferentes niveles: el más pequeño para computadoras portátiles y tarjetas gráficas integradas, y el más grande para audio con acentos o ruido. Puedes cambiar en cualquier momento, y no necesitas ninguna tarjeta gráfica si así lo prefieres.

Leer publicación →
Principios 4 de abril de 2026

Qué significa exactamente “100% sin conexión”.

Tres cosas llegan a la red, y nada más. Una verificación de licencia al iniciar la aplicación. Una verificación de actualizaciones al iniciar la aplicación. Y la descarga del modelo, que se realiza por iniciativa propia. La verificación de licencia envía una clave de licencia; la verificación de actualizaciones envía una cadena de versión. Ninguna de las dos envía audio ni texto, nunca. Una vez que los modelos están en el disco y la verificación de actualizaciones está desactivada, ya no sale nada. Eso no es una frase de marketing; un registro del firewall lo demostrará. La razón para ejecutar todo en la propia máquina no es porque la nube sea una característica especial. Es porque su voz es algo que no puede retirarse: la llamada con su abogado, el producto aún no lanzado, las notas del paciente. Una herramienta que maneja eso no debería necesitar una conexión a red para funcionar. Debería poder funcionar incluso en un avión, y no debería ser capaz de filtrar información. Ese es el propósito principal, y se trata de una decisión de diseño, no de una característica.

Leer publicación →

Recibe actualizaciones en tu bandeja de entrada

Un correo electrónico por versión, con el registro de cambios arriba. Sin spam, sin consejos, sin boletín semanal. Darse de baja con un clic, en cualquier momento.

Crear cuenta

Escúchalo cuando se envíe.

Nuevas publicaciones, pruebas reales y análisis en profundidad de vez en cuando. Sin spam, cancelar la suscripción con un solo clic.

Todo lo que construimos

Externo: YouTube · GitHub