La historia continua de esta aplicación, versión tras versión. Si está en la versión más reciente, esta es la lista de lo que ya tiene; las notas debajo del registro de cambios explican las decisiones detrás de algunos de ellos.
Una regresión en la versión anterior dejó las cuentas con autenticación de dos factores sin poder iniciar sesión. La versión 2.3.1 lo soluciona. Si te pasó a ti: ingresa tus credenciales, ingresa tu código y ya estás dentro. Nada más cambió.
Ahora, traducir un archivo de subtítulos lleva aproximadamente la mitad del tiempo que antes. El tiempo de procesamiento no ha cambiado: cada marca de tiempo se coloca exactamente donde estaba en el original, ya sea a nivel de oración o de palabra. Si se trabaja como traductor de subtítulos, esta es la versión en la que el tiempo de espera se ha reducido notablemente.
También en v2.2.2:
translate_batch Herramienta MCP — Traduzca muchas cadenas en una sola llamada, con un parámetro de tamaño de lote que retrocede automáticamente si la VRAM escasea.Brethof Voice Pro le pertenece una vez que lo compre, y la versión 2.2.1 se asegura de que nada se interponga entre usted y él. La verificación de licencia al iniciar el programa solía funcionar como una barrera: sin conexión a red, servidor ocupado o firewall que lo bloqueara, era posible quedar excluido del software por el que se había pagado. Ahora en cambio permite el acceso sin problemas: si la verificación no puede conectarse con nosotros, la aplicación se abre de todos modos. El software que uno posee no debería necesitar permiso para iniciarse. Ya no es así.
Las grabaciones largas ahora se ejecutan como tareas en segundo plano. Pásale un archivo de una reunión de dos horas y ve a preparar café: no hay límite de duración ni nada que vigilar. Déjalo funcionando y olvídate de él; se completará por sí solo y te guardará la transcripción. Una llamada de tres horas no es diferente a una de tres minutos; simplemente lleva más tiempo.
list_loopback_sources Herramienta para ver qué hay disponible.Un agente en la misma máquina ahora puede utilizar Brethof Voice Pro —para transcribir, traducir y grabar— a través de MCP. Funciona mediante HTTP local, por lo que un agente que solo pueda acceder a los recursos por URL puede usarlo sin una clave API y sin que nada salga de la máquina. Un token protege el acceso, y el servidor se niega a iniciarse sin él. Esta versión requiere una licencia de pago.
La mejor opción. La traducción se realiza completamente en su propia máquina, a 38 idiomas. Diga algo una vez y obtendrá la traducción al inglés, japonés, francés y español al mismo tiempo: una por línea o una al lado de la otra en la misma línea. El motor utilizado es Hunyuan MT2 de Tencent, disponible en dos versiones según sus necesidades: una rápida para el uso diario y otra de mayor calidad para situaciones importantes. Según las pruebas realizadas por Tencent, en el benchmark FLORES-200, la versión de calidad alcanza un 97,9% de la precisión de Gemini 3.1 Pro de Google, y supera a esta última en la traducción de lenguas minoritarias y en contextos reales. Todo esto se hace sin conexión a Internet; ninguna información se envía a ningún lugar.
Novedades en la v2.0.0:
EN: … || PL: …), o solo el primer objetivo.translate_text, translate_srt, list_compute_devices, set_compute_device. El recuento total de herramientas ahora es 19.El binario de Linux tiene 161 MB, mientras que el instalador de Windows tiene 118 MB. Las licencias existentes se transfieren; simplemente descargar v2.0.0 y los modelos de traducción aparecerán en Configuración → Modelos.
Descargar v2.0.0 →Brethof Voice Pro ahora se entrena con tu voz. Los datos de entrenamiento son las correcciones que ya realizas: al corregir una palabra mal escuchada, esa se convierte en un ejemplo. Nunca se te pedirá que leas frases de ejemplo. El entrenamiento se realiza con un solo clic, funciona en tu propio hardware, y cuando termine, el nuevo modelo estará listo para usarlo.
La prueba desbloquea todo excepto el entrenamiento personal y la conexión con el agente; esta opción está destinada a las personas que usan la aplicación a diario.
Dos cosas. La transcripción ahora puede ejecutarse como una tarea asíncrona: se inserta el audio, se recoge la transcripción cuando está lista, sin necesidad de quedarse frente a ella.
Y el sincronización de los subtítulos: ahora puede sincronizar palabra por palabra en lugar de frase por frase, para aquellos momentos en que necesita editar con precisión. Si crea subtítulos, ya sabe por qué eso es importante.
El motor de ejecución ONNX ya no existe. Ahora todo el producto funciona con llama.cpp y nuestra propia biblioteca de traducción: un único motor de ejecución, más pequeño en disco, más rápido para iniciarse y más fácil de distribuir.
Los modelos son paquetes GGUF individuales, y eso es lo que permite que el modelo más pequeño funcione en cualquier tarjeta gráfica de 4 GB. Hay una explicación más detallada sobre por qué tomamos esta decisión más abajo en la página.
Dos primeros logros. Aquí hace su debut el servidor MCP: la primera forma de dotar a un agente de capacidades auditivas, todo en tu propia máquina.
Y el selector de dispositivos: la transcripción y la traducción ahora pueden elegir cada una su propio procesador, de modo que una puede ejecutarse en la tarjeta gráfica mientras la otra funciona en la CPU. Una laptop con una GPU modesta puede ejecutar ambas tareas sin que se detengan por completo.
macOS se encuentra en desarrollo, primero con Apple Silicon. No hay fecha establecida, y no le daremos ninguna hasta que la versión final esté lista. Mientras tanto, Linux y Windows son el mismo producto con las mismas funciones; no se retiene nada en uno para vender el otro. Cuando esté disponible la versión para Mac, esta página lo indicará.
Leer publicación →Su acento no es un problema que haya que solucionar; es un modelo que se puede entrenar. Brethof Voice Pro aprende de las correcciones que ya realiza: al corregir una palabra mal entendida una vez, esa corrección se convierte en un ejemplo. Sin frases de ejemplo, sin script de calibración, sin horas de lectura por el micrófono. Las palabras marcadas que ya ha definido —nombres de marcas, jerga, nombres de colegas— guían tanto la transcripción como la traducción, de modo que un nombre nunca se localice por error. El entrenamiento se realiza con un solo clic, funciona en su propio hardware, y el nuevo modelo está listo para usarse una vez finalice. Las correcciones que ya realizaba siempre fueron material didáctico; ahora sirven para entrenar el modelo.
Leer publicación →La primera versión. Hable en lugar de escribir, en cualquier lugar: su editor, su terminal, un cuadro de chat, un formulario… y las palabras aparecerán donde se encuentre el Cursor. La transcripción se realiza íntegramente en su propia máquina, utilizando Qwen3-ASR de Alibaba junto con DeepFilterNet3 para eliminar ruidos y Silero VAD para la detección de voz. Todo es procesado localmente. La llamada con su abogado, el producto aún no lanzado, las notas del paciente: nada de esto sale de la computadora en la que se procesa, porque no hay a dónde ir. Funciona en avión, en tren dentro de un túnel, en un hotel con mala conexión Wi-Fi. Treinta idiomas, incluyendo 22 dialectos chinos por separado. Funciona en la laptop que ya posee: con tarjeta gráfica o sin ella; si cuenta con una, cualquier GPU compatible con Vulkan 1.2+ de NVIDIA, AMD o Intel Arc. En Linux se entrega como un único archivo portátil, requiere glibc 2.38 o superior, mientras que en Windows es un instalador normal que no necesita derechos de administrador. Prueba de 14 días, sin necesidad de tarjeta: solo se necesita un correo electrónico.
Leer publicación →La licencia individual ahora cubre el trabajo por cuenta propia y como freelancer. Si eres un empresario individual, un estudio de una sola persona o un contratista, la licencia que compras cubre tu trabajo. No hay contabilidad por usuario, ni niveles distintos para empresas. Una licencia para dos dispositivos, de pago único. Incluye actualizaciones durante un año; después de ese tiempo, las actualizaciones son opcionales, y la aplicación seguirá funcionando con la versión que tengas, de forma indefinida. El software por el que pagaste sigue siendo tuyo.
Leer publicación →Brethof Voice Pro permite transcribir en 30 idiomas, reconoce 22 dialectos regionales chinos y traduce entre 38 idiomas más. Además, la interfaz está completamente traducida a cada uno de esos 30 idiomas; las traducciones fueron realizadas por personas que utilizan el producto, y no mediante traducción automática. Puedes configurar la aplicación en tu idioma preferido, y el texto se leerá como si estuviera escrito allí, porque así es.
Leer publicación →Las primeras versiones se ejecutaron con ONNX Runtime. Funcionaba, pero era pesado, complicado de distribuir y hacía que el producto fuera más grande de lo necesario. La versión 1.5.0 lo reemplazó por un único entorno de ejecución: llama.cpp para la transcripción y nuestra propia biblioteca para la traducción; además, los modelos pasaron a ser paquetes GGUF únicos. Lo que se nota es una descarga más pequeña, un inicio más rápido y un producto que cabe mejor en una computadora portátil. Hay dos tamaños de modelo, una elección en lugar de diferentes niveles: el más pequeño para computadoras portátiles y tarjetas gráficas integradas, y el más grande para audio con acentos o ruido. Puedes cambiar en cualquier momento, y no necesitas ninguna tarjeta gráfica si así lo prefieres.
Leer publicación →Tres cosas llegan a la red, y nada más. Una verificación de licencia al iniciar la aplicación. Una verificación de actualizaciones al iniciar la aplicación. Y la descarga del modelo, que se realiza por iniciativa propia. La verificación de licencia envía una clave de licencia; la verificación de actualizaciones envía una cadena de versión. Ninguna de las dos envía audio ni texto, nunca. Una vez que los modelos están en el disco y la verificación de actualizaciones está desactivada, ya no sale nada. Eso no es una frase de marketing; un registro del firewall lo demostrará. La razón para ejecutar todo en la propia máquina no es porque la nube sea una característica especial. Es porque su voz es algo que no puede retirarse: la llamada con su abogado, el producto aún no lanzado, las notas del paciente. Una herramienta que maneja eso no debería necesitar una conexión a red para funcionar. Debería poder funcionar incluso en un avión, y no debería ser capaz de filtrar información. Ese es el propósito principal, y se trata de una decisión de diseño, no de una característica.
Leer publicación →Un correo electrónico por versión, con el registro de cambios arriba. Sin spam, sin consejos, sin boletín semanal. Darse de baja con un clic, en cualquier momento.
Crear cuentaSistema local de voz a texto que aprende tu voz. Licencia perpetua. Nuestro producto estrella.
PAID · modelo estrella
Memoria a largo plazo para tus agentes de IA: texto completo + vectores + grafos. Se proporciona información al inicio de la sesión, se recupera en cada solicitud y se archiva automáticamente.
Pagado · plan gratuito
Modelos digitales listos para imprimir. GLB y OBJ incluidos. Acceso de por vida.
PAID · catálogo digital
Cinco impresoras y capacidad real. Aún no hay tienda de autoservicio: díganos qué necesita y le haremos una cotización por correo electrónico.
Por acuerdo previo · escríbanos por correo electrónico
Nuestro canal de YouTube. Un presentador en forma de tigre cibernético explica las herramientas de IA locales y qué hacen realmente.
CANAL · en vivo
Listas seleccionadas en GitHub para agentes de programación por IA, servidores MCP, IA local y Linux para IA. Cada entrada incluye un enlace de origen.
GRATIS · curado
Guías detalladas para utilizar inteligencia artificial local en Linux, Windows y macOS, que incluyen los archivos de configuración.
GRATIS · en vivo
Curación negativa: prácticas y herramientas que desperdician tu tiempo, clasificadas. Se requieren comprobantes.
GRATIS · en vivo
Quiénes somos, por qué desarrollamos inteligencia artificial centrada en la privacidad, y qué no haremos.