NUEVO · v2.0.0

Todo en una aplicación

Ya hablas más rápido de lo que escribes. Brethof Voice Pro es la única herramienta que escucha. Se trata de un teclado de voz que coloca las palabras dondequiera que esté el Cursor.

Transcripción Es un transcriptor que asiste a una reunión de dos horas y luego le entrega la transcripción.

Habla una vez. Es un traductor que toma una oración pronunciada y la escribe en cuatro idiomas al mismo tiempo.

Subtítulos Es un subtitulador para su propio video; escucha tanto los altavoces como el micrófono: la reunión a la que asistió como invitado, el video sin transcripción.

Deja una grabación de dos horas y ve a hacer café.Todo en una sola computadoraNo está en la nube de alguien.

Brethof Voice Pro — Main Screen
Brethof Voice Pro — Recording

Tu voz nunca abandona tu computadora.

Esa frase es toda la presentación, y es suficiente. Tres cosas llegan a la red, y solo en esos casos: una verificación de licencia al iniciar, una verificación de actualizaciones al iniciar, y la descarga del modelo para que uno mismo pueda usarlo. Sin audio, sin texto, nunca.

  • Sin audio. Sin texto. Nunca.
  • Una vez que los modelos estén en su disco y la verificación de actualizaciones esté desactivada, no se enviará nada en absoluto.
  • Sin red, no hay problema.

Funciona en la computadora portátil que ya tienes.

No se requiere estación de trabajo. El modelo pequeño funciona con cualquier tarjeta gráfica de 4 GB, y todo funciona incluso sin tarjeta gráfica alguna; se necesita 8 GB de RAM, un procesador x86_64 de cuatro núcleos y 5 GB de espacio en disco.

  • NVIDIA — GPU con Vulkan 1.2+
  • AMD — GPU con Vulkan 1.2+
  • En Linux se entrega como un único archivo portátil, sin necesidad de instalar nada.
  • En Windows se trata de un instalador normal que no requiere derechos de administrador.

Treinta idiomas, veintidós dialectos chinos, en tu máquina

Se transcribe en treinta idiomas y reconoce veintidós dialectos regionales chinos por sí mismo, sin que se le indique cuál es el que se habla.

InglésChinoCantonésÁrabe AlemánFrancésEspañolPortugués ItalianoNeerlandésRusoIndonesio CoreanoTailandésVietnamitaJaponés TurcoHindiMalayoSueco DanésFinlandésPolacoCheco FilipinoPersaGriegoRumano HúngaroMacedonio

Todo funciona en su máquina, sin costo por minuto y sin necesidad de subir nada.

Traducción a 38 idiomas: novedad en v2.0.0

Traducción a treinta y ocho idiomas: novedad en la versión 2.0.0

ChinoInglésFrancésPortugués EspañolJaponésTurcoRuso ÁrabeCoreanoTailandésItaliano AlemánVietnamitaMalayoIndonesio FilipinoHindiChino tradicionalPolaco ChecoNeerlandésJemerBirmano PersaGuyaratíUrduTelugú MaratíHebreoBengalíTamil UcranianoCantonésTibetanoKazajo MongolUigur
  • Habla polaco y obtendrás inglés. Habla inglés y obtendrás japonés.
  • Dilo una vez y que se escriba al mismo tiempo en inglés, japonés, francés y español: uno por línea, o uno al lado del otro en la misma línea; puedes usar tantos idiomas de destino como desees.
  • La traducción mantiene su calidad frente a los gigantes de la nube. Gracias a Hunyuan MT2 de Tencent, en el benchmark FLORES-200 alcanza el 97,9% de la calidad de Gemini 3.1 Pro de Google, y supera a esta última en la traducción de textos del mundo real y en idiomas minoritarios.
  • Subtítulos también: texto plano o SRT, sincronizados por oración, o palabra por palabra cuando se necesita editar con precisión.
  • Y al traducir un archivo de subtítulos, se mantiene intacto el tiempo de cada uno.

Tu máquina, tu decisión.

Dos tamaños de modelo: una elección en lugar de una jerarquía. El más pequeño para portátiles y gráficos integrados; el más grande para audio con efectos especiales o ruido. Puede cambiar entre ellos en cualquier momento. Además, la transcripción y la traducción utilizan procesadores separados, por lo que una puede ejecutarse en la tarjeta gráfica mientras que la otra lo hace en la CPU.

  • Pequeño — Para laptops y gráficos integrados
  • Grande — Para audio con acentos o ruido

Complementos opcionales que se descargan bajo demanda desde Ajustes → Modelos: Forced Aligner (~540 MB) para marcas de tiempo a nivel de palabra, Hunyuan MT2 Fast (~1 GB) o Calidad (~4,3 GB) para traducción.

Reducción de ruido

La reducción de ruido sirve para las grabaciones realizadas en habitaciones ruidosas.

  • Está desactivado por defecto, porque se midió para empeorar los clips de micrófono cortos y claros.
  • Enciéndelo cuando haya mucho ruido en la habitación.
  • Olvídese de ello cuando su grabación esté bien.
  • Desactivado por defecto: actívelo por grabación o siempre activo

Aprende de las correcciones que ya haces.

La mayoría de las aplicaciones de voz te piden que leas frases de ejemplo. Esta, en cambio, se entrena con las correcciones que ya haces: corrige una palabra mal escuchada y esa corrección se convierte en el ejemplo.

  • Sin grabación de muestra, sin tarea.
  • El entrenamiento está a un clic
  • Funciona con tu propio hardware
  • El nuevo modelo está listo para ser utilizado una vez que termine.
  • Sin sesiones de grabación
  • No “por favor, repita el siguiente párrafo”.
  • Solo tu voz, y las correcciones que ibas a hacer de todos modos.

El teclado que escucha

Escribe dondequiera que se encuentre el Cursor: en el editor, en la terminal, en un cuadro de chat, en un formulario, en cualquier campo que acepte entrada por teclado. Y si lo deseas, escribe la traducción en lugar de la transcripción: di algo en polaco, y la versión en inglés aparecerá en la página.

  • El micrófono
  • Un archivo de audio o video
  • El audio que se reproduce a través de tus altavoces
  • Funciona con cualquier campo de texto, editor, terminal o chat
  • X11 y Wayland en Linux, entrada nativa en Windows

Tus palabras, escritas a tu manera

Nombres de marcas, jerga, nombres de colegas. Guárdelos una vez y dejarán de escribirse incorrectamente. La misma lista guía la transcripción y la traducción, por lo que un nombre nunca se localiza por error. Corrija una palabra mal escuchada una vez y se convierte en datos de entrenamiento; nunca se le pedirá que la lea en voz alta para practicar.

  • Añada términos en Ajustes: uno por línea
  • Mejora el reconocimiento de nombres propios y abreviaturas
  • Conserva nombres de marcas y términos técnicos en las traducciones
  • No se necesita reentrenamiento: se aplica en el momento de la inferencia.

El agente consigue oídos.

Dale a tu agente de IA la capacidad de escuchar. A través de MCP, puede transcribir, traducir y grabar una reunión de cualquier duración en tu equipo, sin necesidad de una clave API.

  • Transcriba archivos de audio/vídeo, grabaciones de micrófono o audio del sistema
  • Traduzca texto, SRT o VTT (se admite modo bilingüe)
  • Cambie el dispositivo de cómputo de ASR o MT sobre la marcha
  • Liste y cambie perfiles de voz personales
  • Lea/escriba cualquier ajuste de la aplicación desde el agente

Una llamada de tres horas no es diferente de una de tres minutos: no hay nada que supervisar, y si olvida que se estaba grabando, no se pierde nada: termina por sí sola y guarda la transcripción para usted.

¿Listo para probarlo?

¿Listo para probarlo? La prueba dura catorce días y solo se necesita un correo electrónico, sin necesidad de tarjeta. Permite acceder a todo, excepto al entrenamiento personal y a la conexión con el agente. Al comprarlo, se obtiene una licencia permanente con un año de actualizaciones incluidas. Después de ese año, las actualizaciones son opcionales, y sin ellas la aplicación seguirá funcionando con la versión que posees, indefinidamente. Funcionará durante cinco años, independientemente de si vuelves a pagarnos o no. Una licencia personal cubre dos dispositivos; las licencias para equipos se calculan por usuario, con descuentos por volumen, soporte prioritario y un panel de control. Compra una vez y será tuya para siempre.

Escúchalo cuando se envíe.

Nuevas publicaciones, pruebas reales y análisis en profundidad de vez en cuando. Sin spam, cancelar la suscripción con un solo clic.

Todo lo que construimos

Externo: YouTube · GitHub