Producto 20 de mayo de 2026

Ajuste fino está aquí

El entrenamiento de voz personal está activo en Brethof Voice Pro: ajusta el modelo de reconocimiento con tu propia voz mediante LoRA, todo en tu equipo. Así es como funciona.

El entrenamiento de voz personal se ha incluido en Brethof Voice Pro. Ajusta el modelo de reconocimiento con tu propia voz, localmente, con un solo clic: sin línea de comandos, sin nube. Así es como funciona.

Cómo funciona

Cada vez que corrige una palabra mal reconocida, la aplicación guarda el clip de audio y su corrección en un conjunto de datos de entrenamiento local. La tarjeta de entrenamiento de la ventana principal muestra cuántas muestras y minutos ha capturado; haga clic en ella para explorar, reproducir o eliminar las entradas. Cuando esté listo, la pestaña de Entrenamiento perfeccionará un adaptador LoRA para su voz.

El pipeline elige su backend automáticamente: un NVIDIA CUDA build (cu128 PyTorch, auto-instalado en un venv en caché en el primer inicio) cuando hay una GPU compatible, de lo contrario un CPU fallback. Cuando finalice el entrenamiento, la LoRA se fusionará con el modelo base y se exportará a GGUF para que llama.cpp pueda cargarla; cambie a su modelo personal desde Configuración → Modelos. La conversión de PyTorch a GGUF que antes bloqueaba esto ya está resuelta y se ejecuta de extremo a extremo.

Lo que obtienes

  • Recopilación de datos dentro de la aplicación. Las correcciones se convierten automáticamente en datos de entrenamiento; simplemente siga usando la aplicación.
  • Ajuste fino de LoRA con un solo clic. Entrena en tu GPU (NVIDIA CUDA) o CPU. Barra de progreso, no un archivo de registro.
  • Exportación automática a GGUF. El modelo entrenado se fusiona y convierte por ti — sin pasos manuales.
  • Versionado de modelos. Mantén el modelo base junto al tuyo ajustado y cambia entre ellos en los ajustes.
  • Palabras clave para el vocabulario. Agregue nombres, abreviaturas y términos de productos en el diálogo de Palabras clave: se aplica al instante, sin necesidad de volver a entrenar.

A quién afecta esto

  • Hablantes no nativos. Hoy en día, los acentos marcados logran una precisión base sólida, pero el ajuste fino con tu propia voz es donde salta al rango del 95% o más.
  • Usuarios médicos, legales y técnicos. Los nombres de los fármacos, las citaciones de jurisprudencia y los identificadores del código fuente: todo se beneficia enormemente de un vocabulario personalizado.
  • Usuarios con dificultades del habla. El ajuste fino para el habla disártica o atípica es uno de los usos más valiosos del entrenamiento local. Los servicios en la nube comerciales no lo ofrecen.
  • Lenguas con pocos recursos. Los modelos base son buenos en los idiomas más populares y menos eficaces en aquellos menos comunes. Al ajustarlos con unas pocas horas de audio propio, la diferencia se reduce rápidamente.

Lo que no está cambiando

  • El entrenamiento se ejecuta localmente. Las muestras de voz nunca salen de tu máquina. Ese es el objetivo principal.
  • Su modelo afinado es suyo. No lo subimos. No lo agrupamos en un modelo «compartido». Vive en tu disco.
  • Gratis con cualquier licencia de pago. No es una actualización por separado. Si ya tiene la versión Personal o Business, obtendrá la interfaz de capacitación en la actualización que la incluye.

Disponibilidad

Disponible ahora — El entrenamiento de voz personal se incluye en la versión actual y funciona de principio a fin en Linux y Windows. Es gratuito con cualquier licencia de pago; sus datos de voz nunca salen de su equipo.

¿Tienes un caso de uso específico de ajuste fino — vocabularios especializados, acentos inusuales, habla atípica? Cuéntanoslo para que sigamos mejorándolo: [email protected].

Comparte tu caso de uso Volver a actualizaciones

Escúchalo cuando se envíe.

Nuevas publicaciones, pruebas reales y análisis en profundidad de vez en cuando. Sin spam, cancelar la suscripción con un solo clic.

Todo lo que construimos

Externo: YouTube · GitHub