Produto 20 de maio de 2026

Ajuste fino está aqui

O treinamento de voz personalizado está disponível no Brethof Voice Pro — ajuste o modelo de reconhecimento com a sua própria voz usando LoRA, inteiramente na sua máquina. Veja como funciona.

O treinamento de voz personalizado foi lançado no Brethof Voice Pro. Ajuste o modelo de reconhecimento para a sua própria voz, localmente, com um clique — sem linha de comando, sem nuvem. Veja como funciona.

Como funciona

Toda vez que você corrige uma palavra mal reconhecida, o aplicativo salva o clipe de áudio e sua correção em um conjunto de dados de treinamento local. O cartão de treinamento na janela principal mostra quantas amostras e minutos foram capturados — clique nele para navegar, reproduzir ou excluir entradas. Quando estiver pronto, a guia de Treinamento ajusta um adaptador LoRA para sua voz.

O pipeline escolhe seu backend automaticamente: um NVIDIA CUDA build (cu128 PyTorch, instalado automaticamente em um venv em cache na primeira execução) quando há uma GPU compatível, caso contrário um CPU fallback. Quando o treinamento termina, a LoRA é mesclada ao modelo base e exportada para GGUF para que o llama.cpp possa carregá-la — alterne para seu modelo pessoal em Configurações → Modelos. A conversão de PyTorch para GGUF que antes bloqueava isso foi concluída e funciona de ponta a ponta.

O que você recebe

  • Coleta de dados dentro do aplicativo. As correções se tornam dados de treinamento automaticamente — basta continuar usando o aplicativo.
  • Ajuste fino de LoRA com um clique. Treine na sua GPU (NVIDIA CUDA) ou CPU. Barra de progresso, não um arquivo de log.
  • Exportação automática para GGUF. O modelo treinado é mesclado e convertido para você — sem etapas manuais.
  • Versionamento de modelos. Mantenha o modelo padrão ao lado do seu modelo ajustado e alterne entre eles nas configurações.
  • Palavras-chave para vocabulário. Adicione nomes, siglas e termos de produtos na caixa de diálogo Hotwords — aplicado instantaneamente, sem necessidade de retreinamento.

Para quem isso é importante

  • Falantes não nativos. Atualmente, os sotaques fortes já alcançam uma precisão básica decente, mas o ajuste fino com a própria voz é o que faz a precisão chegar a mais de 95%.
  • Utilizadores médicos, jurídicos e técnicos. Nomes de medicamentos, citações de jurisprudência, identificadores de código-fonte — tudo se beneficia enormemente de um vocabulário personalizado.
  • Usuários com dificuldades de fala. O ajuste fino para fala disartrica ou atípica é um dos usos de maior valor do treinamento local. Os serviços em nuvem comerciais não o oferecem.
  • Línguas com poucos recursos. Os modelos base são bons em idiomas populares e mais fracos nos menos comuns. Ajuste fino com algumas horas do seu próprio áudio e a lacuna fecha rápido.

O que não está mudando

  • O treinamento roda localmente. As amostras de voz nunca saem da sua máquina. Esse é o objetivo principal.
  • Seu modelo ajustado é seu. Nós não enviamos. Não o agregamos em um modelo "compartilhado". Ele fica no seu disco.
  • Incluído gratuitamente com qualquer licença paga. Não é uma atualização separada. Se você já possui a versão Personal ou Business, receberá a interface de treinamento na atualização que será enviada.

Disponibilidade

Disponível agora — O treinamento de voz pessoal é entregue na versão atual e funciona de ponta a ponta no Linux e Windows. Gratuito com qualquer licença paga; seus dados de voz nunca saem da sua máquina.

Você tem um caso de uso específico de ajuste fino — vocabulários especializados, sotaques incomuns, fala atípica? Avise-nos para que possamos continuar a aprimorá-lo: [email protected].

Compartilhe seu caso de uso Voltar às atualizações

Ouça quando for enviado

Novos lançamentos, benchmarks reais e análises aprofundadas ocasionais. Sem spam, cancelamento de assinatura com um clique.

Tudo o que construímos

Externo: YouTube · GitHub