100% Local — Sua voz nunca sai do seu dispositivo

Voz em texto que nunca vai embora seu computador

Você está falando. As palavras são gravadas — no seu editor, no seu terminal, em uma caixa de bate-papo, em um formulário, onde quer que o Cursor esteja. E cada uma delas permanece na máquina onde foram ditas.

O Brethof Voice Pro é um sistema de conversão de voz em texto e tradução que funciona inteiramente no seu próprio computador. Isso não é um recurso de privacidade; é o próprio produto.

100% Local — Nunca na nuvem
30 ASR + 38 Tradução idiomas
Acelerado por GPU — NVIDIA, AMD, Intel
Linux & Windows
Funciona Offline

Tudo o que você precisa, nada que não precise.

Um programa, o trabalho de quatro pessoas. Ele transcreve sua voz, traduz para 38 idiomas, adiciona legendas aos seus vídeos e digita por você onde quer que haja um teclado. Funciona off-line — em um avião, em um hotel com Wi-Fi ruim, em um túnel — e no laptop que você já possui, com ou sem placa de vídeo. Sem assinatura. Sem cobrança por minuto. Sem necessidade de envio de arquivos. Dê também ouvidos ao seu agente de IA: ele pode transcrever, traduzir e gravar reuniões de qualquer duração por meio do MCP, no seu próprio dispositivo, sem precisar de chave API. Compre uma vez, e ele continuará funcionando.

Três coisas entram em contato com a rede, e nada mais o faz.

Sua voz nunca sai do seu computador. Essa frase é precisa, e é exatamente isso que acontece. Três coisas são enviadas para a rede no momento da inicialização, e apenas três: uma verificação de licença, uma verificação de atualizações e os modelos que você mesmo baixa. A verificação de licença envia uma chave de licença; a verificação de atualizações envia uma string de versão – sem áudio, sem texto, nunca. Se você desativar a verificação de atualizações, uma vez que os modelos estejam no disco, nada será enviado.

30 idiomas, 22 dialetos, e seu sotaque deixa de ser um problema

Transcrição em mais de 30 idiomas, além de compreensão automática de 22 dialetos regionais chineses — sem configuração, sem treinamento. E seu sotaque não será mais pronunciado de forma incorreta. O Brethof Voice Pro aprende sua voz, seu jargão e seus nomes próprios no próprio dispositivo. Fale o dialeto de Sichuan da sua avó, e ele será reproduzido corretamente.

Fale uma vez, leia em 38 idiomas

Fale polonês, leia inglês. Fale inglês, leia japonês. Ou digite uma vez e tenha o texto digitado em inglês, japonês, francês e espanhol ao mesmo tempo — um por linha ou lado a lado na mesma linha. Escolha quantos idiomas de destino quiser; há 38 disponíveis, e 23 funcionam nas duas direções. A tradução também é feita no seu próprio dispositivo, usando o Hunyuan MT2 da Tencent. Em termos de qualidade, atinge 97,9% do desempenho do Gemini 3.1 Pro do Google no teste FLORES-200, e supera-o em traduções do mundo real e de línguas minoritárias. Existem dois tamanhos, ambos com download opcional: um rápido para uso diário e um de alta qualidade para as palavras importantes. Também há legendas. Em formato de texto simples ou SRT, com sincronização por frase ou palavra, quando for necessário editar com precisão. Ao traduzir um arquivo de legendas, todo o sincronismo é mantido. Crie legendas para o seu próprio vídeo em 38 idiomas sem pagar por minuto.

Totalmente offline

É por isso que funciona onde mais nada funcionará. Um avião. Um hotel com Wi-Fi ruim. Um trem passando por um túnel. Não há para onde a gravação possa ir, então ela não precisa ir a lugar nenhum. Faça uma gravação de uma reunião de duas horas e vá preparar um café; a transcrição estará lá quando você voltar. Esqueça que você deixou a gravação em andamento e nada será perdido — ela termina o trabalho sozinha e guarda a transcrição.

Dois tamanhos de modelo

Dois modelos de transcrição; é uma escolha, não um nível — você pode trocar a qualquer momento.

Ele aprende com as correções que você já faz.

A maioria dos softwares de voz exige que você leia frases de exemplo durante a configuração. Este não faz isso. Ele aprende com as correções que você faz: quando você corrige uma palavra mal ouvida, essa correção se torna um exemplo de treinamento. Ao definir uma vez os nomes da sua marca, seu jargão e os nomes dos seus colegas, eles deixam de ser pronunciados incorretamente – tanto na transcrição quanto na tradução, pois a mesma lista é utilizada em ambos os casos. Um nome nunca é localizado por acaso. O treinamento é feito com apenas um clique; ele roda no seu hardware, e o novo modelo fica pronto para ser utilizado assim que o processo for concluído.

Pague uma vez, tenha para sempre

Compre uma vez e será seu. Uma licença perpétua com um ano de atualizações incluídas.

Redução de ruído, somente quando você precisar.

Uma sala barulhenta deixa de ser um problema. A redução de ruído está integrada, para gravações feitas em um café, em uma feira comercial ou em um carro. Ela está desativada por padrão, pois testamos isso: em clipes curtos e limpos gravados com o microfone, ela piora a situação. Para reuniões de duas horas com uma máquina de espresso ao seu lado, ative-a.

O teclado no qual você já está digitando

O teclado de voz digita onde quer que seu Cursor esteja — em um navegador, em um IDE, em um aplicativo de bate-papo, em qualquer campo que aceite entrada por teclado. E ele pode digitar a tradução em vez da transcrição. Diga a frase em seu idioma, e as palavras corretas serão inseridas no formulário, no idioma exigido pelo mesmo. Uma única linha, sem cortar ou colar.

Dois tamanhos, você escolhe

O 0,6B é o modelo para uso diário. Funciona em qualquer placa de vídeo de 4 GB, em placas de vídeo integradas e em laptops que não possuem placa de vídeo alguma. Rápido, leve, está sempre disponível quando você precisa.

1,7 bilhão

Grande · Vulkan / CPU
~2–3 GB

Sem GPU algum? Ainda funciona. A versão apenas com CPU precisa de 8 GB de RAM, um processador de quatro núcleos e cerca de 5 GB de espaço livre no disco; para o resto, são necessários 7–9 GB. Qualquer placa compatível com Vulkan 1.2+ serve — NVIDIA, AMD, Intel Arc. Além disso, a transcrição e a tradução utilizam processadores separados, então uma pode rodar na placa de vídeo enquanto a outra roda no CPU.

Complementos opcionais baixados sob demanda em Configurações → Modelos:

Forced Aligner (~540 MB) para marcas de tempo em nível de palavra · Hunyuan MT2 Fast (~1 GB) ou Qualidade (~4,3 GB) para tradução.

Como fazemos a comparação

Recurso Brethof Voice Pro Dragon Google STT Otter.ai Whisper (OSS)
Processamento 100% local
Licença perpétua ~
Suporte nativo para Linux ~
Suporte nativo para Windows ~ ~
30 idiomas de ASR + detecção automática ~
Tradução off-line (38 idiomas)
Aceleração por GPU (NVIDIA + AMD + Intel) N/A N/A ~
Ajuste fino de modelo pessoal (LoRA)
Servidor MCP para agentes de IA
Redução de ruído integrada
Injeção direta de texto
Interface gráfica de desktop aprimorada
Custo típico $49 uma vez $350+/ano $17/mês $17/mês Gratuito

Pague uma vez. Tenha para sempre.

Sem taxas mensais. Sem limites de uso. Licença perpétua com 1 ano de atualizações incluídas.

Teste gratuito
$ 0

Não é necessário cartão de crédito. Basta um e-mail para verificar seu teste gratuito.

  • Ambos os tamanhos de modelo (0,6B + 1,7B)
  • Aceleração por GPU
  • 30 ASR + 38 idiomas de tradução
  • Redução de ruído
  • × Sem treinamento personalizado (somente planos pagos)
  • × Sem servidor MCP (somente planos pagos)
  • × Limite de 14 dias
Iniciar teste gratuito
Business
$ 249 /usuário

Licença perpétua por seat. Uso para equipas e organizações. 1 ano de atualizações.

  • Licença perpétua (por assento)
  • Uso por equipes e organizações
  • Ambos os tamanhos de ASR (0,6B + 1,7B)
  • Tradução off-line (38 idiomas)
  • Treinamento de voz pessoal (LoRA)
  • Servidor MCP para agentes de IA
  • Suporte prioritário
  • Descontos por volume (10+ seats)
Comprar licença Business

Preços excluem impostos. Em seguida, $20/seat/ano para atualizações (opcional)

Perguntas frequentes

Não. O Brethof Voice Pro processa tudo localmente no seu dispositivo. Nenhum dado de áudio ou texto sai do seu computador. Não há componente em nuvem, nem telemetria, nem análises.

Qualquer GPU moderna funciona. NVIDIA, AMD e Intel Arc usam aceleração Vulkan. Você também pode rodar apenas com CPU, embora a transcrição seja mais lenta. O modelo de 0,6B roda confortavelmente em gráficos integrados ou em qualquer placa Vulkan com 4 GB+.

Comece com o modelo de 0,6B — É o padrão recomendado e funciona bem na maioria das GPUs (e até mesmo em CPUs nas máquinas mais modernas). Se você precisar de maior precisão em áudio com acentos ou ruídos, mude para o modelo de 1,7B (precisa de 6 GB+ de VRAM). Você pode alterar os tamanhos a qualquer momento em Configurações → Modelos sem baixar novamente.

Sim. O Brethof Voice Pro é compatível nativamente com Linux e Windows. No Linux, funciona com X11 e Wayland. No Windows, roda como um aplicativo de desktop padrão.

Sua licença é perpétua — o aplicativo continua funcionando para sempre com a versão que você tem. O Passe de Atualização opcional, por $20/ano, dá acesso a novos recursos e melhorias nos modelos. Sem ele, você permanece na sua versão atual.

Sim — o treinamento de voz pessoal está incluído na versão 2.0.0 e roda de ponta a ponta na sua máquina. Toda vez que você corrige uma palavra mal reconhecida, o par {clip, correção} é salvo automaticamente no seu conjunto de dados de treinamento local. O cartão de treinamento da janela principal mostra o total de amostras e minutos capturados de relance — clique em "Iniciar treinamento" na aba Treinamento para ajustar um LoRA no seu sotaque. O resultado é exportado automaticamente para GGUF e você alterna para ele com um clique. Grátis para toda licença paga, seus dados de voz nunca saem da sua máquina.

Pronto para experimentar?

Teste gratuito de 14 dias. Sem cartão de crédito. Sem nuvem. Sem concessões.

Ouça quando for enviado

Novos lançamentos, benchmarks reais e análises aprofundadas ocasionais. Sem spam, cancelamento de assinatura com um clique.

Tudo o que construímos

Externo: YouTube · GitHub