Você está falando. As palavras são gravadas — no seu editor, no seu terminal, em uma caixa de bate-papo, em um formulário, onde quer que o Cursor esteja. E cada uma delas permanece na máquina onde foram ditas.
O Brethof Voice Pro é um sistema de conversão de voz em texto e tradução que funciona inteiramente no seu próprio computador. Isso não é um recurso de privacidade; é o próprio produto.
Um programa, o trabalho de quatro pessoas. Ele transcreve sua voz, traduz para 38 idiomas, adiciona legendas aos seus vídeos e digita por você onde quer que haja um teclado. Funciona off-line — em um avião, em um hotel com Wi-Fi ruim, em um túnel — e no laptop que você já possui, com ou sem placa de vídeo. Sem assinatura. Sem cobrança por minuto. Sem necessidade de envio de arquivos. Dê também ouvidos ao seu agente de IA: ele pode transcrever, traduzir e gravar reuniões de qualquer duração por meio do MCP, no seu próprio dispositivo, sem precisar de chave API. Compre uma vez, e ele continuará funcionando.
Sua voz nunca sai do seu computador. Essa frase é precisa, e é exatamente isso que acontece. Três coisas são enviadas para a rede no momento da inicialização, e apenas três: uma verificação de licença, uma verificação de atualizações e os modelos que você mesmo baixa. A verificação de licença envia uma chave de licença; a verificação de atualizações envia uma string de versão – sem áudio, sem texto, nunca. Se você desativar a verificação de atualizações, uma vez que os modelos estejam no disco, nada será enviado.
Transcrição em mais de 30 idiomas, além de compreensão automática de 22 dialetos regionais chineses — sem configuração, sem treinamento. E seu sotaque não será mais pronunciado de forma incorreta. O Brethof Voice Pro aprende sua voz, seu jargão e seus nomes próprios no próprio dispositivo. Fale o dialeto de Sichuan da sua avó, e ele será reproduzido corretamente.
Fale polonês, leia inglês. Fale inglês, leia japonês. Ou digite uma vez e tenha o texto digitado em inglês, japonês, francês e espanhol ao mesmo tempo — um por linha ou lado a lado na mesma linha. Escolha quantos idiomas de destino quiser; há 38 disponíveis, e 23 funcionam nas duas direções. A tradução também é feita no seu próprio dispositivo, usando o Hunyuan MT2 da Tencent. Em termos de qualidade, atinge 97,9% do desempenho do Gemini 3.1 Pro do Google no teste FLORES-200, e supera-o em traduções do mundo real e de línguas minoritárias. Existem dois tamanhos, ambos com download opcional: um rápido para uso diário e um de alta qualidade para as palavras importantes. Também há legendas. Em formato de texto simples ou SRT, com sincronização por frase ou palavra, quando for necessário editar com precisão. Ao traduzir um arquivo de legendas, todo o sincronismo é mantido. Crie legendas para o seu próprio vídeo em 38 idiomas sem pagar por minuto.
É por isso que funciona onde mais nada funcionará. Um avião. Um hotel com Wi-Fi ruim. Um trem passando por um túnel. Não há para onde a gravação possa ir, então ela não precisa ir a lugar nenhum. Faça uma gravação de uma reunião de duas horas e vá preparar um café; a transcrição estará lá quando você voltar. Esqueça que você deixou a gravação em andamento e nada será perdido — ela termina o trabalho sozinha e guarda a transcrição.
Dois modelos de transcrição; é uma escolha, não um nível — você pode trocar a qualquer momento.
A maioria dos softwares de voz exige que você leia frases de exemplo durante a configuração. Este não faz isso. Ele aprende com as correções que você faz: quando você corrige uma palavra mal ouvida, essa correção se torna um exemplo de treinamento. Ao definir uma vez os nomes da sua marca, seu jargão e os nomes dos seus colegas, eles deixam de ser pronunciados incorretamente – tanto na transcrição quanto na tradução, pois a mesma lista é utilizada em ambos os casos. Um nome nunca é localizado por acaso. O treinamento é feito com apenas um clique; ele roda no seu hardware, e o novo modelo fica pronto para ser utilizado assim que o processo for concluído.
Compre uma vez e será seu. Uma licença perpétua com um ano de atualizações incluídas.
Uma sala barulhenta deixa de ser um problema. A redução de ruído está integrada, para gravações feitas em um café, em uma feira comercial ou em um carro. Ela está desativada por padrão, pois testamos isso: em clipes curtos e limpos gravados com o microfone, ela piora a situação. Para reuniões de duas horas com uma máquina de espresso ao seu lado, ative-a.
O teclado de voz digita onde quer que seu Cursor esteja — em um navegador, em um IDE, em um aplicativo de bate-papo, em qualquer campo que aceite entrada por teclado. E ele pode digitar a tradução em vez da transcrição. Diga a frase em seu idioma, e as palavras corretas serão inseridas no formulário, no idioma exigido pelo mesmo. Uma única linha, sem cortar ou colar.
O 0,6B é o modelo para uso diário. Funciona em qualquer placa de vídeo de 4 GB, em placas de vídeo integradas e em laptops que não possuem placa de vídeo alguma. Rápido, leve, está sempre disponível quando você precisa.
O modelo de 1,7 bilhão é o mais preciso – para áudio com acentos, áudio ruim, ou reuniões de duas horas em que as palavras são importantes. Ele requer cerca de 6 GB de VRAM, ou 8 GB se o modelo de tradução de alta qualidade for carregado junto.
Sem GPU algum? Ainda funciona. A versão apenas com CPU precisa de 8 GB de RAM, um processador de quatro núcleos e cerca de 5 GB de espaço livre no disco; para o resto, são necessários 7–9 GB. Qualquer placa compatível com Vulkan 1.2+ serve — NVIDIA, AMD, Intel Arc. Além disso, a transcrição e a tradução utilizam processadores separados, então uma pode rodar na placa de vídeo enquanto a outra roda no CPU.
Complementos opcionais baixados sob demanda em Configurações → Modelos:
Forced Aligner (~540 MB) para marcas de tempo em nível de palavra · Hunyuan MT2 Fast (~1 GB) ou Qualidade (~4,3 GB) para tradução.
| Recurso | Brethof Voice Pro | Dragon | Google STT | Otter.ai | Whisper (OSS) |
|---|---|---|---|---|---|
| Processamento 100% local | ✓ | ✓ | ✗ | ✗ | ✓ |
| Licença perpétua | ✓ | ~ | ✗ | ✗ | ✓ |
| Suporte nativo para Linux | ✓ | ✗ | ~ | ✗ | ✓ |
| Suporte nativo para Windows | ✓ | ✓ | ~ | ✗ | ~ |
| 30 idiomas de ASR + detecção automática | ✓ | ✗ | ✓ | ~ | ✓ |
| Tradução off-line (38 idiomas) | ✓ | ✗ | ✗ | ✗ | ✗ |
| Aceleração por GPU (NVIDIA + AMD + Intel) | ✓ | ✗ | N/A | N/A | ~ |
| Ajuste fino de modelo pessoal (LoRA) | ✓ | ✓ | ✗ | ✗ | ✗ |
| Servidor MCP para agentes de IA | ✓ | ✗ | ✗ | ✗ | ✗ |
| Redução de ruído integrada | ✓ | ✓ | ✓ | ✓ | ✗ |
| Injeção direta de texto | ✓ | ✓ | ✗ | ✗ | ✗ |
| Interface gráfica de desktop aprimorada | ✓ | ✓ | ✗ | ✓ | ✗ |
| Custo típico | $49 uma vez | $350+/ano | $17/mês | $17/mês | Gratuito |
Sem taxas mensais. Sem limites de uso. Licença perpétua com 1 ano de atualizações incluídas.
Não é necessário cartão de crédito. Basta um e-mail para verificar seu teste gratuito.
Licença perpétua. 2 dispositivos pessoais. 1 ano de atualizações incluído.
Preços sem impostos. Depois, $20/ano para atualizações (opcional).
Licença perpétua por seat. Uso para equipas e organizações. 1 ano de atualizações.
Preços excluem impostos. Em seguida, $20/seat/ano para atualizações (opcional)
Não. O Brethof Voice Pro processa tudo localmente no seu dispositivo. Nenhum dado de áudio ou texto sai do seu computador. Não há componente em nuvem, nem telemetria, nem análises.
Qualquer GPU moderna funciona. NVIDIA, AMD e Intel Arc usam aceleração Vulkan. Você também pode rodar apenas com CPU, embora a transcrição seja mais lenta. O modelo de 0,6B roda confortavelmente em gráficos integrados ou em qualquer placa Vulkan com 4 GB+.
Comece com o modelo de 0,6B — É o padrão recomendado e funciona bem na maioria das GPUs (e até mesmo em CPUs nas máquinas mais modernas). Se você precisar de maior precisão em áudio com acentos ou ruídos, mude para o modelo de 1,7B (precisa de 6 GB+ de VRAM). Você pode alterar os tamanhos a qualquer momento em Configurações → Modelos sem baixar novamente.
Sim. O Brethof Voice Pro é compatível nativamente com Linux e Windows. No Linux, funciona com X11 e Wayland. No Windows, roda como um aplicativo de desktop padrão.
Sua licença é perpétua — o aplicativo continua funcionando para sempre com a versão que você tem. O Passe de Atualização opcional, por $20/ano, dá acesso a novos recursos e melhorias nos modelos. Sem ele, você permanece na sua versão atual.
Sim — o treinamento de voz pessoal está incluído na versão 2.0.0 e roda de ponta a ponta na sua máquina. Toda vez que você corrige uma palavra mal reconhecida, o par {clip, correção} é salvo automaticamente no seu conjunto de dados de treinamento local. O cartão de treinamento da janela principal mostra o total de amostras e minutos capturados de relance — clique em "Iniciar treinamento" na aba Treinamento para ajustar um LoRA no seu sotaque. O resultado é exportado automaticamente para GGUF e você alterna para ele com um clique. Grátis para toda licença paga, seus dados de voz nunca saem da sua máquina.
Teste gratuito de 14 dias. Sem cartão de crédito. Sem nuvem. Sem concessões.
Reconhecimento de fala local que aprende sua voz. Licença perpétua. Nosso produto principal.
PAGO · flagship
Memória de longo prazo para seus agentes de IA — texto completo + vetores + grafos. Informado no início da sessão, recuperado em cada solicitação, arquivado automaticamente.
PAGO · plano gratuito
Modelos digitais prontos para impressão. GLB e OBJ incluídos. Acesso vitalício.
PAGO · catálogo digital
Cinco impressoras e capacidade real. Ainda não há loja de autoatendimento — diga-nos o que precisa e enviaremos uma cotação por e-mail.
Por acordo · envie um e-mail para nós
Nosso canal no YouTube. Um apresentador “tigre cibernético” mostra os ferramentas de IA locais e o que elas realmente fazem.
CANAL · ao vivo
Listas selecionadas no GitHub para agentes de codificação de IA, servidores MCP, IA local e Linux para IA. Cada entrada possui um link de origem.
GRÁTIS · curadoria
Guias detalhados de instruções para IA local em Linux, Windows e macOS, com os arquivos de configuração incluídos.
GRÁTIS · ao vivo
Curadoria negativa: práticas e ferramentas que desperdiçam seu tempo, classificadas. Comprovantes necessários.
GRÁTIS · ao vivo
Quem somos, por que desenvolvemos IA com privacidade em primeiro lugar, e o que não faremos.