A história contínua deste aplicativo, versão por versão. Se você está na versão mais recente, esta é a lista do que já possui — e as notas abaixo do registro de alterações explicam as decisões por trás de algumas delas.
Uma regressão na versão anterior fez com que as contas com autenticação de dois fatores ficassem bloqueadas para fazer login. A versão 2.3.1 corrige esse problema. Se for o seu caso: insira suas credenciais e seu código, e você estará logado. Nada mais mudou.
Agora, traduzir um arquivo de legendas leva cerca de metade do tempo que antes. O tempo de processamento permanece o mesmo – cada marca de tempo fica exatamente onde estava no original, seja em nível de frase ou de palavra. Se você trabalha com legendas como profissão, esta é a versão em que o tempo de espera diminuiu significativamente.
Também na v2.2.2:
translate_batch Ferramenta MCP — Traduza muitas strings em uma única chamada, com um parâmetro de tamanho do lote que reduz automaticamente a carga caso a VRAM fique insuficiente.O Brethof Voice Pro é seu assim que você o adquire, e a versão 2.2.1 garante que nada fique no caminho entre você e ele. A verificação de licença na inicialização costumava funcionar como uma barreira: sem conexão à rede, servidor ocupado ou firewall que bloqueasse, você podia ser impedido de usar um software pelo qual havia pago. Agora ela permite o acesso mesmo assim — se a verificação não conseguir nos alcançar, o aplicativo abre de qualquer forma. Um software que você possui não deveria precisar de permissão para ser iniciado. Agora ele não precisa mais.
As gravações longas agora são processadas como tarefas em segundo plano. Entregue um arquivo de reunião de duas horas e vá preparar um café — não há limite de duração e não é preciso ficar supervisionando. Deixe-a rodando e esqueça dela; ela será concluída sozinha e manterá a transcrição para você. Uma chamada de três horas não é diferente de uma de três minutos; só leva mais tempo.
list_loopback_sources Ferramenta para ver o que está disponível.Um agente na mesma máquina agora pode usar o Brethof Voice Pro — para transcrever, traduzir e gravar — por meio do MCP. Ele funciona via HTTP local, portanto um agente que só consegue acessar recursos por URL pode usá-lo sem uma chave API e sem que nada saia da máquina. Um token protege o acesso, e o servidor se recusa a iniciar sem ele. Este requer uma licença paga.
O melhor de todos. A tradução é realizada inteiramente no seu dispositivo, para 38 idiomas. Fale uma vez e tenha o texto digitado em inglês, japonês, francês e espanhol ao mesmo tempo — um por linha ou lado a lado na mesma linha. O motor utilizado é o Hunyuan MT2 da Tencent, disponível em dois tamanhos à sua escolha: rápido para uso diário e de alta qualidade para situações importantes. No modo de alta qualidade, as medições divulgadas pela própria Tencent indicam desempenho de 97,9% em relação ao Google Gemini 3.1 Pro no teste FLORES-200, além de superá-lo em traduções do mundo real e de línguas minoritárias. Tudo isso off-line. Nada é enviado para nenhum lugar.
O que há de novo na v2.0.0:
EN: … || PL: …), ou apenas o primeiro alvo.translate_text, translate_srt, list_compute_devices, set_compute_device. O número total de ferramentas agora é 19.O binário do Linux tem 161 MB, enquanto o instalador do Windows tem 118 MB. As licenças existentes são mantidas — basta baixar v2.0.0 e os modelos de tradução aparecerão em Configurações → Modelos.
Baixar v2.0.0 →O Brethof Voice Pro agora é treinado com a sua voz. Os dados de treinamento são as correções que você já faz — ao corrigir uma palavra mal ouvida uma vez, ela se torna um exemplo. Você nunca precisa ler frases de exemplo. O treinamento leva apenas um clique, é realizado no seu próprio hardware, e, quando termina, o novo modelo está pronto para ser usado.
A versão de teste desbloqueia tudo, exceto o treinamento pessoal e a conexão com o agente; esta é destinada às pessoas que usam o aplicativo todos os dias.
Duas coisas. A transcrição agora pode ser realizada como uma tarefa assíncrona — basta inserir o áudio, e a transcrição será gerada quando estiver pronta; não é preciso ficar esperando em frente ao sistema.
E o tempo dos subtítulos: agora é possível definir o tempo palavra por palavra, em vez de frase por frase, nos momentos em que é necessário fazer edições precisas. Se você cria subtítulos, já sabe por que isso é importante.
O ambiente de execução ONNX foi removido. Agora todo o produto roda no llama.cpp e em nossa própria biblioteca de tradução — um único ambiente de execução, menor em tamanho, mais rápido para iniciar e mais fácil de distribuir.
Os modelos são pacotes GGUF individuais, e é isso que permite que o modelo menor funcione em qualquer placa de vídeo de 4 GB. Há uma explicação mais detalhada sobre por que tomamos essa decisão um pouco mais adiante na página.
Duas primeiras vezes. O servidor MCP faz sua estreia aqui — a primeira maneira de dar “ouvidos” a um agente, tudo em sua própria máquina.
E o seletor de dispositivos: a transcrição e a tradução agora podem escolher seu próprio processador, de modo que uma pode ser executada na placa de vídeo, enquanto a outra funciona no CPU. Um laptop com uma GPU modesta consegue rodar as duas funções sem travar.
O macOS está em desenvolvimento, priorizando o Apple Silicon. Não há data definida, e não informaremos nenhuma até que a versão final esteja pronta. Enquanto isso, o Linux e o Windows são produtos idênticos com as mesmas funcionalidades — nada é retido em um deles para vender o outro. Quando a versão para Mac for lançada, esta página informará isso.
Leia o post →Seu sotaque não é um problema a ser contornado; é um modelo a ser treinado. O Brethof Voice Pro aprende com as correções que você já faz — corrija uma palavra mal ouvida uma vez, e essa correção se torna um exemplo. Sem frases de exemplo, sem script de calibração, sem horas lendo para o microfone. As palavras marcadas que você já definiu — nomes de marcas, jargões, nomes de colegas — orientam tanto a transcrição quanto a tradução, para que um nome nunca seja localizado por acaso. O treinamento leva apenas um clique, é executado em seu próprio hardware, e o novo modelo está pronto para ser usado assim que terminar. As correções que você já fazia sempre foram material didático. Agora, elas treinam o modelo.
Leia o post →A primeira versão. Fale em vez de digitar, em qualquer lugar — seu editor, seu terminal, uma caixa de bate-papo, um formulário — e as palavras serão exibidas onde está o Cursor. A transcrição é realizada inteiramente no seu próprio computador, utilizando o Qwen3-ASR da Alibaba com DeepFilterNet3 para reduzir ruídos e Silero VAD para detecção de voz. Tudo é processado localmente. A ligação com seu advogado, o produto ainda não lançado, as anotações dos pacientes — nada disso sai do computador em que foi processado, pois não há para onde possa ir. Funciona em um avião, em um trem passando por um túnel, em um hotel com Wi-Fi ruim. Trinta idiomas, incluindo 22 dialetos chineses separadamente. Funciona no laptop que você já possui — com ou sem placa de vídeo; se houver placa de vídeo, qualquer GPU compatível com Vulkan 1.2+ da NVIDIA, AMD ou Intel Arc. No Linux, é fornecido como um único arquivo portátil, exigindo glibc 2.38 ou superior, enquanto no Windows é um instalador normal que não precisa de privilégios de administrador. Teste de 14 dias, sem necessidade de cartão — apenas um e-mail.
Leia o post →A licença individual agora cobre trabalhos autônomos e como freelancer. Se você for um empresário individual, um estúdio de uma pessoa ou um empreiteiro, a licença que você compra cobre seu trabalho. Não há contabilidade por usuário, nem níveis diferentes para empresas. Uma licença para dois dispositivos, a ser comprada uma única vez. Vem com um ano de atualizações incluídas; após esse período, as atualizações são opcionais, e o aplicativo continuará funcionando na versão que você possui, indefinidamente. O software pelo qual você pagou permanece seu.
Leia o post →O Brethof Voice Pro transcreve em 30 idiomas, reconhece 22 dialetos regionais chineses e traduz para 38 outros. Além disso, sua interface está totalmente traduzida para cada um desses 30 idiomas — traduzida por pessoas que utilizam o produto, e não por meio de tradução automática. Você pode configurar o aplicativo no seu idioma, e ele será lido como se tivesse sido escrito lá, pois realmente foi.
Leia o post →As primeiras versões foram desenvolvidas com o ONNX Runtime. Funcionava, mas era pesado, difícil de distribuir e fazia com que o produto ficasse maior do que era necessário. A versão 1.5.0 substituiu isso por um único ambiente de execução — o llama.cpp para transcrição e nossa própria biblioteca para tradução —, e os modelos passaram a ser arquivos GGUF únicos. O resultado é: downloads menores, inicialização mais rápida e um produto que se encaixa melhor em um laptop. Existem dois tamanhos de modelo, uma escolha em vez de diferentes níveis — o menor para laptops e placas de vídeo integradas, o maior para áudio com sotaques ou ruídos. Você pode trocar de modelo a qualquer momento, e não precisa de placa de vídeo se preferir.
Leia o post →Três coisas chegam à rede, e nada mais. Uma verificação de licença quando o aplicativo é iniciado. Uma verificação de atualização quando o aplicativo é iniciado. E o download dos modelos, que você mesmo realiza. A verificação de licença envia uma chave de licença; a verificação de atualização envia uma string de versão. Nenhuma delas envia áudio, nem texto, nunca. Uma vez que os modelos estejam no disco e a verificação de atualização for desativada, nada é enviado. Isso não é uma afirmação de marketing – um registro do firewall mostrará isso. A razão para executar tudo em sua própria máquina não é porque a nuvem seja uma funcionalidade. É porque sua voz é algo que não pode ser retirado: a ligação com seu advogado, o produto ainda não lançado, as anotações do paciente. Uma ferramenta que lida com esses dados não deve precisar de conexão à rede para funcionar. Ela deve funcionar até mesmo em um avião, e não deve ser capaz de vazar informações. Essa é toda a ideia, e trata-se de uma decisão de design, não de uma funcionalidade.
Leia o post →Um e-mail por versão, com o registro de alterações acima. Sem spam, sem dicas, sem boletim semanal. Cancelar a assinatura com um clique, a qualquer momento.
Criar ContaReconhecimento de fala local que aprende sua voz. Licença perpétua. Nosso produto principal.
PAGO · flagship
Memória de longo prazo para seus agentes de IA — texto completo + vetores + grafos. Informado no início da sessão, recuperado em cada solicitação, arquivado automaticamente.
PAGO · plano gratuito
Modelos digitais prontos para impressão. GLB e OBJ incluídos. Acesso vitalício.
PAGO · catálogo digital
Cinco impressoras e capacidade real. Ainda não há loja de autoatendimento — diga-nos o que precisa e enviaremos uma cotação por e-mail.
Por acordo · envie um e-mail para nós
Nosso canal no YouTube. Um apresentador “tigre cibernético” mostra os ferramentas de IA locais e o que elas realmente fazem.
CANAL · ao vivo
Listas selecionadas no GitHub para agentes de codificação de IA, servidores MCP, IA local e Linux para IA. Cada entrada possui um link de origem.
GRÁTIS · curadoria
Guias detalhados de instruções para IA local em Linux, Windows e macOS, com os arquivos de configuração incluídos.
GRÁTIS · ao vivo
Curadoria negativa: práticas e ferramentas que desperdiçam seu tempo, classificadas. Comprovantes necessários.
GRÁTIS · ao vivo
Quem somos, por que desenvolvemos IA com privacidade em primeiro lugar, e o que não faremos.