Brethof Voice Pro — O que há de novo?

A história contínua deste aplicativo, versão por versão. Se você está na versão mais recente, esta é a lista do que já possui — e as notas abaixo do registro de alterações explicam as decisões por trás de algumas delas.

Lançamento 14 de agosto de 2026

v2.3.1 — contas de dois fatores podem fazer login novamente

Uma regressão na versão anterior fez com que as contas com autenticação de dois fatores ficassem bloqueadas para fazer login. A versão 2.3.1 corrige esse problema. Se for o seu caso: insira suas credenciais e seu código, e você estará logado. Nada mais mudou.

Lançamento 6 de agosto de 2026

v2.2.2 — arquivos de legenda, aproximadamente duas vezes mais rápido

Agora, traduzir um arquivo de legendas leva cerca de metade do tempo que antes. O tempo de processamento permanece o mesmo – cada marca de tempo fica exatamente onde estava no original, seja em nível de frase ou de palavra. Se você trabalha com legendas como profissão, esta é a versão em que o tempo de espera diminuiu significativamente.

Também na v2.2.2:

  • Correção da entrada do microfone — e isso era especialmente importante em microfones de boa qualidade. O nivelamento de áudio pode fazer com que os momentos mais altos de uma gravação limpa ultrapassem o limite máximo e sejam cortados. Quanto melhor for o seu microfone, maior será a diferença entre seus picos e seu nível médio, aumentando as chances disso acontecer – uma entrada compressa e ruidosa passará incólume, enquanto um ambiente silencioso e um microfone condensador de qualidade terão seus sinais cortados. O nivelamento agora deixa espaço suficiente, fazendo com que consoantes e sons intensos se mantenham intactos.
  • Novo translate_batch Ferramenta MCP — Traduza muitas strings em uma única chamada, com um parâmetro de tamanho do lote que reduz automaticamente a carga caso a VRAM fique insuficiente.
Baixar v2.2.2 →
Lançamento 11 de julho de 2026

v2.2.1 — o aplicativo que você possui permanece seu

O Brethof Voice Pro é seu assim que você o adquire, e a versão 2.2.1 garante que nada fique no caminho entre você e ele. A verificação de licença na inicialização costumava funcionar como uma barreira: sem conexão à rede, servidor ocupado ou firewall que bloqueasse, você podia ser impedido de usar um software pelo qual havia pago. Agora ela permite o acesso mesmo assim — se a verificação não conseguir nos alcançar, o aplicativo abre de qualquer forma. Um software que você possui não deveria precisar de permissão para ser iniciado. Agora ele não precisa mais.

  • Botão Verificar Licença novamente Na caixa de diálogo de licença — força uma nova verificação e continua lançando Em caso de sucesso. Anteriormente, as únicas opções eram Comprar ou Desistir.
  • Sem marcação de validade de teste para clientes pagantes — Os diálogos agora mostram o que realmente aconteceu, em vez de exibir a mesma mensagem para todos.
  • Sem mais travamentos da interface. — Os downloads de modelos são realizados através da thread da interface, com indicação do percentual de progresso, e as verificações da licença de inicialização não bloqueiam mais a janela em conexões lentas.
  • Sem ditado perdido — Se a transcrição ainda estiver em andamento quando você terminar de falar, o novo áudio será colocado na fila, em vez de ser descartado silenciosamente, e um processo travado não poderá mais inserir texto posteriormente na sua próxima gravação.
  • Offline é silencioso — Sem esperas repetidas na rede quando não há conexão.
Baixar →
Lançamento 4 de junho de 2026

v2.2.0 — gravar toda a reunião, e não apenas os primeiros cinco minutos

As gravações longas agora são processadas como tarefas em segundo plano. Entregue um arquivo de reunião de duas horas e vá preparar um café — não há limite de duração e não é preciso ficar supervisionando. Deixe-a rodando e esqueça dela; ela será concluída sozinha e manterá a transcrição para você. Uma chamada de três horas não é diferente de uma de três minutos; só leva mais tempo.

  • Microfone ou áudio do sistema — Grave sua própria voz ou faça a captura de loopback de tudo o que está sendo reproduzido em seu dispositivo: chamadas de reunião, abas do navegador, qualquer coisa que esteja saindo dos alto-falantes. Novo list_loopback_sources Ferramenta para ver o que está disponível.
  • Nada é jogado fora — Se uma gravação for abandonada, o watchdog agora a transcreve para um trabalho recuperável, em vez de descartá-la.
  • Limites honestos — O modo de transcrição instantânea de curta duração teve seu limite aumentado para 10 minutos; solicitar um período maior do que esse agora gera um erro claro, indicando a necessidade de usar a ferramenta de transcrição em formato completo. Ela não limita mais silenciosamente o áudio e retorna apenas uma resposta parcial.
  • Correção da tradução de Linux — Uma dependência faltante fez com que a tradução falhasse em todas as compilações do Linux desde a versão 1.7.0. Isso foi detectado por um novo mecanismo de controle de lançamento de ponta a ponta, que verifica o binário realmente compilado antes de qualquer versão ser enviada.
Baixar →
Atualizar 4 de junho de 2026

v2.1.0 — seu agente ganha um ouvido, via HTTP

Um agente na mesma máquina agora pode usar o Brethof Voice Pro — para transcrever, traduzir e gravar — por meio do MCP. Ele funciona via HTTP local, portanto um agente que só consegue acessar recursos por URL pode usá-lo sem uma chave API e sem que nada saia da máquina. Um token protege o acesso, e o servidor se recusa a iniciar sem ele. Este requer uma licença paga.

  • Privado por padrão — Ele escuta apenas em sua própria máquina, a menos que você altere isso deliberadamente, e isso é um limite maior. Recusa-se a ligar Sem um token de autenticação. Quando um token é definido, toda solicitação deve apresentá-lo.
  • Sem interrupção no trabalho — Modelos que são desligados quando estão ociosos não podem mais ser desligados no meio de um trabalho demorado. Um tempo limite que ignora o trabalho em andamento acabará por interromper algo legítimo; portanto, o cronômetro de ociosidade agora é pausado enquanto algo estiver em execução.
Baixar →
Lançamento 21 de maio de 2026

v2.0.0 — tradução que nunca sai de casa

O melhor de todos. A tradução é realizada inteiramente no seu dispositivo, para 38 idiomas. Fale uma vez e tenha o texto digitado em inglês, japonês, francês e espanhol ao mesmo tempo — um por linha ou lado a lado na mesma linha. O motor utilizado é o Hunyuan MT2 da Tencent, disponível em dois tamanhos à sua escolha: rápido para uso diário e de alta qualidade para situações importantes. No modo de alta qualidade, as medições divulgadas pela própria Tencent indicam desempenho de 97,9% em relação ao Google Gemini 3.1 Pro no teste FLORES-200, além de superá-lo em traduções do mundo real e de línguas minoritárias. Tudo isso off-line. Nada é enviado para nenhum lugar.

O que há de novo na v2.0.0:

  • Transcreva + traduza — O pop-up de transcrição tem um menu suspenso “Traduzir para:”. O ASR transcreve, o MT traduz, ambos são renderizados lado a lado. Funciona com arquivos, microfone e áudio do sistema (captura de loopback de chamadas de reunião, abas do navegador, qualquer coisa tocando nos seus alto-falantes).
  • Teclado de voz multilíngue — Um novo chip de tradução na linha principal abre uma grade de idiomas com 3 colunas. Escolha um ou mais destinos, e o teclado digita a tradução. Modos de layout: um por linha, em linha (EN: … || PL: …), ou apenas o primeiro alvo.
  • Tradutor de legendas SRT / VTT — Preserva tempos e índices de cue, suporta modo bilíngue (linha de origem + tradução por cue). Exposto via MCP para automação de agentes de IA.
  • Multi-GPU por motor — Configurações → Modelos tem um seletor de dispositivo independente para cada mecanismo. Execute o ASR no Vulkan 0 e a tradução no Vulkan 1, ou fixe o Hunyuan MT2 7B na CPU em laptops com pouca VRAM.
  • O treinamento de voz pessoal está totalmente disponível — Ajuste fino de LoRA com sua própria voz, de ponta a ponta em sua máquina. O cartão de treinamento na janela principal mostra, de imediato, o número total de amostras e minutos gravados; o botão “Iniciar treinamento” na aba de Treinamento seleciona automaticamente NVIDIA CUDA ou CPU e, em seguida, exporta o modelo treinado para GGUF. Disponível gratuitamente com cada licença paga.
  • 4 novas ferramentas MCPtranslate_text, translate_srt, list_compute_devices, set_compute_device. O número total de ferramentas agora é 19.
  • Divisão honesta de idiomas — ASR: 30 idiomas selecionáveis + detecção automática + 22 dialetos chineses (52 no total). Tradução: 38 idiomas (33 principais + 5 minorias da região chinesa). 23 funcionam em ambas as direções.

O binário do Linux tem 161 MB, enquanto o instalador do Windows tem 118 MB. As licenças existentes são mantidas — basta baixar v2.0.0 e os modelos de tradução aparecerão em Configurações → Modelos.

Baixar v2.0.0 →
Lançamento 20 de maio de 2026

v1.6.16 — sua voz se torna seu próprio modelo

O Brethof Voice Pro agora é treinado com a sua voz. Os dados de treinamento são as correções que você já faz — ao corrigir uma palavra mal ouvida uma vez, ela se torna um exemplo. Você nunca precisa ler frases de exemplo. O treinamento leva apenas um clique, é realizado no seu próprio hardware, e, quando termina, o novo modelo está pronto para ser usado.

A versão de teste desbloqueia tudo, exceto o treinamento pessoal e a conexão com o agente; esta é destinada às pessoas que usam o aplicativo todos os dias.

Engenharia 15 de maio de 2026

v1.6.0 — faça com que funcione, volte mais tarde

Duas coisas. A transcrição agora pode ser realizada como uma tarefa assíncrona — basta inserir o áudio, e a transcrição será gerada quando estiver pronta; não é preciso ficar esperando em frente ao sistema.

E o tempo dos subtítulos: agora é possível definir o tempo palavra por palavra, em vez de frase por frase, nos momentos em que é necessário fazer edições precisas. Se você cria subtítulos, já sabe por que isso é importante.

Engenharia 15 de maio de 2026

v1.5.0 — um ambiente de execução, e o ONNX foi removido

O ambiente de execução ONNX foi removido. Agora todo o produto roda no llama.cpp e em nossa própria biblioteca de tradução — um único ambiente de execução, menor em tamanho, mais rápido para iniciar e mais fácil de distribuir.

Os modelos são pacotes GGUF individuais, e é isso que permite que o modelo menor funcione em qualquer placa de vídeo de 4 GB. Há uma explicação mais detalhada sobre por que tomamos essa decisão um pouco mais adiante na página.

Engenharia 14 de maio de 2026

v1.4.0 — sua primeira conexão com o agente, e um seletor para suas GPUs

Duas primeiras vezes. O servidor MCP faz sua estreia aqui — a primeira maneira de dar “ouvidos” a um agente, tudo em sua própria máquina.

E o seletor de dispositivos: a transcrição e a tradução agora podem escolher seu próprio processador, de modo que uma pode ser executada na placa de vídeo, enquanto a outra funciona no CPU. Um laptop com uma GPU modesta consegue rodar as duas funções sem travar.

Roteiro 16 de abr. de 2026

macOS — em desenvolvimento, primeiro para Apple Silicon

O macOS está em desenvolvimento, priorizando o Apple Silicon. Não há data definida, e não informaremos nenhuma até que a versão final esteja pronta. Enquanto isso, o Linux e o Windows são produtos idênticos com as mesmas funcionalidades — nada é retido em um deles para vender o outro. Quando a versão para Mac for lançada, esta página informará isso.

Leia o post →
Produto 16 de abr. de 2026

Treine-o com a sua própria voz

Seu sotaque não é um problema a ser contornado; é um modelo a ser treinado. O Brethof Voice Pro aprende com as correções que você já faz — corrija uma palavra mal ouvida uma vez, e essa correção se torna um exemplo. Sem frases de exemplo, sem script de calibração, sem horas lendo para o microfone. As palavras marcadas que você já definiu — nomes de marcas, jargões, nomes de colegas — orientam tanto a transcrição quanto a tradução, para que um nome nunca seja localizado por acaso. O treinamento leva apenas um clique, é executado em seu próprio hardware, e o novo modelo está pronto para ser usado assim que terminar. As correções que você já fazia sempre foram material didático. Agora, elas treinam o modelo.

Leia o post →
Anúncio 16 de abr. de 2026

O Brethof Voice Pro está no ar

A primeira versão. Fale em vez de digitar, em qualquer lugar — seu editor, seu terminal, uma caixa de bate-papo, um formulário — e as palavras serão exibidas onde está o Cursor. A transcrição é realizada inteiramente no seu próprio computador, utilizando o Qwen3-ASR da Alibaba com DeepFilterNet3 para reduzir ruídos e Silero VAD para detecção de voz. Tudo é processado localmente. A ligação com seu advogado, o produto ainda não lançado, as anotações dos pacientes — nada disso sai do computador em que foi processado, pois não há para onde possa ir. Funciona em um avião, em um trem passando por um túnel, em um hotel com Wi-Fi ruim. Trinta idiomas, incluindo 22 dialetos chineses separadamente. Funciona no laptop que você já possui — com ou sem placa de vídeo; se houver placa de vídeo, qualquer GPU compatível com Vulkan 1.2+ da NVIDIA, AMD ou Intel Arc. No Linux, é fornecido como um único arquivo portátil, exigindo glibc 2.38 ou superior, enquanto no Windows é um instalador normal que não precisa de privilégios de administrador. Teste de 14 dias, sem necessidade de cartão — apenas um e-mail.

Leia o post →
Licenciamento 16 de abr. de 2026

Sua própria licença agora cobre seu próprio negócio

A licença individual agora cobre trabalhos autônomos e como freelancer. Se você for um empresário individual, um estúdio de uma pessoa ou um empreiteiro, a licença que você compra cobre seu trabalho. Não há contabilidade por usuário, nem níveis diferentes para empresas. Uma licença para dois dispositivos, a ser comprada uma única vez. Vem com um ano de atualizações incluídas; após esse período, as atualizações são opcionais, e o aplicativo continuará funcionando na versão que você possui, indefinidamente. O software pelo qual você pagou permanece seu.

Leia o post →
Produto 12 de abril de 2026

Trinta idiomas, e uma interface que parece ter sido escrita por um ser humano.

O Brethof Voice Pro transcreve em 30 idiomas, reconhece 22 dialetos regionais chineses e traduz para 38 outros. Além disso, sua interface está totalmente traduzida para cada um desses 30 idiomas — traduzida por pessoas que utilizam o produto, e não por meio de tradução automática. Você pode configurar o aplicativo no seu idioma, e ele será lido como se tivesse sido escrito lá, pois realmente foi.

Leia o post →
Engenharia 8 de abril de 2026

Por que passamos do ONNX para o GGUF

As primeiras versões foram desenvolvidas com o ONNX Runtime. Funcionava, mas era pesado, difícil de distribuir e fazia com que o produto ficasse maior do que era necessário. A versão 1.5.0 substituiu isso por um único ambiente de execução — o llama.cpp para transcrição e nossa própria biblioteca para tradução —, e os modelos passaram a ser arquivos GGUF únicos. O resultado é: downloads menores, inicialização mais rápida e um produto que se encaixa melhor em um laptop. Existem dois tamanhos de modelo, uma escolha em vez de diferentes níveis — o menor para laptops e placas de vídeo integradas, o maior para áudio com sotaques ou ruídos. Você pode trocar de modelo a qualquer momento, e não precisa de placa de vídeo se preferir.

Leia o post →
Princípios 4 de abril de 2026

O que “100% off-line” significa, exatamente

Três coisas chegam à rede, e nada mais. Uma verificação de licença quando o aplicativo é iniciado. Uma verificação de atualização quando o aplicativo é iniciado. E o download dos modelos, que você mesmo realiza. A verificação de licença envia uma chave de licença; a verificação de atualização envia uma string de versão. Nenhuma delas envia áudio, nem texto, nunca. Uma vez que os modelos estejam no disco e a verificação de atualização for desativada, nada é enviado. Isso não é uma afirmação de marketing – um registro do firewall mostrará isso. A razão para executar tudo em sua própria máquina não é porque a nuvem seja uma funcionalidade. É porque sua voz é algo que não pode ser retirado: a ligação com seu advogado, o produto ainda não lançado, as anotações do paciente. Uma ferramenta que lida com esses dados não deve precisar de conexão à rede para funcionar. Ela deve funcionar até mesmo em um avião, e não deve ser capaz de vazar informações. Essa é toda a ideia, e trata-se de uma decisão de design, não de uma funcionalidade.

Leia o post →

Receba atualizações em sua caixa de entrada

Um e-mail por versão, com o registro de alterações acima. Sem spam, sem dicas, sem boletim semanal. Cancelar a assinatura com um clique, a qualquer momento.

Criar Conta

Ouça quando for enviado

Novos lançamentos, benchmarks reais e análises aprofundadas ocasionais. Sem spam, cancelamento de assinatura com um clique.

Tudo o que construímos

Externo: YouTube · GitHub