Brethof Voice Pro — 有什么新消息?

该应用的更新情况是逐次发布的。如果您使用的是最新版本,这里列出了您已拥有的功能;而更新日志下方的说明则解释了某些功能背后的设计思路。

发布 2026年8月14日

v2.3.1 — 两因素认证账户可重新登录

在之前的版本中出现了故障,导致使用了双因素认证的账户无法登录。v2.3.1版本已修复了这一问题。如果是您遇到了这种情况:输入您的账号和密码,再输入验证码即可登录。其他方面没有变化。

发布 2026年8月6日

v2.2.2 — 字幕文件,速度大约快一倍

现在,翻译字幕文件所需的时间大约只有原来的一半。时间标记依然保持不变——无论选择按句子还是按单词来处理,每个时间戳都会准确出现在原始文件中的对应位置。对于以字幕翻译为职业的人来说,这一版本确实大大缩短了等待时间。

在v2.2.2版本中也有:

  • 麦克风输入问题已解决——这对于质量较好的麦克风来说尤为重要。. 音频电平调整可能会导致干净录音中声音最响亮的部分超出最大动态范围而出现失真。麦克风的质量越好,其峰值与平均电平之间的差距就越大,出现这种问题的可能性也就越高——在安静的录制环境中使用优质的电容式麦克风时,声音不会失真;而使用劣质麦克风时,则容易出现失真现象。通过适当的电平调整,可以保留足够的动态范围,从而使辅音及声音的起始部分保持完整无损。
  • translate_batch MCP工具 — 可在一次调用中翻译多个字符串,同时设有批量大小参数;当显存不足时,该参数会自动降低。
下载v2.2.2 →
发布 2026年7月11日

v2.2.1 — 你拥有的应用始终属于你

一旦购买,Brethof Voice Pro就归您所有,而v2.2.1版本确保没有任何因素阻碍您使用它。以往启动时的许可检查就像一道门槛:没有网络、服务器繁忙、防火墙拒绝,都可能让您无法使用已付费的软件。但现在这一检查不再起阻拦作用——即便无法与服务器建立连接,应用依然可以正常启动。属于您的软件不应还需要请求许可才能运行,现在它已经不需要了。

  • 重新检查许可证按钮 在许可证对话框中——会强制进行重新检查。 持续推出 一旦成功。此前,唯一的出路就是购买或放弃。
  • 付费客户无需试用到期标识 — 对话现在会显示实际发生的情况,而不会向所有人展示相同的消息。
  • UI不再卡顿 — 模型下载会在界面线程之外执行,并显示进度百分比;而在网络连接较慢的情况下,启动许可证检查也不会再导致窗口卡住。
  • 没有丢失的听写内容 — 如果在您停止说话时转录过程仍在继续,新的音频会被排队处理,而不会被直接丢弃;同时,处于停滞状态的程序也无法再为下一次录音添加文字内容。
  • 离线时很安静 — 没有连接时,不会发生重复的网络等待。
下载 →
发布 2026年6月4日

v2.2.0 — 录制整个会议内容,而不仅仅是前五分钟

长时间的录音现在可以作为后台任务来处理。只需将时长为两小时的会议录音交给他,然后去喝咖啡即可——没有长度限制,也不需要持续监控。只需让系统继续运行,它就会自动完成处理,并为你保存录音文本。无论是三小时的通话还是三分钟的通话,处理方式都是一样的,只是前者所需时间更长而已。

  • 麦克风或系统音频 — 录制自己的声音,或捕获电脑上正在播放的任何内容:会议通话、浏览器中的页面内容,以及扬声器里发出的所有声音。全新功能 list_loopback_sources 用于查看可用内容的工具。
  • 没有东西会被丢弃。 — 如果某个录音被放弃处理,监控系统会将其转录为可检索的记录,而非直接丢弃。
  • 诚实的限度 — 短时转录模式的时长上限已被提升至10分钟;若尝试输入超过该限制的音频,系统会给出明确错误提示,建议使用长时转录功能。它不会再悄悄截断音频内容并仅返回部分转录结果。
  • Linux的翻译修正 — 自v1.7.0版本以来,由于缺少某个依赖项,导致所有Linux构建版本的翻译功能均出现故障。这一问题是通过新的端到端发布检测机制发现的,该机制会在任何版本发布之前对实际生成的二进制文件进行检测。
下载 →
更新 2026年6月4日

v2.1.0 — 通过HTTP,您的代理能够接收到消息

同一台机器上的代理现在可以通过MCP使用Brethof Voice Pro——进行转录、翻译和录音。它基于本地HTTP运行,因此那些只能通过URL访问资源的代理无需API密钥即可使用,且数据不会离开该机器。令牌起到保护作用,没有令牌服务器将无法启动。此版本需要购买付费许可证。

  • 默认为私密。 — 除非你刻意更改设置,否则它只会在你的机器上监听,限制更为严格。 拒绝启动 没有认证令牌。一旦设置了令牌,每个请求都必须提供该令牌。
  • 工作不会中断 — 那些在空闲时即可被卸载的模型,无法在长时间运行的任务进行过程中被卸载。如果忽略正在执行中的任务而设置超时时间,最终会导致某些正常运行的程序被终止。因此,只要还有任务在运行,空闲计时器就会暂停计时。
下载 →
发布 2026 年 5 月 21 日

v2.0.0 — 从未离开过“家”的翻译版本

这款强大的工具能让翻译完全在您的设备上完成,支持38种语言。只需说一次,就能同时得到英语、日语、法语和西班牙语的文本输出——可以每行一种,也可以在同一行中并排显示。其背后的引擎是腾讯的Hunyuan MT2,提供两种版本供您选择:快速版适合日常使用,高质量版则在关键场合更为可靠。根据腾讯公布的测试数据,在FLORES-200基准测试中,高质量版的性能相当于Google Gemini 3.1 Pro的97.9%,而在实际场景及小语种翻译方面表现更佳。所有处理都在离线状态下进行,数据不会被上传到任何地方。

v2.0.0 版本的新增功能:

  • 转录 + 翻译 — “转录”弹出窗口有一个“翻译为:”下拉菜单。ASR负责转录,MT负责翻译,两者并排渲染。支持文件、麦克风和系统音频(会议通话的回放、浏览器标签页、扬声器播放的任何内容)。
  • 多语言语音键盘 — 主行上的新翻译芯片可生成三列式的语言网格。选择一个或多个目标语言,键盘便会自动输入对应的翻译内容。布局模式:每行一个,内联(EN: … || PL: …),或仅针对第一个目标。
  • SRT / VTT 字幕翻译工具 — 保留时间戳与提示索引,支持双语模式(每个提示包含原文行与译文)。通过 MCP 接口供 AI 智能体自动化使用。
  • 每个引擎支持多 GPU — 设置 → 模型为每个引擎提供独立的设备选择器。可在 Vulkan 0 上运行 ASR,在 Vulkan 1 上运行翻译,或者在显存紧张的笔记本上将 Hunyuan MT2 7B 固定到 CPU 上。
  • 个人语音训练功能已全面上线 — 在您的设备上对您自己的声音进行端到端的 LoRA 微调。主窗口的训练卡片可让您一目了然地查看捕获的总样本数和分钟数;训练选项卡中的“开始训练”会自动选择 NVIDIA CUDA 或 CPU,然后自动将训练好的模型导出为 GGUF。所有付费许可证均免费提供。
  • 4款新的MCP工具translate_text, translate_srt, list_compute_devices, set_compute_device. 工具总数现已达到 19 个。
  • 诚实的语言划分 — 自动语音识别(ASR):30种可选语言 + 自动检测 + 22种中文方言(共52种)。翻译:38种语言(33种主要语言 + 5种中国地区少数民族语言)。其中23种语言支持双向翻译。

Linux二进制文件的大小为161 MB,Windows安装程序的大小为118 MB。现有许可证可继续使用——只需 下载v2.0.0 翻译模型将显示在“设置”→“模型”中。

下载 v2.0.0 →
发布 2026 年 5 月 20 日

v1.6.16 — 您的声音将形成独立的模型

Brethof Voice Pro现在可以基于您的声音进行训练。训练数据就是您所做的修正——一旦您纠正了一个听错的单词,它就会成为训练样本。系统不会要求您朗读示例句子。训练只需点击一下即可,在您的设备上完成,训练结束后即可切换到新的模型。

该试用版可解锁除私人训练和客服联系之外的所有功能;后者则是为那些每天使用该应用的人准备的。

工程 2026 年 5 月 15 日

v1.6.0 — 已启动,稍后再来。

有两点。现在,文本转录可以作为异步任务来执行——只需上传音频文件,待转录完成后再获取结果,无需一直守在电脑前等待。

至于字幕的同步时间设置:现在你可以逐词调整时间,而非按句子来调整,这样在需要精确编辑时更为方便。如果你曾经制作过字幕,就应该明白这一点的重要性。

工程 2026 年 5 月 15 日

v1.5.0 — 仅一个运行时,ONNX已被移除

ONNX运行时已不再使用。现在整个产品都基于llama.cpp以及我们自己的翻译库运行——只需一个运行时,磁盘占用更小,启动更快,部署也更简便。

这些模型都是单个GGUF格式的文件,正因如此,体积较小的模型才能在任何4GB显存的显卡上运行。关于我们为何做出这一选择的详细说明,请参见页面下方的内容。

工程 2026 年 5 月 14 日

v1.4.0 — 首次连接智能体,以及GPU选择功能

两个“首次”。MCP服务器在此首次亮相——这是首个让你在自己的机器上为智能体配备“耳朵”的方法。

至于设备选择功能:现在,转录和翻译功能可以各自选择不同的处理器,这样,一个功能可以在显卡上运行,而另一个则在CPU上运行。即便笔记本电脑的GPU性能一般,也能让这两个功能同时运行而不出现卡顿现象。

路线图 2026年4月16日

macOS——正在开发中,首先支持Apple Silicon芯片

macOS仍在开发中,将首先采用Apple Silicon芯片。目前尚无具体时间表,等到产品真正成型后我们才会公布日期。在此期间,Linux和Windows是功能相同的同类产品——不会为了推销其中一款而限制另一款的功能。一旦Mac版本推出,本页面会及时告知。

阅读文章 →
产品 2026年4月16日

用你自己的声音来训练它。

你的口音并非需要刻意克服的问题,而是一种可以用来训练的模型。Brethof Voice Pro会学习你已做出的修正——一旦纠正了某个听错的单词,该修正就会成为示例。无需样本句子,无需校准脚本,也无需对着麦克风朗读数小时。你预先设定的固定词汇——品牌名称、专业术语、同事的名字——会引导文字转录和翻译过程,从而确保名字不会被错误地本地化。训练只需点击一下,就在你的设备上运行,完成后即可切换到新模型。你之前所做的修正一直都是教学材料,现在它们则用于训练模型。

阅读文章 →
公告 2026年4月16日

Brethof Voice Pro 已上线

首个版本。只需开口说话而非打字,无论是在编辑器、终端、聊天框还是表单中,文字都会出现在光标所在的位置。转录功能完全在您的设备上运行,采用阿里巴巴的Qwen3-ASR技术,并结合DeepFilterNet3处理噪声,再通过Silero VAD进行语音检测。所有处理都在本地完成。与律师的通话、未发布的产品资料、患者记录——这些内容都不会离开运行它们的电脑,因为根本无处传输。它可以在飞机上、穿越隧道的火车上,或是WiFi信号不佳的酒店里使用。支持30种语言,其中22种为中文方言。可在您现有的笔记本电脑上运行——无论是否有显卡;若有显卡,需为Vulkan 1.2+版本的NVIDIA、AMD或Intel Arc显卡。在Linux系统上以单个便携文件形式提供,需要glibc 2.38或更高版本;在Windows系统上则是常规安装程序,无需管理员权限。提供14天试用版,无需信用卡,仅需电子邮件即可。

阅读文章 →
许可授权 2026年4月16日

您自己的许可证现已涵盖您自己的业务。

该个人许可证现在涵盖了个体经营和自由职业工作。无论您是单独经营者、个人工作室主理人还是承包商,所购买的许可证都适用于您的业务。无需按用户数量计费,也没有不同的业务等级划分。一张许可证可对应两台设备,只需购买一次即可。该许可证包含一年的更新服务;之后更新为可选项目,应用程序将一直使用您当前的版本运行。您支付的软件费用归您所有。

阅读文章 →
产品 2026年4月12日

30种语言支持,界面设计得宛如由真人编写一般。

Brethof Voice Pro支持30种语言的转录,能识别22种中文方言,并可进行38种语言之间的互译。其界面也已被完整翻译成这30种语言——这些翻译是由实际使用该产品的人完成的,而非通过机器翻译后再生成的。你可以将应用设置为对应的语言,它的显示效果就会如同是用该语言撰写的一样,因为确实如此。

阅读文章 →
工程 2026年4月8日

我们为何从ONNX转向GGUF

最初的版本是在ONNX Runtime上运行的。虽然可行,但效率较低,部署起来也不方便,还会使产品体积超出必要范围。v1.5.0版本用单一的运行时环境取而代之——转录功能使用llama.cpp,翻译功能则使用我们自己的库,同时模型也被整合为单独的GGUF格式文件。这样一来,下载量更小,启动速度更快,产品也能更轻松地适配笔记本电脑。该版本提供了两种模型尺寸供选择,而非不同的等级:较小的模型适用于笔记本电脑和集成显卡,较大的模型则适合处理带有口音或背景噪音的音频。用户可以随时切换模型,如果不想使用显卡的话也完全不必。

阅读文章 →
原则 2026年4月4日

“100%离线”究竟意味着什么?

只有三样东西会传送到网络中,除此之外没有其他内容。首先是应用启动时的许可证检查;其次是应用启动时的更新检查。至于模型文件,则需要由用户自行下载。许可证检查会发送许可证密钥,而更新检查则会发送版本信息。这两种操作都不会传输任何音频或文本数据。一旦模型文件被存储在本地且更新检查功能被关闭,就再不会有任何数据被传输出去。这并非营销话术——防火墙日志就能证明这一点。将所有处理工作都在本地机器上完成的理由,并不是因为云服务具有某种特殊优势,而是因为人的声音是无法收回的:比如与律师的通话内容、尚未公开的产品设计、病人的病历记录等。用于处理这些内容的工具不应依赖网络连接才能正常工作,它应该能在飞机上使用,而且绝不能泄露任何信息。这就是其设计理念,属于设计决策,而非某种功能特性。

阅读文章 →

在您的收件箱中获取更新

每次发布内容时发送一封邮件,其中包含上述变更日志。不发送垃圾邮件,也不提供任何建议或每周新闻简报。随时可一键取消订阅。

创建账户

产品上市时再听吧

最新作品、真实评测,还有偶尔的深度分析。无垃圾信息,一键即可取消订阅。

我们打造的一切

外部: YouTube · GitHub