该应用的更新情况是逐次发布的。如果您使用的是最新版本,这里列出了您已拥有的功能;而更新日志下方的说明则解释了某些功能背后的设计思路。
在之前的版本中出现了故障,导致使用了双因素认证的账户无法登录。v2.3.1版本已修复了这一问题。如果是您遇到了这种情况:输入您的账号和密码,再输入验证码即可登录。其他方面没有变化。
现在,翻译字幕文件所需的时间大约只有原来的一半。时间标记依然保持不变——无论选择按句子还是按单词来处理,每个时间戳都会准确出现在原始文件中的对应位置。对于以字幕翻译为职业的人来说,这一版本确实大大缩短了等待时间。
在v2.2.2版本中也有:
translate_batch MCP工具 — 可在一次调用中翻译多个字符串,同时设有批量大小参数;当显存不足时,该参数会自动降低。一旦购买,Brethof Voice Pro就归您所有,而v2.2.1版本确保没有任何因素阻碍您使用它。以往启动时的许可检查就像一道门槛:没有网络、服务器繁忙、防火墙拒绝,都可能让您无法使用已付费的软件。但现在这一检查不再起阻拦作用——即便无法与服务器建立连接,应用依然可以正常启动。属于您的软件不应还需要请求许可才能运行,现在它已经不需要了。
长时间的录音现在可以作为后台任务来处理。只需将时长为两小时的会议录音交给他,然后去喝咖啡即可——没有长度限制,也不需要持续监控。只需让系统继续运行,它就会自动完成处理,并为你保存录音文本。无论是三小时的通话还是三分钟的通话,处理方式都是一样的,只是前者所需时间更长而已。
list_loopback_sources 用于查看可用内容的工具。同一台机器上的代理现在可以通过MCP使用Brethof Voice Pro——进行转录、翻译和录音。它基于本地HTTP运行,因此那些只能通过URL访问资源的代理无需API密钥即可使用,且数据不会离开该机器。令牌起到保护作用,没有令牌服务器将无法启动。此版本需要购买付费许可证。
这款强大的工具能让翻译完全在您的设备上完成,支持38种语言。只需说一次,就能同时得到英语、日语、法语和西班牙语的文本输出——可以每行一种,也可以在同一行中并排显示。其背后的引擎是腾讯的Hunyuan MT2,提供两种版本供您选择:快速版适合日常使用,高质量版则在关键场合更为可靠。根据腾讯公布的测试数据,在FLORES-200基准测试中,高质量版的性能相当于Google Gemini 3.1 Pro的97.9%,而在实际场景及小语种翻译方面表现更佳。所有处理都在离线状态下进行,数据不会被上传到任何地方。
v2.0.0 版本的新增功能:
EN: … || PL: …),或仅针对第一个目标。translate_text, translate_srt, list_compute_devices, set_compute_device. 工具总数现已达到 19 个。Linux二进制文件的大小为161 MB,Windows安装程序的大小为118 MB。现有许可证可继续使用——只需 下载v2.0.0 翻译模型将显示在“设置”→“模型”中。
下载 v2.0.0 →Brethof Voice Pro现在可以基于您的声音进行训练。训练数据就是您所做的修正——一旦您纠正了一个听错的单词,它就会成为训练样本。系统不会要求您朗读示例句子。训练只需点击一下即可,在您的设备上完成,训练结束后即可切换到新的模型。
该试用版可解锁除私人训练和客服联系之外的所有功能;后者则是为那些每天使用该应用的人准备的。
有两点。现在,文本转录可以作为异步任务来执行——只需上传音频文件,待转录完成后再获取结果,无需一直守在电脑前等待。
至于字幕的同步时间设置:现在你可以逐词调整时间,而非按句子来调整,这样在需要精确编辑时更为方便。如果你曾经制作过字幕,就应该明白这一点的重要性。
ONNX运行时已不再使用。现在整个产品都基于llama.cpp以及我们自己的翻译库运行——只需一个运行时,磁盘占用更小,启动更快,部署也更简便。
这些模型都是单个GGUF格式的文件,正因如此,体积较小的模型才能在任何4GB显存的显卡上运行。关于我们为何做出这一选择的详细说明,请参见页面下方的内容。
两个“首次”。MCP服务器在此首次亮相——这是首个让你在自己的机器上为智能体配备“耳朵”的方法。
至于设备选择功能:现在,转录和翻译功能可以各自选择不同的处理器,这样,一个功能可以在显卡上运行,而另一个则在CPU上运行。即便笔记本电脑的GPU性能一般,也能让这两个功能同时运行而不出现卡顿现象。
macOS仍在开发中,将首先采用Apple Silicon芯片。目前尚无具体时间表,等到产品真正成型后我们才会公布日期。在此期间,Linux和Windows是功能相同的同类产品——不会为了推销其中一款而限制另一款的功能。一旦Mac版本推出,本页面会及时告知。
阅读文章 →你的口音并非需要刻意克服的问题,而是一种可以用来训练的模型。Brethof Voice Pro会学习你已做出的修正——一旦纠正了某个听错的单词,该修正就会成为示例。无需样本句子,无需校准脚本,也无需对着麦克风朗读数小时。你预先设定的固定词汇——品牌名称、专业术语、同事的名字——会引导文字转录和翻译过程,从而确保名字不会被错误地本地化。训练只需点击一下,就在你的设备上运行,完成后即可切换到新模型。你之前所做的修正一直都是教学材料,现在它们则用于训练模型。
阅读文章 →首个版本。只需开口说话而非打字,无论是在编辑器、终端、聊天框还是表单中,文字都会出现在光标所在的位置。转录功能完全在您的设备上运行,采用阿里巴巴的Qwen3-ASR技术,并结合DeepFilterNet3处理噪声,再通过Silero VAD进行语音检测。所有处理都在本地完成。与律师的通话、未发布的产品资料、患者记录——这些内容都不会离开运行它们的电脑,因为根本无处传输。它可以在飞机上、穿越隧道的火车上,或是WiFi信号不佳的酒店里使用。支持30种语言,其中22种为中文方言。可在您现有的笔记本电脑上运行——无论是否有显卡;若有显卡,需为Vulkan 1.2+版本的NVIDIA、AMD或Intel Arc显卡。在Linux系统上以单个便携文件形式提供,需要glibc 2.38或更高版本;在Windows系统上则是常规安装程序,无需管理员权限。提供14天试用版,无需信用卡,仅需电子邮件即可。
阅读文章 →该个人许可证现在涵盖了个体经营和自由职业工作。无论您是单独经营者、个人工作室主理人还是承包商,所购买的许可证都适用于您的业务。无需按用户数量计费,也没有不同的业务等级划分。一张许可证可对应两台设备,只需购买一次即可。该许可证包含一年的更新服务;之后更新为可选项目,应用程序将一直使用您当前的版本运行。您支付的软件费用归您所有。
阅读文章 →Brethof Voice Pro支持30种语言的转录,能识别22种中文方言,并可进行38种语言之间的互译。其界面也已被完整翻译成这30种语言——这些翻译是由实际使用该产品的人完成的,而非通过机器翻译后再生成的。你可以将应用设置为对应的语言,它的显示效果就会如同是用该语言撰写的一样,因为确实如此。
阅读文章 →最初的版本是在ONNX Runtime上运行的。虽然可行,但效率较低,部署起来也不方便,还会使产品体积超出必要范围。v1.5.0版本用单一的运行时环境取而代之——转录功能使用llama.cpp,翻译功能则使用我们自己的库,同时模型也被整合为单独的GGUF格式文件。这样一来,下载量更小,启动速度更快,产品也能更轻松地适配笔记本电脑。该版本提供了两种模型尺寸供选择,而非不同的等级:较小的模型适用于笔记本电脑和集成显卡,较大的模型则适合处理带有口音或背景噪音的音频。用户可以随时切换模型,如果不想使用显卡的话也完全不必。
阅读文章 →只有三样东西会传送到网络中,除此之外没有其他内容。首先是应用启动时的许可证检查;其次是应用启动时的更新检查。至于模型文件,则需要由用户自行下载。许可证检查会发送许可证密钥,而更新检查则会发送版本信息。这两种操作都不会传输任何音频或文本数据。一旦模型文件被存储在本地且更新检查功能被关闭,就再不会有任何数据被传输出去。这并非营销话术——防火墙日志就能证明这一点。将所有处理工作都在本地机器上完成的理由,并不是因为云服务具有某种特殊优势,而是因为人的声音是无法收回的:比如与律师的通话内容、尚未公开的产品设计、病人的病历记录等。用于处理这些内容的工具不应依赖网络连接才能正常工作,它应该能在飞机上使用,而且绝不能泄露任何信息。这就是其设计理念,属于设计决策,而非某种功能特性。
阅读文章 →本地语音转文字,可学习您的语音。永久许可。我们的旗舰产品。
已付费 · 旗舰版
针对您的AI智能体的长期记忆存储——包括全文、向量及图结构数据。在会话开始时进行说明,每次发起请求时都会被调取,并自动归档。
已付费 · 免费套餐
可直接打印的数字模型。包含GLB和OBJ格式。终身访问。
已支付 · 数字目录
五台打印机,具备实际打印功能。目前尚无自助服务点——请告诉我们您的需求,我们会通过邮件为您报价。
经安排·请通过电子邮件联系我们
我们的YouTube频道。一位“网络老虎”主持人将为大家介绍各类本地化AI工具及其实际功能。
频道 · 直播
精心整理的GitHub列表,涵盖AI编程代理、MCP服务器、本地AI以及用于AI开发的Linux相关内容。每条条目都附有来源链接。
免费 · 精选内容
针对Linux、Windows和macOS平台的本地AI的详细操作指南,附有配置文件。
免费 · 直播
负面精选:浪费你时间的做法与工具,已排序。需提供凭证。
免费 · 直播
我们是谁,为何要打造以隐私为首要考虑的AI,以及我们不会做什么。