一个程序,相当于四个人的工作。它能转录你的语音,将其翻译成38种语言,为视频添加字幕,还能在需要输入文字的任何地方代你打字。它可在离线状态下运行——在飞机上、WiFi信号不佳的酒店里、隧道中——而且可以在你已有的笔记本电脑上使用,无论是否有显卡均可。无需订阅,没有按分钟计费,也不需要上传数据。还可以给你的AI助手配备“耳朵”:它可以通过MCP在你的设备上转录、翻译并录制任意长度的会议内容,且无需API密钥。只需购买一次,就能永久使用。
你的声音永远不会离开电脑。这句话说得很准确,确实如此。在程序启动时,只有三样东西会被发送到网络中:许可证验证信息、版本检测信息,以及你主动下载的模型文件。许可证验证会发送许可证密钥,而版本检测则会发送版本信息——绝对不会有音频或文本被发送出去。如果关闭版本检测功能,那么一旦模型文件被存储在磁盘上,就再不会有任何数据被发送出去了。
支持30多种语言的文字转录功能,还能自动识别22种中文方言——无需任何设置或训练。同时再也不用担心口音发音错误了。Brethof Voice Pro可在您的设备上自动学习您的声音、专业术语以及专有名词。即便您说四川话,也能准确转换出来。
可以说波兰语,阅读英语;可以说英语,阅读日语。或者只需说一次,就能同时将内容翻译成英语、日语、法语和西班牙语——每行一种,或同在一行中并列显示。你可以选择任意数量的目标语言,共有38种,其中23种支持双向翻译。翻译也在你的设备上完成,使用的是腾讯的Hunyuan MT2。在FLORES-200测试基准下,其质量水平可达谷歌的Gemini 3.1 Pro的97.9%,在现实场景及小语种翻译方面更是更胜一筹。提供两种版本,均可选择下载:一种适合日常快速使用,另一种则用于处理重要文本。字幕功能也同样具备,可选择纯文本或SRT格式,按句子或单词设置时间,便于精确编辑。翻译字幕文件时,所有时间设置都会保留。无需按分钟计费,即可用38种语言为自己的视频添加字幕。
正因如此,它才能在其他方法无法起作用的情况下依然有效。无论是飞机上、WiFi信号不佳的酒店里,还是正在穿越隧道的火车上,都没有地方可以存储录制的内容,因此也就无需将数据传送到其他地方。你可以先录制两小时的会议内容,然后去喝咖啡;等你回来时,文字记录已经生成了。你甚至可以忘记自己还在进行录制,因为系统会自动完成工作并保存好文字记录。
有两种转录模型,这是一种选择而非不同的等级——您可以随时切换。
大多数语音软件在设置时都会要求用户朗读示例句子,但这款软件无需如此。它会根据用户所做的修正来学习:一旦用户纠正了某个听错的单词,该修正内容就会成为训练样本。只需将品牌名称、专业术语以及同事的名字一次输入即可,这样它们在文本记录和翻译结果中就不会再出错,因为同一个列表会同时用于这两者。名称绝不会被错误地本地化处理。训练只需点击一下即可完成,它在用户的硬件上运行,训练完成后新的模型便可立即投入使用。
只需购买一次,它就归您所有。这是永久许可证,且包含一年的更新服务。
嘈杂的房间不再成为问题。该功能具备降噪功能,适用于在咖啡馆、展会现场或车内进行的录音。默认情况下该功能是关闭的,因为经过测试发现:在使用较短且质量良好的麦克风录音时,该功能反而会使声音变得更差。如果在有咖啡机作背景噪音的场合进行两小时的会议,那就请打开该功能。
该语音键盘可在光标所在的任何地方输入文字——无论是浏览器、集成开发环境、聊天应用,还是任何支持键盘输入的字段。它能够直接输入翻译结果而非转录内容。用你的母语说出句子,正确的词语就会以目标语言的形式呈现出来,且无需剪切或粘贴,保持单行格式。
0.6B版本是日常使用型产品。它可以在任何4GB显存的显卡上运行,也能在集成显卡上运行,甚至在没有独立显卡的笔记本电脑上也能使用。速度快捷、体积小巧,随时都能满足使用需求。
17亿参数的版本更为可靠——适用于有口音的音频、嘈杂的音频,以及那些内容至关重要的两小时会议。它需要大约6GB的显存,如果同时加载高质量翻译模型,则需要8GB。
根本没有GPU?它依然可以运行。仅靠CPU的话,需要8GB的RAM、四核处理器以及大约5GB的可用磁盘空间;其他配置则需要7–9GB。任何支持Vulkan 1.2及以上版本的显卡都可以——包括NVIDIA、AMD和Intel Arc系列。此外,文本转录和翻译功能会各自使用独立的处理器,因此其中一个可以在显卡上运行,而另一个则在CPU上运行。
可选插件可从“设置”→“模型”按需下载:
Forced Aligner (约540 MB)用于单词级时间戳。 Hunyuan MT2 Fast (约1 GB)或 质量 (约4.3 GB)用于翻译。
| 功能 | Brethof Voice Pro | Dragon | Google STT | Otter.ai | Whisper (OSS) |
|---|---|---|---|---|---|
| 100% 本地处理 | ✓ | ✓ | ✗ | ✗ | ✓ |
| 永久许可 | ✓ | ~ | ✗ | ✗ | ✓ |
| 原生 Linux 支持 | ✓ | ✗ | ~ | ✗ | ✓ |
| 原生 Windows 支持 | ✓ | ✓ | ~ | ✗ | ~ |
| 30种ASR语言支持+自动检测功能 | ✓ | ✗ | ✓ | ~ | ✓ |
| 离线翻译(38种语言) | ✓ | ✗ | ✗ | ✗ | ✗ |
| GPU加速(NVIDIA + AMD + Intel) | ✓ | ✗ | N/A | N/A | ~ |
| 个人模型微调(LoRA) | ✓ | ✓ | ✗ | ✗ | ✗ |
| 用于AI智能体的MCP服务器 | ✓ | ✗ | ✗ | ✗ | ✗ |
| 内置降噪功能 | ✓ | ✓ | ✓ | ✓ | ✗ |
| 直接文本注入 | ✓ | ✓ | ✗ | ✗ | ✗ |
| 优化的桌面GUI | ✓ | ✓ | ✗ | ✓ | ✗ |
| 典型成本 | $49 一旦 | 350美元+/年 | 17美元/月 | 17美元/月 | 免费 |
无月费。无使用限制。永久许可,包含 1 年更新服务。
无需信用卡,只需提供邮箱以验证试用资格。
永久许可。支持2台个人设备。含1年更新服务。
价格不含税。更新服务可选,费用为每年20美元。
按席位计算的永久许可。适用于团队及组织使用。包含 1 年的更新服务。
价格不含税。更新服务可选,费用为每席位每年 20 美元。
不会。Brethof Voice Pro会在您的设备上本地处理所有内容,任何音频或文本数据都不会离开您的电脑。它没有云服务组件,无遥测数据,也无分析功能。
任何现代 GPU 均可使用。NVIDIA、AMD 和 Intel Arc 均使用 Vulkan 加速。您也可以仅使用 CPU 运行,但转录速度较慢。0.6B 模型在集成显卡或任何 4 GB 及以上的 Vulkan 显卡上均可流畅运行。
从……开始 0.6B模型 — 这是推荐的默认设置,在大多数GPU上都能良好运行(在大多数现代机器的CPU上也能正常工作)。如果需要对带有重音或噪声的音频实现更高精度处理,可切换到 1.7B模型 (需要 6 GB+ 显存)。您可以通过“设置”→“模型”随时切换模型大小,无需重新下载。
是的。Brethof Voice Pro可直接在Linux和Windows系统上运行。在Linux系统中,它支持X11和Wayland显示协议;在Windows系统中,则作为常规桌面应用程序运行。
您的许可证为永久有效——无论使用哪个版本,该应用都将永久运行。可选的每年20美元更新套餐可让您获得新功能及模型改进。如果不购买,您将停留在当前版本。
是的——v2.0.0版本已包含个人语音训练功能,且所有处理都在您的设备上端到端完成。每次您纠正被错误识别的单词时,对应的{clip, correction}数据对都会自动保存到您的本地训练数据集中。主界面的训练卡片可让您一目了然地查看总样本数及录音时长——在“训练”选项卡中点击“开始训练”即可针对您的口音微调LoRA模型。训练结果会自动导出为GGUF格式,您只需一键即可切换使用。该功能对所有付费许可证用户免费开放,且您的语音数据永远不会离开您的设备。
本地语音转文字,可学习您的语音。永久许可。我们的旗舰产品。
已付费 · 旗舰版
针对您的AI智能体的长期记忆存储——包括全文、向量及图结构数据。在会话开始时进行说明,每次发起请求时都会被调取,并自动归档。
已付费 · 免费套餐
可直接打印的数字模型。包含GLB和OBJ格式。终身访问。
已支付 · 数字目录
五台打印机,具备实际打印功能。目前尚无自助服务点——请告诉我们您的需求,我们会通过邮件为您报价。
经安排·请通过电子邮件联系我们
我们的YouTube频道。一位“网络老虎”主持人将为大家介绍各类本地化AI工具及其实际功能。
频道 · 直播
精心整理的GitHub列表,涵盖AI编程代理、MCP服务器、本地AI以及用于AI开发的Linux相关内容。每条条目都附有来源链接。
免费 · 精选内容
针对Linux、Windows和macOS平台的本地AI的详细操作指南,附有配置文件。
免费 · 直播
负面精选:浪费你时间的做法与工具,已排序。需提供凭证。
免费 · 直播
我们是谁,为何要打造以隐私为首要考虑的AI,以及我们不会做什么。