100% 本地处理——您的语音数据永不离开您的设备

语音转文本功能 从不离开 你的电脑

你正在说话。这些文字会出现在——你的编辑器中、终端里、聊天框中、表单里,也就是光标所在的位置。而每一个字都会留在你说出它们的那台机器上。

Brethof Voice Pro是一款完全在用户自己的电脑上运行的语音转文字及翻译工具。这并非隐私保护功能,而是该产品的核心功能。

100% 本地处理——无需使用云端服务
30 ASR + 38 翻译种语言
GPU加速 — NVIDIA、AMD、Intel
Linux与Windows
可离线使用

您所需的一切,无多余功能

一个程序,相当于四个人的工作。它能转录你的语音,将其翻译成38种语言,为视频添加字幕,还能在需要输入文字的任何地方代你打字。它可在离线状态下运行——在飞机上、WiFi信号不佳的酒店里、隧道中——而且可以在你已有的笔记本电脑上使用,无论是否有显卡均可。无需订阅,没有按分钟计费,也不需要上传数据。还可以给你的AI助手配备“耳朵”:它可以通过MCP在你的设备上转录、翻译并录制任意长度的会议内容,且无需API密钥。只需购买一次,就能永久使用。

有三样东西会接触到网络,除此之外没有其他东西会接触它。

你的声音永远不会离开电脑。这句话说得很准确,确实如此。在程序启动时,只有三样东西会被发送到网络中:许可证验证信息、版本检测信息,以及你主动下载的模型文件。许可证验证会发送许可证密钥,而版本检测则会发送版本信息——绝对不会有音频或文本被发送出去。如果关闭版本检测功能,那么一旦模型文件被存储在磁盘上,就再不会有任何数据被发送出去了。

30种语言,22种方言,你的口音再也不是问题了

支持30多种语言的文字转录功能,还能自动识别22种中文方言——无需任何设置或训练。同时再也不用担心口音发音错误了。Brethof Voice Pro可在您的设备上自动学习您的声音、专业术语以及专有名词。即便您说四川话,也能准确转换出来。

说一次,即可用38种语言读取。

可以说波兰语,阅读英语;可以说英语,阅读日语。或者只需说一次,就能同时将内容翻译成英语、日语、法语和西班牙语——每行一种,或同在一行中并列显示。你可以选择任意数量的目标语言,共有38种,其中23种支持双向翻译。翻译也在你的设备上完成,使用的是腾讯的Hunyuan MT2。在FLORES-200测试基准下,其质量水平可达谷歌的Gemini 3.1 Pro的97.9%,在现实场景及小语种翻译方面更是更胜一筹。提供两种版本,均可选择下载:一种适合日常快速使用,另一种则用于处理重要文本。字幕功能也同样具备,可选择纯文本或SRT格式,按句子或单词设置时间,便于精确编辑。翻译字幕文件时,所有时间设置都会保留。无需按分钟计费,即可用38种语言为自己的视频添加字幕。

完全离线

正因如此,它才能在其他方法无法起作用的情况下依然有效。无论是飞机上、WiFi信号不佳的酒店里,还是正在穿越隧道的火车上,都没有地方可以存储录制的内容,因此也就无需将数据传送到其他地方。你可以先录制两小时的会议内容,然后去喝咖啡;等你回来时,文字记录已经生成了。你甚至可以忘记自己还在进行录制,因为系统会自动完成工作并保存好文字记录。

两种模型尺寸

有两种转录模型,这是一种选择而非不同的等级——您可以随时切换。

它会从你已做的修正中学习。

大多数语音软件在设置时都会要求用户朗读示例句子,但这款软件无需如此。它会根据用户所做的修正来学习:一旦用户纠正了某个听错的单词,该修正内容就会成为训练样本。只需将品牌名称、专业术语以及同事的名字一次输入即可,这样它们在文本记录和翻译结果中就不会再出错,因为同一个列表会同时用于这两者。名称绝不会被错误地本地化处理。训练只需点击一下即可完成,它在用户的硬件上运行,训练完成后新的模型便可立即投入使用。

一次支付,永久拥有

只需购买一次,它就归您所有。这是永久许可证,且包含一年的更新服务。

降噪功能,仅在需要时启用

嘈杂的房间不再成为问题。该功能具备降噪功能,适用于在咖啡馆、展会现场或车内进行的录音。默认情况下该功能是关闭的,因为经过测试发现:在使用较短且质量良好的麦克风录音时,该功能反而会使声音变得更差。如果在有咖啡机作背景噪音的场合进行两小时的会议,那就请打开该功能。

你正在输入文字的键盘

该语音键盘可在光标所在的任何地方输入文字——无论是浏览器、集成开发环境、聊天应用,还是任何支持键盘输入的字段。它能够直接输入翻译结果而非转录内容。用你的母语说出句子,正确的词语就会以目标语言的形式呈现出来,且无需剪切或粘贴,保持单行格式。

两种尺寸,由您选择

0.6B版本是日常使用型产品。它可以在任何4GB显存的显卡上运行,也能在集成显卡上运行,甚至在没有独立显卡的笔记本电脑上也能使用。速度快捷、体积小巧,随时都能满足使用需求。

17亿

大型 · Vulkan / CPU
~2–3 GB

根本没有GPU?它依然可以运行。仅靠CPU的话,需要8GB的RAM、四核处理器以及大约5GB的可用磁盘空间;其他配置则需要7–9GB。任何支持Vulkan 1.2及以上版本的显卡都可以——包括NVIDIA、AMD和Intel Arc系列。此外,文本转录和翻译功能会各自使用独立的处理器,因此其中一个可以在显卡上运行,而另一个则在CPU上运行。

可选插件可从“设置”→“模型”按需下载:

Forced Aligner (约540 MB)用于单词级时间戳。 Hunyuan MT2 Fast (约1 GB)或 质量 (约4.3 GB)用于翻译。

我们如何进行比较

功能 Brethof Voice Pro Dragon Google STT Otter.ai Whisper (OSS)
100% 本地处理
永久许可 ~
原生 Linux 支持 ~
原生 Windows 支持 ~ ~
30种ASR语言支持+自动检测功能 ~
离线翻译(38种语言)
GPU加速(NVIDIA + AMD + Intel) N/A N/A ~
个人模型微调(LoRA)
用于AI智能体的MCP服务器
内置降噪功能
直接文本注入
优化的桌面GUI
典型成本 $49 一旦 350美元+/年 17美元/月 17美元/月 免费

一次付费,永久拥有。

无月费。无使用限制。永久许可,包含 1 年更新服务。

免费试用
$ 0

无需信用卡,只需提供邮箱以验证试用资格。

  • 两种模型规模(0.6B + 1.7B)
  • GPU加速
  • 30种ASR识别技术 + 38种翻译语言
  • 降噪
  • × 无需个人训练 (仅限付费套餐)
  • × 无 MCP 服务器 (仅限付费套餐)
  • × 14天限制
开始免费试用
Business
$ 249 /用户

按席位计算的永久许可。适用于团队及组织使用。包含 1 年的更新服务。

  • 永久许可(每席位)
  • 团队与机构使用
  • 两种ASR模型规模(0.6B + 1.7B)
  • 离线翻译(38种语言)
  • 个人语音训练(LoRA)
  • 用于AI智能体的MCP服务器
  • 优先支持
  • 批量折扣(10+ 席位)
购买 Business 许可

价格不含税。更新服务可选,费用为每席位每年 20 美元。

常见问题解答

不会。Brethof Voice Pro会在您的设备上本地处理所有内容,任何音频或文本数据都不会离开您的电脑。它没有云服务组件,无遥测数据,也无分析功能。

任何现代 GPU 均可使用。NVIDIA、AMD 和 Intel Arc 均使用 Vulkan 加速。您也可以仅使用 CPU 运行,但转录速度较慢。0.6B 模型在集成显卡或任何 4 GB 及以上的 Vulkan 显卡上均可流畅运行。

从……开始 0.6B模型 — 这是推荐的默认设置,在大多数GPU上都能良好运行(在大多数现代机器的CPU上也能正常工作)。如果需要对带有重音或噪声的音频实现更高精度处理,可切换到 1.7B模型 (需要 6 GB+ 显存)。您可以通过“设置”→“模型”随时切换模型大小,无需重新下载。

是的。Brethof Voice Pro可直接在Linux和Windows系统上运行。在Linux系统中,它支持X11和Wayland显示协议;在Windows系统中,则作为常规桌面应用程序运行。

您的许可证为永久有效——无论使用哪个版本,该应用都将永久运行。可选的每年20美元更新套餐可让您获得新功能及模型改进。如果不购买,您将停留在当前版本。

是的——v2.0.0版本已包含个人语音训练功能,且所有处理都在您的设备上端到端完成。每次您纠正被错误识别的单词时,对应的{clip, correction}数据对都会自动保存到您的本地训练数据集中。主界面的训练卡片可让您一目了然地查看总样本数及录音时长——在“训练”选项卡中点击“开始训练”即可针对您的口音微调LoRA模型。训练结果会自动导出为GGUF格式,您只需一键即可切换使用。该功能对所有付费许可证用户免费开放,且您的语音数据永远不会离开您的设备。

准备好尝试了吗?

14天免费试用。无需信用卡,无需云服务,毫无妥协。

产品上市时再听吧

最新作品、真实评测,还有偶尔的深度分析。无垃圾信息,一键即可取消订阅。

我们打造的一切

外部: YouTube · GitHub