一個程式,完成四項功能。它能轉錄你的聲音、將其翻譯成38種語言、為影片添加字幕,還能在需要輸入鍵盤的任何場合代你打字。它可在離線環境下運作——無論是在飛機上、網路不佳的飯店裡,還是隧道中;同時也能在你已有的筆電上運行,不管是否有顯示卡都行。無需訂閱,沒有按分鐘計費,也不需要上傳資料。再給你的AI助手加上「耳朵」吧:它能透過MCP,在你的設備上,無需API金鑰即可轉錄、翻譯並錄製任意長度的會議。只需購買一次,就能持續使用。
您的聲音永遠不會離開您的電腦。這句話說得很準確,事實也確實如此。在程式啟動時,只有三樣東西會傳送到網路上:授權檢查、版本檢查,以及您主動下載的模型檔案。授權檢查會傳送授權金鑰,版本檢查則會傳送版本資訊——從來沒有音頻或文字。如果關閉版本檢查,一旦模型檔案被儲存到磁碟上,就再也不會有任何資料被傳送出去了。
支援30多種語言的文字轉錄功能,且能自動識別22種中文方言——無需任何設定或訓練。如此一來,您的口音就不會再出現錯誤。Brethof Voice Pro可在您的電腦上自行學習您的聲音、專有術語及人名。即便您說的是祖母那口的四川話,也能正確轉錄出來。
說波蘭語,閱讀英文;說英文,閱讀日文。或者一次說出內容,即可同時以英文、日文、法文和西班牙文輸出——每種語言一行,或在同一行中並排顯示。您可以選擇任意多的目標語言;總共有38種,其中23種支持雙向翻譯。翻譯也在您的電腦上進行,使用的是騰訊的Hunyuan MT2。在FLORES-200測試集上,其翻譯品質可達Google的Gemini 3.1 Pro的97.9%,且在真實情境及少數語言翻譯方面表現更佳。提供兩種版本,皆可選擇下載:一種為快速版,適用於日常使用;另一種為高品質版,適用於重要內容的翻譯。也支援字幕功能,可選普通文本或SRT格式,可按句子或單詞設定時間,方便精確編輯。翻譯字幕檔案時,所有時間設定都會保留。您可以用38種語言為自己的影片添加字幕,且無需按分鐘計費。
這就是為何它在其他方式無法使用的環境中仍能發揮作用。無論是飛機上、Wi-Fi品質不佳的飯店裡,或是行經隧道的火車上,都沒有地方可以儲存錄音內容,因此也沒有必要將其傳送至其他地方。你可以先放下兩小時的會議錄音,去喝杯咖啡;等你回來時,轉錄稿已經準備好了。你甚至可以忘記自己還在錄音,因為它會自動完成工作並保存好轉錄稿。
有兩種轉錄模型,這是一種選擇而非等級之分——您可以隨時更換。
大多數語音軟體在安裝時都會要求用戶朗讀一些範例句子,但這個軟體不需要。它會根據用戶所做的修正來學習:當用戶更正了錯誤的發音後,該修正就會成為訓練樣本。一旦將品牌名稱、專有術語以及同事的名字設定好,它們就不會再出現錯誤——無論是在文字記錄中還是翻譯結果中,因為兩者都是依據同一份清單來處理的。名字絕不會因為偶然而出現錯誤。訓練只需一鍵操作,它會在用戶的硬體上運行,完成後即可立即切換到新的模型。
購買一次即可擁有,為永久授權,且包含一年的更新服務。
嘈雜的環境不再成為問題。它具有內建降噪功能,適用於在咖啡廳、展會現場或車內進行的錄音。預設狀態下該功能是關閉的,因為我們經過測試發現:在短時間、乾淨的麥克風錄音中,此功能反而會讓情況變得更糟。如果在有濃縮咖啡機作為背景噪音的兩小時會議中使用,則應將該功能打開。
語音鍵盤可於光標所在之處輸入文字——無論是瀏覽器、IDE、聊天應用,或是任何可接收鍵盤輸入的欄位。它還能直接輸入翻譯結果而非轉錄內容。只要用您的語言說出句子,正確的詞句就會以表格所需的語言呈現出來,且為單一行,無需剪切或貼上。
0.6B版本是日常使用的型號。它可以在任何4GB容量的顯示卡上運作,也能在內建顯示卡的電腦上使用,甚至那些沒有顯示卡的筆電也能使用。速度快、體積小,且在需要時隨時可用。
17億個參數的版本是最為精確的——適用於有重音的語音、嘈雜的環境音,以及那些詞句至關重要的兩小時長會議。它需要約6GB的顯存,若同時載入高品質的翻譯模型則需要8GB的顯存。
根本沒有 GPU?它仍然可以運作。僅使用 CPU 時,需要 8 GB 的 RAM、四核心處理器,以及約 5 GB 的可用磁碟空間;其餘需求則為 7–9 GB。任何支援 Vulkan 1.2+ 的顯卡都可行——包括 NVIDIA、AMD、Intel Arc。而轉錄與翻譯功能會各自選擇不同的處理器,因此一個功能可以在顯卡上運行,另一個則在 CPU 上運行。
可選附加元件可依需求從「設定」→「模型」下載:
Forced Aligner (約 540 MB)用於字級時間戳記。 Hunyuan MT2 Fast (約 1 GB)或 品質 (約 4.3 GB)用於翻譯。
| 功能 | Brethof Voice Pro | Dragon | Google STT | Otter.ai | Whisper (OSS) |
|---|---|---|---|---|---|
| 100% 本地處理 | ✓ | ✓ | ✗ | ✗ | ✓ |
| 永久授權 | ✓ | ~ | ✗ | ✗ | ✓ |
| 原生 Linux 支援 | ✓ | ✗ | ~ | ✗ | ✓ |
| 原生 Windows 支援 | ✓ | ✓ | ~ | ✗ | ~ |
| 30 種 ASR 語言 + 自動偵測 | ✓ | ✗ | ✓ | ~ | ✓ |
| 離線翻譯(38 種語言) | ✓ | ✗ | ✗ | ✗ | ✗ |
| GPU 加速(NVIDIA + AMD + Intel) | ✓ | ✗ | N/A | N/A | ~ |
| 個人模型微調(LoRA) | ✓ | ✓ | ✗ | ✗ | ✗ |
| 適用於 AI 代理的 MCP 伺服器 | ✓ | ✗ | ✗ | ✗ | ✗ |
| 內建降噪 | ✓ | ✓ | ✓ | ✓ | ✗ |
| 直接文字注入 | ✓ | ✓ | ✗ | ✗ | ✗ |
| 精緻的桌面 GUI | ✓ | ✓ | ✗ | ✓ | ✗ |
| 典型成本 | $49 一旦 | 每年 350 美元以上 | 每月 17 美元 | 每月 17 美元 | 免費 |
無月費、無使用限制。永久授權,內含 1 年更新。
無需信用卡。只需一個電子郵件即可驗證您的試用。
永久授權。2 台個人裝置。內含 1 年更新。
價格不含稅。之後每年 20 美元可選購更新服務。
每名席位永久授權。適用於團隊及組織使用,包含 1 年的更新服務。
價格不含稅。如需更新服務,則需每席位每年支付 20 美元(可選)
不會。Brethof Voice Pro 完全在您的裝置上本地處理一切。任何音訊或文字資料都不會離開您的電腦。沒有雲端元件、沒有遙測、也沒有分析。
任何現代 GPU 皆可。NVIDIA、AMD 和 Intel Arc 都使用 Vulkan 加速。您也可以僅用 CPU 運行,但轉錄速度會較慢。0.6B 模型在內建顯示或任何 4 GB 以上的 Vulkan 顯示卡上都能流暢運行。
從 0.6B 模型 — 這是推薦的預設選項,且在大多數 GPU 上都能良好運作(在現代電腦的 CPU 上亦然)。如果需要對帶重音或雜訊的音訊提升辨識精度,請改用 1.7B 模型 (需要 6 GB 以上 VRAM)。您可以隨時從「設定」→「模型」切換尺寸,無需重新下載。
可以。Brethof Voice Pro 原生支援 Linux 和 Windows。在 Linux 上,它可與 X11 和 Wayland 搭配使用。在 Windows 上,它作為標準桌面應用程式運行。
您的授權是永久的——應用程式會以您持有的任何版本永遠運作。可選的每年 20 美元更新通行證可讓您使用新功能和模型改進。沒有它,您只需繼續使用目前版本即可。
可以——個人語音訓練已包含在 v2.0.0 中,並在您的機器上端對端運行。每次您修正一個辨識錯誤的單詞時,{clip, correction} 配對會自動儲存到您的本地訓練資料集。主視窗的訓練卡片會一目了然地顯示已收集的樣本數和分鐘數——在「訓練」標籤中點擊「開始訓練」,即可針對您的口音微調 LoRA。結果會自動匯出為 GGUF,您只需一鍵即可切換使用。所有付費授權皆免費,您的語音資料絕不會離開您的機器。
能學習您聲音的本地語音轉文字功能,享有永久授權,為我們的旗艦產品。
已付費 · 旗艦版
用於您的 AI 代理的長期記憶——包含全文、向量與圖表。在會話開始時進行說明,每次提問時皆會被調出,並自動存檔。
已付費 · 免費階段
可直接列印的數位模型。包含 GLB 與 OBJ 格式。終身存取。
已付費 · 數位目錄
五台印表機,具備實際打印能力。目前還沒有自助服務店——請告訴我們您的需求,我們會透過電子郵件給您報價。
經協商安排 · 請寄電郵給我們
我們的YouTube頻道。一位網路老虎主持人將為您介紹各種本地AI工具及其實際功能。
頻道 · 直播
為人工智慧編碼代理、MCP 伺服器、本地人工智慧以及用於人工智慧的 Linux 精選的 GitHub 清單。每個條目都附有來源連結。
免費 · 精選內容
針對 Linux、Windows 與 macOS 的本地 AI 的詳細操作指南,並附上相關設定檔。
免費 · 直播
負面篩選:浪費您時間的做法與工具排名。需附證據。
免費 · 直播
我們是誰、為何要打造以隱私為優先的 AI,以及我們不會做的事。