Brethof Voice Pro — 有咩新消息?

呢個應用程式會逐次更新。如果你使用的是最新版本,這裡就顯示了你已有的內容——而變更記錄下方的說明則解釋了某些改動的背後原因。

版本 2026年8月14日

v2.3.1 — 兩因素驗證帳戶可再次登入

上個版本出現的問題導致需要雙重驗證的帳戶無法登入。v2.3.1已修復此問題。如果你遇到這個問題:輸入你的登入資料及密碼,就能正常登入。其他部分則沒有變動。

版本 2026年8月6日

v2.2.2 — 字幕檔,速度大約快兩倍

現在翻譯字幕檔案所需時間大約只有過去的一半。時間節點完全保持不變——無論是按句子還是單詞來處理,每個時間戳都會精確地出現在原文件中的相同位置。如果你以翻譯字幕為生,這個版本讓等待時間明顯縮短了。

另外喺 v2.2.2 入面:

  • 修正麥克風輸入問題——而呢個問題喺靚麥克風上面影響最大. 音量平衡可能會將乾淨錄音中最響亮嘅部分推過滿刻度而截斷。你嘅麥克風越好,峰值同平均音量之間嘅差距就越大,就越容易中招——壓縮過、有雜音嘅輸入可以原封不動通過,但係安靜嘅房間加一支靚電容咪反而會被截斷。而家嘅音量平衡會留返啲餘量,所以輔音同硬攻擊音可以完整保留。
  • translate_batch MCP 工具 — 可以一次過翻譯好多段字串,有批次大小參數;VRAM 唔夠嗰陣會自動退讓。
下載 v2.2.2 →
版本 2026年7月11日

v2.2.1 — 你擁有的應用程式依然屬於你

一旦購買,Brethof Voice Pro 就屬於你,而 v2.2.1 確保沒有任何東西阻礙你使用它。過去啟動時的授權檢查就像一道門閘:沒有網路、伺服器繁忙、防火牆拒絕,都可能讓你無法使用已付費的軟體。現在則是直接開放——如果無法進行檢查,應用程式仍會正常打開。你擁有的軟體不應該需要獲得許可才能運作,現在也不再需要了。

  • 重新檢查許可證按鈕 喺許可證對話框度——會強制重新檢查。 繼續啟動 成功之後。以前得兩條路:買或者退出。
  • 付費客戶唔會再見到試用期滿嘅標記 — 對話框而家會講實際發生咗嘅事,而唔係對所有人顯示同一句訊息。
  • UI 唔會再凍結 — 模型下載會喺介面執行緒以外運行,帶有百分比進度,而啟動時嘅許可證檢查唔會再喺慢網絡下阻塞視窗。
  • 聽寫唔會再遺失 — 如果你講完嘢嘅時候轉錄仲喺度進行,新音訊會被排隊而唔係靜靜雞丟咗,而且停滯嘅 worker 冇辦法再將遲到嘅文字打入你下一次錄音。
  • 離線時好安靜 — 冇連線嗰陣,唔會再重複等網絡。
下載 →
版本 2026年6月4日

v2.2.0 — 可錄製整個會議,而非僅前五分鐘

長時間的錄音現在可以作為背景任務來處理。將兩小時長度的會議檔案交給它,然後去煮咖啡吧——沒有長度限制,也無需一直監控。讓它繼續運作,忘記它的存在即可,它會自動完成錄製並為你保存文字記錄。三小時的通話跟三分鐘的通話沒有差別,只是需要更長的時間而已。

  • 麥克風或系統音訊 — 錄低自己把聲,或者用迴路錄音捕捉電腦正在播放嘅嘢:會議通話、瀏覽器分頁、喇叭出嘅任何聲音。新功能 list_loopback_sources 用嚟睇有咩可用嘅工具。
  • 冇嘢會被丟棄 — 如果錄音被放棄,看門狗而家會將佢轉錄成一個可以攞返嘅任務,而唔係丟棄。
  • 老實講嘅限制 — 短時段即時轉錄模式嘅上限提升到 10 分鐘,要求超過佢裝得落嘅時間,而家會出明確錯誤,指你去用長格式工具。佢唔會再靜靜雞截走你段音頻,然後交返個唔完整嘅答案。
  • 修正 Linux 翻譯問題 — 一個缺失嘅依賴令到自 v1.7.0 以嚟每個 Linux 版本嘅翻譯都壞咗。呢個係由一個新嘅端到端發布檢查機制發現,佢會喺任何版本發布之前實際執行真正嘅二進制檔案。
下載 →
更新 2026年6月4日

v2.1.0 — 你的代理可透過 HTTP 收到訊息

同一部機器上的代理人現在可以透過MCP使用Brethof Voice Pro——進行轉錄、翻譯、錄音等操作。它透過本地HTTP運作,因此只有能夠透過URL存取資源的代理人也能在無需API密鑰且不會有資料流出機器的情況下使用它。一個令牌用來保護系統,若沒有該令牌,伺服器將拒絕啟動。此版本需要購買授權才能使用。

  • 預設就係私密 — 除非你特登改,否則佢只會喺你自己部機度監聽,而更闊嘅綁定 拒絕啟動 冇認證令牌。一旦設咗令牌,每個請求都要提供佢。
  • 工作唔會再被打斷 — 閒置時會卸載嘅模型,唔可以再喺長任務進行到一半嘅時候被卸載。一個忽略進行中工作嘅逾時最終會殺死啲正當任務,所以而家只要有嘢喺度運行,閒置時鐘就會暫停。
下載 →
版本 2026年5月21日

v2.0.0 — 永遠不出門的翻譯

呢個強大嘅工具。翻譯完全在您的電腦上進行,可支援 38 種語言。只要說一次,就能同時將內容輸出成英語、日語、法語同西班牙語——可以每行一種,或者同一行並排顯示。其背後的引擎係騰訊嘅 Hunyuan MT2,有兩種版本供您選擇:快速版適用於日常使用,高品質版則用於重要場合。根據騰訊公佈的測試結果,在 FLORES-200 標準測試中,高品質版嘅表現相當於 Google Gemini 3.1 Pro 的 97.9%,而在真實環境及少數語言翻譯方面更為優秀。所有操作均在離線模式下進行,資料絕不會外傳。

v2.0.0 嘅新功能:

  • 轉錄 + 翻譯 — 轉錄彈出視窗有「翻譯為:」下拉選單。ASR 負責轉錄,MT 負責翻譯,兩者並排顯示。支援檔案、麥克風同系統音訊(包括會議通話、瀏覽器分頁、任何喺你揚聲器播放嘅聲音嘅循環回放)。
  • 多語言語音鍵盤 — 主行上面嘅新翻譯按鈕會彈出一個三欄語言格。揀一個或多個目標語言,鍵盤就會打出翻譯。排版模式:每行一個、內聯(EN: … || PL: …),或僅選第一個目標。
  • SRT / VTT 字幕翻譯工具 — 保留時間戳同提示索引,支援雙語模式(每個提示顯示原文行同翻譯)。透過 MCP 供 AI 代理自動化使用。
  • 每個引擎多個 GPU — 設定 → 模型為每個引擎提供獨立嘅裝置揀選器。喺 Vulkan 0 行 ASR,喺 Vulkan 1 行翻譯,或者喺顯存緊張嘅筆電將 Hunyuan MT2 7B 鎖定喺 CPU 行。
  • 個人語音訓練功能已全面上線 — 可以喺你自己部機上面,由頭到尾對你自己把聲做 LoRA 微調。主視窗嘅訓練卡片會一眼睇晒總樣本數同錄低咗幾多分鐘;「開始訓練」按鈕喺 Training 分頁入面,會自動揀 NVIDIA CUDA 或者 CPU,然後自動將訓練好嘅模型匯出做 GGUF。每張付費許可證都免費包含呢個功能。
  • 4 個新 MCP 工具translate_text, translate_srt, list_compute_devices, set_compute_device. 工具總數而家係 19 個。
  • 誠實嘅語言分類 — ASR:30 種可選語言 + 自動偵測 + 22 種中文方言(合共 52 種)。翻譯:38 種語言(33 種主要語言 + 5 種中國地區少數民族語言)。其中 23 種雙向都用到。

Linux 二進制檔案係 161 MB,Windows 安裝程式係 118 MB。現有許可證會自動帶過去——只需 下載 v2.0.0 而翻譯模型會出現喺「設定」→「模型」入面。

下載 v2.0.0 →
版本 2026年5月20日

v1.6.16 — 你的聲音會成為獨立的模型

Brethof Voice Pro 現在可以根據你的聲音進行訓練。訓練數據就是你已經做出的修正——一旦修正了某個聽錯的詞,它就會成為訓練樣本。系統從不要求你朗讀範例句子。訓練只需一鍵操作,就在你的硬體上運行,完成後即可立即切換到新模型。

呢個試用版可以解鎖所有功能,唯獨唔包括個人訓練同經理聯絡功能;呢個版本係為咗那些每日都使用呢個應用程式嘅人準備嘅。

工程 2026年5月15日

v1.6.0 — 設定後即可使用,稍後再回來

有兩點。現在,文字轉錄可以以非同步方式進行——將音頻上傳,待轉錄完成後再取得結果,無需一直守在旁邊。

至於字幕的時間控制:現在你可以逐個字來設定時間,而非按句子來設定,這在需要精確編輯的時候特別有用。如果你曾經製作過字幕,就應該明白這一點的重要性。

工程 2026年5月15日

v1.5.0 — 僅一個運行時環境,且已移除 ONNX

ONNX運行時環境已經唔存在了。現在整個產品都是用llaama.cpp同我哋自己嘅翻譯函式庫來運作——只有一個運行時環境,佔用磁碟空間更少、啟動速度更快,而且更易於部署。

呢些模型係單一嘅 GGUF 檔案,正因如此,體積較小的模型才能在任何 4 GB 的顯卡上運行。關於我們為何要這樣做的詳細說明,請參考頁面下方嘅內容。

工程 2026年5月14日

v1.4.0 — 你的首次代理連線功能,以及用於選擇 GPU 的工具

兩個首次。MCP伺服器在此首次亮相——這是首個讓智能體擁有「耳朵」的方法,而且全部在您的電腦上完成。

至於裝置選擇器:現在,轉錄與翻譯功能可以各自選擇各自的處理器,因此一個功能可以在顯示卡上運行,而另一個則在中央處理器上運行。就算筆電的GPU性能一般,也能同時運行這兩個功能而不會出現卡頓情況。

路線圖 2026 年 4 月 16 日

macOS — 正在開發中,將率先採用 Apple Silicon 處理器

macOS目前仍在開發中,會先採用Apple Silicon平台。目前還沒有具體日期,等到實際產品出現後我們才會公佈。在此期間,Linux同Windows都是擁有相同功能嘅產品——並沒有為了推銷其中一個而隱瞞任何資訊。等Mac版本正式推出後,呢個頁面就會有相關說明。

閱讀文章 →
產品 2026 年 4 月 16 日

用你自己的聲音來訓練它

你嘅口音並非需要刻意迴避嘅問題,而係可以用來訓練的模型。Brethof Voice Pro會學習你已經做出的修正——一旦糾正咗一個聽錯嘅詞,呢個修正就會成為一個範例。無需樣本句子、無需校準腳本,亦無需花時間將內容讀入麥克風。你事先設定好的關鍵字——品牌名、專業術語、同事名字——會引導文字轉錄同翻譯過程,因此名字絕不會被意外本地化。訓練只需一按,就在你的硬體上運行,完成後即可立即切換到新模型。你之前所做的修正其實一直都是教學資料,而現在它們則用來訓練模型。

閱讀文章 →
公告 2026 年 4 月 16 日

Brethof Voice Pro 已上線

呢個係第一個版本。你可以透過說話而非打字來輸入內容——無論係喺編輯器、終端機、聊天框定表格入面,文字都會出現在Cursor所在的位置。轉錄功能完全在用戶自己的電腦上運作,使用阿里巴巴嘅Qwen3-ASR,再搭配DeepFilterNet3處理雜音,以及Silero VAD進行語音檢測。所有過程都喺本地完成。同律師通話、未發布嘅產品資料、病人記錄——這些資料都唔會離開運行它嘅電腦,因為根本冇地方可以傳送。它喺飛機上、穿過隧道嘅火車上、Wi-Fi不佳嘅酒店裡都能使用。支援30種語言,另外仲有22種中文方言。可以用你已經有的筆電運行——有圖形卡都得,冇都得;如果有圖形卡,則需要Vulkan 1.2+版本的GPU,可以是NVIDIA、AMD或者Intel Arc。在Linux系統上,它以單一可攜帶檔案形式提供,需要glibc 2.38或更新版本;而在Windows系統上,則是普通安裝程式,不需要管理員權限。提供14天試用期,無需任何卡片,只要一封電郵即可。

閱讀文章 →
授權 2026 年 4 月 16 日

你自己的執照現在已經涵蓋你自己的Business。

呢個個人許可證現已涵蓋個體經營同自由職業工作。如果你係獨資經營者、一人工作室或承包商,所購買的許可證就足以覆蓋你的工作。無需按用戶數計費,亦無分不同的商業等級。一張許可證可用於兩台裝置,只需購買一次。它附帶一年嘅更新服務;過咗嗰一年之後,更新就屬自願性質,應用程式會一直以你當前嘅版本運作,永遠有效。你已付款嘅軟件仍屬於你。

閱讀文章 →
產品 2026 年 4 月 12 日

三十種語言,以及一個看起來好似由人類所撰寫的用戶介面。

Brethof Voice Pro可以將文本轉寫成30種語言,識別22種中文方言,並能進行38種語言之間的翻譯。其介面亦已為這30種語言全部翻譯完成——由實際使用該產品的人士翻譯,而非透過機器翻譯後直接使用。你可以將應用程式設定為所需語言,它會像是用該語言撰寫的一樣呈現,因為確實如此。

閱讀文章 →
工程 2026 年 4 月 8 日

為何我們從 ONNX 轉移到 GGUF

最初嘅版本係用 ONNX Runtime 建置嘅。雖然可以運作,但體積龐大、部署起來好麻煩,仲令產品嘅大小超過實際需要。v1.5.0 就用一個運行時環境取代咗它——用 llama.cpp 進行轉錄,用我哋自己開發嘅函式庫進行翻譯——而且模型也變成單一嘅 GGUF 檔案。如此一來,下載量減少、啟動速度加快,產品也能更輕鬆地安裝在筆電上。有兩種模型尺寸供選擇,並非分不同等級:較小嘅適用於筆電同集成圖形卡,較大嘅則適用於有口音或背景噪音嘅音頻。你可以隨時切換,如果不想使用圖形卡,根本就唔需要。

閱讀文章 →
原則 2026 年 4 月 4 日

「100%離線」究竟是什麼意思?

有三樣東西會傳送到網絡上,除此之外再無其他。一是應用程式啟動時的授權檢查,二是同樣在應用程式啟動時進行的更新檢查,三是由用戶自行下載的模型。授權檢查會傳送授權密鑰,而更新檢查則會傳送版本資訊。它們從不傳送音頻或文字。一旦模型已儲存在磁碟中且更新檢查被關閉,就完全不會有任何資料外傳。這並非市場推廣用的說辭——防火牆的日誌就能證明這一點。將所有功能都在本地電腦上運行的原因,在於雲端服務並非必要功能;因為你的聲音是無法收回的資訊:比如與律師的通話、尚未公開的產品資料、病人的診療記錄等。用來處理這些資料的工具,不應需要網路連線才能運作,它應該能在飛機上使用,且不能有任何資料洩漏。這就是整個設計理念,屬於設計上的決定,而非某項功能。

閱讀文章 →

喺你嘅收件箱獲取更新

每有新版本就發一封電郵,附上上述的變更記錄。不會有垃圾郵件、推薦內容,也沒有每週通訊簡報。隨時只需點擊一下即可取消訂閱。

建立帳戶

出貨嗰陣先聽啦

新版本、真實基準測試,同埋偶爾嘅深入分析。冇垃圾郵件,一鍵取消訂閱。

我哋整嘅所有嘢

外部: YouTube · GitHub