Brethof Voice Pro — 何か新しいことは?

このアプリの更新履歴は、1回のリリースごとに記録されます。最新バージョンを利用している場合、これが既に持っている機能の一覧となります。チェンジログの下にある説明では、それらの決定背景が述べられています。

リリース 2026年8月14日

v2.3.1 — 二要素認証のアカウントでも再ログインできるようになりました

前回のバージョンアップで発生した不具合により、二要素認証を使用しているアカウントはログインできなくなっていました。v2.3.1ではこの問題が修正されています。もしその影響を受けた方は、ログイン情報とコードを入力すれば正常にログインできます。その他に変更点はありません。

リリース 2026年8月6日

v2.2.2 — 字幕ファイル、処理速度が約2倍に

現在、字幕ファイルの翻訳にかかる時間は、以前の半分程度です。タイミングも変わらず、文単位でも単語単位でも、各タイムスタンプは元の位置に正確に配置されます。もし字幕作成を生業としているのであれば、待ち時間が明らかに短くなったバージョンです。

v2.2.2でも同様に:

  • マイク入力の修正——特に高品質なマイクでは重要だった. オーディオのレベリングにより、クリーンな録音で最も大きな音量の部分がフルスケールを超えてクリップしてしまうことがあります。マイクの性能が高ければ高いほど、そのピーク値と平均レベルとの差が広くなり、このような問題が起きやすくなります。つまり、圧縮されたノイジーな入力信号はそのまま通過する一方で、静かな環境や質の良いコンデンサーマイクを使用した場合にはクリップが発生します。現在のレベリング処理ではヘッドルームが確保されるため、子音や急な音の立ち上がりもそのまま保持されます。
  • 新しい translate_batch MCPツール — 1回の呼び出しで複数の文字列を翻訳し、VRAMが不足した場合にはバッチサイズパラメーターによって自動的に調整される。
v2.2.2をダウンロード →
リリース 2026年7月11日

v2.2.1 — あなたのアプリはずっとあなたのものです

Brethof Voice Proは購入すればすぐにご利用いただけ、v2.2.1では何もがその利用を妨げることはありません。以前の起動時のライセンスチェックはまるでゲートのような役割を果たし、ネットワークがない、サーバーが混雑している、ファイアウォールが許可しないなどの理由で、お金を支払って購入したソフトウェアを利用できない状況になります。しかし今ではそのチェックが失敗してもアプリは正常に起動します。自分が所有しているソフトウェアが起動するために許可を求めるべきではありません。もはやそうではありません。

  • ライセンスを再確認するボタン ライセンスダイアログで——再検証を強制する 引き続き打ち上げが行われている 成功した場合。以前は、やり抜くか諦めるかしか方法がなかった。
  • 有料顧客向けの試用期限付きブランディングはありません。 — ダイアログは、もはや同じメッセージを全員に表示するのではなく、実際に起こったことを示すようになっている。
  • UIのフリーズがなくなる — モデルのダウンロードはインターフェーススレッド上で進行度を表示しながら実行され、接続速度が遅い場合でも起動時のライセンスチェックによってウィンドウがブロックされることはなくなります。
  • 失われたディクテーションなし — 話し終わった時点でテキスト変換がまだ実行中の場合、新しい音声は無視されることなくキューに入れられ、処理が止まっているプロセスでは次の録音に遅れて入力されるテキストを追加することはできなくなります。
  • オフラインは静かだ — 接続がない場合、ネットワークの待機を繰り返しません。
ダウンロード →
リリース 2026年6月4日

v2.2.0 — 最初の5分間ではなく、会議全体を記録する

長時間の録音も今ではバックグラウンドジョブとして処理されます。2時間分の会議の録音ファイルを渡せば、その間にコーヒーを淹れていられます。長さに制限はなく、特別な管理も必要ありません。そのまま放置しておけば自動的に処理が完了し、転記結果も残してくれます。3時間の通話も3分の通話と変わりません。ただ、処理に時間がかかるだけです。

  • マイクまたはシステム音声 — 自分の声を録音するか、またはコンピューターで再生されている音声——会議通話、ブラウザのタブ、スピーカーから出てくるあらゆる音声——をループバックでキャプチャします。New list_loopback_sources 利用可能なものを確認するためのツール。
  • 何も捨てられない。 — 録音が中断された場合、ウォッチドッグはそれを破棄するのではなく、後で取り出せるジョブとして転記します。
  • 正直な限界 — ショートインスタント転記モードの制限時間は10分に引き上げられ、その容量を超えて依頼すると、ロングフォームツールを利用すべきだという明確なエラーメッセージが表示される。もはや、音声をこっそりと処理して部分的な結果だけを返すようなことはない。
  • Linuxの翻訳修正 — v1.7.0以降のすべてのLinuxビルドにおいて、必要な依存関係が欠如していたため翻訳が正常に行われなかった。これは、リリース前に実際にビルドされたバイナリをチェックする新しいエンドツーエンドのリリースゲートによって発見された。
ダウンロード →
更新 2026年6月4日

v2.1.0 — HTTPを介してエージェントが情報を受け取れるようになりました

同じマシン上のエージェントは、MCPを通じてBrethof Voice Proを利用できるようになりました。これによりテキストの転記、翻訳、録音が可能です。ローカルHTTPを介して動作するため、URL経由でのみアクセスできるエージェントでもAPIキーなしで、かつマシン外にデータが送信されることなく利用できます。トークンがアクセスを制御し、トークンがなければサーバーは起動しません。この機能には有料ライセンスが必要です。

  • デフォルトでプライベート — 意図的に変更しない限り、自分のマシンでのみ聞き取りが可能で、制約が大きくなる。 起動を拒否する 認証トークンがない場合。トークンが設定されている場合、すべてのリクエストでそれを提示する必要がある。
  • 作業を中断しない — アイドル状態のときに解放されるモデルは、長時間にわたる処理の途中ではもはや解放できなくなります。進行中の処理を無視するタイムアウトは、最終的には正当な処理まで停止させてしまうため、何かが実行中の間はアイドルタイマーは一時停止されます。
ダウンロード →
リリース 2026年5月21日

v2.0.0 — 家を出ない翻訳

この強力なツールです。翻訳はすべてユーザーの端末で行われ、38言語に対応しています。一度話せば、英語、日本語、フランス語、スペイン語に同時にテキストが入力されます——1行ずつ、または同じ行内に並んで表示されます。エンジンはテンセントのHunyuan MT2で、使い勝手の良い軽量版と高品質な重量版の2種類から選べます。高品質版では、FLORES-200ベンチマークにおいてGoogleのGemini 3.1 Proの97.9%の性能を発揮し、実際の翻訳やマイノリティ言語の翻訳においてもそれを上回ります。すべてオフラインで動作し、データはどこにも送信されません。

v2.0.0の新機能:

  • 文字起こし+翻訳 — 「トランスクライブ」ポップアップには「翻訳先:」ドロップダウンがあります。ASRが文字起こしし、MTが翻訳し、両方が並べて表示されます。ファイル、マイク、システム音声(会議通話、ブラウザタブ、スピーカーから再生されるあらゆるもののループバックキャプチャ)に対応しています。
  • 多言語音声キーボード — メイン行の新しい翻訳チップをクリックすると、3列の言語グリッドが開きます。1つ以上のターゲットを選択すると、キーボードが翻訳を入力します。レイアウトモード:各行に1つ、インラインEN: … || PL: …)、または最初のターゲット言語のみ。
  • SRT / VTT字幕翻訳ツール — タイミングとキューインデックスを保持し、バイリンガルモード(原文行+翻訳)をサポート。AIエージェントの自動化のためにMCP経由で公開。
  • エンジンごとのマルチGPU対応 — 設定 → モデルには、各エンジン用の独立したデバイス選択があります。Vulkan 0でASRを実行し、Vulkan 1で翻訳を実行するか、VRAMが限られたノートパソコンではHunyuan MT2 7BをCPUに固定できます。
  • パーソナルボイストレーニングが本格稼働 — 自身の声を用いたLoRAファインチューニングを、マシン上でエンドツーエンドで実行可能。メインウィンドウのトレーニングカードには、取得したサンプル数と時間が一目で表示され、トレーニングタブの「トレーニング開始」でNVIDIA CUDAまたはCPUが自動選択され、トレーニング済みモデルがGGUF形式で自動エクスポートされます。すべての有料ライセンスに付属し、無料で利用可能です。
  • 新しいMCPツール4点translate_text, translate_srt, list_compute_devices, set_compute_device. 現在のツール総数は19です。
  • 正直な言語範囲の定義 — ASR:選択可能な言語30種+自動検出+中国語方言22種(合計52種)。翻訳:38言語(主要33言語+中国地域の少数民族言語5種)。23言語は双方向で対応。

Linuxのバイナリは161 MBで、Windowsのインストーラーは118 MBです。既存のライセンスはそのまま有効です——ただ v2.0.0をダウンロード 翻訳モデルは、設定 → モデルに表示されます。

v2.0.0をダウンロード →
リリース 2026年5月20日

v1.6.16 — あなたの声が独自のモデルに

Brethof Voice Proは今、あなたの声を使って学習します。学習データとなるのは、あなたが既に行った訂正内容で——聞き間違えた単語を一度修正すると、それが学習用のサンプルとして利用されます。サンプル文を読むよう求められることは一切ありません。学習はワンクリックで行われ、ご自身のハードウェア上で処理され、完了すると新しいモデルに切り替える準備が整います。

このトライアルでは、パーソナルトレーニングとエージェントとの連携を除くすべての機能が利用可能になります。これは、アプリを毎日使う人向けのものです。

エンジニアリング 2026年5月15日

v1.6.0 — 実行させて、後で戻ってきてください

二つあります。テキスト変換は今や非同期ジョブとして実行できるようになりました。音声ファイルを投入し、処理が終了したらテキストを取得すればよく、その間ずっと待っている必要はありません。

字幕のタイミングについてですが、正確に編集が必要な場合には、文単位ではなく単語単位でタイミングを設定できるようになりました。字幕を作成したことがある人なら、その重要性がわかるはずです。

エンジニアリング 2026年5月15日

v1.5.0 — ランタイムが1つで、ONNXはなし

ONNXランタイムはなくなりました。現在、この製品全体はllama.cppおよび当社独自の翻訳ライブラリ上で動作します。ランタイムが1つになり、ディスク上の容量が削減され、起動が速くなり、配布も容易になりました。

これらのモデルは単一のGGUFバンドルであり、そのおかげで小さいサイズのものでもどんな4GBのグラフィックカードでも動作するのです。なぜこのようにしたのかについては、ページの下の方に詳しい説明があります。

エンジニアリング 2026年5月14日

v1.4.0 — 初めてのエージェント接続機能、およびGPU選択機能が追加されました。

二つの初めて。ここでMCPサーバーが登場します——自分のマシン上でエージェントに「耳」を与える最初の方法です。

そしてデバイス選択機能:テキストの転写と翻訳はそれぞれ独自のプロセッサを選べるようになったため、一方はグラフィックカードで処理され、もう一方はCPUで処理される。GPUの性能がそれほど高くないノートパソコンでも、両方の処理を滞りなく行うことができる。

ロードマップ 2026年4月16日

macOS — 開発中、Apple Silicon搭載機から先行提供

macOSはApple Siliconを搭載したバージョンから開発が進められています。具体的なリリース日はまだ決まっておらず、実際の製品が完成するまで公表しません。その間、LinuxとWindowsは同じ機能を持つ同じ製品であり、一方を売るために他方の機能を制限することはありません。Mac版がリリースされたら、このページでお知らせします。

記事を読む →
製品 2026年4月16日

自分の声でトレーニングしてください。

あなたのアクセントは克服すべき問題ではなく、学習させるべきモデルです。Brethof Voice Proは、あなたが既に行った修正から学習します。聞き間違えた単語を一度正すだけで、その修正内容が学習例として保存されます。サンプル文も、キャリブレーションスクリプトも、マイクで長時間音声を読み込む必要もありません。あらかじめ設定した固有名詞——ブランド名、専門用語、同僚の名前など——がテキスト転記や翻訳の方向性を決定するため、名前が誤って現地語化されることはありません。トレーニングはワンクリックで行え、ご自身のハードウェア上で動作し、処理が完了すると新しいモデルに切り替えることができます。これまであなたが行ってきた修正は常に教育素材でしたが、今ではそれらがモデルを訓練するのです。

記事を読む →
お知らせ 2026年4月16日

Brethof Voice Proが稼働中

最初のリリースです。キーボード入力の代わりに話しかけるだけで、エディタやターミナル、チャットボックス、フォームなど、どんな場所にでもテキストが表示されます。音声認識はすべてユーザーのコンピュータ上で行われ、AlibabaのQwen3-ASRを使用し、ノイズ処理にはDeepFilterNet3、音声検出にはSilero VADが活用されます。すべてがローカルで処理されます。弁護士との通話、未公開の製品の情報、患者の記録など、どれも処理されたコンピュータから外に出ることはありません。飛行機の中、トンネルを通る電車の中、Wi-Fiが悪いホテルでも利用可能です。30か国語に対応し、中国語の地方言語も22種類別途サポートしています。既存のラップトップで動作し、グラフィックカードの有無に関係なく、グラフィックカードがある場合はVulkan 1.2以上のGPUであればNVIDIA、AMD、Intel Arcのいずれでも大丈夫です。Linux版は単一のポータブルファイルとして提供され、glibc 2.38以降が必要です。Windows版は通常のインストーラー形式で、管理者権限は不要です。14日間の試用期間があり、カードは不要でメールアドレスだけで登録できます。

記事を読む →
ライセンス 2026年4月16日

あなたのライセンスは、現在、あなた自身のビジネスに適用されます。

この個人ライセンスは、個人事業やフリーランスとしての活動にも適用されます。個人事業主、一人で営むスタジオ、請負業者であっても、購入したライセンスがその活動をカバーします。ユーザーごとの課金はなく、別途の事業者向けプランもありません。1つのライセンスで2台のデバイスを使用でき、一度購入すればよいのです。1年間のアップデートが含まれており、その後はアップデートは任意で、アプリは現在のバージョンのまま無期限に動作し続けます。購入したソフトウェアは常にあなたのものです。

記事を読む →
製品 2026年4月12日

30か国語に対応し、まるで人間が書いたかのようなUI。

Brethof Voice Proは30の言語にテキストを転記し、22の中国語地域方言を認識し、38の言語間で翻訳が可能です。また、そのインターフェースも30の言語すべてに完全に翻訳されており、これらは機械翻訳を経由したものではなく、実際に製品を使用する人々によって翻訳されたものです。アプリの言語を自分の好きな言語に設定すれば、まるでその言語で書かれたかのように読めます。実際、そうなっているのです。

記事を読む →
エンジニアリング 2026年4月8日

なぜONNXからGGUFに移行したのか

最初のバージョンではONNX Runtimeを使用していました。動作はしましたが、負荷が大きく、配布が面倒で、製品のサイズも必要以上に大きくなっていました。v1.5.0では、トランスクリプション用にllama.cppという単一のランタイム、翻訳用に独自のライブラリを採用し、モデルもGGUF形式の単一バンドルになりました。その結果、ダウンロード容量が減少し、起動が速くなり、ノートパソコン上でもスムーズに動作するようになりました。モデルには2つのサイズがあり、これは階層ではなく選択肢です。小さい方はノートパソコンや統合グラフィックス向けで、大きい方はアクセント付き音声や雑音の多い音声向けです。いつでも切り替えが可能で、必要でなければグラフィックカードは全く不要です。

記事を読む →
原則 2026年4月4日

「100%オフライン」とは正確にどういう意味か

ネットワークに届くのは3つのものだけで、それ以外は何もない。アプリが起動する際のライセンスチェック、同じく起動時のアップデートチェック、そしてユーザーが自ら行うモデルのダウンロードだ。ライセンスチェックではライセンスキーが送信され、アップデートチェックではバージョン情報が送信される。どちらも音声やテキストを送信することは決してない。モデルがディスク上に保存され、アップデートチェックがオフになれば、一切何も送信されなくなる。これはマーケティング用の文句ではなく、ファイアウォールのログで確認できる。すべてを自分のコンピューター上で処理する理由は、クラウドが何か特別な機能だからではない。重要なのは、自分の声というものは一度発せられたら取り消せないという点だ。弁護士との通話、未公開の製品に関する情報、患者の記録などだ。これらを扱うツールは、機能を果たすためにネットワーク接続を必要としてはならない。飛行機の中でも動作し、情報が漏洩してはならないのだ。これがその核心であり、これは機能ではなく設計上の決定事項なのだ。

記事を読む →

メールで最新情報を受け取る

リリースごとに1通のメールを送信し、その上にチェンジログを記載します。スパムや宣伝メール、週次ニュースレターはありません。いつでもワンクリックで購読解除が可能です。

アカウントを作成する

発送されたらお知らせします

新リリース、実際のベンチマーク、時折の深掘り記事。スパムなし、ワンクリックで登録解除。

私たちが作るすべて

Voice Pro

あなたの声を学習するローカル音声認識。永久ライセンス。当社のフラッグシップ製品。

有料・フラッグシップ

brethof-brain

AIエージェント用の長期記憶機能——全文データ、ベクターデータ、グラフデータをサポート。セッション開始時に説明が行われ、各プロンプトで呼び出され、自動的にアーカイブされる。

有料・無料プラン

3Dモデル

印刷対応デジタルモデル。GLBとOBJを含む。生涯アクセス権付き。

有料・デジタルカタログ

3Dプリント

プリンター5台、十分な処理能力を備えています。まだセルフサービス店はありません——ご要望をお知らせいただければ、メールで見積もりを送らせていただきます。

ご予約制・メールでお問い合わせください

Nova

私たちのYouTubeチャンネル。サイバータイガー司会者が、地元のAIツールとその実際の機能について解説します。

チャンネル・ライブ

厳選リスト

AIコーディングエージェント、MCPサーバー、ローカルAI、およびAI向けLinuxに特化した厳選されたGitHubリスト。各エントリーには出典のリンクが記載されています。

無料・厳選

ガイド

Linux、Windows、macOSでのローカルAIを扱った詳細なガイドで、設定ファイルも同梱されています。

無料・ライブ

アンチデベロッパー向けティアリスト

ネガティブキュレーション:時間を無駄にする手法とツールのランキング。証拠必須。

無料・ライブ

Brethof AIについて

私たちとは誰か、なぜプライバシーを最優先にしたAIを開発するのか、そして何をしないのか。

外部: YouTube · GitHub