このアプリの更新履歴は、1回のリリースごとに記録されます。最新バージョンを利用している場合、これが既に持っている機能の一覧となります。チェンジログの下にある説明では、それらの決定背景が述べられています。
前回のバージョンアップで発生した不具合により、二要素認証を使用しているアカウントはログインできなくなっていました。v2.3.1ではこの問題が修正されています。もしその影響を受けた方は、ログイン情報とコードを入力すれば正常にログインできます。その他に変更点はありません。
現在、字幕ファイルの翻訳にかかる時間は、以前の半分程度です。タイミングも変わらず、文単位でも単語単位でも、各タイムスタンプは元の位置に正確に配置されます。もし字幕作成を生業としているのであれば、待ち時間が明らかに短くなったバージョンです。
v2.2.2でも同様に:
translate_batch MCPツール — 1回の呼び出しで複数の文字列を翻訳し、VRAMが不足した場合にはバッチサイズパラメーターによって自動的に調整される。Brethof Voice Proは購入すればすぐにご利用いただけ、v2.2.1では何もがその利用を妨げることはありません。以前の起動時のライセンスチェックはまるでゲートのような役割を果たし、ネットワークがない、サーバーが混雑している、ファイアウォールが許可しないなどの理由で、お金を支払って購入したソフトウェアを利用できない状況になります。しかし今ではそのチェックが失敗してもアプリは正常に起動します。自分が所有しているソフトウェアが起動するために許可を求めるべきではありません。もはやそうではありません。
長時間の録音も今ではバックグラウンドジョブとして処理されます。2時間分の会議の録音ファイルを渡せば、その間にコーヒーを淹れていられます。長さに制限はなく、特別な管理も必要ありません。そのまま放置しておけば自動的に処理が完了し、転記結果も残してくれます。3時間の通話も3分の通話と変わりません。ただ、処理に時間がかかるだけです。
list_loopback_sources 利用可能なものを確認するためのツール。同じマシン上のエージェントは、MCPを通じてBrethof Voice Proを利用できるようになりました。これによりテキストの転記、翻訳、録音が可能です。ローカルHTTPを介して動作するため、URL経由でのみアクセスできるエージェントでもAPIキーなしで、かつマシン外にデータが送信されることなく利用できます。トークンがアクセスを制御し、トークンがなければサーバーは起動しません。この機能には有料ライセンスが必要です。
この強力なツールです。翻訳はすべてユーザーの端末で行われ、38言語に対応しています。一度話せば、英語、日本語、フランス語、スペイン語に同時にテキストが入力されます——1行ずつ、または同じ行内に並んで表示されます。エンジンはテンセントのHunyuan MT2で、使い勝手の良い軽量版と高品質な重量版の2種類から選べます。高品質版では、FLORES-200ベンチマークにおいてGoogleのGemini 3.1 Proの97.9%の性能を発揮し、実際の翻訳やマイノリティ言語の翻訳においてもそれを上回ります。すべてオフラインで動作し、データはどこにも送信されません。
v2.0.0の新機能:
EN: … || PL: …)、または最初のターゲット言語のみ。translate_text, translate_srt, list_compute_devices, set_compute_device. 現在のツール総数は19です。Linuxのバイナリは161 MBで、Windowsのインストーラーは118 MBです。既存のライセンスはそのまま有効です——ただ v2.0.0をダウンロード 翻訳モデルは、設定 → モデルに表示されます。
v2.0.0をダウンロード →Brethof Voice Proは今、あなたの声を使って学習します。学習データとなるのは、あなたが既に行った訂正内容で——聞き間違えた単語を一度修正すると、それが学習用のサンプルとして利用されます。サンプル文を読むよう求められることは一切ありません。学習はワンクリックで行われ、ご自身のハードウェア上で処理され、完了すると新しいモデルに切り替える準備が整います。
このトライアルでは、パーソナルトレーニングとエージェントとの連携を除くすべての機能が利用可能になります。これは、アプリを毎日使う人向けのものです。
二つあります。テキスト変換は今や非同期ジョブとして実行できるようになりました。音声ファイルを投入し、処理が終了したらテキストを取得すればよく、その間ずっと待っている必要はありません。
字幕のタイミングについてですが、正確に編集が必要な場合には、文単位ではなく単語単位でタイミングを設定できるようになりました。字幕を作成したことがある人なら、その重要性がわかるはずです。
ONNXランタイムはなくなりました。現在、この製品全体はllama.cppおよび当社独自の翻訳ライブラリ上で動作します。ランタイムが1つになり、ディスク上の容量が削減され、起動が速くなり、配布も容易になりました。
これらのモデルは単一のGGUFバンドルであり、そのおかげで小さいサイズのものでもどんな4GBのグラフィックカードでも動作するのです。なぜこのようにしたのかについては、ページの下の方に詳しい説明があります。
二つの初めて。ここでMCPサーバーが登場します——自分のマシン上でエージェントに「耳」を与える最初の方法です。
そしてデバイス選択機能:テキストの転写と翻訳はそれぞれ独自のプロセッサを選べるようになったため、一方はグラフィックカードで処理され、もう一方はCPUで処理される。GPUの性能がそれほど高くないノートパソコンでも、両方の処理を滞りなく行うことができる。
macOSはApple Siliconを搭載したバージョンから開発が進められています。具体的なリリース日はまだ決まっておらず、実際の製品が完成するまで公表しません。その間、LinuxとWindowsは同じ機能を持つ同じ製品であり、一方を売るために他方の機能を制限することはありません。Mac版がリリースされたら、このページでお知らせします。
記事を読む →あなたのアクセントは克服すべき問題ではなく、学習させるべきモデルです。Brethof Voice Proは、あなたが既に行った修正から学習します。聞き間違えた単語を一度正すだけで、その修正内容が学習例として保存されます。サンプル文も、キャリブレーションスクリプトも、マイクで長時間音声を読み込む必要もありません。あらかじめ設定した固有名詞——ブランド名、専門用語、同僚の名前など——がテキスト転記や翻訳の方向性を決定するため、名前が誤って現地語化されることはありません。トレーニングはワンクリックで行え、ご自身のハードウェア上で動作し、処理が完了すると新しいモデルに切り替えることができます。これまであなたが行ってきた修正は常に教育素材でしたが、今ではそれらがモデルを訓練するのです。
記事を読む →最初のリリースです。キーボード入力の代わりに話しかけるだけで、エディタやターミナル、チャットボックス、フォームなど、どんな場所にでもテキストが表示されます。音声認識はすべてユーザーのコンピュータ上で行われ、AlibabaのQwen3-ASRを使用し、ノイズ処理にはDeepFilterNet3、音声検出にはSilero VADが活用されます。すべてがローカルで処理されます。弁護士との通話、未公開の製品の情報、患者の記録など、どれも処理されたコンピュータから外に出ることはありません。飛行機の中、トンネルを通る電車の中、Wi-Fiが悪いホテルでも利用可能です。30か国語に対応し、中国語の地方言語も22種類別途サポートしています。既存のラップトップで動作し、グラフィックカードの有無に関係なく、グラフィックカードがある場合はVulkan 1.2以上のGPUであればNVIDIA、AMD、Intel Arcのいずれでも大丈夫です。Linux版は単一のポータブルファイルとして提供され、glibc 2.38以降が必要です。Windows版は通常のインストーラー形式で、管理者権限は不要です。14日間の試用期間があり、カードは不要でメールアドレスだけで登録できます。
記事を読む →この個人ライセンスは、個人事業やフリーランスとしての活動にも適用されます。個人事業主、一人で営むスタジオ、請負業者であっても、購入したライセンスがその活動をカバーします。ユーザーごとの課金はなく、別途の事業者向けプランもありません。1つのライセンスで2台のデバイスを使用でき、一度購入すればよいのです。1年間のアップデートが含まれており、その後はアップデートは任意で、アプリは現在のバージョンのまま無期限に動作し続けます。購入したソフトウェアは常にあなたのものです。
記事を読む →Brethof Voice Proは30の言語にテキストを転記し、22の中国語地域方言を認識し、38の言語間で翻訳が可能です。また、そのインターフェースも30の言語すべてに完全に翻訳されており、これらは機械翻訳を経由したものではなく、実際に製品を使用する人々によって翻訳されたものです。アプリの言語を自分の好きな言語に設定すれば、まるでその言語で書かれたかのように読めます。実際、そうなっているのです。
記事を読む →最初のバージョンではONNX Runtimeを使用していました。動作はしましたが、負荷が大きく、配布が面倒で、製品のサイズも必要以上に大きくなっていました。v1.5.0では、トランスクリプション用にllama.cppという単一のランタイム、翻訳用に独自のライブラリを採用し、モデルもGGUF形式の単一バンドルになりました。その結果、ダウンロード容量が減少し、起動が速くなり、ノートパソコン上でもスムーズに動作するようになりました。モデルには2つのサイズがあり、これは階層ではなく選択肢です。小さい方はノートパソコンや統合グラフィックス向けで、大きい方はアクセント付き音声や雑音の多い音声向けです。いつでも切り替えが可能で、必要でなければグラフィックカードは全く不要です。
記事を読む →ネットワークに届くのは3つのものだけで、それ以外は何もない。アプリが起動する際のライセンスチェック、同じく起動時のアップデートチェック、そしてユーザーが自ら行うモデルのダウンロードだ。ライセンスチェックではライセンスキーが送信され、アップデートチェックではバージョン情報が送信される。どちらも音声やテキストを送信することは決してない。モデルがディスク上に保存され、アップデートチェックがオフになれば、一切何も送信されなくなる。これはマーケティング用の文句ではなく、ファイアウォールのログで確認できる。すべてを自分のコンピューター上で処理する理由は、クラウドが何か特別な機能だからではない。重要なのは、自分の声というものは一度発せられたら取り消せないという点だ。弁護士との通話、未公開の製品に関する情報、患者の記録などだ。これらを扱うツールは、機能を果たすためにネットワーク接続を必要としてはならない。飛行機の中でも動作し、情報が漏洩してはならないのだ。これがその核心であり、これは機能ではなく設計上の決定事項なのだ。
記事を読む →リリースごとに1通のメールを送信し、その上にチェンジログを記載します。スパムや宣伝メール、週次ニュースレターはありません。いつでもワンクリックで購読解除が可能です。
アカウントを作成するあなたの声を学習するローカル音声認識。永久ライセンス。当社のフラッグシップ製品。
有料・フラッグシップ
AIエージェント用の長期記憶機能——全文データ、ベクターデータ、グラフデータをサポート。セッション開始時に説明が行われ、各プロンプトで呼び出され、自動的にアーカイブされる。
有料・無料プラン
印刷対応デジタルモデル。GLBとOBJを含む。生涯アクセス権付き。
有料・デジタルカタログ
プリンター5台、十分な処理能力を備えています。まだセルフサービス店はありません——ご要望をお知らせいただければ、メールで見積もりを送らせていただきます。
ご予約制・メールでお問い合わせください
私たちのYouTubeチャンネル。サイバータイガー司会者が、地元のAIツールとその実際の機能について解説します。
チャンネル・ライブ
AIコーディングエージェント、MCPサーバー、ローカルAI、およびAI向けLinuxに特化した厳選されたGitHubリスト。各エントリーには出典のリンクが記載されています。
無料・厳選
Linux、Windows、macOSでのローカルAIを扱った詳細なガイドで、設定ファイルも同梱されています。
無料・ライブ
ネガティブキュレーション:時間を無駄にする手法とツールのランキング。証拠必須。
無料・ライブ
私たちとは誰か、なぜプライバシーを最優先にしたAIを開発するのか、そして何をしないのか。