あなたが話している。言葉は——エディター、ターミナル、チャットボックス、フォーム、つまりカーソルがある場所ならどこでも——送信される。そしてそれらの言葉はすべて、発言したそのコンピューター上に残るのだ。
Brethof Voice Proとは、すべてユーザーのコンピュータ上で動作する音声入力からテキストへの変換機能および翻訳機能です。これはプライバシー保護機能ではなく、製品そのものなのです。
一つのプログラムで、四人分の仕事に相当する。声をテキストに変換し、38か国語に翻訳し、動画に字幕を付け、キーボードが使える場所ならどこでも入力を代行してくれる。オフラインでも動作し——飛行機の中、Wi-Fiが悪いホテル、トンネルの中でも——既存のノートパソコン上でも、グラフィックカードの有無に関わらず利用可能だ。サブスクリプションも不要、分単位の料金もなく、アップロードも必要ない。AIエージェントには耳も与えよう——APIキーなしで、MCPを通じてあらゆる長さの会議をテキスト化・翻訳・録音できるのだ。一度購入すれば、ずっと使い続けられる。
あなたの声はコンピューターから外に出ることはない。その表現は正確で、まさに要点を突いている。起動時にネットワークに送信されるのは3つだけで、それ以上ではない。ライセンスチェック、アップデートチェック、そしてユーザーが自らダウンロードするモデルファイルのみだ。ライセンスチェックではライセンスキーが送信され、アップデートチェックではバージョン情報が送信される——音声もテキストも一切ない。アップデートチェックをオフにすれば、モデルファイルがディスクに保存された後は、何も外部に送信されることはない。
30以上の言語への文字起こしに加え、22の中国の地域方言も自動的に認識——設定やトレーニングは不要。さらに、あなたのアクセントも間違って表現されることがなくなります。Brethof Voice Proは、あなたの声や専門用語、固有名詞をご自身のデバイスで学習します。おばあさんの四川語で話しても正しく翻訳されます。
ポーランド語を話し、英語を読む。英語を話し、日本語を読む。あるいは一度発音するだけで、英語、日本語、フランス語、スペイン語に同時にテキストが入力される——1行ずつ、または同じ行内で並べて表示される。希望するターゲット言語を自由に選べる。合計38言語があり、そのうち23言語は双方向での翻訳が可能だ。翻訳処理はユーザーのコンピュータ上のTencentのHunyuan MT2で行われる。FLORES-200ベンチマークにおいて、その品質レベルはGoogleのGemini 3.1 Proの97.9%に達し、実世界の翻訳やマイノリティ言語の翻訳ではそれを上回る。2つのサイズがあり、どちらもオプションでダウンロード可能だ——日常的な使用には高速版、重要な文章には高品質版がある。字幕も対応しており、プレーンテキストまたはSRT形式で、文単位、または正確に編集が必要な場合は単語単位でタイミング設定が可能だ。字幕ファイルを翻訳してもすべてのタイミング情報は保持される。分単位で料金を支払うことなく、38言語で自分の動画に字幕を付けることができる。
だからこそ、他のどんな方法ではうまくいかない場所でも機能するのです。飛行機の中や、Wi-Fiが悪いホテル、トンネルを通る列車の中などです。録音データを送信先に送る必要がないので、どこかに送信する必要もありません。2時間分の会議の録音を残しておいて、その間にコーヒーを淹れに行っても大丈夫。戻ってきた時には文字起こしが既に用意されています。録音を忘れていたとしても何も失われず、自動的に処理が完了し、文字起こしも残っているのです。
2つの転写モデルがあり、これは階層ではなく選択肢であり、いつでも切り替えることができます。
ほとんどの音声ソフトウェアでは、設定時にサンプル文を読み上げる必要があります。しかし、このソフトはそうではありません。既に行った修正から学習します。聞き間違えた単語を正すと、その修正内容が学習用の例として使われます。ブランド名や専門用語、同僚の名前を一度登録しておけば、テキスト転記でも翻訳結果でも、それらが間違って表示されることはありません。なぜなら、両方の処理で同じリストが使用されるからです。名前が誤ってローカライズされることは決してありません。学習はワンクリックで行え、ユーザーのハードウェア上で処理され、学習が完了すると新しいモデルに切り替えることができます。
一度購入すれば、それがあなたのものです。1年間のアップデートが含まれた永久ライセンスです。
騒がしい部屋ももはや問題ではなくなります。カフェや見本市会場、車内での録音にもノイズ低減機能が内蔵されています。私たちの測定結果によると、この機能はデフォルトでオフになっており、短くてクリーンなマイク音声ではかえって状況を悪化させます。背後にエスプレッソマシンがある2時間の会議の場合は、この機能をオンにしてください。
このボイスキーボードは、ブラウザ、IDE、チャットアプリ、キーボード入力が可能なあらゆる場所で、カーソルがある位置にテキストを入力します。また、音声の転写ではなく翻訳されたテキストを入力することもできます。自分の言語で文を話せば、その文はフォームに必要な言語で正しい単語として表示されます。1行のみで、切り貼りは不要です。
0.6Bは日常的に使えるモデルです。4GBのグラフィックカードがあればもちろん、内蔵グラフィックを搭載した機器や、グラフィックカードが全くないノートパソコンでも動作します。高速で軽量、必要な時にすぐに利用できます。
17億モデルは慎重に設計されており、アクセントのある音声や雑音の多い音声、言葉が重要となる2時間の会議向けです。約6GBのVRAMが必要で、高品質な翻訳モデルも同時に使用する場合は8GBが必要です。
GPUがまったくないの?それでも動作する。CPUのみの場合は、8GBのRAM、4コアプロセッサ、そして約5GBの空きディスク容量が必要で、その他の要素には7~9GBが必要だ。Vulkan 1.2以降をサポートするどのグラフィックカードでも利用可能——NVIDIA、AMD、Intel Arcなどだ。また、音声認識と翻訳はそれぞれ別のプロセッサを使用するため、一方はグラフィックカードで、もう一方はCPUで動作させることができる。
設定 → モデルから、必要に応じてオプションアドオンをダウンロードできます。
Forced Aligner 単語レベルのタイムスタンプ用(約540 MB) Hunyuan MT2 Fast (約1 GB)または 品質 翻訳には(約4.3 GB)が必要です。
| 機能 | Brethof Voice Pro | Dragon | Google STT | Otter.ai | Whisper (OSS) |
|---|---|---|---|---|---|
| 100%ローカル処理 | ✓ | ✓ | ✗ | ✗ | ✓ |
| 永久ライセンス | ✓ | ~ | ✗ | ✗ | ✓ |
| ネイティブLinux対応 | ✓ | ✗ | ~ | ✗ | ✓ |
| Windowsネイティブ対応 | ✓ | ✓ | ~ | ✗ | ~ |
| 30のASR言語+自動検出 | ✓ | ✗ | ✓ | ~ | ✓ |
| オフライン翻訳(38言語) | ✓ | ✗ | ✗ | ✗ | ✗ |
| GPUアクセラレーション(NVIDIA + AMD + Intel) | ✓ | ✗ | N/A | N/A | ~ |
| パーソナルモデルの微調整(LoRA) | ✓ | ✓ | ✗ | ✗ | ✗ |
| AIエージェント用のMCPサーバー | ✓ | ✗ | ✗ | ✗ | ✗ |
| 内蔵ノイズリダクション | ✓ | ✓ | ✓ | ✓ | ✗ |
| テキストの直接挿入 | ✓ | ✓ | ✗ | ✗ | ✗ |
| 洗練されたデスクトップGUI | ✓ | ✓ | ✗ | ✓ | ✗ |
| 一般的なコスト | $49 一度 | 年額350米ドル以上 | 月額17米ドル | 月額17米ドル | 無料 |
月額料金はなく、利用制限もありません。1年間のアップデートが含まれた永久ライセンスです。
クレジットカードは不要です。トライアルを確認するためにメールアドレスのみが必要です。
永久ライセンス。パーソナルデバイス2台まで。1年間のアップデートが含まれます。
価格は税抜きです。アップデートには年間$20がかかります(任意)
席ごとの永久ライセンス。チームおよび組織での利用。1年間のアップデート付き。
価格は税別です。アップデートはオプションで、1席あたり年間20ドルです。
いいえ。Brethof Voice Proはすべての処理をデバイス上でローカルに行います。音声やテキストデータは一切外部に送信されません。クラウド機能、テレメトリ、分析機能はありません。
どの最新のGPUでも利用可能です。NVIDIA、AMD、Intel ArcはすべてVulkanアクセラレーションを採用しています。CPUのみで動作させることもできますが、その場合は文字起こしの速度が遅くなります。0.6Bモデルは統合グラフィックスや4 GB以上のVulkan対応グラフィックカードでも問題なく動作します。
から始める 0.6Bモデル — これが推奨されるデフォルト設定で、ほとんどのGPUで優れたパフォーマンスを発揮します(最新のマシンではCPU上でも動作します)。アクセントのある音声やノイズの多い音声でより高い精度が必要な場合は、に切り替えてください。 1.7Bモデル (6GB以上のVRAMが必要です)。設定→モデルからいつでもサイズを変更でき、再ダウンロードする必要はありません。
はい。Brethof Voice ProはLinuxおよびWindowsの両方をネイティブにサポートしています。LinuxではX11およびWaylandで動作し、Windowsでは標準的なデスクトップアプリケーションとして実行されます。
ご利用のライセンスは永久制で、どのバージョンをお使いでもアプリは永遠に動作し続けます。年間20ドルのオプションであるアップデートパスを購入すれば、新機能やモデルの改良を利用できます。購入しなければ、現在のバージョンのままです。
はい — v2.0.0には個人向けの音声トレーニング機能が含まれており、すべてユーザーのマシン上でエンドツーエンドで処理されます。誤認識された単語を訂正するたびに、{clip, correction}のペアが自動的にローカルのトレーニングデータセットに保存されます。メインウィンドウのトレーニングカードには、取得されたサンプル数や時間が一目で表示されます。トレーニングタブの「トレーニングを開始」をクリックすると、自分のアクセントに合わせてLoRAを微調整できます。結果は自動的にGGUF形式でエクスポートされ、ワンクリックで利用可能になります。すべての有料ライセンスで無料で提供され、ユーザーの音声データは決してマシン外に送信されません。
あなたの声を学習するローカル音声認識。永久ライセンス。当社のフラッグシップ製品。
有料・フラッグシップ
AIエージェント用の長期記憶機能——全文データ、ベクターデータ、グラフデータをサポート。セッション開始時に説明が行われ、各プロンプトで呼び出され、自動的にアーカイブされる。
有料・無料プラン
印刷対応デジタルモデル。GLBとOBJを含む。生涯アクセス権付き。
有料・デジタルカタログ
プリンター5台、十分な処理能力を備えています。まだセルフサービス店はありません——ご要望をお知らせいただければ、メールで見積もりを送らせていただきます。
ご予約制・メールでお問い合わせください
私たちのYouTubeチャンネル。サイバータイガー司会者が、地元のAIツールとその実際の機能について解説します。
チャンネル・ライブ
AIコーディングエージェント、MCPサーバー、ローカルAI、およびAI向けLinuxに特化した厳選されたGitHubリスト。各エントリーには出典のリンクが記載されています。
無料・厳選
Linux、Windows、macOSでのローカルAIを扱った詳細なガイドで、設定ファイルも同梱されています。
無料・ライブ
ネガティブキュレーション:時間を無駄にする手法とツールのランキング。証拠必須。
無料・ライブ
私たちとは誰か、なぜプライバシーを最優先にしたAIを開発するのか、そして何をしないのか。