Voice Proは30のテキスト化言語と38の翻訳言語で音声を認識・テキスト化し、アプリのインターフェース全体(メニュー、設定、エラー、ライセンスダイアログ)もそれぞれの言語に翻訳されています。ウェブサイトも同様で、あなたが今読んでいるページは他の35言語でも利用可能です。 /xx/ URL。
リスト
アラビア語、ブルガリア語、広東語、中国語(簡体字)、クロアチア語、チェコ語、デンマーク語、オランダ語、英語、フィリピン語、フィンランド語、フランス語、ドイツ語、ギリシャ語、ヒンディー語、ハンガリー語、インドネシア語、イタリア語、日本語、韓国語、マケドニア語、マレー語、ペルシア語、ポーランド語、ポルトガル語、ルーマニア語、ロシア語、セルビア語、スロバキア語、スロベニア語、スペイン語、スウェーデン語、タイ語、トルコ語、ウクライナ語、ベトナム語。
言語検出の仕組み
2つの独立したシステム:
- ウェブサイト: 初回アクセス時にGeo-IP照会が行われます。ポーランドから閲覧している場合、次のページに移動します。
/pl/. ナビゲーションに言語切り替え機能があり、手動で別の言語を選択できます。選択した言語は記憶されます。 - アプリ(音声認識): 設定で基本言語を指定してください。ASRモデルはこれを強い手がかりとして使用します。ポーランド語の文の中に時折英単語が含まれていても認識できますが、「こんにちは」と言っただけで突然チェコ語に切り替わることはありません。
「完全翻訳」とは実際にどういう意味か
ユーザーが見るすべてのUI文字列——すべてのボタン、メニューアイテム、エラーメッセージ、ツールチップ、設定ラベル、ログ行——は、翻訳カタログ内のキーとして保存されています。各言語には、対応する機能に応じて275~320件の翻訳済み文字列が含まれたファイルが用意されています。アプリ起動時、選択した言語のカタログが読み込まれ、インターフェース上のすべてのラベルはそのファイルから取得されます。
ウェブサイトでも同じことをしています:ページごとに1つの英語テンプレート、言語ごとに1つのJSONファイル、そしてそれらを結合するビルドスクリプトです。現在288ページが生成されています(8ページ×30の音声転写言語+38の翻訳言語)、Googleに各翻訳版を正しい形で指し示すサイトマップも用意しています。 hreflang タグ。
翻訳の品質
最初の翻訳は、ドイツ語、スペイン語、フランス語、イタリア語、ポーランド語、ポルトガル語、ロシア語、中国語、日本語、韓国語という上位10言語については大規模モデルによって行われ、その後人間によるレビューが施されました。残りの26言語についてはモデルの出力のみを利用しました——これでも十分ですが、完璧とは言えません。
翻訳が不自然で、文脈に合っていなかったり、まるでロボットが書いたように聞こえる場合は: お知らせください. 文字列、言語、そしてより良い提案を送ってください [email protected]. 翻訳修正も、有効なChampions Programの貢献として受け付けています。
対応していない言語ですか?需要があり、Qwen ASRモデルが対応可能な場合は、追加いたします。