DeepL Voice、音声通訳の一般提供を開始 Windows/Mac向けデスクトップアプリも発表

DeepLは9月15日、リアルタイム音声翻訳サービス「DeepL Voice」のVoice AIモデルを強化したと発表した。オンライン会議、対面での会話、およびDeepL Voice APIを通じた利用において、音声から音声への翻訳(音声通訳)の一般提供を開始する。
DeepL Voiceはこれまで、音声からテキストへの翻訳字幕を中心に多言語コミュニケーションを支援してきた。今回のアップデートでは、話者本人の声質や話し方の特徴、テンポを保ったまま相手の言語で再生する音声通訳へと機能が広がる。質問の語尾やイントネーション、ためらいや高揚感といった感情表現も翻訳に反映されるという。
音声通訳は30以上の言語で利用可能。このうち日本語を含む14言語では、話者の声の特徴も維持される。複数の参加者を同時に翻訳する場合でも、それぞれの声の違いから誰が話しているかを把握できるとしている。DeepL Voice APIは、コンタクトセンターや会議ツールなど外部のサービス・製品にリアルタイム音声AIを組み込むための仕組みで、開発者向けに提供されている。
あわせて、Windows/Mac向けの「DeepL Voiceデスクトップアプリ」も発表された。Zoom、Microsoft Teams、Google Meetと連携して会議を自動検出し、翻訳字幕をオーバーレイで常時表示する。ユーザーは会議中に翻訳字幕で内容を追うことも、音声で把握したい場合は音声対音声翻訳へ切り替えることもできる。字幕のサイズや背景の音量、翻訳設定なども調整可能だという。
DeepLは、オンライン会議プラットフォーム側のアップデートを待たずに新たなVoice機能を利用できる点をデスクトップアプリの利点として挙げている。既存のプラットフォームを使い続けながら、追加のシステム連携なしで同じ操作性で翻訳を利用できる設計となっている。
なお、DeepLは9月15日から17日まで米国サンフランシスコで開催される「Salesforce Dreamforce 2026」において、Voice AIパートナーとして全50ステージおよび1,000を超えるセッションでリアルタイム翻訳を提供する。























