Dellows News

DeepL、声の特徴や感情を維持する新Voice AIモデルとアプリを発表

DeepLは2026年9月15日、Voice AIテクノロジーを大幅に強化したと発表しました。新たなVoice AIモデルでは、日本語を含む14言語において話者の声質や話し方の特徴、感情表現を維持したままリアルタイムで翻訳を行うことが可能になります。あわせて、WindowsおよびMac向けとなる新しいDeepL Voiceデスクトップアプリも発表されました。

話者の声や感情のニュアンスを維持するリアルタイム音声翻訳

今回のアップデートにより、従来の翻訳字幕に加え、話者の話し方そのものを維持するリアルタイムの音声通訳が実現しました。新しいDeepL Voice AIモデルは、質問の語尾やイントネーション、ためらいや緊急性、高揚感といった感情表現を翻訳に反映し、低遅延で会話のテンポを保ちながら伝えます。

音声から音声への翻訳(音声通訳)は30以上の言語に対応しており、このうち日本語を含む14言語では、同時に複数の参加者が発言する場合でもそれぞれの声の特徴が維持されます。なお、AI翻訳業界専門メディアのSlatorが実施した独立ベンチマーク調査において、DeepL Voiceの翻訳字幕は品質スコア96.4点(100点満点)を記録し、人間による評価で最高評価を獲得しています。

主要なオンライン会議ツールに対応するデスクトップアプリ

新たに発表されたDeepL Voiceデスクトップアプリは、WindowsおよびMacに対応しています。Zoom、Microsoft Teams、Google Meetと連携して会議を自動検出し、翻訳字幕をオーバーレイで常時表示します。

追加のシステム連携を必要とせず、ユーザーは状況に応じて翻訳字幕の確認や音声対音声翻訳への切り替えが可能です。字幕サイズや背景音量、翻訳設定の調整ができるほか、新機能が追加された際も各会議プラットフォーム側のアップデートを待たずに利用できます。音声通訳は、オンライン会議、対面での会話、およびDeepL Voice APIを通じた利用において一般提供が開始されます。

企業利用から大規模イベントまで広がる活用

DeepL Voiceは、製造業、小売業、ライフサイエンス、プロフェッショナルサービスなど多様な業界で活用が進んでいます。さらに、2026年9月15日から17日まで米国サンフランシスコで開催される「Salesforce Dreamforce 2026」では、全50ステージおよび1,000を超えるセッションにおいてリアルタイム翻訳が提供されます。

DeepL 創業者兼CEOのヤレック・クテロフスキーは、今回のアップデートについて、単なる字幕中心の翻訳を超え、話者の個性や感情、間の取り方までもリアルタイムで維持する会話体験を実現するシステムへと進化したと説明しています。また、最高技術責任者(CTO)のセバスチャン・エンダーラインは、話者の声の特徴の維持、高い翻訳品質、低遅延という課題を同時に解決した前進であると述べています。

DeepLの概要

  • 設立:2017年(CEO:ヤレック・クテロフスキー)
  • 従業員数:約900人以上
  • 導入実績:20万社以上の法人顧客と数百万人の個人
  • 主な投資家:Benchmark、IVP、Index Ventures
  • 公式サイト:www.deepl.com
  • 製品ページ:https://www.deepl.com/ja/products/voice

本記事はDeepLの発表をもとに作成。

アクセスランキング

今日

1週間