DeepLジャパンは、リアルタイム音声翻訳サービス「DeepL Voice」で音声間翻訳の一般提供を始めました。
話すテンポや抑揚、声質を反映した翻訳音声を、30以上の言語で生成できます。
Windows/Mac向けアプリやグループ会話機能に加え、ChatGPTやClaudeからDeepLを使えるMCP対応も進めています。
記事の概要
DeepLジャパンは9月29日、報道関係者向け説明会で「DeepL Voice」の新機能を紹介しました。
音声間翻訳は、2025年10月に発表され、2026年4月からベータ版の早期アクセスを実施していました。
一般提供では、Voice AIモデルが話すテンポや抑揚、ピッチ、トーンを反映し、別の言語の音声へ翻訳します。
30以上の言語に対応し、日本語、英語、中国語、ドイツ語など14言語では「スピーカーマッチ」を利用できます。
スピーカーマッチは事前の音声登録なしで、話者に似た声質の翻訳音声を生成する機能です。
DeepL Voice for Meetingsでは、Zoom、Microsoft Teams、Google Meetを自動検出するWindows/Mac向けアプリを提供します。
DeepL Voice for Conversationsには最大20人が参加できるグループ会話機能を追加し、QRコードからブラウザで参加できます。
Microsoft Copilot、ChatGPT、Claudeなどから翻訳や用語集、カスタムルールを直接使えるMCP対応も発表しています。
記事のポイント
- 声質を保つ翻訳音声: 14言語では、発話者の声質や話し方の特徴を反映した翻訳音声を、事前登録なしで生成できます。
- 会議と対面会話に対応: 会議アプリの自動連携や最大20人のグループ会話により、参加者が各自の端末で翻訳を確認できます。
- AIから直接DeepL利用: MCP対応により、ChatGPTやClaudeなどを離れずに、用語集やカスタムルール付きの翻訳を使えます。
このニュースがもたらす影響
- 導入検討企業: 海外との会議や接客で、通訳担当者の配置だけでなく、声質を保つ音声翻訳を含む運用設計が選択肢になります。まず遅延や情報管理を自社業務で検証する必要がありそうです。
- 同業サービス提供者: 翻訳精度だけでなく、会議アプリとの接続、複数人参加、話者の識別しやすさまで含めた体験が比較対象になりそうです。音声データの扱いも選定要件として重みを増す可能性があります。
- AI活用部門: ChatGPTやClaudeで作業する際、翻訳や社内用語の適用を別画面へ移さず進められるため、文書作成や海外対応の手順を見直す契機になります。MCPを前提に権限管理を考えることが求められそうです。
このニュースの背景
従来のDeepL Voiceは、Web会議や対面会話で音声をテキストに翻訳する機能を中心に提供していました。
音声間翻訳は2025年10月に発表され、2026年4月からベータ版の早期アクセスが行われていました。
Web会議では従来、参加リンクを別画面に貼り付けて翻訳用ボットを手動で参加させる必要があり、対面会話でも端末を共有する場面がありました。
一方で、ChatGPTやClaudeなどのAI上で翻訳が必要になった場合、従来はDeepLとの間で内容をコピーして移す手間がありました。
関連するニュース
- DeepLはMCPを活用し、Copilot、ChatGPT、Claudeなどから翻訳機能を直接使えるようにしました。
- DeepLは、話者の声や感情表現を保つリアルタイム音声通訳を提供開始しました。
- OpenAIがChatGPTの音声モードを拡張し、接続アプリを使う作業指示に対応しました。
詳しい記事の内容はこちらから(引用元)
DeepLジャパンは29日、リアルタイム音声翻訳サービス「DeepL Voice」の新機能やMCP対応に関する報道関係者…
https://www.watch.impress.co.jp/docs/news/2144182.html