OpenAIが開発した「Voice Engine」は、人の声に近い自然な音声を生成できるAIモデルです。
音声合成APIや教育テクノロジー企業での利用も進められていますが、合成音声の悪用を防ぐために慎重な姿勢を示しています。
また、多言語展開や発声障害者への活用も視野に入れており、そのサンプルも公開されています。
一方で、音声の利用にはセキュリティ対策や個人の声の保護、出所の確認技術などが求められます。
記事の概要
AIモデル「Voice Engine」は、人の声を模した自然な音声を生成することができる。
OpenAIは2022年後半に開発し、音声合成APIやさまざまなプラットフォームに導入する予定であるが、合成音声の悪用の可能性もあるため慎重な姿勢を示している。
教育テクノロジー企業のAge of Learningや翻訳サービスのHeyGenなど、さまざまな分野でVoice Engineを利用した音声コンテンツの作成が進められている。
また、Voice Engineは発話が不自由な人や発声障害のある人向けにも活用され、音声のサンプルはOpenAIの発表リリースから確認できる。
ただし、検証やリリースには厳しい制約があり、元の話し手からの明示的な同意が必要であり、一般市民の理解やセキュリティ対策が求められている。
記事のポイント
- Voice Engineの開発: OpenAIがVoice EngineというAIモデルを開発し、元の話し手に近い自然な音声を生成できることを発表しました。
- 音声合成の利用範囲: Voice Engineは音声合成APIやさまざまなコンテンツで活用されることができ、教育テクノロジー企業や翻訳サービスなどでの応用が進んでいます。
- 悪用防止のための対策: 合成音声の悪用を防ぐため、OpenAIでは慎重な姿勢を示し、電子透かしの付与や利用制限のリスト作成などの対策を行っています。また、一般市民の理解や音声の使用を保護する政策の検討も重要とされています。
詳しい記事の内容はこちらから(引用元)
OpenAIは29日(米国時間)、人の声を模した自然な音声を生成できるAIモデル「Voice Engine」による成果を…
https://www.watch.impress.co.jp/docs/news/1580522.html