OpenAIの「Voice Engine」は、15秒分の声データから本人そっくりに喋ることができるという驚きの技術です。
感情的なリアルな音声で、母国語以外の言語も話せるということで、さまざまな可能性を秘めています。
しかし、悪用されるリスクもあるため、慎重なテストが行われています。
音声認証システムの廃止や個人の声を保護するポリシーの確立が必要です。
記事の概要
OpenAIは、15秒分の音声データを元に「Voice Engine」という生成AIモデルを開発しました。
このモデルはテキスト入力と音声サンプルを使用して、本人にそっくりな自然な音声を生成することができます。
また、感情豊かなリアルな音声を再現し、母国語以外の言語も話すことができます。
OpenAIは、この合成音声の悪用を防ぐためにテストを行っており、広範囲にリリースするかどうかを検討しています。
また、既にいくつかのアプリで採用されており、音声認証システムの廃止や個人の声を保護するポリシーの確立、AIの機能と限界についての一般の理解促進が必要だと述べています。
記事のポイント
- Voice Engineの発表: 米OpenAIは3月29日、生成AIモデル「Voice Engine」を発表しました。テキスト入力と15秒分の音声サンプルで、元の話者によく似た自然な音声を生成できるという特徴があります。
- 合成音声の悪用対策: OpenAIは合成音声の悪用について懸念しており、広範囲にリリースするかどうかを検討するために慎重にテストを行っています。パートナーにはなりすましや悪用を禁止するポリシーに同意してもらっています。
- 音声認証システムの廃止や個人の声保護の必要性: Voice Engineを広くリリースするためには、音声認証システムの廃止や個人の声を保護するポリシーの確立、AIの機能と限界についての一般の理解促進などが必要だとOpenAIは述べています。
詳しい記事の内容はこちらから(引用元)
OpenAIは、人の声を再現する生成AIモデル「Voice Engine」を発表した。動画生成の「Sora」同様「重大な…
https://www.itmedia.co.jp/news/articles/2403/30/news079.html