OpenAIがリリースした音声生成AIモデル「Voice Engine」は、テキスト入力と音声サンプルから元の話者に似た自然な音声を生成できます。
本を読まない人や子供たちの読書支援や、発話が困難な人の音声復元にも役立ちます。
ただし、悪用されるリスクもあるため、安全対策が重要です。
OpenAIは社会の理解や施策が必要とし、具体的な対策を検討中です。
記事の概要
OpenAIは、音声生成AIモデル「Voice Engine」を発表しました。
テキスト入力と音声サンプルを使用して、元の話者によく似た自然な音声を生成することができます。
この技術は、読書支援や発話困難な人の声を復元するなどの応用が期待されます。
ただし、合成音声の悪用リスクがあるため、OpenAIは慎重に取り組んでいます。
具体的なリリース計画はまだありませんが、社会の理解と施策が必要とされています。
記事のポイント
- 音声生成AIモデル「Voice Engine」の発表: OpenAIが音声生成AIモデル「Voice Engine」を発表しました。
- 元の話者によく似た自然な音声の生成: テキスト入力と音声サンプルを使用して、元の話者によく似た自然な音声を生成することができます。
- 安全対策の強化: 悪用されるリスクがあるため、一般利用には課題もありますが、OpenAIは安全対策をより一層強化していくとコメントしています。
詳しい記事の内容はこちらから(引用元)
OpenAIは、音声生成AIモデル「Voice Engine」を発表しました。テキスト入力と15 秒の音声サンプルを使用…
https://aismiley.co.jp/ai_news/openai-voice-engine-generative-ai/