「GPT-4o」の進化により、画像生成機能が大幅に向上しました。
キャラクターの一貫性の保持やテキストの再現、複数画像の合成など、さまざまなクリエイティブな可能性が広がります。
これからの展開に期待が高まります。
記事の概要
OpenAIが開発した大規模言語モデル「GPT-4o」の新機能について紹介する記事。
「GPT-4o」は音声会話機能だけでなく、画像生成機能も大幅に進化しており、一貫性の保持や複数画像の合成などが可能になっている。
また、テキストの表現や修正も高い精度で行えるようになり、さらにベクターデータと写真の合成や2D画像から3Dアニメーションの生成も可能になっている。
現状では完全に統合されていない部分もあるが、今後の統合により、画像生成AIのクリエイティブ分野に革命的な変化が起こる可能性がある。
記事のポイント
- 一貫性の保持: 新しい大規模言語モデル「GPT-4o」を使用した画像生成AIの一貫性の保持能力が大幅に向上しており、同じキャラクターを生成するのが苦手だったAI漫画の普及が期待される。
- 長いテキストの正確な再現: GPT-4oはテキストの表現においても高い難易度を持つ画像生成AIであり、詳細な指示に基づいてポエムを描画することが可能。さらに、細かい修正を加えても一貫性が保たれる。
- 複数画像の合成: GPT-4oは複数の画像を合成する機能も備えており、詳細なプロンプトに基づいて顔写真の合成や異なるフォーマットの素材の合成が可能。さらに、2D画像から3Dアニメーションを生成するデモも行われている。
詳しい記事の内容はこちらから(引用元)
ASCII.jp
OpenAIは5月13日、大規模言語モデル(LLM)「GPT-4o(オー)」を発表。音声会話機能が話題になっているが、実…
https://ascii.jp/elem/000/004/198/4198450/