Googleの新画像生成AI「Gemini 2.5 Flash Image」は、クリエイターや企業にとって革新的なツールです。
多様なスタイルで高品質な画像を迅速に生成でき、コスト効率も向上します。
一方、AI生成物の透明性確保が求められる中、「Synth ID」による識別機能も注目されます。
社会的影響は大きく、広告やコンテンツ制作の方法が変わる可能性があります。
記事の概要
Googleが新しい画像生成AIモデル「Gemini 2.5 Flash Image」、通称「nano banana」を一般に提供開始しました。
このモデルは、風景、正方形、ポートレートなど4つのスタイルに対応し、10種類のアスペクト比で画像を生成できます。
また、自然言語による指示での細かな画像編集や複数画像の融合も可能です。
利用料金は1枚当たり0.039ドルで、開発者向けのドキュメントも公開されています。
さらに、生成された画像には目に見えない「Synth ID」ウォーターマークが埋め込まれ、AI生成画像の識別が可能です。
技術の進化が進む中、透明性の確保が求められています。
記事のポイント
- 画像生成AIの進化: Googleの「Gemini 2.5 Flash Image」は、複数のスタイルとアスペクト比に対応し、様々なコンテンツ制作を簡単にします。
- 開発者向けリソースの提供: Googleは、開発者が利用を開始できるためのドキュメントと「クックブック」を公開し、APIを通じたアクセスを提供しています。
- 透明性の確保: 生成された画像には「Synth ID」ウォーターマークが埋め込まれ、AI生成や編集されたことを識別可能にすることで、ユーザーへの透明性を確保しています。
詳しい記事の内容はこちらから(引用元)
グーグルの画像生成AI「Gemini 2.5 Flash Image」が、米国時間10月2日にテストを終え、実際の利用に…
https://japan.zdnet.com/article/35238818/