グーグルが新たに発表した画像生成AI「Whisk」は、画像をドラッグ&ドロップするだけでオリジナルアートを生成できる点が注目されます。
これにより、専門的な知識がなくてもクリエイティブな表現が可能となり、アート制作のハードルが大幅に下がるでしょう。
今後のクリエイティブ業界への影響が期待されます。
記事の概要
グーグルは、複数の画像を組み合わせて作品を生成できるAIツール「Whisk」を公開しました。
このツールは、テキストプロンプトではなく、画像をドラッグ&ドロップするだけで利用できるのが特徴です。
ユーザーは、被写体、シーン、スタイルの3種類の画像を入力することで、オリジナルのデジタルアートを作成できます。
Whiskは、グーグルのマルチモーダルAIモデル「Gemini」を活用して、入力された画像の詳細な説明文を生成し、その情報を元に画像生成AIモデル「Imagen 3」が新しい表現を作り出します。
このサービスはアイデアを迅速に検討することを目的としており、現時点では米国内でのみ利用可能です。
日本からはアクセスできません。
記事のポイント
- 画像生成の新しいアプローチ: ユーザーはテキストではなく画像を使って作品を生成できるため、直感的なクリエイティブ体験が可能です。
- マルチモーダルAIの活用: Googleの「Gemini」によって、入力された画像から詳細な説明文が自動生成され、より豊かな作品が生み出されます。
- 現在の利用制限: Whiskは米国内でのみ利用可能で、日本を含む他国ではまだアクセスできないため、今後の展開が期待されます。
詳しい記事の内容はこちらから(引用元)
グーグルは現地時間12月16日、複数の画像を組み合わせることで作品を生成できるAIツール「Whisk(ウィスク)」を公開…
https://ascii.jp/elem/000/004/241/4241529/