Googleは8月27日、動画生成モデル「Gemini Omni 1.1 Flash」を発表しました。
Google AI StudioのGemini APIで利用でき、Gemini Enterprise Agent PlatformのAgent Platform APIにも展開します。
既存動画の延長生成やプレビュー生成に対応し、API料金は生成動画1秒あたり0.03ドルからです。
記事の概要
「Gemini Omni 1.1 Flash」では、既存動画の続きを生成するシーン延長機能を追加しました。
最大10秒分の直前映像を参照しながら、10秒単位で映像を延長できます。
生成できる映像は累計で最大40秒までで、従来モデルの参照範囲は直前の1秒でした。
最初と最後のフレームを指定し、その間を連続した映像として生成する機能にも対応しました。
360pのプレビュー生成は、720pと比べて最大60%高速で、コストは3分の1です。
完成映像は1080pまたは4Kへのアップスケールに対応し、参照素材として最大3秒の動画を入力できます。
同モデルはGoogle Flowでも、Google AI Plus、Pro、Ultraの利用者向けに提供します。
Geminiアプリでは、同プランの利用者向けにシーン延長機能を提供します。
記事のポイント
- 動画の続きを生成: 直前の映像を最大10秒参照し、10秒単位で延長できます。累計では最大40秒まで生成できます。
- 360pで高速プレビュー: 360pのプレビューは720pより最大60%高速で、生成コストを3分の1に抑えられます。
- API料金を解像度別に設定: 生成料金は1秒あたり360pが0.03ドル、720pが0.10ドル、1080pが0.15ドル、4Kが0.30ドルです。
このニュースがもたらす影響
- 導入を検討する企業: 短時間の動画制作では、まず360pで複数案を安価に試し、採用案だけを高解像度化する工程を組みやすくなると考えられます。
- 動画制作事業者: 最大10秒の映像を参照して続きを生成できるため、短い素材から展開案や長尺化の試作を増やせる可能性があります。
- AI基盤担当者: 解像度ごとに料金と速度が異なるため、プレビューと最終出力を分けたAPI利用設計や、用途別の費用管理が求められそうです。
このニュースの背景
既存動画の参照範囲が直前の1秒から最大10秒に広がり、映像の連続性を保ちながら延長しやすくなっています。
最初と最後のフレームを指定して中間を生成する機能や、最大3秒の参照動画を使う入力にも対応しました。
360pのプレビューは720pより最大60%高速で、コストを3分の1に抑えられるため、生成前の試行を増やしやすい条件です。
関連するニュース
- SUPERNOVAがStella AIとStella AI for BizでGemini 3.7 Flashの提供を始めます
- GoogleがGemini 3.7 Flashを公開し、開発性能とエージェント機能を高めました。
- GoogleがChromeにGemini Sparkを統合し、許可を得たWeb操作や予約手続きをAIが代行します。
詳しい記事の内容はこちらから(引用元)
Googleは27日、動画生成モデル「Gemini Omni 1.1 Flash」を発表した。Google AI Stu…
https://www.watch.impress.co.jp/docs/news/2136430.html