OpenAIは8日(米国時間)、画像生成モデル「ChatGPT Images 2.5」の提供を開始しました。
自然な照明や質感の再現、被写体の保持、複数回の編集指示への対応を強化しています。
画像生成の遅延は、Images 2.0と比べて最大50%削減しました。
ChatGPT、ChatGPT Work、Codexのユーザーに加え、開発者向けAPIも提供します。
記事の概要
ChatGPT Images 2.5は、写真内の被写体をより忠実に保持できる画像生成モデルです。
複数のやり取りにわたり、編集指示をより確実に反映できるようにしました。
Images 2.0と比較して、画像生成の遅延を最大50%削減しています。
開発者向けには、「GPT-Image-2.5 Flare」と「GPT-Image-2.5 Sunburst」を用意しました。
FlareはImage 2.0より50%高速で、Sunburstは生成時間と引き換えに精度を高めています。
ChatGPTでは、画面上に直接描ける「Sketch」や、画像へのコメント機能を追加しました。
ポスターやグッズなどのテンプレート、C2PAメタデータ、透かしにも対応しています。
記事のポイント
- 生成品質を強化: 照明や質感を自然に再現し、参照写真の被写体や構図を保った生成に対応します。
- 編集の一貫性を向上: 指定した部分だけを変更し、被写体や背景など他の細部を維持しやすくしました。
- 開発者向けAPIを提供: 高速なFlareと高精度なSunburstを用意し、用途に応じた画像生成を可能にします。
このニュースがもたらす影響
- 導入を検討する企業: APIを組み込む企業は、反復編集や参照画像を使う工程で、手作業による修正をどこまで減らせるか検証しやすくなります。高速さを優先する工程と精度を優先する工程を分ける設計が求められそうです。
- 同領域のサービス提供者: 画像生成サービスの提供者は、被写体やブランド表現を保った編集が利用企業の選択基準になる可能性があります。単なる生成機能では差別化しにくくなり、業務別の編集体験や運用管理が問われそうです。
- 画像制作チーム: 制作チームは、Sketchや画像上のコメントを使って、修正箇所を視覚的に共有できるため、依頼と確認の往復を短縮できる可能性があります。一方、透かしやC2PAの扱いを制作フローに組み込む必要があります。
このニュースの背景
Images 2.5は、Images 2.0に比べて生成遅延を最大50%削減し、FlareとSunburstで速度と精度の選択肢を分けています。
ChatGPT側ではSketch、画像へのコメント、ポスターやグッズのテンプレートを追加し、制作時の指示方法を広げています。
APIや生成画像には安全性対策としてプロンプト・画像チェック、C2PAメタデータ、透かしも用意されています。
関連するニュース
- xAIがGrokの画像生成・編集モデル「Imagine Image 2.0」を一般提供しました。
- Googleは、Nano Bananaを基盤に資料内画像を編集できるGoogle Picsを発表しました。
- OpenAIがChatGPTにMac操作を記録・検索するComputer Historyを追加しました。
詳しい記事の内容はこちらから(引用元)
OpenAIは8日(米国時間)、最新の画像生成モデル「ChatGPT Images 2.5」を提供開始した。より自然な照…
https://www.watch.impress.co.jp/docs/news/2139304.html