アップルが新たに公開した画像生成AI「マトリョーシカ」は、複数解像度の画像を同時生成できる革新的な技術です。
これにより、広告やメディアコンテンツのカスタマイズが効率化され、開発者コミュニティの活性化にも寄与します。
オープンソース化は技術共有を促進し、アップルの市場競争力を高める狙いがあります。
記事の概要
アップルは2023年8月9日に、新しい画像生成AIモデル「Matryoshka Diffusion Models(MDM)」とそのフレームワーク「ml-mdm」をGitHubで公開しました。
このモデルは、複数の解像度の画像を同時に生成する革新的な手法を採用しており、高品質な画像を効率的に作成できます。
MDMは、訓練に1200万枚のデータセット「CC12M」を用いることが可能ですが、ライセンスの制約から代わりに「Flickr2017」データセットで事前学習したモデルが提供されています。
アップルはこの技術をオープンソースで提供することで、開発者コミュニティとの連携を強化し、技術的エコシステムの形成を目指しています。
将来的には動画生成にも応用でき、広告やメディアコンテンツのカスタマイズに大きな可能性が期待されています。
記事のポイント
- 新技術の導入: アップルが新しい画像生成AI「マトリョーシカ」を公開し、効率的に高品質な画像を生成できる技術を導入しました。
- 開発者向けのオープンソース: GitHubでの公開により、開発者が手軽に利用できる環境を提供し、技術の普及を狙っています。
- 将来的な応用可能性: MDMの技術は、動画生成など他の分野にも応用できる可能性があり、広告やメディアコンテンツにおいて革新をもたらすと期待されています。
詳しい記事の内容はこちらから(引用元)
アップルは8月9日、新しい画像生成AIモデル「Matryoshka Diffusion Models(MDM)」およびフ…
https://ascii.jp/elem/000/004/215/4215112/