Googleが次世代AIモデル「Gemini 1.5」を発表しました。
長文理解が進化し、より少ない計算量で高品質な処理が可能になりました。
また、膨大な情報を一度に処理できるため、多くのコンテンツを効率的に分析、推論できます。
さらに、マルチモーダル対応で、複数の形式のデータにも対応。
性能も向上し、大規模言語モデルのベンチマークで1.0 Proを上回るほどのパフォーマンスを発揮しています。
記事の概要
Googleは次世代のAIモデル「Gemini 1.5」を発表しました。
Gemini 1.5では、ロングコンテキスト(長文)の理解において大幅な進化があり、最大100万トークンを処理できるようになりました。
Gemini 1.5は新しいMixture–of-Experts(MoE)アーキテクチャによるトレーニングとサービスの効率化を含んでおり、パフォーマンスも大幅に向上しています。
初期テストでは、中規模のマルチモーダルモデルの「Gemini 1.5 Pro」を提供し、長文の文脈理解に関する試験運用機能も導入されています。
Gemini 1.5 Proは128,000トークンのコンテキストウィンドウを持ち、AI StudioとVertex AIからは最大10万トークンのコンテキストウィンドウの試用が可能です。
Gemini 1.5はさまざまな形式のデータに対応し、テキスト、コード、画像、音声、動画評価などのタスクを実行できます。
AI StudioとVertex AIでの早期プレビュー版の提供が始まり、モデルのリリースに合わせて様々なコンテキストウィンドウの選択肢も導入される予定です。
記事のポイント
- Gemini 1.5の発表: Googleが次世代のAIモデル「Gemini 1.5」を発表しました。
- 長文理解の進化: Gemini 1.5では、ロングコンテキスト(長文)の理解において大きく進歩し、最大100万トークンを一貫して実行できるようになりました。
- マルチモーダル対応: Gemini 1.5 Proでは、動画など複数の形式のデータにおいて、理解や推論のタスクを実行可能であり、さまざまなデータをシームレスに分析、分類、要約することができます。
詳しい記事の内容はこちらから(引用元)
Googleは15日(米国時間)、次世代のAIモデルとなる「Gemini 1.5」を発表した。同社では'23年12月に最…
https://www.watch.impress.co.jp/docs/news/1569217.html