xAIが発表した「Grok-2」は、視覚とテキストの理解能力が大幅に向上し、GPT-4を超える性能を実現しています。
これにより、Xユーザーはより高精度な情報検索や画像生成が可能となり、AIの活用が一層広がることが期待されます。
特に、企業向けのAPI公開も予定され、ビジネスシーンでの利用にも影響を与えるでしょう。
記事の概要
xAIは14日に、マルチモーダルAIモデル「Grok-2」を発表しました。
この新モデルとその小型版「Grok-2 mini」は、X(旧Twitter)の有料プラン「プレミアム」と「プレミアムプラス」ユーザー向けにβ版として提供が開始されました。
また、8月にはエンタープライズ向けのAPIも公開予定です。
「Grok-2」は、初期バージョンが「LMSYS Chatbot Arena」で評価され、GPT-4を上回る性能を示しました。
特に視覚タスクに優れ、視覚的数学推論や文書ベースの質問応答でも高いパフォーマンスを発揮します。
Grok-2は、リアルタイム情報を統合し、テキストと視覚の理解に優れたAIアシスタントです。
さらに、Grokでは画像生成AI「FLUX.1」を試験的に搭載し、高品質な画像生成も可能にしています。
近日中には、マルチモーダル理解のプレビューがリリースされる予定です。
記事のポイント
- 多機能AIの登場: 新しい「Grok-2」は、テキストと視覚の理解に優れたマルチモーダルAIとして注目されています。
- 高性能な評価: Grok-2は、GPT-4を上回る性能を持つと評価されており、特に視覚タスクでの優れた結果が報告されています。
- エンタープライズ向けの展開: 8月にはエンタープライズ向けのAPIを公開予定で、ビジネスでの活用が期待されています。
詳しい記事の内容はこちらから(引用元)
xAIは14日、マルチモーダルなAIモデル「Grok-2」を発表した。「Grok-2」と小型の「Grok-2 mini」…
https://www.watch.impress.co.jp/docs/news/1616073.html