Google Cloudは10月8日(米国時間)、業務向けの汎用エージェント「Gemini agent」を発表しました。
Gemini agentは、質問への回答からナレッジワーク、コンテンツ作成、コーディングまでを担います。
Google WorkspaceやMicrosoft 365、Slackなどを横断し、業務の起点をプロンプトボックスに集約します。
記事の概要
Gemini agentは、プロンプトで指示や目標を与えると、業務処理や成果物の作成を進めるエージェントです。
回答、ナレッジワーク、画像・メディア作成、コードの記述と実行に対応します。
Gmail、Google ドライブ、ドキュメント、スライド、スプレッドシート、Chat、カレンダー内でも直接利用できます。
利用場所が変わっても、同一のメモリ、スキル、ガバナンス制御を維持します。
Webやモバイル、デスクトップに加え、コマンドラインやサードパーティー製アプリからも利用できます。
クラウド上で処理を継続するため、数時間や数日かかる作業もPCを閉じた後に進められます。
Geminiに加えてAnthropicのClaudeにも対応し、将来はオープンモデルなどにも対応する予定です。
記事のポイント
- 業務を横断して実行: 会議設定では、過去のチャットやイベントスレッドを確認し、参加者調整やメール送信まで進められます。
- 企業ツールと接続: Confluence、Git、Jira、Salesforce、BigQuery、Snowflakeなどに加え、MCPサーバーにも接続できます。
- 権限とログを管理: 各エージェントに固有のアイデンティティとロールベース権限を付与し、作業ログも記録できます。
このニュースがもたらす影響
- 導入を検討する企業: ツールごとにAIを選ぶのではなく、既存の業務データと権限をどこまで接続し、どの作業を委任するかを運用単位で先に設計する必要がありそうです。
- 競合するAIベンダー: 単体アプリの支援機能だけでは比較されにくくなり、複数サービスをまたぐ実行力、継続処理、モデル選択の柔軟性が差別化の軸になる可能性があります。
- 情シス・管理部門: エージェント固有の権限やログを前提に、従業員向けツールとは別の管理単位で承認範囲と監査方法を導入前から決めることが求められそうです。
このニュースの背景
業務データや作業場所がGoogle Workspace、Microsoft 365、Slackなどに分散しているため、エージェントが実行するには各種ツールや記録システムへの接続が必要になります。
数時間から数日かかる作業をクラウド上で継続する仕組みにより、利用者の端末や作業中のアプリに依存しない運用が可能になります。
複数のモデルを使い分ける構成に加え、エージェントごとの権限や作業ログを管理する仕組みが示されており、モデル性能だけでなく企業内運用も前提になっています。
関連するニュース
- GoogleがWindows 10/11向けGeminiアプリを提供し、ショートカット起動や各種生成機能に対応しました。
- GoogleはGemini 3.8に音声生成モデルと映像アバターによる対話機能を追加しました。
- Googleが視覚対話や多段階推論に対応するGemini新モデルを提供します。
詳しい記事の内容はこちらから(引用元)
Google Cloudは8日(米国時間)、業務向けのユニバーサルエージェント「Gemini agent(Gemini …
https://www.watch.impress.co.jp/docs/news/2147050.html