Acompanyと東北大学言語AI研究センターは、AIエージェントの安全性と信頼性に関する共同研究を開始します。
AIエージェントが悪意のある指示に誘導され、権限や制約を逸脱する脅威の理解を目指します。
自然言語処理や機械学習、AIセキュリティ、プライバシーの知見を組み合わせ、対策技術を検討します。
記事の概要
共同研究には、東北大学言語AI研究センターと株式会社Acompanyが参加します。
AIエージェントは、Webページや文書、メール、外部ツールなどから悪意のある指示を受ける可能性があります。
その結果、意図しない挙動や、与えられた権限・制約からの逸脱につながるリスクがあります。
研究では、こうした脅威の発生条件と影響を明らかにします。
安全性と信頼性を高めるモデルやハーネスの構成方法も検討します。
脅威の検知や、影響を抑制する技術についても幅広く研究します。
ハーネスは、AIエージェントが利用できるツールや権限、操作対象を制限する仕組みです。
Acompanyは研究を通じて、「秘密を守れるAI」の具現化と社会実装への貢献を目指します。
記事のポイント
- 対象となる脅威: 外部のWebページや文書などに含まれる悪意ある指示で、AIエージェントが意図しない行動を取るリスクです。
- 研究する対策技術: 脅威の発生条件と影響を分析し、モデルやハーネスの設計、検知、影響抑制の技術を検討します。
- 両者の知見を融合: 東北大学の言語AI研究と、AcompanyのAIセキュリティ・プライバシーの知見を組み合わせます。
このニュースがもたらす影響
- 導入を検討する企業: AIエージェントに与える権限や接続先を決める際、静的な制限だけでなく、外部情報による誘導を想定した検知・影響抑制まで事前に評価する必要が高まりそうです。
- AIサービス提供者: 安全性を訴求するには、実行環境の保護に加え、モデルの振る舞いとハーネスの設計、脅威への対応力を示すことが差別化の条件になる可能性があります。
- AI業界全体: AIエージェントの評価軸が、タスクを完了できるかだけでなく、悪意ある情報に接触した場合も権限や制約を守れるかへ広がるきっかけになると考えられます。
このニュースの背景
AIエージェントにツールやシステムへのアクセス権限を与え、複雑な業務を自動化する取り組みが広がっています。
一方で、Webページや文書、メール、外部ツールに含まれる悪意のある指示が、エージェントを意図しない行動へ誘導するリスクがあります。
利用環境や使えるツールが変化するため、個別かつ静的な対策だけでは安全性を保ちにくい点も課題です。
関連するニュース
- Acompanyは、AIエージェントの作成・共有から接続制御、監査、予算管理までを統合する企業向け基盤のβ版を提供開始しました。
- 順天堂大学とケアネットが、院内データを活用する臨床支援AIエージェントの共同研究を5年間実施します。
- 大塚商会は、基幹業務データを自然言語で分析できるAIエージェントを提供します。
詳しい記事の内容はこちらから(引用元)
株式会社Acompanyのプレスリリース(2026年10月2日 11時00分)東北大学言語AI研究センターと共同でAIエ…
https://prtimes.jp/main/html/rd/p/000000148.000046917.html
