FlashLabsは9月18日、AIエージェントのセキュリティ事案を収録したデータベースを公開しました。
「Orca AI Incident Archive」は、2026年9月23日時点で354件を収録しています。
各記録に情報源と実害の有無を付け、JSON・CSV形式でも無償公開しています。
記事の概要
データベースは、米国の研究機関Continuum AIが開発し、FlashLabsが日本市場向けに提供するOrcaRouterに関連して公開されました。
収録対象は2024年12月から2026年9月22日までの22カ月分です。
354件の内訳は、事故138件、研究85件、政策70件、脆弱性46件、脅威レポート15件です。
実際に被害が確認された記録は127件で、深刻度が「重大(Critical)」の記録は45件です。
記録には593件の情報源が用いられ、リンク総数は662件です。情報源のない記録は収録していません。
ジェイルブレイク、攻撃の成功、実害を別々に扱い、「起きうること」と「起きたこと」を区別しています。
データはWebページとGitHubで公開され、JSON・CSV形式や情報源URL一覧を利用できます。
2025年は121件、2026年は9カ月で232件を収録し、2026年9月は51件で月別最多となっています。
記事のポイント
- 実害の有無を明示: 各記録に実害の有無、AIの関与、記録種別を付け、事故と研究デモなどを区別しています。
- 出典付きで再利用: 593件の情報源と662リンクを参照し、CC BY 4.0で商用利用を含めて再利用できます。
- 12種類の攻撃分類: 認証情報の悪用や間接プロンプトインジェクションなど、攻撃タイプを12分類で整理しています。
このニュースがもたらす影響
- 導入を検討する企業: 自社のAIエージェント導入では、モデル性能だけでなく、実害の有無や攻撃経路を基準にリスクを洗い出す運用が求められそうです。
- AIセキュリティ担当: 事故・研究・政策を分けた記録と出典を使えば、脅威情報の収集や社内報告で、発生可能性と実際の被害を切り分けやすくなると考えられます。
- AIサービス提供者: 攻撃分類や訂正履歴を参照できるため、外部ツールや認証情報を扱う機能では、想定脅威と対策の対応関係を説明することが求められそうです。
このニュースの背景
AIエージェントは、ブラウザやコマンド実行環境、認証情報、本番システムへのアクセス権を持つようになり、モデルの能力評価だけでは安全性を判断しにくくなっています。
一方で、ジェイルブレイクや研究デモ、攻撃の成功、実害の発生は同じ意味ではなく、事案数を単純に合算するとリスクの実態を捉えにくくなります。
2026年は9カ月で232件が収録され、2025年通年の121件を上回っており、AIエージェントに関する事案を継続的に追跡する必要性が高まっています。
関連するニュース
- FlashLabsはOrcaRouterで、正当なセキュリティ研究向けアクセス枠の申請を再開しました。
- FlashLabsは、AIエージェントの実行記録を2コマンドでローカルとクラウド間転送できる機能を提供開始しました。
- Continuum AIが320BのMoEモデルで安全性アラインメントの脆弱性を示しました。
詳しい記事の内容はこちらから(引用元)
FlashLabs株式会社のプレスリリース(2026年9月24日 20時30分)OrcaRouter、AIエージェント事…
https://prtimes.jp/main/html/rd/p/000000096.000138449.html