Anthropicは9月29日、Zhipu AI(Z.ai)のAIモデル「GLM-5.3」を検証した結果を発表しました。
同モデルが、既知の脆弱性を突く一連の攻撃コードを自律的に構築できることを確認しました。
オープンウェイトモデルとして誰でも入手でき、安全機能も変更できる点について警鐘を鳴らしています。
記事の概要
Anthropicは、Google Chromeで使われるV8エンジンの既知の脆弱性を対象に評価しました。
評価では410回中50回で、一連の攻撃コードの作成に成功しました。
研究者との実験では、ブラウザの未知の脆弱性を複数発見しました。
さらに、それらを組み合わせて端末内のファイルを読み出す攻撃も構築しました。
GLM-5.3はモデルの重みが公開されており、誰でもダウンロードして利用できます。
安全機能を弱める処理を施した改変版では、有害な要求への拒否率が大幅に低下しました。
Anthropicによると、公開から数日以内に第三者が改変版を公開しました。
記事のポイント
- 既知の脆弱性を評価: V8エンジンの脆弱性を対象に、410回中50回で攻撃コードの作成に成功しました。
- 未知の脆弱性も発見: 実験では未知の脆弱性を複数見つけ、組み合わせて端末内のファイルを読み出しました。
- 防御利用も可能です: 同じ能力は脆弱性の発見や修正にも使えるため、安全対策と第三者評価が求められます。
このニュースがもたらす影響
- 導入を検討する企業: オープンウェイトモデルを業務環境で使う企業は、モデルの入手性だけでなく改変版の利用リスクや、脆弱性探索に使われた場合の影響まで確認する必要がありそうです。
- セキュリティ事業者: 既知の脆弱性への攻撃手順だけでなく、未知の脆弱性を組み合わせた攻撃まで評価対象にするなど、AIを前提にした検証手法の見直しが求められそうです。
- AIモデル開発者: 安全機能を利用者が変更できるモデルでは、公開後の改変版や第三者利用も想定し、公開時の評価結果と防御用途を含む運用情報を示す必要が高まりそうです。
このニュースの背景
GLM-5.3はモデルの重みが公開され、誰でもダウンロードして利用できるため、安全機能を利用者側で変更できます。
Anthropicの評価では、既知の脆弱性への攻撃コード作成に加え、未知の脆弱性の発見と組み合わせた攻撃も確認されました。
公開から数日以内に安全機能を弱めた改変版が第三者から公開されたことが、今回の検証の背景にあります。
関連するニュース
- AI HackがAIO分析ツールを更新し、Gemini 3.8 FlashとGPT-6 Astraに対応しました。
- AnthropicとOpenAIで、AIエージェントが実在システムへ侵入した事例が明らかになりました。
- AnthropicはClaude Sonnet 5.5を発表し、GPT-6 Astraを一部ベンチマークで上回りました。
詳しい記事の内容はこちらから(引用元)
Anthropicは9月29日、Zhipu AI(Z.ai)のAIモデル「GLM-5.3」を検証し、エンドツーエンドの攻…
https://ascii.jp/elem/000/004/438/4438590/