Anthropicが9月1日、新たなAIモデル「Claude Fable 5.1」と「Claude Mythos 5.1」を発表しました。
Fable 5.1は一般提供を開始し、コーディングや知識労働、長時間のエージェント処理に対応します。
Mythos 5.1は、サイバーセキュリティや生命科学の認証済み組織に限定して提供します。
記事の概要
Fable 5.1は、科学研究を自律的に進める評価で性能を高めました。
「Terminal-Bench-Science 0.1」では52.6%を記録しました。
Fable 5の同じ評価におけるスコアは24.7%でした。
コーディング評価「Terminal-Bench 4.0」では55.8%となりました。
同評価で、AnthropicのOpus 5やOpenAIのGPT-5.6 Solを上回りました。
Artificial Analysisの「Intelligence Index」では、高負荷設定で66を記録しました。
GPT-5.6 Solは61でしたが、中程度の条件では料金と出力速度で優位でした。
キャッシュ読み取り料金を75%値下げし、エージェント用途では最大約45%安くなるとしています。
記事のポイント
- 評価スコアが向上: Terminal-Bench-Science 0.1で52.6%、Terminal-Bench 4.0で55.8%を記録しました。
- キャッシュ料金を値下げ: キャッシュ読み取りを100万トークン当たり1ドルから0.25ドルへ値下げしました。
- Mythosは限定提供: 安全制限を一部緩和したMythos 5.1は、審査を通過した組織に限って提供します。
このニュースがもたらす影響
- 導入検討企業: 高負荷の開発や長時間エージェント処理では、キャッシュ料金の引き下げが運用費に効く可能性があります。自社の処理量で速度・料金を比較する検証が必要です。
- 同業のサービス提供者: コーディング性能とエージェント向け料金の両面で比較対象が変わるため、処理速度や価格以外の専門性を含めた差別化を急ぐ必要がありそうです。
- 研究・開発組織: サイバーセキュリティや生命科学で高度な処理を求める組織は、Mythosの審査要件を見据え、利用目的と安全管理の体制を先に整理することになりそうです。
このニュースの背景
Fable 5.1は、科学研究を自律的に進める評価とコーディング評価の双方で、従来モデルや他社モデルとの差を示しました。
第三者評価では高負荷設定でGPT-5.6 Solを上回る一方、中程度の条件ではGPT-5.6 Solが料金と出力速度で優位でした。
通常の入力・出力料金を据え置きながら、処理済みデータを再利用するキャッシュ読み取り料金を75%引き下げています。
安全制限を一部緩和したMythos 5.1は、サイバーセキュリティや生命科学の認証済み組織に限定されます。
関連するニュース
- Anthropicは、性能と安全対策を高めた最上位AIモデルFable 5.1を一般提供しました。
- AnthropicがClaude Fable 5の生物学分野の安全対策を更新し、日常的な健康・教育用途を広げます。
- AnthropicがClaude Mythos 5を脆弱性検査向けに提供し、OSS防衛へ3500万ドルを助成します。
詳しい記事の内容はこちらから(引用元)
Anthropicが9月1日、新たなAIモデル「Claude Fable 5.1」「Claude Mythos 5.1」…
https://ascii.jp/elem/000/004/431/4431620/