Anthropicは9月28日、新しいAIモデル「Claude Sonnet 5.5」を発表しました。
従来モデルから速度とコスト効率を改善し、一部のベンチマークでOpenAIの「GPT-6 Astra」を上回りました。
一方、最高設定では出力トークン数が多く、1タスクあたりのコストが課題になります。
記事の概要
Claude Sonnet 5.5は、従来のSonnet 5より出力速度を30%以上高速化したモデルです。
同じ作業にかかるコストは、最大30%削減したとAnthropicは説明しています。
API価格は据え置きで、入力100万トークンあたり2ドル、出力は10ドルです。
Artificial AnalysisのIntelligence Indexでは、最高設定のMax effortで56ポイントを記録しました。
この数値はSonnet 5から18ポイント上昇し、Opus 5.5との差は2ポイントです。
Terminal-Bench 4.0では64%となり、GPT-6 Astraの60%を上回りました。
一方、Sonnet 5.5はMax effortで1タスクあたり平均約19万3000出力トークンを使います。
1タスクあたりのコストは7.60ドルで、GPT-6 AstraのMax設定と比べて出力トークン数は約7倍です。
記事のポイント
- 速度とコストを改善: Sonnet 5.5はSonnet 5と比べ、出力速度を30%以上高め、同じ作業のコストを最大30%削減しました。
- 一部ベンチマークで優位: Terminal-Bench 4.0では64%を記録し、GPT-6 Astraの60%を上回りました。
- 高い推論コスト: Max effortでは平均約19万3000出力トークンを使用し、1タスクあたり7.60ドルとなっています。
このニュースがもたらす影響
- 導入検討企業: 開発支援で速度や同一作業のコストを重視する企業には候補になり得ますが、最高設定では1タスク7.60ドルのため、性能優先の業務と費用上限を分けた運用設計が求められそうです。
- 競合モデル提供者: 一部ベンチマークでGPT-6 Astraを上回ったことで、モデルの優劣は総合スコアだけでなく、エージェント性能と実行コストを組み合わせて比較される流れが強まりそうです。
- API運用担当: 速度と単価の改善だけでは利用費を見積もりにくく、Max effortの利用範囲やタスクごとの出力トークン数を監視し、用途別に設定を使い分ける必要が生じそうです。
このニュースの背景
Claude Sonnet 5.5は、従来のSonnet 5から出力速度を30%以上高め、同じ作業のコストを最大30%削減したとされています。
Artificial Analysisの評価では、最高設定のIntelligence Indexで56ポイントを記録し、Terminal-Bench 4.0ではGPT-6 Astraを上回りました。
一方、最高設定では1タスクあたり平均約19万3000出力トークンを使い、コストは7.60ドルに達しています。
関連するニュース
- OpenAIがGPT-6 SolとLunaを発表し、API料金をGPT-5.6シリーズから50%引き下げました。
- OpenAIがGPT-6 Astraを発表し、未知環境を攻略するARC-AGI-3で99.9%を記録しました。
- OpenAIのGPT-6 Astraを創作課題で検証し、具体的なフィードバックが成果を左右したと報告しています。
詳しい記事の内容はこちらから(引用元)
Anthropicは9月28日、新しいAIモデル「Claude Sonnet 5.5」を発表した。…
https://ascii.jp/elem/000/004/438/4438155/