Anthropic、Sonnet 5.5発表 GPT-6 Astraを一部上回る

Anthropicは9月28日、新しいAIモデル「Claude Sonnet 5.5」を発表しました。
従来モデルから速度とコスト効率を改善し、一部のベンチマークでOpenAIの「GPT-6 Astra」を上回りました。
一方、最高設定では出力トークン数が多く、1タスクあたりのコストが課題になります。

記事の概要

Claude Sonnet 5.5は、従来のSonnet 5より出力速度を30%以上高速化したモデルです。
同じ作業にかかるコストは、最大30%削減したとAnthropicは説明しています。
API価格は据え置きで、入力100万トークンあたり2ドル、出力は10ドルです。
Artificial AnalysisのIntelligence Indexでは、最高設定のMax effortで56ポイントを記録しました。
この数値はSonnet 5から18ポイント上昇し、Opus 5.5との差は2ポイントです。
Terminal-Bench 4.0では64%となり、GPT-6 Astraの60%を上回りました。
一方、Sonnet 5.5はMax effortで1タスクあたり平均約19万3000出力トークンを使います。
1タスクあたりのコストは7.60ドルで、GPT-6 AstraのMax設定と比べて出力トークン数は約7倍です。

記事のポイント

  1. 速度とコストを改善: Sonnet 5.5はSonnet 5と比べ、出力速度を30%以上高め、同じ作業のコストを最大30%削減しました。
  2. 一部ベンチマークで優位: Terminal-Bench 4.0では64%を記録し、GPT-6 Astraの60%を上回りました。
  3. 高い推論コスト: Max effortでは平均約19万3000出力トークンを使用し、1タスクあたり7.60ドルとなっています。

このニュースがもたらす影響

  • 導入検討企業: 開発支援で速度や同一作業のコストを重視する企業には候補になり得ますが、最高設定では1タスク7.60ドルのため、性能優先の業務と費用上限を分けた運用設計が求められそうです。
  • 競合モデル提供者: 一部ベンチマークでGPT-6 Astraを上回ったことで、モデルの優劣は総合スコアだけでなく、エージェント性能と実行コストを組み合わせて比較される流れが強まりそうです。
  • API運用担当: 速度と単価の改善だけでは利用費を見積もりにくく、Max effortの利用範囲やタスクごとの出力トークン数を監視し、用途別に設定を使い分ける必要が生じそうです。

このニュースの背景

Claude Sonnet 5.5は、従来のSonnet 5から出力速度を30%以上高め、同じ作業のコストを最大30%削減したとされています。
Artificial Analysisの評価では、最高設定のIntelligence Indexで56ポイントを記録し、Terminal-Bench 4.0ではGPT-6 Astraを上回りました。
一方、最高設定では1タスクあたり平均約19万3000出力トークンを使い、コストは7.60ドルに達しています。

関連するニュース

詳しい記事の内容はこちらから(引用元)

ASCII.jp

Anthropicは9月28日、新しいAIモデル「Claude Sonnet 5.5」を発表した。…

ASCII.jp:Anthropic「Claude Sonnet 5.5」発表、一部でOpenAI「GPT-6 Astra」上回る
https://ascii.jp/elem/000/004/438/4438155/

最新情報をチェックしよう!
>ビジネスを飛躍させるAIキュレーションメディア「BizAIdea」

ビジネスを飛躍させるAIキュレーションメディア「BizAIdea」

国内外の最新AIに関する記事やサービスリリース情報を、どこよりも早くまとめてお届けします。
日々BizAIdeaに目を通すだけでAIの最新情報を手軽にキャッチアップでき、
AIの進化スピードをあなたのビジネスの強みに変えます。

SNSをフォローして頂くと、最新のAI記事を最速でお届けします!
X: https://twitter.com/BizAIdea
Facebook: https://www.facebook.com/people/Bizaidea/61554218505638/

CTR IMG