AnthropicはClaude Sonnet 5.5を発表し、プログラミングの成績がOpus 5.5を超えました。
Anthropicは今週の月曜日にClaude Sonnet 5.5を発表しました。これは今年の6月に発売されたSonnet 5のアップグレード版です。公式によると、この中間モデルは前世代よりも30%以上の速度向上を実現しており、明確な範囲のデイリーニーズ、バグ修正、ドキュメント、スライド、表の作成において最も優れたパフォーマンスを発揮し、鋭いデザイン能力を備えています。価格は、1百万入力トークンあたり2ドル、1百万出力トークンあたり10ドルで、Opus 5.5の半分であり、各タスクで消費されるトークンはSonnet 5よりも約3分の1減少しています。
Terminal-Bench 4のテストでは、Sonnet 5.5は70.6%のスコアを獲得し、Opus 5.5の66.4%を上回り、Sonnet 5はわずか10.3%でした。独立したテスト機関Artificial Analysisの結果も同様にその優位性を示しており、それぞれ63.6%と59.6%を記録し、OpenAIのGPT-6 Astraは59.1%でした。44種類の職業の実際の仕事のパフォーマンスを評価するGDPval-AAでは、Sonnet 5.5は1844点を獲得し、Opus 5.5の1846点とほぼ同等で、GPT-6 Solは1487点でした。






