AnthropicはClaude Haiku 5.5を発表し、運用コストが前のバージョンより約75%削減されました。
Anthropicは水曜日にClaude Haiku 5.5を発表し、同社にとってこれまでで最も安価で、最も速く、最も強力な小型モデルであると述べました。このモデルは、文書要約、データベースクエリなどの高バッチタスクや、リアルタイムカスタマーサービス、ユーザーの代わりにブラウザを操作するなどの速度に敏感なシナリオを対象としています。開発者が自社製品に接続する際、10万トークン以内のプロンプトは、百万入力トークンあたり0.1ドル、百万出力トークンあたり0.5ドルで課金され、OpenAIが9月22日に発表した競合小型モデルGPT-6 Lunaの価格設定と一致しています。
Haiku 4.5の対応価格は1ドルと5ドルで、新しい価格は90%低下しており、10万トークンを超えるプロンプトは50%の値下げが行われます。旧モデルの約90%のリクエストがこの閾値を下回っており、Haiku 5.5のトークン数がわずかに多いため、Anthropicは平均して約75%の節約を見込んでいます。ベンチマークテストでは、Haiku 5.5はOSWorld 2.1で72.4%の成功率を達成し、GPT Lunaの48.9%を上回りました;Terminal-Bench 4では39.2%で、Lunaの16.4%やHaiku 4.5の0%を上回っていますが、Sonnet 5.5の70.6%には及びません。
これは調整可能なeffort設定を持つ最初のHaikuモデルであり、ユーザーはコストと回答の質の間でトレードオフを行うことができます。






