ついに、Claude Haiku 5.5がリリースされました!価格が90%暴落しました!

つい先ほど、AnthropicはClaude Haiku 5.5を発表しました。価格は前世代のHaiku 4.5の1/10、Sonnet 5.5の1/20、OpenAIのGPT-6 Lunaと同じです。

公式のスコアボードでは、Lunaが提出した6項目の成績はすべてこれに負けており、いくつかの項目ではSonnetに迫っています。
コンピュータ操作のOSWorldは前世代の15.7%から72.4%に急上昇し、Sonnet 5.5にはわずか11.5ポイント差です。
端末プログラミングのTerminal-Bench 4.0は、前世代はゼロ点でしたが、今回は39.2%を獲得しました。
知識作業のGDPval-AAは1620点を獲得し、前世代の2倍以上です。
「人類最後の試験」HLEはツールなしで、10.2%から45.9%に上昇しました。

実際にどれだけ節約できるか
価格は、入力が100万トークンあたり0.10ドル、出力が0.50ドルです。これは10万トークン以内の価格で、10万を超えると入力が0.50ドル、出力が2.50ドルになります。
キャッシュ読み取りは100万トークンあたり0.01ドルで、バッチ処理を行うとさらに50%オフになります。

公式の試算によると、同じ作業は平均してHaiku 4.5より約75%のコスト削減が可能で、同じ予算で約4倍の呼び出し量を処理できます。
9割の節約には至らなかったのは、10万トークンを超えるリクエストが半額になるためで、前世代のHaikuでは約9割のリクエストが10万以内でした。また、新しい分割器により、同じ文章で約3割多くのトークンが生成されます。
GPT-6 Lunaと比較すると、10万トークン以内では両者の入力、出力、キャッシュ価格は完全に同じです。
長いコンテキストに対してはLunaがより安価で、27万トークンあたりで価格が上がり、その後も入力が0.20ドル、出力が0.75ドルになります。
Sonnet 5.5のキャッシュ読み取りも本日から半額になり、100万トークンあたり0.20ドルから0.10ドルに下がります。公式の試算では、多くのエージェントタスクで約20%のコスト削減が可能です。
MaxとTeamのサブスクリプションは今週から毎月APIクレジットを提供し、Max 5xは100ドル、Max 20xは200ドル、Teamは最大500ドルで、全チームで共有でき、Claude Platform上のどのモデルでも使用できます。
スコアはLunaを上回ったが、複雑なプログラミングではSonnetに劣る
今回のHaikuは前世代と比較して、スコアが大幅に向上しました。

コンピュータ操作のOSWorldは前世代の15.7%から72.4%に急上昇し、Sonnet 5.5にはわずか11.5ポイント差です。
端末プログラミングのTerminal-Bench 4.0は、前世代は得点ゼロでしたが、今回は39.2%を獲得しました。
知識作業のGDPval-AAは1620点を獲得し、前世代の2倍以上です。
「人類最後の試験」HLEはツールなしで、10.2%から45.9%に上昇しました。
コンピュータ操作は今回最も進歩した項目で、OSWorldで同価格のLunaは48.9%しかなく、Haiku 5.5はそれを23.5ポイント上回っています。
コストを考慮するとさらに驚異的で、Medium設定でLunaのフルスコアを超え、費用も少なく済みます。

知識作業のGDPval-AAでは、Haiku 5.5の1620点がLunaの1437点を上回り、Sonnet 5.5の1840点にはまだ届かず、デフォルトのMedium設定でも1277点を獲得しています。
長期プロジェクトのAA-Briefcaseでは、前世代の614点から1578点に上昇し、Lunaは1336点です。

推論と画像読み取りでは、HLEが検索とコードツールを使用した場合、Haiku 5.5は57.4%、Sonnet 5.5は64.5%です。専門的な図表を読むChartographyでは、前世代の6.4%から46.4%に上昇し、Lunaは29.1%、Sonnet 5.5は61.6%です。

Sonnetとの最大の差はプログラミングで、Terminal-Bench 4.0では39.2%がLuna(16.4%)の2倍以上ですが、Sonnet 5.5は70.6%です。
FrontierCodeでは46.4%がLunaの42.4%を上回り、Sonnet 5.5の最高得点52.1%には約6ポイント差があります。
公式も明言しており、複雑なエージェントプログラミングはSonnet 5.5とOpus 5.5に任せるべきです。
何に使うのが適しているか
公式はHaiku 5.5の位置付けを、大量で迅速、コスト削減が求められる作業、例えば要約作成、コンテキストの圧縮、データベースの検索、分類作業などとしています。
現在最も速いClaudeモデルで、迅速モード(非常に高価!)を使用したOpusよりもわずかに遅く、リアルタイムのカスタマーサービスやブラウザ操作に適しています。
公式は一連のスターAIアプリケーション企業の内部テストフィードバックも提供しています。
Asanaのテストによると、タスク完了の遅延は彼らが現在使用しているモデルよりも30%以上減少しました。Boxではその遅延がHaiku 4.5の半分程度であることがわかりました。

もう一つの主要な使い方は、OpusやSonnetのサブエージェントとして使用することです。大モデルがタスクを分割し、アイデアを出し、Haikuがそれを実行します。
CognitionのDevin FusionはOpus 5.5をメインに、Haiku 5.5をサブとして使用し、FrontierCodeは66.2点のトップレベルを維持し、コストと遅延も削減されました。

金融AI企業Rogoは大モデルにPPTを作成させ、Haiku 5.5は10-K財務報告書から部門別収益データを抽出しました。

Claude開発者アカウントはデモを提供し、タスクは家庭用雑貨を使って卵を運ぶためのスタンドを設計することで、目標は32メートルから落としても壊れないことです。

Opus 5.5は単独で3分37秒かかり、25種類の方案を試し、0.47ドルを費やしましたが、10個のHaiku 5.5サブエージェントを使用すると58秒で86種類を試し、0.14ドルで済みました。
Haiku 5.5 使用ガイド
Haiku 5.5はすでにClaudeクライアント、Claude Code、AWS、Google Cloud、Microsoft Azure、Cursor、OpenRouterなどのプラットフォームで利用可能で、モデルIDはclaude-haiku-5-5、コンテキストは100万トークン、単回の最大出力は12.8万トークンです。

これは思考モードを調整できる最初のHaikuで、LowからMaxまでの5段階があります。APIのデフォルトはMediumです。
PythonとTypeScript SDKにはコンピュータ操作とブラウザ操作が追加され、現在はベータ版です。
Haiku 4.5から移行する際、同じ文字トークンは約3割増加し、max_tokensとコストの見積もりを再計算する必要があります。
budgettokensは自適応思考とEffortレベルに変更され、temperature、topp、top_kは削除する必要があり、事前入力の返信は使用できなくなり、フォーマット要件は構造化出力に変更されます。
コンピュータ操作は新しいツールセットcomputertoolset20260801に変更する必要があり、Priority Tierは現在サポートされていません。
面倒な場合はClaude Codeで次の一文を実行できます:
自分で修正させてください。
もちろん、開発者でない方でも、今すぐクライアントで Haiku 5.5 と対話できます!

簡単な質問であれば、Fable、Opus、Sonnet を煩わせる必要はありません。Haiku 5.5 は、Low モードの推論強度でも、正確に瞬時に答えを出すことができ、検索エンジンを完璧に代替できます。

さあ、試してみてください!
参考資料:
https://www.anthropic.com/claude-haiku-5-5











