Haiku 5.5 の 100K の段階は、プロンプト全体に高い単価が適用されるのか、超えた部分だけなのか?
確認できた報道は「100K トークンを超えるプロンプトは入力 $0.50、出力 $2.50」と記しており、超過分だけの上乗せではなくリクエスト全体が高い段階に移る書き方に読める。ただしこれは報道の文面からの推測であり、公式の価格ページの文言を直接確認したものではない。
本番投入の前に公式の価格ページを基準とし、110K トークンの実リクエストを1件送って請求明細で確認しておきたい。
既存の Haiku 4.5 のトラフィックをすべて Haiku 5.5 に切り替えるべきか?
必ずしもそうではない。短いコンテキストで形式が決まった分類や要約なら切り替える価値が高いが、リクエスト長が 77K から 270K の間に多く入るなら、新トークナイザーと $0.50 の段階で節約幅が縮み、他モデルの定価に負けることもある。
堅実なのは、1週間分の実リクエストをサンプリングし、トークン数を1.3倍で見積もって2段階の単価で計算し、どのルートを移すか残すかを決めることだ。
既存コードが独自の temperature を送っている場合、モデルを切り替えるとどうなるか?
報道によれば、Haiku 5.5 はデフォルト以外の temperature、top_p、top_k を受け取ると 400 エラーを返す。値が無視されるのではなく、リクエストそのものが失敗する。
サービスにリトライやフォールバックの処理がある場合、この 400 を一時的なエラーとみなして無限にリトライしないか確認すること。最もきれいな対処は、切り替え前にこれらのパラメータを外しておくことだ。
ベンチマークで Haiku 5.5 が GPT-6 Luna を上回っているなら、モデル選定の根拠にしてよいか?
お勧めしない。これらの数値は Anthropic 自身が公表し報道を通じて伝わったもので、課題セットや設定もベンダーが選んでおり、しかもすべての項目で Sonnet 5.5 のほうが高い。
最も信頼できる根拠は、自社のタスクとプロンプトで小規模な比較テストを行い、ランキングの数字だけでなく品質と1000リクエストあたりの実コストを併せて比べることだ。
Anthropic は 2026年10月7日に Claude Haiku 5.5(モデル ID claude-haiku-5-5)を発表した。同社は「これまでで最も安く最速の小型モデル」と位置づけ、要約、Claude Code のコンテキスト圧縮、分類、サブエージェントのタスク向けとしている。同じ週に Claude Code v2.1.293 が Anthropic API でのデフォルトの Haiku モデルにした。
Haiku 5.5 は 1M トークンのコンテキスト、最大 128K の出力(バッチは beta で 300K)に対応し、入力はテキストと画像、知識のカットオフは 2026年6月だ。価格は百万トークンあたり2段階で、プロンプトが 100K トークン以内なら入力 $0.10、出力 $0.50、100K を超えると入力 $0.50、出力 $2.50 になる。キャッシュ読み取りは $0.01、5分キャッシュ書き込みは $0.125、バッチ処理は50%引きだ。比較として Haiku 4.5 は $1 と $5 だった。effort を調整できる初の Haiku クラスのモデルでもあり、デフォルトは medium、adaptive thinking は標準で有効。デフォルト以外の temperature、top_p、top_k を渡すと 400 エラーが返る。
報道されている Anthropic のデータによれば、短いコンテキストでは Haiku 5.5 は Haiku 4.5 より90%安い。Anthropic は Haiku 4.5 のリクエストの約90%が 100K 以内だったとし、新しいトークナイザーは同じ文章で約30%多くトークンを数えるため、補正後は平均で約75%安いと見積もっている。見落としやすい点がある。旧モデルで 77K トークンだったプロンプトは新トークナイザーで約 100K になり、ちょうど境界に届く。Haiku 4.5 で 100K トークンのプロンプトはコストが $0.10 だが、Haiku 5.5 では約 130K トークンとなり、報道の段階説明から推算すると $0.50 の段階で課金され、約 $0.065 になる。節約幅は90%から約35%に縮む。逆に Haiku 4.5 で 50K トークンのプロンプトは約 65K になり、コストは $0.05 から約 $0.0065 に下がり、節約幅は約87%だ。
Anthropic が公表した数値では、OSWorld 2.1(オフラインのサブセット)は Haiku 5.5 が72.4%、GPT-6 Luna が48.9%、Haiku 4.5 が15.7%。Terminal-Bench 4.0 は39.2%で、Luna の16.4%、Haiku 4.5 の0.0%を上回る。Humanity's Last Exam はツールなしで45.9%、ありで57.4%だ。これらはベンダー自己申告の数値であり、すべての項目で Sonnet 5.5 が上回る(Terminal-Bench 4.0 は70.6%)。Anthropic 自身も複雑なエージェント型コーディングには Sonnet 5.5 か Opus 5.5 を勧めており、Haiku 5.5 はその配下のサブエージェントという位置づけだ。価格面では、GPT-6 Luna も短いコンテキストの定価は同じ $0.10 と $0.50 だが、上位の価格帯は入力 272K トークン超から($0.20 と $0.75)なので、150K トークン前後では Luna の定価のほうが Haiku 5.5 より低い。Haiku 5.5 は Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWS で一般提供されている。
移行前に自分のトラフィックで2つ確認したい。1つ目は、現在のリクエストのトークン数に1.3を掛けて、100K を超える割合を見ること。2つ目は、独自の temperature を送っているコードがないか探すことで、それは 400 エラーになる。ワークロードが短いコンテキストの分類、要約、サブエージェント呼び出しが中心なら節約効果は大きい。100K から 270K の間のリクエストが多いなら、$0.10 という見出しの数字に頼らず、Haiku 5.5 の $0.50 の段階を他モデルの定価と一つずつ比較すべきだ。