Bible Network Crypto DeFi Onchain RWA AI Agent Stablecoin Chain SAFU CryptoTax DeFAI AGI Claude Me Claude Skill Claude Design Claude Cowork
独立メディア
いかなるプロジェクトとも無提携
AI知性のフロンティアを探求する
claude-me.com
最新
Claude Haiku 5.5 登場:入力 $0.10/百万トークン、ただし 100K を超えると価格は5倍、移行前に計算を  ·  Claude Code の hooks に onFailure: "block" 追加:スクリプトのパスを間違えてもポリシーゲートが黙って素通りしなくなる  ·  Claude Code の Agent ツールに effort パラメータ追加:思考の深さごとにサブエージェントを別々に作る必要がなくなる  ·  Claude Code に --max-findings パラメータ追加:コードレビューが一度に百件の指摘で埋もれることがなくなる  ·  Claude Code に Mods 機能追加:プラグインがより深い挙動を変更可能に、だが品質評価方法は Anthropic 自身も明言していない  ·  バークレイズが Claude を大規模導入:年内にエンジニアの50%が Claude Code 採用、1日12万通のメール分類も
news

Claude Haiku 5.5 登場:入力 $0.10/百万トークン、ただし 100K を超えると価格は5倍、移行前に計算を

30秒バージョン · 忙しい方へ
Haiku 5.5 の $0.10 は 100K 以内だけの話で、新トークナイザーは約30%多く数えるため、旧 77K のプロンプトはもう価格の崖っぷちにいる。

詳しく読む +
01 · なぜ起きたのか?

Haiku 5.5 の 100K の段階は、プロンプト全体に高い単価が適用されるのか、超えた部分だけなのか?

確認できた報道は「100K トークンを超えるプロンプトは入力 $0.50、出力 $2.50」と記しており、超過分だけの上乗せではなくリクエスト全体が高い段階に移る書き方に読める。ただしこれは報道の文面からの推測であり、公式の価格ページの文言を直接確認したものではない。

本番投入の前に公式の価格ページを基準とし、110K トークンの実リクエストを1件送って請求明細で確認しておきたい。

02 · 仕組みは?

既存の Haiku 4.5 のトラフィックをすべて Haiku 5.5 に切り替えるべきか?

必ずしもそうではない。短いコンテキストで形式が決まった分類や要約なら切り替える価値が高いが、リクエスト長が 77K から 270K の間に多く入るなら、新トークナイザーと $0.50 の段階で節約幅が縮み、他モデルの定価に負けることもある。

堅実なのは、1週間分の実リクエストをサンプリングし、トークン数を1.3倍で見積もって2段階の単価で計算し、どのルートを移すか残すかを決めることだ。

03 · 自分にどう影響する?

既存コードが独自の temperature を送っている場合、モデルを切り替えるとどうなるか?

報道によれば、Haiku 5.5 はデフォルト以外の temperature、top_p、top_k を受け取ると 400 エラーを返す。値が無視されるのではなく、リクエストそのものが失敗する。

サービスにリトライやフォールバックの処理がある場合、この 400 を一時的なエラーとみなして無限にリトライしないか確認すること。最もきれいな対処は、切り替え前にこれらのパラメータを外しておくことだ。

04 · どうすればいい?

ベンチマークで Haiku 5.5 が GPT-6 Luna を上回っているなら、モデル選定の根拠にしてよいか?

お勧めしない。これらの数値は Anthropic 自身が公表し報道を通じて伝わったもので、課題セットや設定もベンダーが選んでおり、しかもすべての項目で Sonnet 5.5 のほうが高い。

最も信頼できる根拠は、自社のタスクとプロンプトで小規模な比較テストを行い、ランキングの数字だけでなく品質と1000リクエストあたりの実コストを併せて比べることだ。

全文 +

Anthropic は 2026年10月7日に Claude Haiku 5.5(モデル ID claude-haiku-5-5)を発表した。同社は「これまでで最も安く最速の小型モデル」と位置づけ、要約、Claude Code のコンテキスト圧縮、分類、サブエージェントのタスク向けとしている。同じ週に Claude Code v2.1.293 が Anthropic API でのデフォルトの Haiku モデルにした。

仕様と価格:100K が分かれ目

Haiku 5.5 は 1M トークンのコンテキスト、最大 128K の出力(バッチは beta で 300K)に対応し、入力はテキストと画像、知識のカットオフは 2026年6月だ。価格は百万トークンあたり2段階で、プロンプトが 100K トークン以内なら入力 $0.10、出力 $0.50、100K を超えると入力 $0.50、出力 $2.50 になる。キャッシュ読み取りは $0.01、5分キャッシュ書き込みは $0.125、バッチ処理は50%引きだ。比較として Haiku 4.5 は $1 と $5 だった。effort を調整できる初の Haiku クラスのモデルでもあり、デフォルトは medium、adaptive thinking は標準で有効。デフォルト以外の temperature、top_p、top_k を渡すと 400 エラーが返る。

90%安いかはプロンプトの長さ次第

報道されている Anthropic のデータによれば、短いコンテキストでは Haiku 5.5 は Haiku 4.5 より90%安い。Anthropic は Haiku 4.5 のリクエストの約90%が 100K 以内だったとし、新しいトークナイザーは同じ文章で約30%多くトークンを数えるため、補正後は平均で約75%安いと見積もっている。見落としやすい点がある。旧モデルで 77K トークンだったプロンプトは新トークナイザーで約 100K になり、ちょうど境界に届く。Haiku 4.5 で 100K トークンのプロンプトはコストが $0.10 だが、Haiku 5.5 では約 130K トークンとなり、報道の段階説明から推算すると $0.50 の段階で課金され、約 $0.065 になる。節約幅は90%から約35%に縮む。逆に Haiku 4.5 で 50K トークンのプロンプトは約 65K になり、コストは $0.05 から約 $0.0065 に下がり、節約幅は約87%だ。

ベンチマークと競合

Anthropic が公表した数値では、OSWorld 2.1(オフラインのサブセット)は Haiku 5.5 が72.4%、GPT-6 Luna が48.9%、Haiku 4.5 が15.7%。Terminal-Bench 4.0 は39.2%で、Luna の16.4%、Haiku 4.5 の0.0%を上回る。Humanity's Last Exam はツールなしで45.9%、ありで57.4%だ。これらはベンダー自己申告の数値であり、すべての項目で Sonnet 5.5 が上回る(Terminal-Bench 4.0 は70.6%)。Anthropic 自身も複雑なエージェント型コーディングには Sonnet 5.5 か Opus 5.5 を勧めており、Haiku 5.5 はその配下のサブエージェントという位置づけだ。価格面では、GPT-6 Luna も短いコンテキストの定価は同じ $0.10 と $0.50 だが、上位の価格帯は入力 272K トークン超から($0.20 と $0.75)なので、150K トークン前後では Luna の定価のほうが Haiku 5.5 より低い。Haiku 5.5 は Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWS で一般提供されている。

あなたのお金にとって何を意味するか

移行前に自分のトラフィックで2つ確認したい。1つ目は、現在のリクエストのトークン数に1.3を掛けて、100K を超える割合を見ること。2つ目は、独自の temperature を送っているコードがないか探すことで、それは 400 エラーになる。ワークロードが短いコンテキストの分類、要約、サブエージェント呼び出しが中心なら節約効果は大きい。100K から 270K の間のリクエストが多いなら、$0.10 という見出しの数字に頼らず、Haiku 5.5 の $0.50 の段階を他モデルの定価と一つずつ比較すべきだ。

出典:MarkTechPost: Anthropic Releases Claude Haiku 5.5、Claude Code changelog (v2.1.293)
質問する
10文字以上入力してください
関連記事
Claude Code の hooks に onFailure: "block" 追加:スクリプトのパスを間違えてもポリシーゲートが黙って素通りしなくなる
practice · 10/10
Claude Code の Agent ツールに effort パラメータ追加:思考の深さごとにサブエージェントを別々に作る必要がなくなる
practice · 10/10
Claude Code に --max-findings パラメータ追加:コードレビューが一度に百件の指摘で埋もれることがなくなる
practice · 10/06
Claude Code に Mods 機能追加:プラグインがより深い挙動を変更可能に、だが品質評価方法は Anthropic 自身も明言していない
tools · 10/06
関連ニュース
関連トピック
なぜ「hi」一言で2万トークン以上消費するのか:ClaudeCodeの固定起動オーバーヘッドを分解する
Claude Skill Me
プロンプトキャッシングが節約するのはお金であり、空間ではない——その2万超のトークンは依然としてコンテキストウィンドウを完全に占有している。
#prompt-caching#token-cost
Subagentが本当に役立つ時と、単純なタスクを複雑にしているだけの時
Claude Skill Me
複雑そうに見えることは本当にSubagentが必要なことを意味しない——線形タスクを複数のSubagentに分割すると、得られるのは効率ではなく調整コストであることが多い。
#subagent#token-cost
エージェントがすぐ忘れる?問題はコンテキストウィンドウが小さいことではなく、そこに詰め込みすぎていることだ
AI Agent Bible
企業のAI導入における失敗の約65%はコンテキストドリフトとメモリ喪失が原因で、モデルの能力不足ではない——ウィンドウを大きくしても「詰め込みすぎ」という問題は解決しない。
#prompt-caching
Subagentはより賢い小さなClaudeではない——それが解決するのは隔離の問題であり、能力の問題ではない
Claude Skill Me
Subagentは Claude をある分野により詳しくするわけではない。ノイズを見えない場所に隔離し、メイン対話をクリーンに保つだけだ。
#subagent