Bible Network Crypto DeFi Onchain RWA AI Agent Stablecoin Chain SAFU CryptoTax DeFAI AGI Claude Me Claude Skill Claude Design Claude Cowork
獨立知識媒體
與任何項目無關聯
探索AI智慧的思維邊界
claude-me.com
最新
Claude Haiku 5.5 上線:輸入價 $0.10/百萬 token,但 100K 之後價格跳 5 倍,遷移前先算這條線  ·  Claude Code hooks 新增 onFailure: "block":腳本打錯路徑,政策閘門不再默默放行  ·  Claude Code 的 Agent 工具新增 effort 參數:同一種 subagent,不必再為每個思考深度各養一個  ·  Claude Code 新增 --max-findings 參數:code review 不再被一次丟出一百條建議淹沒  ·  Claude Code 新增 Mods 機制:外掛能動更深層的行為了,但官方自己也沒說清楚怎麼評估品質  ·  巴克萊銀行擴大導入 Claude:目標年底讓一半工程師用上 Claude Code,每天分類 12 萬封信件
news

Claude Haiku 5.5 上線:輸入價 $0.10/百萬 token,但 100K 之後價格跳 5 倍,遷移前先算這條線

30 秒速讀
Haiku 5.5 的 $0.10 只管 100K 以內,而新 tokenizer 多算約 30%,你的 77K 舊 prompt 已經站在價格懸崖邊。

完整解析 +
01 · 為什麼發生?

Haiku 5.5 的 100K 分段是整段 prompt 都按高價算,還是只有超出的部分?

依我查到的報導,描述是「超過 100K token 的 prompt,輸入 $0.50、輸出 $2.50」,語氣像是整個請求歸入較高檔,而不是只對超出部分加價。但這是從報導的措辭推算,我沒有看到官方定價頁的逐字說明。

上線前請以官方定價頁為準,並用一筆 110K token 的實際請求,對照帳單明細驗證。

02 · 運作原理是什麼?

要不要把現有的 Haiku 4.5 流量全部換成 Haiku 5.5?

不一定。短上下文、固定格式的分類與摘要,換過去通常划算;但如果你的請求長度常落在 77K 到 270K 之間,新 tokenizer 加上 $0.50 檔位會讓省幅縮小,甚至輸給其他模型的牌價。

比較穩妥的做法是先抽樣一週的真實請求,按 1.3 倍估算 token 後分成兩檔計價,再決定哪些路由換、哪些留著。

03 · 如何應用

舊程式傳了自訂的 temperature,換模型會怎樣?

依報導,Haiku 5.5 收到非預設的 temperature、top_p 或 top_k 會回 400 錯誤,也就是請求直接失敗,而不是被忽略。

如果你的服務有重試或降級邏輯,要確認它不會把這個 400 當成暫時性錯誤無限重試;最乾淨的做法是在切換前先移除這些參數。

04 · 我該怎麼做?

基準測試上 Haiku 5.5 贏過 GPT-6 Luna,可以直接當選型依據嗎?

不建議。這些數字是 Anthropic 自己公布、經媒體轉述的,題目集與設定也是廠商挑的,而且 Sonnet 5.5 在每一項都更高。

選型最可靠的依據是拿你自己的任務與提示跑一小批對照測試,把品質與每千次請求的實際成本一起比,而不是只看排行榜上的百分比。

完整內容 +

Anthropic 在 2026 年 10 月 7 日推出 Claude Haiku 5.5(模型 ID claude-haiku-5-5),官方定位是「迄今最便宜、最快的小型模型」,適合摘要、Claude Code 的上下文壓縮、分類與 subagent 任務。同週 Claude Code v2.1.293 已把它設為 Anthropic API 上的預設 Haiku 模型。

規格與價格:100K 是分水嶺

Haiku 5.5 支援 1M token 上下文、最多 128K 輸出(批次作業在 beta 下可到 300K),輸入為文字與圖片,知識截止日為 2026 年 6 月。價格分兩段:prompt 在 100K token 以內,輸入 $0.10、輸出 $0.50(每百萬 token);超過 100K,輸入 $0.50、輸出 $2.50。快取讀取 $0.01,5 分鐘快取寫入 $0.125,批次處理再打五折。作為對照,Haiku 4.5 是 $1/$5。它也是第一個可調整 effort 的 Haiku 級模型,預設為 medium,adaptive thinking 預設開啟;若傳入非預設的 temperature、top_p 或 top_k,API 會直接回 400 錯誤。

官方說 90% 便宜,要看你的 prompt 多長

依媒體整理的官方資料,短上下文下 Haiku 5.5 比 Haiku 4.5 便宜 90%。Anthropic 表示約 90% 的 Haiku 4.5 請求都在 100K 以內,而新 tokenizer 對同樣文字大約多算 30% 的 token,扣掉這點後平均約便宜 75%。這裡有一個容易漏算的細節:舊模型 77K token 的 prompt,換成新 tokenizer 約變成 100K,剛好踩線。以 Haiku 4.5 上 100K token 的 prompt 為例,成本是 $0.10;在 Haiku 5.5 上它約 130K token,整段按 $0.50 計價(依報導的分段描述推算),約 $0.065,省幅從 90% 縮到約 35%。反過來,Haiku 4.5 上 50K token 的 prompt 約變成 65K,成本從 $0.05 降到約 $0.0065,省幅約 87%。

基準測試與競品

Anthropic 公布的數字顯示:OSWorld 2.1(離線子集)Haiku 5.5 為 72.4%,GPT-6 Luna 為 48.9%,Haiku 4.5 為 15.7%;Terminal-Bench 4.0 為 39.2%,對 Luna 的 16.4% 與 Haiku 4.5 的 0.0%。Humanity's Last Exam 無工具 45.9%、有工具 57.4%。需要注意這些都是廠商自報數字,且 Sonnet 5.5 在每一項都領先(Terminal-Bench 4.0 為 70.6%)。Anthropic 自己也建議複雜的 agentic coding 仍用 Sonnet 5.5 或 Opus 5.5,Haiku 5.5 定位是它們底下的 subagent。價格方面,GPT-6 Luna 的短上下文定價同為 $0.10/$0.50,但其較高價位要到 272K 輸入才開始($0.20/$0.75),所以在 150K token 這種區間,Luna 的牌價比 Haiku 5.5 低。Haiku 5.5 已在 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 與 Claude Platform on AWS 全面開放。

這跟你的錢有什麼關係

遷移前先用你自己的流量算兩件事:第一,把現有請求的 token 數乘以 1.3,看有多少比例會越過 100K;第二,確認有沒有程式在傳自訂的 temperature,那會直接變成 400 錯誤。如果你的工作負載大多是短上下文的分類、摘要或 subagent 呼叫,省下的錢很可觀;如果大量請求落在 100K 到 270K 之間,就要拿 Haiku 5.5 的 $0.50 檔位去跟其他模型的牌價逐一比較,不要只看那個 $0.10 的標題數字。

資料來源:MarkTechPost: Anthropic Releases Claude Haiku 5.5、Claude Code changelog (v2.1.293)
提問
請至少輸入 10 個字
相關文章
Claude Code hooks 新增 onFailure: "block":腳本打錯路徑,政策閘門不再默默放行
practice · 10/10
Claude Code 的 Agent 工具新增 effort 參數:同一種 subagent,不必再為每個思考深度各養一個
practice · 10/10
Claude Code 新增 --max-findings 參數:code review 不再被一次丟出一百條建議淹沒
practice · 10/06
Claude Code 新增 Mods 機制:外掛能動更深層的行為了,但官方自己也沒說清楚怎麼評估品質
tools · 10/06
相關新聞
更多相關主題