Bible Network Crypto DeFi Onchain RWA AI Agent Stablecoin Chain SAFU CryptoTax DeFAI AGI Claude Me Claude Skill Claude Design Claude Cowork
獨立知識媒體
與任何項目無關聯
探索AI智慧的思維邊界
claude-me.com
最新
用 Prompt Caching 砍 API 成本:一個常被忽略的省錢設定  ·  第一次用 Claude Code:從零開始做一個小專案的完整步驟  ·  Anthropic 的負責任擴展政策:一套隨模型能力升級而自動加嚴的安全框架  ·  什麼時候該開擴展思考:不是每個問題都需要 Claude 慢慢想  ·  Claude Skills 跟 Projects 到底差在哪:實測後我的取捨標準  ·  Anthropic 的模型福祉研究:如果 Claude 有某種程度的道德地位,公司該做什麼
名詞解析 · core-concepts

Extended Thinking

延伸思考
core-concepts 中級

30 秒版 · 給沒耐心的人
延伸思考是 Claude 在給你最終答案之前,先用一段「看不見的草稿空間」做推理的能力。你設定一個「思考預算」(<a href="https://claudecowork-me.com/zh/glossary/workspace-basics/token-limit/" target="_blank">Token 上限</a>),Claude 在這個預算內自由地推導、試錯,最後才輸出你看得到的答案。思考過程本身通常看不到,但它讓 Claude 在複雜問題上能做更深、更有條理的推理——就像一個人在開口回答之前先在草稿紙上算清楚。
完整解說 +
01 · 這是什麼?

設太高的思考預算會有什麼問題?

兩個:時間和錢。思考 token 和輸出 token 一樣計費,預算設多高,可能花費的 token 就多多少——雖然是上限不是保證用滿。更直接的問題是延遲:Claude 思考完才輸出答案,預算越高,等待時間越長。一個 100K 思考預算的複雜任務,等待時間可能比同等問題不用延伸思考長幾倍。

建議根據問題難度設預算:快問快答不需要開延伸思考;中等複雜度的分析或程式設定幾千 token;真正的多步驟數學或長推理鏈才需要幾萬 token。對所有任務一律設最高預算,等於把快速任務拖慢又付更多錢。

02 · 為什麼存在?

延伸思考和一般 Claude 回答有什麼可以觀察到的實際差別?

最直接的是答案結構更完整、推理更有層次。開了延伸思考的 Claude 在回答複雜問題時,更可能先把問題拆解成子問題、逐一推導、然後整合結論,而不是直接跳到答案、或在「聽起來合理但跳過了一步」的地方出錯。

另一個差別是在有「陷阱」的問題上。如果一道題有個不直覺的地方,沒有延伸思考的模型更容易走捷徑落入常見錯誤;有思考空間的模型比較可能在草稿裡先試錯再自我糾正,最後給你正確答案。這個差別在問題越複雜、越多步驟時越明顯。

03 · 如何影響你的決策?

思考過程看不到,我怎麼知道 Claude 有沒有認真思考?

你無法直接驗證思考過程,但有幾個間接指標。第一,答案本身的結構和邏輯深度:如果最終答案有清楚的步驟分解、考慮了邊界條件、說明了為什麼某個方向走不通,那思考通常是有效的。第二,部分 API 設定可以開啟思考摘要或部分思考可見,讓你做抽查。

更實用的做法是對同一個複雜問題,開延伸思考和不開各跑一次,比較輸出品質和錯誤率。如果你的任務類型固定,累積幾次對比就能建立對「這種任務開多少預算值得」的直觀。

04 · 你該怎麼辦?

進階:延伸思考在哪些情況下反而沒有幫助?

幾個真實的邊界條件。第一,問題本身是「知識查找」而不是「推理」:你問的是直接能查到的事實,思考空間並不能讓 Claude 憑空知道它不知道的資料,反而只是延遲輸出。第二,任務需要最新資訊:延伸思考是推理能力的增強,不是知識更新,如果答案在知識截止日之後,再多思考 token 都不夠。

第三個比較微妙:過長的思考預算在特定任務上可能造成「過度推敲」——模型在已有正確答案的情況下繼續考慮替代方向,有時反而說服自己走錯路。對有明確最優解的問題,設一個合理的中等預算比最高預算更穩定。

實際例子 +

有思考 vs 沒思考的實際差別:讓 Claude 解一道需要找矩陣中最長遞增路徑的演算法題。

不開延伸思考時,Claude 可能直接給出一個「看起來對」的 BFS 解法,但在邊界條件(例如所有元素相等)出錯。

開了 10K token 思考預算後,Claude 在草稿裡先考慮 DFS+記憶化、確認哪個方向算「遞增」、測試邊界條件,最後輸出帶有完整邊界處理的解法。你看到的程式碼沒有變短,但少了讓測試案例三爆掉的 bug。

圖解
Extended Thinking: reasoning budget controls depth vs speedA horizontal scale showing thinking budget from off through 1K, 10K, and 100K tokens, with boxes describing the resulting reasoning depth and best-use scenario.Extended Thinking: budget sets how deep Claude can reasonBudgetOffNo thinkingFast, cheap1K tokensLightShort planstructured tasks10K tokensMediumMulti-step logicanalysis, code100K tokensDeepComplex researchmath, long reasoningThinking tokens are billed but hidden -- you see only the final answerBudget = ceiling, not a fixed charge; simple problems may stop well before the capClaude Me · claude-me.com
歡迎截圖分享,轉載請註明來源
常見誤解 +
✕ 誤解1
× 誤解一:開延伸思考 Claude 就「更聰明了」,任何問題都該開。延伸思考讓 Claude 推理做得更深,但它不知道更多事實、也不能存取更新的資料。問「今天天氣」或「台灣首都是哪裡」,開再大的思考預算都幫不了你,只會讓回答更慢、費用更高。它的價值只在推理密集的任務上。
✕ 誤解2
× 誤解二:思考預算是一定會被用滿的費用。預算是上限,不是保證消耗。簡單的問題即使設了 20K token 預算,Claude 可能 2000 token 就結束了,因為問題本身不需要那麼長的推理。你付的是實際使用量,不是上限,所以設高一點給複雜任務緩衝,並不是在多花錢。
✕ 誤解3
× 誤解三:思考過程看不到代表 Claude 可能在偷懶。思考 token 確實在運算,只是結果通常不顯示給使用者(有些設定下可以看到摘要)。這是設計選擇——思考草稿包含很多半成型的想法和試錯,對最終使用者沒有意義。你需要的是整理好的答案,不是 Claude 如何否定自己前幾個嘗試的過程。
這件事跟你有什麼關係 +
直接影響

延伸思考的核心取捨是:推理品質 vs 速度與成本。

開延伸思考,Claude 有機會在答題前把複雜問題想清楚,對多步驟邏輯、數學、深度分析的任務,答案品質和可靠性都會提升。代價是延遲增加(要等思考完才輸出)和費用上升(思考 token 也計費)。

不開延伸思考,回應快、費用低,對直接問答、知識查詢、創意寫作這類不需要深度推理鏈的任務完全足夠。判斷準則:這個問題如果給一個高手,他需不需要在白板上推導才能給出可靠答案?需要的話,延伸思考有價值;不需要的話,它只是讓你等更久。

提問
請至少輸入 10 個字