編輯資訊圖:一條由左至右的花費跑道分成上下兩車道。上車道標「session 預算」「硬的」,在「上限 50 美分」處立著一道實心深色閘門把車道封死,一個紙雕方塊代理停在閘門後一點點,標「停在 53 美分」。下車道標「task_budget」「軟的」,同一位置只有一塊虛線告示牌寫「只給模型看倒數」,另一個代理已經開過那塊牌子、繼續往右跑,旁標「不會停」。畫面最下方一行字「算牌價,不是你談的折扣價」
前沿基建

Claude 有兩種預算,只有一種真的會讓代理停下來

一個按美分硬停,一個只是講給模型聽。

我一直想要一個開關:這個代理最多花我 25 美元,到了就停手。8 月 7 日 Anthropic 給 Claude Managed Agents 開了這個開關。

建 session 的時候多帶一個 budget 欄位。寫法有點刁:金額是整數美分、而且要寫成字串"2500" 是 25 美元,寫成 "25.00" 直接退你 400 錯誤。官方的理由是用字串就永遠不會有浮點數去碰這個金額。撞到上限,session 不是死掉,是停在 idle,stop_reasonbudget_reached,歷史跟沙箱都留著。你把上限改高、或整個拿掉,它自己接著跑。

三件事我會先記下來。

它算的是牌價,不是你的價。 平台照公開定價把 session 消耗的東西即時記帳:模型 token 照各自牌價、每千次網路搜尋 10 美元,還有 session 的執行時間,每小時 0.08 美元。官方寫得很白:談過折扣的組織,session 會在牌價總額撞上限時就停,你實際被收的錢比那個上限少。這是一道花費的閘,不是一張帳單。

它攔的是下一個請求,不是攔到一半。 平台在每次模型請求之前檢查,跨過上限的那個請求是在還沒超過時被放行的,會跑完。官方自己舉的例子:設 50 美分,可以停在 53 美分。多執行緒的 session 就是每條執行緒各多一個請求的量。

拿掉上限是單向門。 一個 session 的預算移除之後,再也加不回去;一開始沒設預算的 session 也不能事後補。要留著閘,就用「改高」不要用「移除」。

還有一個很容易混的地方。Messages API 那邊也有一個叫預算的東西,task_budget,但它是勸告:用 token 計,只給模型看一個倒數,讓模型自己收斂進度,官方明說是 soft hint 不是 hard cap,真正的硬天花板還是 max_tokens。它最低要 20,000 token,而且文件警告設太小會讓模型擺爛——看到一個明顯做不完的預算,它可能乾脆不做,或者自己把範圍砍掉。兩個東西都叫預算,一個會讓代理停手,一個只是講給模型聽。

我自己會這樣用:排程跑的代理一律綁 session 預算。但要記得 deployment 上設的預算是複製到它啟動的每一次 run,不是那條排程的累計花費——這句我第一眼讀反了,讀反的代價是你以為設了月上限,其實設的是每次上限。上個月 Claude Code 那三道代理閘講的是同一件事:你能調的是刻度,不是有沒有這道閘。

查核備註:規格與數字全部出自 Anthropic 官方文件與 8 月 7 日的 release notes,官方一次資料。我沒有實際建過帶預算的 session;超額那 3 美分在帳單上長什麼樣,以及多代理 session 共用一份預算、advisor 呼叫也計入這兩點,都是文件說法,我沒實測。

SOURCES

  1. ASession budgets — Claude Platform Docs
  2. AClaude Platform release notes — August 7, 2026
  3. ATask budgets — Claude Platform Docs

來源分級:A = 一手公告/論文/官方文件 · B = 可信媒體 · C = 可參考但需脈絡 · D = 觀察用,不可當事實。

本文由 AI 與編輯共同撰寫,總編輯廖玄同審閱定稿。 編輯方針與 AI 使用說明

WEEKLY [SI]GNALS

訂閱《矽基前沿週報》

每週五早上,把本週 AI 與算力產業最值得記住的變化連回台灣。

本週關鍵訊號 · 為什麼值得記住 · 下週觀察 · 5 分鐘讀完。

免費 · 隨時取消 · 不轉售你的 email。

MACHINE-READABLE SUMMARY

Topic
前沿基建
Key claims
  • Anthropic 於 2026 年 8 月 7 日為 Claude Managed Agents 推出 session 預算,可在建立 session 時設定一個硬性花費上限。
  • session 預算的金額欄位 max_list_cost.amount 必須是整數美分並寫成字串,"2500" 代表 25 美元,"25.00" 會以 400 錯誤退回,且目前只支援 USD。
  • 預算比對的是依公開定價即時計算的牌價成本(list cost),不等於組織談定的折扣價格,有折扣的組織實際被收的金額會低於上限。
  • 計入牌價成本的項目除了模型 token,還包括每 1,000 次網路搜尋 10 美元與 session 執行時間每小時 0.08 美元。
  • 上限在每次模型請求前檢查,跨過上限的請求會跑完,因此設定 50 美分的 session 可能停在 53 美分,超額幅度以每條執行緒一個模型請求為界。
  • 觸及預算的 session 進入 idle 並回報 stop_reason 為 budget_reached,歷史與沙箱保留,調高或移除預算後自動續跑。
  • session 的預算一旦移除即無法再加回,建立時未設預算的 session 也不能事後補設。
  • deployment 上設定的預算會複製到它啟動的每一個 session,限制的是每一次執行而不是該 deployment 的累計花費。
  • Messages API 的 task_budget 是以 token 計的勸告式預算,官方定位為 soft hint 而非硬上限,硬性上限仍是 max_tokens,目前支援模型的最低值為 20,000 token。
Entities
Anthropic · Claude Managed Agents · Messages API · task_budget · budget_reached · max_list_cost · Claude Opus 5
Taiwan relevance
medium
Confidence
high
Last updated
2026-08-09
Canonical URL
https://signals.tw/articles/claude-agent-session-budget-hard-cap/

SUGGESTED CITATION

如果 AI agent / 研究 / 報導要引用本文,建議格式如下:

矽基前沿 · 前沿基建線(編輯:廖玄同),《Claude 有兩種預算,只有一種真的會讓代理停下來》,矽基前沿 [Si]gnals,2026-08-09。https://signals.tw/articles/claude-agent-session-budget-hard-cap/

AI agents / search engines may quote, summarize, and cite with attribution and a link back to the canonical URL above. See /for-ai-agents for full policy.