Codex 悄悄把視窗改回 272k,其實是替你擋 2 倍帳單
罵 nerf 之前,先看 272k 這條線。
這幾天在 Codex 裡用 GPT-5.6 跑大一點的任務,你可能發現同一個 session 塞不下之前那麼多程式碼了。GitHub 的 openai/codex 上冒出一條標成「SEVERE REGRESSION」的 issue,說有效視窗從約 353k tokens 掉到 258k,還變慢。留言區的第一反應很一致:OpenAI 又偷偷 nerf。
但翻 OpenAI 自己的 Codex changelog,2026-07-18 那筆(Codex CLI 0.142.6)寫得很白:把 GPT-5.6 Sol、Terra、Luna 的 context 上限「corrected(更正)」到 272,000 tokens。用「更正」而不是「調降」,是它認為 272k 才是本來該有的數字,先前 harness 開到的 372k 反而是設錯的。為什麼是這個數字?答案不在 changelog,在定價頁。
GPT-5.6 Sol 的標準價是每百萬 tokens 輸入 5 美元、輸出 30 美元。但官方 model page 上有一行門檻:輸入一旦超過 272k tokens,整筆請求就改以 2× input、1.5× output 計——等於輸入 10 美元、輸出 45 美元。先前 Codex 把視窗開到 372k,意思是你一跑大 repo、一開子代理人,很容易就跨過那條線,然後在完全沒感覺的情況下,這一趟的帳單和訂閱配額用兩倍速在燒。這次改動與其說是砍你的視窗,不如說是把你擋在收費線之前。
「更正」兩個字,是 OpenAI 說 372k 本來就設錯了
changelog 的原句是「corrected their context windows to 272,000 tokens」,關鍵在 correct。它不是宣布「我們決定調小」,而是把一個被誤設的數字改回應有值。先前 Codex 的 bundled 設定把 Sol 的視窗開到 372k,而那個 372k 從來就不是模型的能力上限,只是 harness(Codex 這層外殼)自己填的數。
要分清楚兩件事:GPT-5.6 Sol 這顆模型透過 raw API 的最大 context 仍然約 1.05M tokens,沒有動。這次縮的是 Codex 這個訂閱入口曝露給你的工作視窗。所以「模型 context 被砍到 272k」是誤讀——被壓回 272k 的是你在 Codex 裡一次能推進的量,不是模型的天花板。
真正的線在定價頁:輸入過 272k,整筆帳單就 ×2
把它想成手機資費的超量門檻。你的吃到飽方案有一條公平使用量,過了那條線不是斷網,是整包套餐的單價往上跳。GPT-5.6 Sol 的 272k 就是這條線,只是它跳的不是速率,是計價:輸入一超過 272k tokens,這一整筆請求的輸入照 2 倍算、輸出照 1.5 倍算。
| 改動前(harness 開 372k) | 改動後(更正回 272k) | |
|---|---|---|
| Codex 曝露的視窗上限 | 372k tokens | 272,000 tokens |
| 有效工作視窗(使用者回報) | 約 353k | 約 258k |
| 跑長任務時 | 容易越過 272k、整筆跳 2×/1.5× | 被擋在門檻內,較不越線 |
| 訂閱配額燃燒 | 過線時 2 倍速,而且常常無感 | 較不會意外爆量 |
| 模型 raw API 最大 context | 約 1.05M(超過 272k 仍算 2×/1.5×) | 約 1.05M(同上,未變) |
這也是 openai/codex 另一條 issue(#32486)的主題:「預設的 GPT-5.6 context 會越過 272K 的高用量門檻」。當 harness 預設就開到 372k,一個正常的長 session 幾乎必然跨線,而多數人根本不知道自己已經進入 2 倍計價區。把上限收回 272k,等於把這個陷阱封起來。
使用者感覺被砍的,是「不越線」換來的工作視窗
代價是真的。issue #32806 裡使用者回報,有效視窗從約 353k 掉到 258k,跑起來也變慢——對要一次餵進整包大型 codebase 的人來說,這就是實打實的空間變小。更麻煩的是子代理人:當 Sol 開子代理人幫自己審查,子代理人的 context 和推理會悄悄疊上去,你沒有主動選「長 context 模式」,卻可能被它們推過線。
想保留大視窗也不是沒路:走 raw API,你仍能用到接近 1.05M 的 context——只是超過 272k 的部分,一樣照 2× input、1.5× output 收,該付的溢價一分不少。所以 Codex 這次收窄的是訂閱端的預設視窗,大 context 本身透過 API 還在,只是要照溢價付。
OpenAI 的說法:這邊縮、那邊加量 10%
OpenAI 這邊的框架和使用者的體感是對不上的。負責 Codex 的 Tibo Sottiaux(@thsottiaux)公開說,這波同時 land 了推論優化、把省下的成本回饋給所有訂閱,GPT-5.6 Sol 大約多出 10% 的可用量,並強調「沒有 nerf,只有好料」。也就是說,官方認為就算單一 session 視窗變小,你整體能跑的量反而變多。這 10% 是他貼文的說法,不是 changelog 裡的官方數字,先記著層級;至於有開發者稱燒掉超過 20 萬美元 Sol tokens、$200 的 Codex Pro 也很容易撞頂,那是單一案例的據報導,別當通例。把兩邊擺在一起看,結論不難下:這是止血,不是純 nerf——視窗確實更擠了,但換回來的是配額不再偷偷失血。
用 Codex 的你,現在該記住的三件事
- 272k 既是收費線,也是你在 Codex 的實際工作視窗。排任務時就按 272k 抓上限,別再假設有 372k 可用。
- 盯住子代理人。它們會把 context 靜默疊高、把你推過 272k;長流程裡如果不需要,關掉或限制子代理人比事後看帳單省。
- 真要大 context,走 raw API,但心裡有數:超過 272k 的部分照 2× input、1.5× output 收,這是你自己選的溢價,不是被偷的。
OpenAI 說會在「接下來幾天」把 372k 放回來,但沒給時程,也只是貼文層級——在它真的回來之前,就把 272k 當你在 Codex 的硬牆來用。
SOURCES
- A Codex changelog
- A GPT-5.6 Sol Model | OpenAI API
- B SEVERE REGRESSION: GPT-5.6 Sol context cut again: 353K → 258K (openai/codex #32806)
- B Default GPT-5.6 context can cross the 272K higher-usage threshold (openai/codex #32486)
- B Tibo Sottiaux on X: updates for Codex and ChatGPT Work users
- C Kun Chen on X: tip on GPT-5.6 requests beyond 272k tokens
來源分級:A = 一手公告/論文/官方文件 · B = 可信媒體 · C = 可參考但需脈絡 · D = 觀察用,不可當事實。
本文由 AI 協助研究與起草,矽基前沿編輯部編修,總編輯廖玄同審閱定稿。 編輯方針與 AI 使用說明