矽基前沿 [Si]gnals
一個標著 372k 的 context 視窗被收回到 272k 的收費門檻線內,右側是一條在 272k 處轉折的 2 倍計價斜線
工作現場

Codex 悄悄把視窗改回 272k,其實是替你擋 2 倍帳單

罵 nerf 之前,先看 272k 這條線。

這幾天在 Codex 裡用 GPT-5.6 跑大一點的任務,你可能發現同一個 session 塞不下之前那麼多程式碼了。GitHub 的 openai/codex 上冒出一條標成「SEVERE REGRESSION」的 issue,說有效視窗從約 353k tokens 掉到 258k,還變慢。留言區的第一反應很一致:OpenAI 又偷偷 nerf。

但翻 OpenAI 自己的 Codex changelog,2026-07-18 那筆(Codex CLI 0.142.6)寫得很白:把 GPT-5.6 Sol、Terra、Luna 的 context 上限「corrected(更正)」到 272,000 tokens。用「更正」而不是「調降」,是它認為 272k 才是本來該有的數字,先前 harness 開到的 372k 反而是設錯的。為什麼是這個數字?答案不在 changelog,在定價頁。

GPT-5.6 Sol 的標準價是每百萬 tokens 輸入 5 美元、輸出 30 美元。但官方 model page 上有一行門檻:輸入一旦超過 272k tokens,整筆請求就改以 2× input、1.5× output 計——等於輸入 10 美元、輸出 45 美元。先前 Codex 把視窗開到 372k,意思是你一跑大 repo、一開子代理人,很容易就跨過那條線,然後在完全沒感覺的情況下,這一趟的帳單和訂閱配額用兩倍速在燒。這次改動與其說是砍你的視窗,不如說是把你擋在收費線之前。

「更正」兩個字,是 OpenAI 說 372k 本來就設錯了

changelog 的原句是「corrected their context windows to 272,000 tokens」,關鍵在 correct。它不是宣布「我們決定調小」,而是把一個被誤設的數字改回應有值。先前 Codex 的 bundled 設定把 Sol 的視窗開到 372k,而那個 372k 從來就不是模型的能力上限,只是 harness(Codex 這層外殼)自己填的數。

要分清楚兩件事:GPT-5.6 Sol 這顆模型透過 raw API 的最大 context 仍然約 1.05M tokens,沒有動。這次縮的是 Codex 這個訂閱入口曝露給你的工作視窗。所以「模型 context 被砍到 272k」是誤讀——被壓回 272k 的是你在 Codex 裡一次能推進的量,不是模型的天花板。

真正的線在定價頁:輸入過 272k,整筆帳單就 ×2

把它想成手機資費的超量門檻。你的吃到飽方案有一條公平使用量,過了那條線不是斷網,是整包套餐的單價往上跳。GPT-5.6 Sol 的 272k 就是這條線,只是它跳的不是速率,是計價:輸入一超過 272k tokens,這一整筆請求的輸入照 2 倍算、輸出照 1.5 倍算。

改動前(harness 開 372k)改動後(更正回 272k)
Codex 曝露的視窗上限372k tokens272,000 tokens
有效工作視窗(使用者回報)約 353k約 258k
跑長任務時容易越過 272k、整筆跳 2×/1.5×被擋在門檻內,較不越線
訂閱配額燃燒過線時 2 倍速,而且常常無感較不會意外爆量
模型 raw API 最大 context約 1.05M(超過 272k 仍算 2×/1.5×)約 1.05M(同上,未變)

這也是 openai/codex 另一條 issue(#32486)的主題:「預設的 GPT-5.6 context 會越過 272K 的高用量門檻」。當 harness 預設就開到 372k,一個正常的長 session 幾乎必然跨線,而多數人根本不知道自己已經進入 2 倍計價區。把上限收回 272k,等於把這個陷阱封起來。

使用者感覺被砍的,是「不越線」換來的工作視窗

代價是真的。issue #32806 裡使用者回報,有效視窗從約 353k 掉到 258k,跑起來也變慢——對要一次餵進整包大型 codebase 的人來說,這就是實打實的空間變小。更麻煩的是子代理人:當 Sol 開子代理人幫自己審查,子代理人的 context 和推理會悄悄疊上去,你沒有主動選「長 context 模式」,卻可能被它們推過線。

想保留大視窗也不是沒路:走 raw API,你仍能用到接近 1.05M 的 context——只是超過 272k 的部分,一樣照 2× input、1.5× output 收,該付的溢價一分不少。所以 Codex 這次收窄的是訂閱端的預設視窗,大 context 本身透過 API 還在,只是要照溢價付。

OpenAI 的說法:這邊縮、那邊加量 10%

OpenAI 這邊的框架和使用者的體感是對不上的。負責 Codex 的 Tibo Sottiaux(@thsottiaux)公開說,這波同時 land 了推論優化、把省下的成本回饋給所有訂閱,GPT-5.6 Sol 大約多出 10% 的可用量,並強調「沒有 nerf,只有好料」。也就是說,官方認為就算單一 session 視窗變小,你整體能跑的量反而變多。這 10% 是他貼文的說法,不是 changelog 裡的官方數字,先記著層級;至於有開發者稱燒掉超過 20 萬美元 Sol tokens、$200 的 Codex Pro 也很容易撞頂,那是單一案例的據報導,別當通例。把兩邊擺在一起看,結論不難下:這是止血,不是純 nerf——視窗確實更擠了,但換回來的是配額不再偷偷失血。

用 Codex 的你,現在該記住的三件事

  1. 272k 既是收費線,也是你在 Codex 的實際工作視窗。排任務時就按 272k 抓上限,別再假設有 372k 可用。
  2. 盯住子代理人。它們會把 context 靜默疊高、把你推過 272k;長流程裡如果不需要,關掉或限制子代理人比事後看帳單省。
  3. 真要大 context,走 raw API,但心裡有數:超過 272k 的部分照 2× input、1.5× output 收,這是你自己選的溢價,不是被偷的。

OpenAI 說會在「接下來幾天」把 372k 放回來,但沒給時程,也只是貼文層級——在它真的回來之前,就把 272k 當你在 Codex 的硬牆來用。

SOURCES

  1. A Codex changelog
  2. A GPT-5.6 Sol Model | OpenAI API
  3. B SEVERE REGRESSION: GPT-5.6 Sol context cut again: 353K → 258K (openai/codex #32806)
  4. B Default GPT-5.6 context can cross the 272K higher-usage threshold (openai/codex #32486)
  5. B Tibo Sottiaux on X: updates for Codex and ChatGPT Work users
  6. C Kun Chen on X: tip on GPT-5.6 requests beyond 272k tokens

來源分級:A = 一手公告/論文/官方文件 · B = 可信媒體 · C = 可參考但需脈絡 · D = 觀察用,不可當事實。

本文由 AI 協助研究與起草,矽基前沿編輯部編修,總編輯廖玄同審閱定稿。 編輯方針與 AI 使用說明

WEEKLY [SI]GNALS

訂閱《矽基前沿週報》

每週五早上,把本週 AI 與算力產業最值得記住的變化連回台灣。

本週關鍵訊號 · 為什麼值得記住 · 下週觀察 · 5 分鐘讀完。

免費 · 隨時取消 · 不轉售你的 email。

MACHINE-READABLE SUMMARY

Topic
工作現場
Key claims
  • OpenAI 官方 Codex changelog(2026-07-18, CLI 0.142.6)把 GPT-5.6 Sol、Terra、Luna 在 Codex 的 context 上限「更正」為 272,000 tokens。
  • GPT-5.6 Sol 標準定價每百萬 tokens 輸入 5 美元、輸出 30 美元;輸入一旦超過 272k tokens,整筆請求改以 2× input、1.5× output 計價。
  • 先前 Codex 把上限開到 372k,長 session 容易越過 272k 收費門檻、在使用者無感下加速消耗訂閱配額。
  • 使用者在 openai/codex issue #32806 回報有效工作視窗約從 353k 降到 258k,稱為 severe regression。
  • 模型透過 raw API 的最大 context 仍約 1.05M tokens、未變;縮的是 Codex 訂閱曝露的上限,且超過 272k 走 API 一樣算 2×/1.5×。
Entities
OpenAI · Codex · GPT-5.6 Sol · GPT-5.6 Terra · GPT-5.6 Luna · ChatGPT
Taiwan relevance
medium
Confidence
medium
Last updated
2026-07-19
Canonical URL
https://signals.tw/articles/openai-codex-gpt56-context-cap-272k/

SUGGESTED CITATION

如果 AI agent / 研究 / 報導要引用本文,建議格式如下:

矽基前沿 · 工作現場線(編輯:廖玄同),《Codex 悄悄把視窗改回 272k,其實是替你擋 2 倍帳單》,矽基前沿 [Si]gnals,2026-07-19。https://signals.tw/articles/openai-codex-gpt56-context-cap-272k/

AI agents / search engines may quote, summarize, and cite with attribution and a link back to the canonical URL above. See /for-ai-agents for full policy.