
GPT-5.6 多一檔 14 倍速,你的帳單暫時算不出來
Fast 貴一倍換 2.5 倍速,Ultrafast 價格未定
如果你在幫產品挑「用哪個 GPT-5.6 速度檔」——客服機器人、即時寫程式助手、要秒回的金融分析——OpenAI 這幾天多給了一個選項,只是這個選項現在還沒有價格標籤。
OpenAI 8 月 13 日公布 GPT-5.6 Sol 的第三個服務層 Ultrafast:官方稱最快可達 Standard 模式的 14 倍,輸出上看每秒 750 個 token,由 Cerebras 供應算力,目前限量預覽給一小群客戶,之後隨產能擴大開放。技術上靠的是 Cerebras 的晶圓級引擎(wafer-scale engine)——每片晶片上有 44GB SRAM,模型權重直接留在晶片上,不必像一般 GPU 那樣把資料不斷搬進搬出,繞開了推論最容易卡住的記憶體頻寬瓶頸。
這不是 Sol 的第一個加速檔。同一天 OpenAI 也把 Fast 模式擴大支援到 272K token 以上的長文本——Fast 比 Standard 快 2.5 倍,代價是價格直接翻倍:input 從每百萬 token 5 美元漲到 10 美元、output 從 30 美元漲到 60 美元。換算成「每單位速度的成本」,Fast 其實比 Standard 便宜兩成;但你每月帳單的絕對數字,確實是照翻在走。
Ultrafast 這段目前是空的。OpenAI 跟 Cerebras 兩邊的公告都沒提價格,也沒講清楚會不會照 Fast 那種「翻倍價」邏輯,還是走 Cerebras 專用硬體常見的按時段包底價模式。如果你現在在規劃下一季的推理成本,Ultrafast 先別排進預算——它還沒有價格可以排。
雙方都強調沒有犧牲智能:GDP-Val 這個經濟任務基準上,官方稱端到端提速 5.6 倍且品質沒有下降;在 Humanity's Last Exam 這個 2,500 題的研究生程度基準上,Ultrafast 模式約 11 小時跑完全部題目,對照的 Claude Fable 5 要三天以上。這組對照題目與對照模型是 OpenAI/Cerebras 自己選的,我沒有找到第三方獨立跑分。
我的判斷是:三層分級的重點不是「哪個更強」——三層跑的都是同一個 Sol,同樣的智能。真正的決定題是你的產品有沒有「用戶等得起、你也付得起」那段時間差。客服機器人、語音助手這類要即時回話的場景,慢一秒用戶就流失,多花的錢多半划算;批次處理、背景任務這種不趕時間的活,多付兩倍錢換速度多半是浪費。
今天可以做的事:先盤點你產品裡哪些呼叫是「用戶在等」、哪些是「背景在跑」——前者才是該考慮 Fast 或 Ultrafast 的候選;Ultrafast 定價公布前,先別把它寫進架構決策,等價格出來那天再回頭算這筆帳划不划算。
查核備註:本篇是對 OpenAI、Cerebras 官方部落格與 TechCrunch、9to5Mac 等媒體報導的檢視,我沒有實際測試過 Ultrafast 的真實延遲或輸出品質,GDP-Val 與 Humanity's Last Exam 的對比數字是官方自選情境,我沒有找到第三方復現。
SOURCES
- APreviewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed
- AAdvancing the price-performance frontier with GPT-5.6
- AAccelerating GPT-5.6 Sol Ultrafast with OpenAI
- BOpenAI introduces 'Ultrafast,' a new mode that makes GPT-5.6 Sol work at 14x the speed
來源分級:A = 一手公告/論文/官方文件 · B = 可信媒體 · C = 可參考但需脈絡 · D = 觀察用,不可當事實。
本文由 AI 與編輯共同撰寫,總編輯廖玄同審閱定稿。 編輯方針與 AI 使用說明


