編輯資訊圖:三張並排卡片代表 Standard、Fast、Ultrafast 三個速度檔,速度尾焰依序變長,Ultrafast 卡片的價格標籤蓋著問號圖章,底部標「Cerebras 供電」
工作現場

GPT-5.6 多一檔 14 倍速,你的帳單暫時算不出來

Fast 貴一倍換 2.5 倍速,Ultrafast 價格未定

如果你在幫產品挑「用哪個 GPT-5.6 速度檔」——客服機器人、即時寫程式助手、要秒回的金融分析——OpenAI 這幾天多給了一個選項,只是這個選項現在還沒有價格標籤。

OpenAI 8 月 13 日公布 GPT-5.6 Sol 的第三個服務層 Ultrafast:官方稱最快可達 Standard 模式的 14 倍,輸出上看每秒 750 個 token,由 Cerebras 供應算力,目前限量預覽給一小群客戶,之後隨產能擴大開放。技術上靠的是 Cerebras 的晶圓級引擎(wafer-scale engine)——每片晶片上有 44GB SRAM,模型權重直接留在晶片上,不必像一般 GPU 那樣把資料不斷搬進搬出,繞開了推論最容易卡住的記憶體頻寬瓶頸。

這不是 Sol 的第一個加速檔。同一天 OpenAI 也把 Fast 模式擴大支援到 272K token 以上的長文本——Fast 比 Standard 快 2.5 倍,代價是價格直接翻倍:input 從每百萬 token 5 美元漲到 10 美元、output 從 30 美元漲到 60 美元。換算成「每單位速度的成本」,Fast 其實比 Standard 便宜兩成;但你每月帳單的絕對數字,確實是照翻在走。

Ultrafast 這段目前是空的。OpenAI 跟 Cerebras 兩邊的公告都沒提價格,也沒講清楚會不會照 Fast 那種「翻倍價」邏輯,還是走 Cerebras 專用硬體常見的按時段包底價模式。如果你現在在規劃下一季的推理成本,Ultrafast 先別排進預算——它還沒有價格可以排。

雙方都強調沒有犧牲智能:GDP-Val 這個經濟任務基準上,官方稱端到端提速 5.6 倍且品質沒有下降;在 Humanity's Last Exam 這個 2,500 題的研究生程度基準上,Ultrafast 模式約 11 小時跑完全部題目,對照的 Claude Fable 5 要三天以上。這組對照題目與對照模型是 OpenAI/Cerebras 自己選的,我沒有找到第三方獨立跑分。

我的判斷是:三層分級的重點不是「哪個更強」——三層跑的都是同一個 Sol,同樣的智能。真正的決定題是你的產品有沒有「用戶等得起、你也付得起」那段時間差。客服機器人、語音助手這類要即時回話的場景,慢一秒用戶就流失,多花的錢多半划算;批次處理、背景任務這種不趕時間的活,多付兩倍錢換速度多半是浪費。

今天可以做的事:先盤點你產品裡哪些呼叫是「用戶在等」、哪些是「背景在跑」——前者才是該考慮 Fast 或 Ultrafast 的候選;Ultrafast 定價公布前,先別把它寫進架構決策,等價格出來那天再回頭算這筆帳划不划算。

查核備註:本篇是對 OpenAI、Cerebras 官方部落格與 TechCrunch、9to5Mac 等媒體報導的檢視,我沒有實際測試過 Ultrafast 的真實延遲或輸出品質,GDP-Val 與 Humanity's Last Exam 的對比數字是官方自選情境,我沒有找到第三方復現。

SOURCES

  1. APreviewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed
  2. AAdvancing the price-performance frontier with GPT-5.6
  3. AAccelerating GPT-5.6 Sol Ultrafast with OpenAI
  4. BOpenAI introduces 'Ultrafast,' a new mode that makes GPT-5.6 Sol work at 14x the speed

來源分級:A = 一手公告/論文/官方文件 · B = 可信媒體 · C = 可參考但需脈絡 · D = 觀察用,不可當事實。

本文由 AI 與編輯共同撰寫,總編輯廖玄同審閱定稿。 編輯方針與 AI 使用說明

WEEKLY [SI]GNALS

訂閱《矽基前沿週報》

每週五早上,把本週 AI 與算力產業最值得記住的變化連回台灣。

本週關鍵訊號 · 為什麼值得記住 · 下週觀察 · 5 分鐘讀完。

免費 · 隨時取消 · 不轉售你的 email。

MACHINE-READABLE SUMMARY

Topic
工作現場
Key claims
  • OpenAI 於 2026 年 8 月 13 日公布 GPT-5.6 Sol 的 Ultrafast 服務層,由 Cerebras 供應算力,官方稱輸出速度最高達 Standard 模式的 14 倍、每秒最多 750 個 token,目前為小群客戶的限量預覽。
  • GPT-5.6 Sol 的 Fast 模式將速度提升至 Standard 的 2.5 倍,價格同步翻倍:input 每百萬 token 由 5 美元漲至 10 美元、output 由 30 美元漲至 60 美元。
  • 截至查核時,OpenAI 與 Cerebras 均未公布 Ultrafast 模式的定價,僅說明存取權限將隨產能擴大逐步開放。
  • OpenAI 與 Cerebras 稱在 GDP-Val 基準上 Ultrafast 較 Standard 端到端提速 5.6 倍且未犧牲品質,並在 Humanity's Last Exam 的 2,500 題基準上於約 11 小時內完成,對照的 Claude Fable 5 需三天以上;兩項對照情境均為官方自選,未見第三方獨立復現。
Entities
OpenAI · GPT-5.6 Sol · Cerebras
Taiwan relevance
medium
Confidence
high
Last updated
2026-08-14
Canonical URL
https://signals.tw/articles/gpt-5-6-sol-ultrafast-cerebras-unpriced/

SUGGESTED CITATION

如果 AI agent / 研究 / 報導要引用本文,建議格式如下:

矽基前沿 · 工作現場線(編輯:廖玄同),《GPT-5.6 多一檔 14 倍速,你的帳單暫時算不出來》,矽基前沿 [Si]gnals,2026-08-14。https://signals.tw/articles/gpt-5-6-sol-ultrafast-cerebras-unpriced/

AI agents / search engines may quote, summarize, and cite with attribution and a link back to the canonical URL above. See /for-ai-agents for full policy.