
Sol 5.6 降價!帳單砍到五分之一
便宜那一檔降八成,旗艦一毛沒動。
如果你的產線上有一批「不必動用旗艦模型」的雜活——分類、抽欄位、批次改寫——這幾天它的成本結構變了。
7 月 30 日起,OpenAI 把 GPT-5.6 Luna 的 API(應用程式介面)價格砍掉八成:每百萬 token 的輸入/輸出,從 1/6 美元降到 0.2/1.2 美元。中間那一檔 Terra 降兩成,2.5/15 變成 2/12。旗艦 Sol 維持 5/30,一毛沒動。
值得記一筆的不是幅度,是官方給的理由。OpenAI 稱這批效率有一部分是模型自己做出來的:在人類主導的流程裡,GPT-5.6 Sol 改寫並優化了自家生產環境的 GPU kernel(顯示卡上實際跑矩陣運算的那層核心程式)、設計並執行數百次改善 token 生成的實驗,還在訓練過程出狀況時介入。官方說這讓端到端的服務成本降低 20%、token 生成效率提升超過 15%。
這是官方自報,沒有第三方驗證,站在外面的人也量不到那 20%。但如果數字成立,這是「AI 去改善跑 AI 的那套基礎設施」第一次直接落到你付的單價上。
同一份更新還有一個反方向的動作:Sol 不但沒降,還多了一個取代 Priority Processing 的 Fast mode,官方稱最快 2.5 倍、價格是標準處理的兩倍。便宜那一端崩價、貴那一端加價——價格帶是被拉開,不是整條往下移。
今天可以做的事:翻 log,看有多少呼叫跑在 Sol 上、但難度只需要 Luna。動手之前先記得七月初那一集的教訓——單價降不等於帳單降,斷詞方式或思考長度一變,同一段話的 token 數就跟著變。已經替 token 支出裝了上限的團隊,換檔前拿一週真實流量跑一次對照再決定。
本篇是對 OpenAI 官方公告與業界媒體報導的文件檢視,我們沒有重跑自己的帳單。
SOURCES
- AAdvancing the price-performance frontier with GPT-5.6(官方公告,Terra/Luna 新價與效率來源說明)
- BOpenAI drops GPT-5.6 Luna and Terra API prices by up to 80%(新舊價格對照、Sol 未調整)
- BOpenAI cuts GPT-5.6 API prices & adds faster Sol mode(Fast mode 取代 Priority Processing、kernel 改寫與 20%/15% 數字)
來源分級:A = 一手公告/論文/官方文件 · B = 可信媒體 · C = 可參考但需脈絡 · D = 觀察用,不可當事實。
本文由 AI 與編輯共同撰寫,總編輯廖玄同審閱定稿。 編輯方針與 AI 使用說明


