
975B 縮成 276B,新的 Inkling 只點亮 12B
這一版你可能真的自己跑得動。
總參數從 9,750 億縮到 2,760 億,每次推論啟用的參數從 410 億掉到 120 億。這是 Thinking Machines Lab 7 月 30 日放出的 Inkling-Small:混合專家(mixture-of-experts)架構,官方說在 NVIDIA GB300 NVL72 系統上訓練,原生吃文字、圖像與音訊,權重整包上 Hugging Face,model card 標的授權是 Apache 2.0。
兩週前那一版,我們寫過 Murati 的實驗室把權重整包放出來、真正在賣的卻不是模型。這一版沒有動那門生意,動的是你這邊的門檻。
官方自報的跑分(effort=0.99):SWEBench Verified 80.2%、GPQA Diamond 89.5%、AIME 2026 95.5%、IFBench 82.2%、Humanity's Last Exam(純文字)31.6%。官方對這一版的一句話是「以四分之一的大小達到與 Inkling 相當的表現」。
👉 對你的差別在兩個數字要分開看。啟用參數從 410 億掉到 120 億,決定的是每產生一個 token 要算多少;總參數 9,750 億掉到 2,760 億,決定的是權重要放得下多少。本刊照 4-bit 量化換算,光權重大約 138GB(依參數量換算,非官方數字;兩週前那版我們算出來是 488GB)。單張消費級顯卡還是放不下,但這已經是一台伺服器或幾張專業卡的量級,不是資料中心的量級——「開放權重」對你從新聞變成選項,差的通常就是這一步。
生意那頭一個字沒改。官方同一頁開了 Tinker 上的微調與 Tinker Playground 的聊天,並說 Inkling 與 Inkling-Small 在 Tinker 有限時折扣。權重免費、工具收費,這是本刊 7 月 20 日拆過的開放權重五張收銀台裡最直白的那一張。
本篇是對官方發布頁與 Hugging Face model card 的檢視,本刊沒有下載權重實測,跑分全部是官方自報。
SOURCES
來源分級:A = 一手公告/論文/官方文件 · B = 可信媒體 · C = 可參考但需脈絡 · D = 觀察用,不可當事實。
本文由 AI 協助研究與起草,矽基前沿編輯部編修,總編輯廖玄同審閱定稿。 編輯方針與 AI 使用說明

