AGENT TRACKER

Agent 又更新

AI 工具的價格、額度和服務條款一直在變,而且常常不會先問你。這裡持續追蹤最重要的幾個—— 每個工具一張現況卡、一條異動時間軸,每筆都有查核日和來源。

CHANGELOG

最新異動

只想追你在用的工具?點下面的標籤篩選。

完整登記簿
  1. 政策Claude Code

    Claude Code 收回代理人的預設放行:巢狀 subagent 改為預設關閉、同時併發封頂 20

    官方文件現在寫明,subagent 預設不能再生出自己的 subagent——巢狀關閉時 Claude Code 會把 `Agent` 工具從所有 subagent 手上收走(fork 例外,但呼叫會回錯誤),要開得自己把 `CLAUDE_CODE_MAX_SUBAGENT_SPAWN_DEPTH` 設成想要的層數。這是預設值的反轉:文件註明 v2.1.172 到 v2.1.216 之間 subagent 預設可巢狀、最深五層且不能調。同時新增併發上限, 一個 session 同時跑 20 個 subagent 後再開會拿到 `Concurrent subagent limit reached`, 以 `CLAUDE_CODE_MAX_CONCURRENT_SUBAGENTS` 調整、ultracode session 不受此限(需 v2.1.217 以上); 另有每 session 最多 200 個 subagent 的總量上限(需 v2.1.212 以上)。受影響的是靠 subagent 自行 fan-out 的多代理人設定——升級後同一套腳本會少一層委派、或在第 21 個併發卡住。

  2. 政策Claude Code

    Anthropic 反轉 Claude Code 的脈絡建議:系統提示砍掉逾八成,CLAUDE.md 改成只寫坑

    官方發文(作者 Thariq Shihipar,與 Claude Opus 5 同日)表示團隊把 Claude Code 的系統提示 為 Claude Opus 5、Claude Fable 5 等模型移除超過八成,官方稱自家 coding evaluations 沒有可測量 的退步,並自承先前在系統提示、CLAUDE.md 與 skills 三處都過度約束。建議隨之反轉六項:規則改成 讓模型自行判斷、工具用法範例改成把介面設計清楚、上游一次塞滿改成漸進揭露(部分工具改為 deferred loading,需先用 ToolSearch 取定義)、重複交代改成精簡的工具描述、CLAUDE.md 記憶 改交給自動記憶、簡單規格改用測試套件與程式碼樣本等豐富參照。CLAUDE.md 的新原則是保持輕量、 大部分篇幅留給 codebase 裡的 gotchas。受影響的是所有維護 CLAUDE.md、skills 與工具描述的團隊; 官方建議用 `/doctor` 檢查修剪(該檢查自 v2.1.206 起提供,措辭為提出建議而非自動刪除)。 八成與「無可測量退步」皆為官方自報自評,評測題目與分數未公開,亦無第三方複現;結論僅限 Claude 5 世代模型。

  3. 功能Codex CLI

    Codex 桌面版接上語音:用講的跨 Chat/Work/Codex 交辦,iOS Remote 也能用

    OpenAI 官方 changelog(2026-07-23、版本 26.715)把 GPT-Live 驅動的語音帶進桌面版, 可以開語音 session 並跨 Chat、Work、Codex 三邊指派工作;適用 Plus、Pro、Business、Edu、 Enterprise,管道為桌面版與 iOS Remote。同版本的 local projects 開始支援多個相關資料夾, 分主要/次要資料夾決定操作與檔案存取範圍。影響範圍是既有訂閱者的操作介面,未見價格或額度變動。

  4. 方案Cursor

    Cursor Auto 拆成三檔:只有 Auto Cost 還是固定費率,另兩檔照被路由到的模型原價計費

    Cursor 官方 changelog(2026-07-22)記載 Auto 模式改由新的 Cursor Router 驅動,並拆成 Cost、Balance、Intelligence 三種最佳化模式。計費規則跟著分岔:官方文件寫 Auto Cost 採固定 費率(每百萬 token 輸入 1.25 美元、快取寫入 1.25 美元、快取讀取 0.25 美元、輸出 6 美元, 不論實際用哪個模型),官方 changelog 則寫 Balance 與 Intelligence「照被路由到的模型原價 計費」;直接選第三方模型或這兩檔路由到第三方模型時,Teams 與 Enterprise 須另計每百萬 token 0.25 美元的 Cursor Token Rate,Auto Cost 與第一方模型(Composer 2.5、Grok 4.5)免計。 Router 在 Teams 預設開啟、Enterprise 由管理後台啟用;管理員可限制可選模式與模型 allow/ block 清單,官方註明 Grok 4.5 是必要的省成本路由選項。影響範圍:把活丟給 Auto 的個人與團隊, 帳單從單一固定費率變成三種算法。

  5. 功能Claude Cowork(Claude for Mac)

    Claude Cowork 新增「Record a skill」:錄一段螢幕操作+旁白就能建 skill,限 Mac 的 Pro/Max/Team

    Anthropic 在 2026 年 7 月 21 日為 Claude for Mac 的 Cowork 加入「Record a skill」:使用者打開錄影、 把工作做一遍並以語音旁白說明,Claude 會擷取螢幕操作加旁白,合成為結構化、可重播的 skill,取代原本 必須把流程寫成文件的建立方式。開啟路徑有兩條——composer 的 `+` 按鈕選「Record a skill」,或走 Customize > Skills > Add > Record your screen;要保留旁白需維持麥克風開啟,單段錄影上限約 10 分鐘。 可用範圍:僅限 Claude for Mac 的 Cowork,且僅 Pro、Max、Team 三個方案,chat 介面、Windows、Free 與 Enterprise 皆沒有。邊界:本站未實機錄製測試,不主張合成品質或省時幅度;錄出的 skill 能否手動編輯、 是否計入用量額度、能否跨團隊分享,官方文件未說明。釋出日由多家媒體同日報導交叉確認,官方頁面未標日期。

  6. 功能Codex CLI

    Codex CLI 0.145.0:終端機開始收音訊、可跑在 Amazon Bedrock 上,還能直接匯入 Claude Code 設定

    OpenAI 官方 changelog 記載 Codex CLI 0.145.0(2026-07-21)三項會改到工作流程的更動: 加入音訊輸入與 realtime V3 串流對話;支援 Amazon Bedrock、預設模型為 GPT-5.6 Sol; 匯入遷移擴大到 Cursor 與 Claude Code 的設定、MCP server 與專案記憶。同版另有可搜尋的分頁 thread 歷史、multi-agent V2 穩定化與終端機漸進渲染。影響範圍:走 Bedrock 的團隊多一條計費與 部署路徑,從 Cursor/Claude Code 搬家的人少一輪手動重設;官方未公布額度或價格調整。

  7. 價格Gemini API(Gemini 3.6 Flash)

    Gemini 3.6 Flash 上線,輸出每百萬 token 從 9 美元降到 7.50 美元——輸入價不變

    Google 於 2026 年 7 月 21 日同日推出 Gemini 3.6 Flash、3.5 Flash-Lite 與限量的 3.5 Flash Cyber。 3.6 Flash(model ID `gemini-3.6-flash`)官方牌價為輸入 1.50 美元、輸出 7.50 美元(每百萬 token), 前一代 3.5 Flash 為 1.50/9.00 美元——輸入價相同,只有輸出價降約 16.7%;Batch 亦從 4.50 降到 3.75 美元。 Google 另稱依 Artificial Analysis Index,新模型完成同樣任務的輸出 token 用量少 17%。知識截止從 2025 年 1 月推進到 2026 年 3 月。邊界:−17% 為 Google 引用第三方指數的自陳結果,非本站或第三方對讀者實際負載的實測; 兩項折扣疊乘只作用於輸出側,總帳單降幅取決於各自的輸入輸出比。

  8. 政策Gemini API

    Gemini API 棄用 temperature/top_p/top_k:現在被忽略,未來世代回 HTTP 400

    Google 於 2026 年 7 月 21 日在 Gemini API release notes 宣告取樣參數 `temperature`、`top_p`、 `top_k` 棄用。官方「Using the latest Gemini models」文件寫明目前的行為是 deprecated **and ignored**——送出不會報錯,參數直接被忽略;要到未來的模型世代才會「returns an HTTP 400 error」。 適用範圍自 Gemini 3.6 Flash 與 3.5 Flash-Lite 起,並涵蓋所有未來發布的 Gemini 模型。官方建議改以 system instruction 寫明輸出規則。同一份文件另列三項變更:請求最後一則為非空 model role 現在即回 400;數值型 `thinking_budget` 改為字串列舉 `thinking_level`(minimal/medium/high,3.6 Flash 預設 medium、3.5 Flash-Lite 預設 minimal);`candidate_count` 在 Gemini 3.x 不再支援。邊界:官方未說明 移除原因,也未說明既有舊模型是否仍支援;「未來世代」無版本或日期;`candidate_count` 只寫 unsupported,未定義行為;本站未實際呼叫 API 驗證忽略行為。

  9. 模型Gemini 3.5 Pro

    Google 旗艦 Gemini 3.5 Pro 延遲數月未上線——據 Bloomberg 卡在寫程式(coding)

    Google 在 2026 年 5 月 I/O 發表 Gemini 3.5 系列並稱 Pro 版六月推出;到七月中仍無上線日期,遲約兩個月。 據 Bloomberg,主因是 coding 表現未達內部標準——六月底更新訓練資料想補強、結果「令人失望」。Google 發言人 證實正與夥伴測試 3.5 Pro、一個升級版 Flash 與其他模型,但未給日期。目前 3.5 系列只有 Flash 可用,旗艦位 仍由 2 月的 Gemini 3.1 Pro 頂著。邊界:延遲主因為 Bloomberg 引匿名消息人士,非 Google 官方措辭;本站未取得 Bloomberg 原文連結,以 9to5Google、Search Engine Journal 含具名 Google 回應的轉述交叉。

  10. 政策Codex CLI

    Codex CLI 0.144.5 收緊 `rm` 危險指令偵測——full access 未開沙箱時模型會刪掉 $HOME

    Codex 負責人 Thibault Sottiaux 認帳:full access 開啟、且未啟用沙箱保護(含未開 auto review)時,模型嘗試覆寫 $HOME 環境變數以建立暫存目錄,結果刪除 $HOME 本身;至少三名具名使用者回報資料遭刪(Matt Shumer 的 Mac 家目錄、Bruno Lemos 的正式資料庫、Joey Kudish 的部分檔案)。官方修補 Codex CLI 0.144.5(2026-07-16)改版說明為「Improved dangerous-command detection for `rm` forms」;同期 0.144.2(7/13)「Restored Guardian auto-review policy」、桌面版 26.707(7/9)加入 full access 與 Ultra 併用的警告對話框。邊界註記:觸發條件是使用者自行關閉沙箱保護,非預設狀態;GPT-5.6 的 system card 在出貨前即把破壞性刪除記為 severity level 3,OpenAI 稱此類行為 should be rare,完整 post-mortem 至本文發稿為止尚未發布。

  11. 模型Kimi

    Moonshot 發布旗艦 Kimi K3,定價每百萬 token 輸入 3 美元、輸出 15 美元

    Kimi K3(2.8 兆參數、100 萬 token 脈絡窗)上架 Kimi.com、Kimi Work、Kimi Code 與 Kimi API,定價為輸入 3.00 美元、快取命中 0.30 美元、輸出 15.00 美元,且全脈絡窗單一費率。邊界註記:這不是調價——前代 K2.6(公開定價 0.95/4 美元)仍在架上、價格未動,K3 是新增的旗艦價格帶。完整權重預計 2026-07-27 前釋出,授權條款官方尚未公布。

  12. 方案Gemini Notebook

    NotebookLM 改名 Gemini Notebook,新增的程式碼執行按方案分層開放

    Google 於 2026-07-16 把 NotebookLM 改名為 Gemini Notebook(官方稱逾 3,000 萬人、60 萬組織在用),同時新增原生寫並執行程式碼的能力,用於分析使用者自己上傳的來源。該能力先開給 Google AI Ultra 使用者,以及具 AI Ultra Access 或 AI Expanded Access 的 Workspace 商業客戶,官方稱未來幾週推給網頁版 Pro 使用者;免費帳號官方未提及、亦未給時程。邊界註記:這不是停服或併入 Gemini 聊天機器人——官方明說維持獨立產品,且有自動轉址確保既有分享筆記本與連結繼續可用,管理員無需動作。改名推送為 Extended rollout,官方稱可能超過 15 天才會看到新名稱與 logo。

  13. 模型Inkling

    Thinking Machines 發布開放權重模型 Inkling,Apache-2.0、權重當天上 Hugging Face

    Inkling(9,750 億總參數、每個 token 啟用 410 億的 MoE,原生支援文字/圖像/音訊輸入,開放權重版脈絡窗 100 萬 token)以 Apache-2.0 授權釋出,權重與 NVFP4 checkpoint 發布當天即上架 Hugging Face,可商用、可改、無使用者數量門檻。邊界註記:官方公告自己寫明「Inkling is not the strongest overall model available today, open or closed」,定位是給人微調的底座而非最強模型;同步推出的 Tinker 微調平台(64K/256K 脈絡、限時五折)才是付費面。較小的 Inkling-Small(2,760 億/120 億啟用)仍在測試,權重尚未釋出。

  14. Copilot in 30:25 人、30 天的 Copilot Business 試用,8/1 起經銷通路開賣

    微軟推出 Copilot in 30,給 300 人以下企業的 25 人 30 天 Microsoft 365 Copilot Business 試用,搭配導入指引與成效評估素材。2026-08-01 起在 CSP 新商務通路開放,只能透過經銷夥伴取得,微軟官網直購沒有這條路。

WEEKLY [SI]GNALS

訂閱《矽基前沿週報》

每週五早上,把本週 AI 與算力產業最值得記住的變化連回台灣。

本週關鍵訊號 · 為什麼值得記住 · 下週觀察 · 5 分鐘讀完。

免費 · 隨時取消 · 不轉售你的 email。