矽基前沿週報 #006:你的 Claude 從來沒有住在你的機器上
矽基前沿週報 #006:本週最重要的五件事。Anthropic 8 月 30 日起通知部分用戶,竊密惡意程式偷走已登入的 Claude 工作階段、有人拿著它燒你的額度;同一週 Compliance API 的工作階段端點移出 beta,合規人員調得出你在自己筆電上跑的對話逐字稿。帳單兩頭走:Claude Code 週上限 9 月 14 日起比現在少 17%,Fable 5.1 的快取讀取砍到四分之一。GPT-6 Astra 9 月 3 日上線,一次焊死四個旋鈕、輸出價 2.5 倍;OpenAI 同時把「你衝太快」與「他忙不過來」拆成兩種錯誤。生意線拆按觀看付費的剪片買量,同一門生意裡的 CPM 差三十倍。
這週最該處理的一件事,是有人可能正拿著你的登入在用你的帳號。Anthropic 8 月 30 日起寄信給一部分用戶:電腦上的竊密惡意程式偷走了已經登入的 Claude 工作階段,Windows 上點名 Vidar、Lumma、StealC 等五支,macOS 上是 Atomic Stealer。被偷走的不是密碼,是「你已經通過驗證」這件事本身——所以改密碼沒有用,兩階段驗證跟單一登入也擋不住,攻擊者根本不用走登入那一段。Anthropic 替受影響的人做了三件事,其中「移除帳號上已儲存的付款方式」那一件最說明它在防什麼。
官方給的自我診斷很具體:額度看起來補滿了,卻在你沒開 Claude 的時候掉光。真正切得斷的動作只有一個,就是到 claude.ai 的設定→帳號按「登出所有工作階段」,用 Claude Code 的另外到設定→Claude Code 刪掉授權 token。但順序不能反——機器沒清乾淨就登回去,等於再送對方一份。
同一週還有一則,方向完全不同,講的卻是同一格。Anthropic 8 月 26 日把 Compliance API 的工作階段端點對 Claude Code 與 Cowork 移出 beta:Claude Enterprise 組織的合規人員可以把你在自己筆電上跑的對話逐字稿整段調出來,提示詞、Claude 的回覆、工具呼叫與工具結果的文字,包括被讀進上下文的檔案內容與 CLAUDE.md。思考區塊、系統提示詞、圖片與花費不在裡面。機制上它不是裝在你機器上的監控軟體,是伺服器端記下你的用戶端本來就會送出去的請求。
把這兩件擺在一起,是這週最重要的一句話:你的 Claude 從來沒有住在你的機器上。 額度算在哪裡、對話留在哪裡,判定的那一端都在伺服器。我不覺得這是壞消息,但它會改變你排優先順序的方式——本機的防護保護的是本機,而你的工作階段跟逐字稿不在那裡。
帳單這週兩頭走
會扣你的那一頭:Anthropic 8 月 29 日宣布,9 月 14 日起 Claude Code 的標準週上限永久調高 25%,同一天把 5 月開跑的臨時 50% 加碼撤掉。舊標準當 100,你今天手上是 150,9 月 14 日起是 125。「永久加 25%」跟「比現在少 17%」是同一件事,只是起算點不同,17% 那個數字官方自己也寫了。我要做的很單純:把排長任務時心裡那格額度從 150 改成 125,然後在 14 號之前盤一次,看哪些流程其實是靠多出來的那 25 點在撐。
省下來的那一頭:Anthropic 9 月 1 日發布 Claude Fable 5.1 與 Mythos 5.1,輸入輸出價都沒動,動的是快取讀取——每百萬 token 從 1 美元降到 0.25 美元,等於基礎輸入價的 0.025 倍,其他所有 Claude 模型仍是 0.1 倍。官方稱典型工作負載能省約 25%、高度代理式的最多約 45%,但沒說那個估計是拿什麼工作負載算出來的。對每天在跑代理迴圈的人,真正要改的是成本模型裡那個寫死的「快取讀取=十分之一」。
這兩則都預設你算得出自己現在花多少。多數人算不出來,而且問題往往不在算術在名詞——點數制計費的那些點數什麼時候會不見,我這週把它單獨寫成了一頁。
OpenAI 這週一次焊死四個旋鈕
GPT-6 Astra 9 月 3 日上線:105 萬 token 上下文,輸入每百萬 10 美元、輸出 50 美元。官方遷移指南要你刪掉 temperature、top_p、top_logprobs,走 Chat Completions 的話 logprobs 也一起刪;reasoning.effort 只吃 low 到 max 五格,設成 none 直接回 HTTP 400——而 none 在同一份官方指南裡的用途,正是「對延遲敏感、不需要推理」的那條又快又便宜的路。工具呼叫則必須走 Responses API。
我的讀法:這是一顆刻意不給你調的模型。換來的是行為一致,代價是四種便宜的實驗手段一次消失,而它的輸出價是 GPT-5.6 Sol 的 2.5 倍。換之前先把「我為什麼需要這顆」寫得出來,寫不出來就先別動。
前一天還有一則小的,但它決定你的重試碼寫得對不對。OpenAI 9 月 2 日把 429 加 slow_down 跟 503 加 server_is_overloaded 分成兩件事:一個是你衝太快,一個是他忙不過來,以前在你的重試碼裡長得一樣。文件裡更該抄下來的是那句「你還沒撞到每分鐘請求數與 token 上限也可能收到 slow_down」——它看的是你增加得多快,不是你用掉多少。官方給的節奏是流量過每分鐘一百萬輸入 token 之後,每 15 分鐘增加不要超過 50%。Anthropic 早就是同一套分法,只是門牌不一樣,過載在它那邊是 529。
生意線:同一個字,四個數字
這週我把按觀看付費的剪片買量拆了一遍,結論卡在 CPM 這三個字母上。9 月 4 日我在一家平台的公開活動看板讀到前二十檔活動的創作者費率,換算後是每千次觀看 1 到 2.5 美元;同一家給品牌看的頁面自報 blended CPM 0.03 美元。三十倍的差距不是誰在騙人,是分母不一樣——品牌那個均價把「預算花完之後內容繼續累積的觀看」也算了進去,那些觀看沒有按件付錢給任何人。
更底層的一格在「觀看」本身。YouTube 官方說明頁寫著,2025 年 3 月 31 日起 Shorts 的觀看次數改成開始播放或重播就算、沒有最低秒數門檻,舊的那個定義改名叫參與觀看次數(Engaged views);而合作夥伴計畫資格與 Shorts 廣告分潤,用的是後面那個小的。你在活動頁上看到的觀看數,跟平台拿來付你錢的觀看數,可以是兩個欄位。
同一種毛病這週也長在別的地方——「終身方案」的終身,條款裡只算到它關站那天。看到聽起來很篤定的名詞,先問口徑再問數字,這是我今年重複最多次的一句話。
最後一格:你的代理讀到的東西,可能是兩天前的
我這週把代理查資料那條鏈的四層官方文件從頭讀了一遍,只問兩題——這一層自己抓不抓、它回給我的東西放多久了。答案是快取多半是預設值而不是選項:Firecrawl 的預設新鮮度是兩天,而且快取命中照樣扣 1 點,官方自己寫明快取改善的是速度不是點數;Anthropic 的 web fetch 官方也明寫回傳內容不一定反映最新版本,要新鮮的得把 use_cache 設成 false。
讀完我只改了一件事:把「這件事需要多新」寫進工具設定,不留給預設值。查價格、查條款、查今天發生的事,強制繞過快取;查定義、查規格、查歷史,吃快取沒關係,還比較快。這週前面那幾則的共通點其實也在這裡——出問題的很少是模型,多半是某個你沒去看的預設值。
查核備註:本期各段數字與引語的完整來源標記在各篇原文的查核備註,本刊未在原文之外做額外查證。竊密程式那則的家族清單與三項處置轉引自資安媒體、Anthropic 未發公開公告頁,受影響帳號數官方沒說。Claude Code 週上限的公告原文在 X 上,我打不開,數字轉引自二手報導。剪片買量的費率是我在單一平台當日看板讀到的公開數字,不是全市場行情。本期選材只取自本站本週已發布的文章,我這週沒有另做站外新聞掃描,因此不敢說「這就是本週全部的大事」。