
Claude 沒有拒答你,它把問題丟給了另一個模型
生物題的誤判少了八成五,但四個介面差到十倍。
你問 Claude 一個跟生物有關的問題,拿到一個明顯比較弱的答案,你以為是模型今天狀況不好。實際上,答你的已經不是同一個模型。
Anthropic 8 月 7 日調整了 Claude Fable 5 的生物安全防護,官方說法是生物相關的 fallback 少了大約 85%。fallback 在這裡不是拒答——官方寫得很清楚,分類器一觸發,模型把使用者的請求改道給 Opus 5,一個沒有 Fable 5 那種生物能力水準的模型。你拿到的是答案,只是換人答的。
真正該看的是後面那四個數字。官方說這次調整之後,fallback 總量預期會減少:claude.ai 約 67%、Cowork 55%、Claude Code 17%、Claude Platform 7%。同一次調整,最上面跟最下面差了將近十倍。
我把這四個數字除回去(各介面總降幅 ÷ 85%,我自己算的,非官方數字):生物誤判原本佔 claude.ai 全部 fallback 的約八成、Cowork 約三分之二、Claude Code 約兩成、Claude Platform 不到一成。
這組比例講的是官方沒有明講的一件事:同一個模型,在四個介面上被攔下來的理由根本不是同一批。 在網頁上跟 Claude 講話的人,大部分被攔是因為問了症狀、檢驗報告、生物課的東西——一般人的日常問題。API 那一側被攔的,九成以上是別的類別。官方文件目前列了五個分類:cyber、bio、frontier_llm、reasoning_extraction、general_harms。
所以這則公告對你的意義,取決於你從哪裡呼叫。產品跑在 Claude Platform 上的,今天這個 85% 幾乎不會反映在你的錯誤率上,你的 fallback 大多不姓生物。在 claude.ai 或 Cowork 裡工作、尤其做醫療與生技內容的,這是今天就有感的鬆綁。
API 側還有一個差別值得知道:那裡的改道不是自動的。文件寫明分類器擋下來時,Messages API 回的是一個正常回應,stop_reason 是 refusal、content 是空的,而且沒有產出就不收費。要它自動改走別的模型,你得自己設 fallbacks 參數並帶 beta 標頭,目前還在 beta。開了之後你查得到誰答的——回應的 model 欄位會寫,usage.iterations 裡會有一筆 fallback_message。但那張「哪個類別改道去哪個模型」的路由表,官方明說不對外公布。
這條線本站追過一次。Fable 5 六月上線那時,改道的目的地還是 Opus 4.8;Opus 5 七月接手之後換成它。規則沒公布,目的地卻已經換過一輪。
今天沒放寬的部分官方也講了:病毒學、毒理學、分子設計這三類仍然一律改道 Opus 5,Fable 還不能拿來做專業生物研究與藥物開發;給經審核研究者的信任存取管道正在做。
下次再看到哪一家宣布「我們把誤判降低了 X%」,先去找它的分母。Anthropic 這次難得把四個分母都給了,而那四個數字比 85% 這個頭條有用得多。
查核備註:數字全部出自 Anthropic 8 月 7 日的官方公告,屬官方自報、無第三方驗證。「生物誤判佔各介面 fallback 幾成」那一組是我自己除的,前提是 85% 的降幅在四個介面一致,官方沒說是不是。使用者在產品介面上被改道時看不看得到提示,官方公告沒寫,我也沒查到。
SOURCES
- AImproving Fable 5's biology safeguards — Anthropic
- ARefusals and fallback — Claude Platform Docs
- AClaude Platform release notes
來源分級:A = 一手公告/論文/官方文件 · B = 可信媒體 · C = 可參考但需脈絡 · D = 觀察用,不可當事實。
本文由 AI 與編輯共同撰寫,總編輯廖玄同審閱定稿。 編輯方針與 AI 使用說明

