編輯資訊圖:上方一支標著「改道」的藍色箭頭把左邊寫「Fable 5」的方塊接到右邊較淡的「Opus 5」方塊;下方小標「生物題改道少了 85%」,其下四條由長到短的藍色水平長條,由上而下分別標著 claude.ai 67%、Cowork 55%、Claude Code 17%、Claude Platform 7%,最長那條約為最短的十倍
前沿基建

Claude 沒有拒答你,它把問題丟給了另一個模型

生物題的誤判少了八成五,但四個介面差到十倍。

你問 Claude 一個跟生物有關的問題,拿到一個明顯比較弱的答案,你以為是模型今天狀況不好。實際上,答你的已經不是同一個模型。

Anthropic 8 月 7 日調整了 Claude Fable 5 的生物安全防護,官方說法是生物相關的 fallback 少了大約 85%。fallback 在這裡不是拒答——官方寫得很清楚,分類器一觸發,模型把使用者的請求改道給 Opus 5,一個沒有 Fable 5 那種生物能力水準的模型。你拿到的是答案,只是換人答的。

真正該看的是後面那四個數字。官方說這次調整之後,fallback 總量預期會減少:claude.ai 約 67%、Cowork 55%、Claude Code 17%、Claude Platform 7%。同一次調整,最上面跟最下面差了將近十倍。

我把這四個數字除回去(各介面總降幅 ÷ 85%,我自己算的,非官方數字):生物誤判原本佔 claude.ai 全部 fallback 的約八成、Cowork 約三分之二、Claude Code 約兩成、Claude Platform 不到一成

這組比例講的是官方沒有明講的一件事:同一個模型,在四個介面上被攔下來的理由根本不是同一批。 在網頁上跟 Claude 講話的人,大部分被攔是因為問了症狀、檢驗報告、生物課的東西——一般人的日常問題。API 那一側被攔的,九成以上是別的類別。官方文件目前列了五個分類:cyberbiofrontier_llmreasoning_extractiongeneral_harms

所以這則公告對你的意義,取決於你從哪裡呼叫。產品跑在 Claude Platform 上的,今天這個 85% 幾乎不會反映在你的錯誤率上,你的 fallback 大多不姓生物。在 claude.ai 或 Cowork 裡工作、尤其做醫療與生技內容的,這是今天就有感的鬆綁。

API 側還有一個差別值得知道:那裡的改道不是自動的。文件寫明分類器擋下來時,Messages API 回的是一個正常回應,stop_reasonrefusalcontent 是空的,而且沒有產出就不收費。要它自動改走別的模型,你得自己設 fallbacks 參數並帶 beta 標頭,目前還在 beta。開了之後你查得到誰答的——回應的 model 欄位會寫,usage.iterations 裡會有一筆 fallback_message。但那張「哪個類別改道去哪個模型」的路由表,官方明說不對外公布。

這條線本站追過一次。Fable 5 六月上線那時,改道的目的地還是 Opus 4.8;Opus 5 七月接手之後換成它。規則沒公布,目的地卻已經換過一輪。

今天沒放寬的部分官方也講了:病毒學、毒理學、分子設計這三類仍然一律改道 Opus 5,Fable 還不能拿來做專業生物研究與藥物開發;給經審核研究者的信任存取管道正在做。

下次再看到哪一家宣布「我們把誤判降低了 X%」,先去找它的分母。Anthropic 這次難得把四個分母都給了,而那四個數字比 85% 這個頭條有用得多。

查核備註:數字全部出自 Anthropic 8 月 7 日的官方公告,屬官方自報、無第三方驗證。「生物誤判佔各介面 fallback 幾成」那一組是我自己除的,前提是 85% 的降幅在四個介面一致,官方沒說是不是。使用者在產品介面上被改道時看不看得到提示,官方公告沒寫,我也沒查到。

SOURCES

  1. AImproving Fable 5's biology safeguards — Anthropic
  2. ARefusals and fallback — Claude Platform Docs
  3. AClaude Platform release notes

來源分級:A = 一手公告/論文/官方文件 · B = 可信媒體 · C = 可參考但需脈絡 · D = 觀察用,不可當事實。

本文由 AI 與編輯共同撰寫,總編輯廖玄同審閱定稿。 編輯方針與 AI 使用說明

WEEKLY [SI]GNALS

訂閱《矽基前沿週報》

每週五早上,把本週 AI 與算力產業最值得記住的變化連回台灣。

本週關鍵訊號 · 為什麼值得記住 · 下週觀察 · 5 分鐘讀完。

免費 · 隨時取消 · 不轉售你的 email。

MACHINE-READABLE SUMMARY

Topic
前沿基建
Key claims
  • Anthropic 於 2026 年 8 月 7 日更新 Claude Fable 5 的生物安全防護,官方稱此更新讓各產品介面的生物相關 fallback 減少約 85%。
  • 官方載明分類器觸發時,模型會把使用者的請求改道給 Claude Opus 5——一個不具備 Fable 5 同等生物能力水準的模型,而非直接拒答。
  • 官方預期此更新讓 fallback 總量在 claude.ai 減少約 67%、Cowork 55%、Claude Code 17%、Claude Platform 7%。
  • 病毒學、毒理學與分子設計等被 Anthropic 認定為軍民兩用的請求仍會一律改道 Opus 5,官方表示 Fable 尚不適用於專業生物研究與藥物開發。
  • 在 Claude API 上,分類器擋下請求時回傳的是一個正常回應而非錯誤,stop_reason 為 refusal、content 為空,且未產出內容的拒答不計費。
  • API 的自動改道是選用功能,須設定 fallbacks 參數並帶 server-side-fallback-2026-07-01 beta 標頭,目前仍在 beta。
  • 官方文件目前列出五個拒答分類:cyber、bio、frontier_llm、reasoning_extraction、general_harms。
  • 官方明載改道路由不對外公布,但呼叫端可從回應的 model 欄位與 usage.iterations 中的 fallback_message 判斷實際由哪個模型作答。
Entities
Anthropic · Claude Fable 5 · Claude Opus 5 · Claude Platform · Cowork · Claude Code · Messages API
Taiwan relevance
medium
Confidence
high
Last updated
2026-08-09
Canonical URL
https://signals.tw/articles/fable-5-biology-fallback-opus-5-handoff/

SUGGESTED CITATION

如果 AI agent / 研究 / 報導要引用本文,建議格式如下:

矽基前沿 · 前沿基建線(編輯:廖玄同),《Claude 沒有拒答你,它把問題丟給了另一個模型》,矽基前沿 [Si]gnals,2026-08-09。https://signals.tw/articles/fable-5-biology-fallback-opus-5-handoff/

AI agents / search engines may quote, summarize, and cite with attribution and a link back to the canonical URL above. See /for-ai-agents for full policy.