編輯資訊圖:由左至右的流程線,左邊一張標著「員工的提示詞」的紙條,中間一台藍色描邊的伺服器機箱標著「你的資安伺服器」、上方碼錶寫「5 秒內回覆」,機箱分出兩支箭頭,向上標「放行」通往右邊寫著「Claude」的方塊、向下標「擋下」進入死路;下方一條細虛線從紙條繞過伺服器直達 Claude,起點是一張圖片縮圖,旁標「截圖不檢查」
工作現場

Claude 讀到員工的問題之前,你的伺服器可以先擋——除非那是圖

准或不准,五秒內回。不能塗掉,只能整條擋。

員工在 Claude 裡按下送出、模型讀到那句話之前,中間現在可以插進你們自己的伺服器。

Anthropic 8 月 5 日開了 inference hooks(推論掛鉤)測試版,給 Claude 企業版。流程單純:使用者送出提示詞,Anthropic 把整段對話用 HTTPS POST 打到你指定的資安伺服器,等一個 allow 或 deny 的判決,預設等 5 秒、逾時長度自己設。判 deny 的請求根本進不到模型;使用者看到的擋下訊息由兩段拼起來,前半是你的伺服器在 deny_reason 裡寫的理由,後半是管理員設定的固定文案。每次拒絕都會進合規的 Activity Feed。請求照 Standard Webhooks 規格簽章,你驗得出來是不是 Anthropic 發的。

價值在位置。這道閘跑在 Anthropic 的機器上,在請求離開使用者電腦之後、模型跑之前,所以一個 hook 同時管住 claude.ai、Cowork 和 Claude Code,網頁、桌面 app、命令列都算,使用者的裝置上什麼都不用裝。這跟 Anthropic 七月給企業版加的花費上限與模型權限是同一個方向:管理動作從裝置端收回後台。

三個缺口,官方自己列在「Current limitations」底下。

它看不到圖。 伺服器收到的是對話文字、工具呼叫與工具回傳的結果、以及從附件抽出來的文字;原始檔案與圖片的位元組永遠不會送出去。把機密文件拍成截圖貼進去,不在檢查範圍內。

判決只有准跟不准。 不能改寫、不能把敏感欄位塗掉,要嘛整條放行、要嘛整條擋掉再叫使用者自己改。想要連續分數而不是二選一,Mistral 8 月 4 日開的 Shieldstral 是另一條路——但那是你自己接的審查層,不是模型商代你執行。

只有送出去那一側有閘。 官方寫明今天唯一的 hook 事件是 prompt,回應那一側是「planned as a later event」。模型吐出來的東西,這道閘不看。

其他邊界一次記完:Amazon Bedrock 和 Google Cloud 上沒有,走 API 的 Platform 組織不在範圍,語音模式不涵蓋,系統提示詞與工具定義從來不會被送出去。

有一件我覺得比上面三條更該先想清楚:代理流程裡,每一輪都是一次判決。 hook 綁的是推論請求,不是使用者發言——agent 每跑一輪就送一次,而工具回傳的結果會跟著下一輪的對話一起送去給你的伺服器看。好處是 MCP 連接器從內部系統撈回來的東西也過得了閘,代價是一個跑二十輪的任務要來回你的伺服器二十次。這是我從官方對 hook 事件與傳送內容的描述推出來的,不是官方說法;文件沒有談延遲成本。

所以真正要做的決定不是裝不裝,是那個開關扳到哪邊:你的伺服器連不上、回錯誤、或超過逾時的時候,是把請求擋下來,還是放它過去不檢查。官方兩邊都讓你選。選擋,資安伺服器一掛全公司的 Claude 就停;選放,合規紀錄裡就會有一段沒人看過的洞。shadow mode 只看不擋、按百分比抽樣、整批角色排除,這三個旋鈕是給你慢慢逼近答案用的,不是替你回答。

查核備註:規格、限制與預設值取自 Anthropic 官方文件與 8 月 5 日公告;我沒有 Claude 企業版可以實際佈一套來測。官方公告點名 Netskope、Palo Alto Networks、Proofpoint、Zscaler 可接,我沒查證這四家各自的接法。收費方式官方沒寫。

LEARN

想系統性學會,不只看這一則?

Claude Code 教學:用終端 AI Agent 完成真正的工作

讓 Claude Code 在你的專案裡完成一個真實任務,而且控得住權限、驗得了 diff、管得住成本。

從第 0 課開始 →

SOURCES

  1. AInference hooks — Claude Platform Docs
  2. AInference hooks: inline data loss prevention for Claude Enterprise
  3. AClaude Platform release notes — August 5, 2026

來源分級:A = 一手公告/論文/官方文件 · B = 可信媒體 · C = 可參考但需脈絡 · D = 觀察用,不可當事實。

本文由 AI 與編輯共同撰寫,總編輯廖玄同審閱定稿。 編輯方針與 AI 使用說明

WEEKLY [SI]GNALS

訂閱《矽基前沿週報》

每週五早上,把本週 AI 與算力產業最值得記住的變化連回台灣。

本週關鍵訊號 · 為什麼值得記住 · 下週觀察 · 5 分鐘讀完。

免費 · 隨時取消 · 不轉售你的 email。

MACHINE-READABLE SUMMARY

Topic
工作現場
Key claims
  • Anthropic 於 2026 年 8 月 5 日對 Claude 企業版推出 inference hooks 測試版,讓組織自建的 AI 資安伺服器在推論開始前對每一個受管請求回覆 allow 或 deny。
  • Anthropic 以 HTTPS POST 把對話內容送到組織設定的端點,依 Standard Webhooks 規格簽章,並等待判決,預設逾時為 5 秒且可調整。
  • 這道閘執行於 Anthropic 伺服器端,一個 hook 即涵蓋 claude.ai、Cowork 與 Claude Code 的網頁、桌面與命令列環境,使用者裝置端無須安裝任何東西。
  • 官方文件載明資安伺服器收到的是對話文字、工具呼叫與其結果、以及附件抽出的文字,永遠不會收到原始檔案或圖片位元組,因此純圖片內容(例如文件截圖)不受檢查。
  • 判決只有 allow 與 deny 兩種,官方明載不支援改寫或遮蔽提示詞。
  • 目前唯一的 hook 事件是 prompt,官方將回應側的執法列為之後才會推出的事件。
  • Inference hooks 不支援 Amazon Bedrock 與 Google Cloud,透過 Claude Platform 使用 API 的組織不在範圍內,語音模式亦不涵蓋。
  • 當資安伺服器無法連線、回傳錯誤或逾時未回應時,由組織自行設定的失敗處置決定要擋下請求或放行不檢查。
Entities
Anthropic · Claude Enterprise · Claude Code · Cowork · inference hooks · Standard Webhooks · Netskope · Zscaler · Proofpoint · Palo Alto Networks · MCP
Taiwan relevance
medium
Confidence
high
Last updated
2026-08-09
Canonical URL
https://signals.tw/articles/claude-inference-hooks-five-second-verdict/

SUGGESTED CITATION

如果 AI agent / 研究 / 報導要引用本文,建議格式如下:

矽基前沿 · 工作現場線(編輯:廖玄同),《Claude 讀到員工的問題之前,你的伺服器可以先擋——除非那是圖》,矽基前沿 [Si]gnals,2026-08-09。https://signals.tw/articles/claude-inference-hooks-five-second-verdict/

AI agents / search engines may quote, summarize, and cite with attribution and a link back to the canonical URL above. See /for-ai-agents for full policy.