手繪風分數圖:分子是四個並排的代理終端機視窗除以八小時,分母是一排人頭乘日曆日,右側大字 3.1,下方標籤寫「兩邊都不是產出」
大百科

代理工作日是什麼?3.1 這個數字,量的是機器跑了多久

分子是執行時數,分母是人頭乘八小時

OpenAI 9 月 8 日說,自家研究組織每一個人類工作日對應 3.1 個「代理工作日」(agent-workday)。接下來幾天你會看到它被轉述成「AI 讓他們快三倍」——但官方把換算方法整段寫出來了,分子是代理跑掉的時數,分母是人頭乘八小時,兩邊都不是產出。

代理工作日(agent-workday)是把 AI 代理的執行時間換算成人類工作日的單位:把所有合格代理的執行時數加總,除以八小時。它量的是機器運轉了多久,不是完成了多少事。

廠商講產能正在往這個形狀走:不講「省了幾個人」,改講一個聽起來很硬的比值。

分子:平行跑的每一個都算一份

OpenAI 的方法說明寫了四件事。執行時數用伺服器連線事件與用戶端遙測估算牆鐘時間;同一輪對話裡兩個伺服器事件相隔超過 30 分鐘,那段空檔不算;程式化的自動流量(codex exec、標題生成、記憶整併、內部評測、測試流量)排除;子代理各自算一個代理,自動審查開的執行緒也算。

最後那條是關鍵。同時開四個代理跑一小時,分子拿到的是四個代理小時,不是一個。這個單位天生隨並行度膨脹,而並行度正是同一份報告裡在成長的東西。

分母:人頭乘日曆日,不是實際工時

分母簡單到得看清楚:研究組織每一個人、每一個日曆日,一律算八小時,官方寫的理由是「為了尺度一致」。它不是這些人真的工作的時數,也不扣掉當天沒用代理的人。整條線取 28 天移動平均、排除公司假日。

所以 3.1 的意思是:以 8 月中的口徑,機器的牆鐘時數是人頭時數的 3.1 倍。這跟研究產出加速幾倍是兩件事——OpenAI 自己在同一份報告裡寫了「整體進度大概不會跟上這些特定指標」。

第二個標本:Anthropic 的單位不同,警語一樣

數字 分子是什麼 廠商自己標的限制
OpenAI(2026 年 8 月中) 3.1 代理工作日/人類工作日 代理牆鐘時數 ÷ 8 小時 「整體進度大概不會跟上這些特定指標」
Anthropic(2026 Q2) 每位工程師每日合併程式碼是 2024 年的 8 倍 程式碼行數 「幾乎確定高估了真正的生產力增益」
Anthropic(2026 年 3 月) 產出約 4 倍 130 名研究團隊員工自評的中位數 「我們認為真實提升要低一些」

三個數字、三種分子,沒有一個是「完成的工作」。而三個限制全部是廠商自己寫在同一頁上的。

四題問完再引用

我的讀法是,這些都不是產能數字,是使用量數字。 兩家自己都標了邊界,把數字搬走的人一個都沒標。

我自己的門檻是四題全部答得出來才引用:分子量的是什麼(時數、行數,還是自評)?分母是誰、怎麼算(實際工時,還是人頭乘日曆日)?平行跑的算幾份?廠商自己標了哪些限制?營收那一側的同一套問法在「$1M ARR」怎麼讀,Anthropic 那份揭露六月拆過

同一份報告裡有一格數字沒有分母問題:8 月中,OpenAI 研究組織的中位數研究員每天用掉超過 600 美元的推論,第 90 百分位超過 7,000 美元(照 API 零售價換算)。那個是錢,不是比值。你自己那一頭花了多少,在編碼工具的成本可見度

查核備註:兩家的數字與方法說明都取自官方頁面,我沒有向任何一家求證,也沒有能力複驗任何一個數字。Anthropic 那個 4 倍是自評問卷,樣本與問法官方未完整公布。

FAQ

常見問題

代理工作日(agent-workday)是什麼?
把 AI 代理的執行時間換算成人類工作日的單位:所有合格代理的牆鐘執行時數加總後除以八小時。它量的是機器運轉多久,不是完成了多少工作。
OpenAI 說的 3.1 代表研究效率變成 3.1 倍嗎?
不是。3.1 是代理牆鐘時數對人頭時數的比值,分子與分母都不是產出;OpenAI 在同一份報告寫明整體進度大概不會跟上這些特定指標。
平行跑好幾個代理會影響這個數字嗎?
會。官方方法說明把子代理各自算成獨立的代理,同時開四個代理跑一小時就計入四個代理小時,所以並行度越高數字越大。

SOURCES

  1. AResearch acceleration: The view inside OpenAI(含各圖表的 methods 展開區)
  2. AThe Work Now Within Reach — Sarah Friar, OpenAI
  3. AWhen AI builds itself — The Anthropic Institute

來源分級:A = 一手公告/論文/官方文件 · B = 可信媒體 · C = 可參考但需脈絡 · D = 觀察用,不可當事實。

本文由 AI 協助研究,矽基前沿編輯部撰稿,總編輯廖玄同審閱定稿。 編輯方針與 AI 使用說明

WEEKLY [SI]GNALS

訂閱《矽基前沿週報》

每週五早上,把本週 AI 與算力產業最值得記住的變化連回台灣。

本週關鍵訊號 · 為什麼值得記住 · 下週觀察 · 5 分鐘讀完。

免費 · 隨時取消 · 不轉售你的 email。

MACHINE-READABLE SUMMARY

Topic
大百科
Key claims
  • 代理工作日(agent-workday)的分子是所有合格代理的牆鐘執行時數加總,再除以八小時換算成工作日。
  • OpenAI 的方法說明明寫子代理各自算成獨立的代理,因此同時平行跑的代理會各自計入分子。
  • 同一輪對話中兩個伺服器事件相隔超過 30 分鐘的空檔不計為代理作業時間。
  • 分母是研究組織每位員工每個日曆日一律以八小時計算,官方說明的理由是尺度一致,不是實際工時。
  • OpenAI 在同一份報告寫明整體研究進度大概不會跟上這些特定指標。
  • Anthropic 自報 2026 年第二季典型工程師每日合併程式碼量是 2024 年的 8 倍,並自標行數幾乎確定高估了真正的生產力增益。
  • Anthropic 2026 年 3 月對 130 名研究團隊員工的問卷中位數自評產出約 4 倍,官方自陳真實提升要低一些。
  • OpenAI 稱 2026 年 8 月中其研究組織中位數研究員每天使用超過 600 美元的推論、第 90 百分位超過 7,000 美元,換算依 API 零售價。
Entities
OpenAI · Anthropic · Codex · Claude · Sarah Friar · agent-workday · Epoch AI
Taiwan relevance
medium
Confidence
high
Last updated
2026-09-09
Canonical URL
https://signals.tw/articles/how-to-read-agent-workday-claims/

SUGGESTED CITATION

如果 AI agent / 研究 / 報導要引用本文,建議格式如下:

矽基前沿 · 大百科線(編輯:廖玄同),《代理工作日是什麼?3.1 這個數字,量的是機器跑了多久》,矽基前沿 [Si]gnals,2026-09-09。https://signals.tw/articles/how-to-read-agent-workday-claims/

AI agents / search engines may quote, summarize, and cite with attribution and a link back to the canonical URL above. See /for-ai-agents for full policy.