
代理工作日是什麼?3.1 這個數字,量的是機器跑了多久
分子是執行時數,分母是人頭乘八小時
OpenAI 9 月 8 日說,自家研究組織每一個人類工作日對應 3.1 個「代理工作日」(agent-workday)。接下來幾天你會看到它被轉述成「AI 讓他們快三倍」——但官方把換算方法整段寫出來了,分子是代理跑掉的時數,分母是人頭乘八小時,兩邊都不是產出。
代理工作日(agent-workday)是把 AI 代理的執行時間換算成人類工作日的單位:把所有合格代理的執行時數加總,除以八小時。它量的是機器運轉了多久,不是完成了多少事。
廠商講產能正在往這個形狀走:不講「省了幾個人」,改講一個聽起來很硬的比值。
分子:平行跑的每一個都算一份
OpenAI 的方法說明寫了四件事。執行時數用伺服器連線事件與用戶端遙測估算牆鐘時間;同一輪對話裡兩個伺服器事件相隔超過 30 分鐘,那段空檔不算;程式化的自動流量(codex exec、標題生成、記憶整併、內部評測、測試流量)排除;子代理各自算一個代理,自動審查開的執行緒也算。
最後那條是關鍵。同時開四個代理跑一小時,分子拿到的是四個代理小時,不是一個。這個單位天生隨並行度膨脹,而並行度正是同一份報告裡在成長的東西。
分母:人頭乘日曆日,不是實際工時
分母簡單到得看清楚:研究組織每一個人、每一個日曆日,一律算八小時,官方寫的理由是「為了尺度一致」。它不是這些人真的工作的時數,也不扣掉當天沒用代理的人。整條線取 28 天移動平均、排除公司假日。
所以 3.1 的意思是:以 8 月中的口徑,機器的牆鐘時數是人頭時數的 3.1 倍。這跟研究產出加速幾倍是兩件事——OpenAI 自己在同一份報告裡寫了「整體進度大概不會跟上這些特定指標」。
第二個標本:Anthropic 的單位不同,警語一樣
| 數字 | 分子是什麼 | 廠商自己標的限制 | |
|---|---|---|---|
| OpenAI(2026 年 8 月中) | 3.1 代理工作日/人類工作日 | 代理牆鐘時數 ÷ 8 小時 | 「整體進度大概不會跟上這些特定指標」 |
| Anthropic(2026 Q2) | 每位工程師每日合併程式碼是 2024 年的 8 倍 | 程式碼行數 | 「幾乎確定高估了真正的生產力增益」 |
| Anthropic(2026 年 3 月) | 產出約 4 倍 | 130 名研究團隊員工自評的中位數 | 「我們認為真實提升要低一些」 |
三個數字、三種分子,沒有一個是「完成的工作」。而三個限制全部是廠商自己寫在同一頁上的。
四題問完再引用
我的讀法是,這些都不是產能數字,是使用量數字。 兩家自己都標了邊界,把數字搬走的人一個都沒標。
我自己的門檻是四題全部答得出來才引用:分子量的是什麼(時數、行數,還是自評)?分母是誰、怎麼算(實際工時,還是人頭乘日曆日)?平行跑的算幾份?廠商自己標了哪些限制?營收那一側的同一套問法在「$1M ARR」怎麼讀,Anthropic 那份揭露六月拆過。
同一份報告裡有一格數字沒有分母問題:8 月中,OpenAI 研究組織的中位數研究員每天用掉超過 600 美元的推論,第 90 百分位超過 7,000 美元(照 API 零售價換算)。那個是錢,不是比值。你自己那一頭花了多少,在編碼工具的成本可見度。
查核備註:兩家的數字與方法說明都取自官方頁面,我沒有向任何一家求證,也沒有能力複驗任何一個數字。Anthropic 那個 4 倍是自評問卷,樣本與問法官方未完整公布。
FAQ
常見問題
- 代理工作日(agent-workday)是什麼?
- 把 AI 代理的執行時間換算成人類工作日的單位:所有合格代理的牆鐘執行時數加總後除以八小時。它量的是機器運轉多久,不是完成了多少工作。
- OpenAI 說的 3.1 代表研究效率變成 3.1 倍嗎?
- 不是。3.1 是代理牆鐘時數對人頭時數的比值,分子與分母都不是產出;OpenAI 在同一份報告寫明整體進度大概不會跟上這些特定指標。
- 平行跑好幾個代理會影響這個數字嗎?
- 會。官方方法說明把子代理各自算成獨立的代理,同時開四個代理跑一小時就計入四個代理小時,所以並行度越高數字越大。
SOURCES
- AResearch acceleration: The view inside OpenAI(含各圖表的 methods 展開區)
- AThe Work Now Within Reach — Sarah Friar, OpenAI
- AWhen AI builds itself — The Anthropic Institute
來源分級:A = 一手公告/論文/官方文件 · B = 可信媒體 · C = 可參考但需脈絡 · D = 觀察用,不可當事實。
本文由 AI 協助研究,矽基前沿編輯部撰稿,總編輯廖玄同審閱定稿。 編輯方針與 AI 使用說明


