OpenAI 自家客服 75% 不轉真人,這套系統卻不賣
模型買得到,為什麼線還是上不了?
打電話到 OpenAI 的英文客服專線 1-888-GPT-0090,接起來的已經不是人。從 2026 年 7 月 22 日 起,那條線由 OpenAI 新發表的企業產品 Presence 接聽。官方稱它上線幾週內就達到或超過 OpenAI 自己用來評鑑第一線人工客服的品質基準,目前 75% 的來電不需要轉給真人。
這是前沿實驗室第一次把自家客服代理人的營運數字攤在公告裡。然後在同一份公告的最後一段, OpenAI 寫了這句:「Presence is not yet available as a self-serve product.」不開放自助購買。 想用,得先是「eligible enterprise customers」,而且得由 OpenAI 的 Forward Deployed Engineers 或挑選過的全球系統整合商帶隊,一次導入一條產線。
所以這篇公告同時做了兩件事:公布一個很好看的成績,和關上一道門。模型繼續賣給所有人, 把模型變成一條能上線的客服的那套系統,只租給挑過的人。
公告最後一段才是重點——不自助賣,工程師帶著裝
Availability 那段只有三句話,每一句都在收窄範圍。第一句,限量 general availability, 只給「符合資格」的企業客戶,資格標準沒公開。第二句,導入由 OpenAI 的 Forward Deployed Engineers 與挑選過的全球系統整合商帶隊。第三句,尚未開放自助購買。
這個賣法本身不新。7 月初微軟成立 Microsoft Frontier Company,承諾 25 億美元、6000 名 專家派駐客戶端;同一週亞馬遜也宣布 10 億美元規模的同類部隊,而派工程師進客戶公司這套 模式最早是 Palantir 做起來的。差別在於,微軟和亞馬遜那兩筆是「部隊」,Presence 是一個 有名字、有元件清單、有公開成績單的產品——只是這個產品附帶一組人。
導入方式也寫得很細。每次上線從一個具體任務起手,官方舉的三個例子是帳單爭議、保險理賠、 員工 IT 服務請求。代理人只拿那個任務需要的知識與系統權限,其餘的碰不到。能做什麼、 什麼時候要人核准、什麼時候該轉人,全由企業自己設。
模型照賣,能上線的那套系統只租給挑過的人
公告收尾還留了一句給沒進名單的人:「we’ll continue supporting voice customers with access to our frontier models through the OpenAI API.」語音客戶照樣能透過 API 拿到前沿 模型。
兩條路就此分開。API 給你模型,Presence 給你把模型接進電話系統、接進帳務資料庫、接進 轉人流程的那一整套東西。台灣的中小企業和多數軟體團隊短期內不會出現在限量名單上—— 沒有台灣客戶出現在這次公告裡——所以實際處境很清楚:想做,就是自己組。
好消息是 OpenAI 這次把要組什麼列出來了。
OpenAI 自己列了六個零件,那就是一條客服線缺的東西
公告裡有一句話把 Presence 拆得很乾淨:這個產品包含「policies and standard operating procedures, guardrails, approved actions, simulations, evaluation tools, and a Codex-powered improvement process」。
六件。這不是我們歸納的框架,是官方自己列的清單——等於 OpenAI 公開承認,光有模型跑不起 一條 production 客服線。拿它對照你用 API 自建的狀況:
| 官方列的元件 | 你用 API 自建時對應什麼 | 缺口在哪 |
|---|---|---|
| 政策與標準作業程序 | 系統提示詞加上一份內部規章文件 | 提示詞不是可稽核的政策,改了誰核准、版本怎麼追,多數團隊沒有機制 |
| 防護欄(guardrails) | 自己寫的輸入輸出檢查、關鍵字攔截 | 攔得住明顯的,攔不住「照著政策講但講錯個案」這種 |
| 核准過的動作 | 函式呼叫(function calling)加上權限白名單 | 技術上做得到,難的是把「哪些動作要人點頭」這件事寫成公司規則並維持 |
| 模擬測試 | 手動整理的測試對話 | 邊界案例與高風險情境要靠人想,想不到就測不到 |
| 評估工具 | 自建評分腳本或現成 eval 框架 | 判斷「有沒有照政策走、該轉人時有沒有轉」比判斷答案對錯難得多 |
| Codex 驅動的改版迴路 | 人工看逐字稿、人工改提示詞 | 這一格是清單裡唯一買不到的,OpenAI 沒說會單獨開放 |
前面五格,有經驗的團隊咬牙都補得起來,只是慢。第六格不一樣。
第六個零件,是讓代理人讀自己的轉真人紀錄來改自己
Presence 上線後,production 對話、轉真人紀錄與品質訊號會回流。按官方描述,接手的是 Codex——它掛上一個 Presence 外掛去追這些訊號,然後直接提出改版建議。團隊拿這些建議跟 線上版本比測,核准之後受控上線。
OpenAI 說這條迴路在自家客服線上,10 天內把轉真人的比例又壓低了 15 個百分點。
這個迴路的形狀很特別:代理人失敗的紀錄,變成另一個代理人的輸入,產出是設定檔的修改提案, 最後那道核准仍然留給人。這跟「拿真實對話再訓練一個模型」是不同的事——它改的 不是權重,是政策、提示詞與流程設定,所以每一次改動都看得見、可以比測、可以退回。
自建的團隊當然也在做這件事,只是由人做:撈逐字稿、看哪裡轉人、改提示詞、再上線。差別是 速度和覆蓋率。10 天壓 15 個百分點這種節奏,靠人工看逐字稿很難跑出來。
75% 能信到哪裡——三家客戶都還寫著「探索中」
現在把邊界一次講完。
75% 和 15 個百分點都是 OpenAI 自報,對照的是「benchmarks we use to grade frontline human-support quality」——OpenAI 自己訂的人工客服品質基準,沒有第三方稽核。公告沒說來電 總量是多少、統計了多長時間,也沒定義什麼叫「解決」。而且這是一家數位產品公司的客服線, 打進去的多半是懂技術的人問帳號、額度、API 的問題,跟保險理賠或銀行臨櫃業務不是同一種 難度,不能直接外推。
公告具名的三家企業也不是產線案例。原文措辭是 BBVA「is exploring」墨西哥的日常銀行語音 支援、SoftBank「is testing」日語自然對話、IAG「is exploring」惡劣天氣這類高需求時段的 即時支援。探索和測試,不是已經上線。唯一的具名發言來自 BBVA Mexico 的 AI 轉型主管 Daniel Ordaz,他說 BBVA 是 Presence 的設計夥伴,正在一起打磨金融客服的語音體驗—— 這句話的訊息量就是「還在打磨」。
價格則完全沒有。整份公告沒有任何金額、席次數或用量費率。以規模對照,這個市場已經很貴: Sierra 在 2026 年 5 月 4 日募得 9.5 億美元、估值 158 億美元,創辦人 Bret Taylor 同時是 OpenAI 的董事長。
這份清單今天就能拿去用
進不了限量名單,這篇對你仍然有一個用處:把那六格印出來,對著自己手上那條還沒上線的 代理人流程一格一格勾。多數團隊會發現前五格是零散存在的——提示詞裡有政策、程式裡有檢查、 測試在某個人的筆記本裡——但沒有一格是成建制的。
我們最想知道、公告卻沒回答的是第六格:那個掛在 Codex 上的 Presence 外掛,會不會有一天 單獨開放給 API 客戶。如果會,前五格的手工活就有人接手了;如果不會,限量名單內外的差距 會隨著每一次迴路跑完再拉開一點。
SOURCES
- A Introducing OpenAI Presence
- B OpenAI launches Presence for enterprise voice agents
- B Sierra raises $950M as the race to own enterprise AI gets serious
來源分級:A = 一手公告/論文/官方文件 · B = 可信媒體 · C = 可參考但需脈絡 · D = 觀察用,不可當事實。
本文由 AI 協助研究與起草,矽基前沿編輯部編修,總編輯廖玄同審閱定稿。 編輯方針與 AI 使用說明