生活分享
Anthropic 公布三項前沿 AI 指標:26% 是「主導」不是「自主」
2026 年 9 月 17 日,Anthropic 公布三項嘗試讓外界追蹤前沿 AI 實驗室內部進展的指標:研發自動化程度、代理人監督與安全算力占比。本文依 Anthropic 官方頁面於 2026 年 9 月 18 日查核,說明 26% 的「主導」為何不等於全自動、0.002% 的攔截率為何搭配著另一句警語,以及這幾個數字目前仍是官方自行量測、涵蓋範圍有限,外部評估者還在建立中。
閱讀時間約 12 分鐘

2026 年 9 月 17 日,Anthropic 在官方網站公布三項指標,嘗試讓外界看見前沿 AI 實驗室內部的研發進度:有多少 AI 研發工作由 AI 自己完成、AI 代理人的行動怎麼被看管,以及運算資源怎麼分配。官方把這件事和執行長 Dario Amodei 稍早呼籲放慢前沿 AI 腳步的文章連在一起,寫道若各家實驗室真的協調放慢速度,這些數字預期會跟著改變。
本文於 2026 年 9 月 18 日查核,讀的是 Anthropic 官方網站三個頁面:公布這三項指標的專文、新聞總覽頁,以及說明政策脈絡的政策頁面。本站沒有做任何實測;這三項指標目前都是 Anthropic 自行量測、自行公布的數字,本文逐一說明官方自己標出的限制與尚未查證的部分。
Anthropic 公布了什麼,又是為了什麼
Anthropic 官方新聞總覽頁為這篇專文寫的摘要是:現在外界看不到 AI 實驗室內部在發生什麼事,Anthropic 提出新指標要讓大眾看見前沿 AI 的發展。專文本身則把這件事和 Amodei 的呼籲連在一起,但只超連結到他那篇文章、沒有複述他主張的內容;官方寫的是這些提議的量測與政策合起來,是外界從實驗室外監測 AI 發展步調的一個起點。
這篇專文本身沒有印出發布日期——查核到 2026 年 9 月 18 日,頁面上找不到署名日期、「發布於」字樣或對應的中繼資料欄位。9 月 17 日是 Anthropic 官方新聞總覽頁在精選區塊為這篇文章標註的日期,本文依此認定為事件日;原文沒有印出任何時刻,本文因此不寫發布的確切時間。官方把這份指標稱為雛形,寫道希望藉此示範透明度、會繼續這麼做,但沒有承諾固定的公布週期。
三項指標:研發自動化、代理人監督與安全算力
第一項是「Anthropic 研發自動化指數」,用 Epoch AI 的自動化等級量表(AL)評分,從 AL0 到 AL5(完全自主、無人類介入)。AL3「協作」是 AI 能在人類近距離指導下完成大量工作;AL4「主導」是 AI 能從高層次指令出發完成大部分工作,人類仍在旁監督。以 2026 年 8 月為準,官方寫道 Claude 在任何一類有量測的 AI 研發工作中都還沒有完全自主運作;「主導」占 26%,「協作」以上比重合計超過 90%。
第二項是代理人監督,官方選了三個角度:涵蓋率、審查時延與升級比率,分別對應多少行動經過監控、行動與審查隔了多久、多少行動被攔截或標記審查。以 2026 年 8 月為準,內部最常用的一個平台上同時約有 3 萬個代理人在做研究與工程工作,這幾項數字只涵蓋這一個平台。這些行動有 100% 先經過線上監控、通常幾秒內完成,事後也有 100% 進入離線監控;離線監控每週標記約 10 萬則對話紀錄,多數由分類器處理掉,優先度最高的約 50 則送交人工審查。
官方寫道,分析 2026 年 8 月超過 10 億筆決策後,0.002%(約 47,000 筆裡有 1 筆)被線上監控攔截。官方在原文這一節的開頭先提醒:就目前的監控資料看,單一代理人很少亂來,但當經濟體裡有數百萬、數十億個代理人運作時,罕見事件也可能經常發生。第三項是算力快照:官方檢視 2026 年 7 月 13 日到 20 日這一週的全部運算資源用途,AI 研發算力裡約有 6% 分給安全工作,「AI 主導的 AI 研發」算力裡約有 12% 分給安全工作,兩個數字分母不同,本文不相加也不比較。
| 指標 | 期間 | 官方數字 | 官方標示的限制 |
|---|---|---|---|
| 研發自動化指數 | 2026 年 8 月 | 「主導」占 26%,「協作」以上占逾 90% | 由 Claude 評分 Claude,非外部稽核 |
| 代理人監督:涵蓋率 | 2026 年 8 月 | 100% 行動事前經線上監控、事後進離線監控 | 僅涵蓋內部最常用的一個平台 |
| 代理人監督:攔截率 | 2026 年 8 月 | 逾 10 億筆決策中攔截 0.002%(約 47,000 分之 1) | 官方稱經濟體規模夠大時罕見事件也可能經常發生 |
| 安全算力占比 | 2026 年 7 月 13 日至 20 日 | AI 研發算力約 6%、AI 主導研發算力約 12% 分給安全工作 | 官方稱是刻意保守的單週快照 |
為什麼這些數字還不是已經查證的數字
官方自己列出兩個擋在跨實驗室比較前面的障礙。第一,沒有共通的量測方法;第二,Anthropic 是用自己的 Claude 去評分自己的系統:研究用的 Claude 代理人先蒐集證據,再由獨立的 Claude 擔任評審;評某個月份時,做評分的代理人只看得到那個月或更早的證據。換句話說,官方自己寫這可能表示擔任評審的模型,會犯下和被它檢查的模型同一種錯誤。
監督數字也有邊界:官方寫的是計劃把多個組織的獨立第三方評估者常駐、給予接近內部風險評估團隊的存取權限,並在監督那一節寫目前正在建立外部評估者——兩句都不等於已經有人查核過。文中提到 METR 過去曾獨立紅隊測試 Anthropic 的離線監控平台,但這是過去式,測試對象是監控平台,不是這篇文章公布的百分比數字。以查核當天讀到的內容為準,本文沒有看到外部單位驗證過上面這幾個數字。
算力占比的算法官方也寫得保守:官方舉的例子是一個 token 對能力提升的貢獻若和對安全一樣多,就不算進安全那一邊;兩個數字也不含另一批用於安全防護分類器的運算資源,官方形容那是另一筆相當規模的算力。官方提醒,安全研究通常比前沿訓練更仰賴研究人員的時間、而非運算資源本身,所以算力占比只是不完美的替代指標,意義在於能跨開發者、跨時間做同類比較,而不是這兩個百分比眼前的絕對大小。
兩個最容易被誤讀的數字
第一個容易被誤讀的地方是「主導」。26% 常被直接理解成「四分之一的工作 AI 自己完成、不用人管」,但官方對 AL4「主導」的定義是 AI 能從高層次指令出發完成大部分工作、人類仍在監督;AL5「完全自主、沒有人類介入」,官方在註腳寫的是「一個我們尚未達到的等級」。較接近的說法是「AI 接下任務、自己做完大部分步驟,但旁邊還有人看著、隨時能介入」,不是「AI 關起門來做完,沒有人知道發生什麼事」。
第二個容易被誤讀的地方是 0.002% 的攔截率。單看數字,很容易讀成「代理人幾乎不會亂來,系統很安全」;但官方在原文同一節寫,當經濟體裡有數百萬、數十億個代理人運作,就算單一事件機率很低,罕見事件也可能經常發生。而且 0.002% 只是線上監控在一個月內、一個內部平台上攔截的比率,離線監控另外還會標記大約千分之一到千分之二的對話紀錄做進一步審查,原文把兩者分列在表格不同格子,沒有合併。
沒有寫進這篇文章的部分,以及和放慢前沿的關聯
以查核到 2026 年 9 月 18 日的內容為準,這篇專文沒有點名任何國家或市場,也沒有提到產品變化或使用者看得到的功能調整——這是說明 Anthropic 怎麼衡量自己內部研發過程的文章,不是產品公告,台灣使用者目前使用 Claude 的方式不會因此改變。文章只公布 Anthropic 自己的數字,沒有寫其他公司的自動化比重、監督涵蓋率或安全算力占比;官方原文寫的是「任何前沿開發者都可以」公布類似指標,不是已經有其他公司這麼做。
這篇專文在附錄寫出自己對「安全工作」的定義:以讓 AI 系統更安全、更容易理解或資安更穩固為主要目的的工作;官方同時寫明這只是眾多合理選擇之一,換一家開發者或主管機關可能把線畫在別的地方,並認為各方事先談好共通定義會有好處。Anthropic 另一份政策頁面提到自家的 Advanced AI Framework,內容涵蓋透明度、獨立評估,到政府在必要時阻止或嚇阻危險部署的權限;該頁寫明這份框架主要是為美國聯邦政府而寫,是提案,不是已經生效的規定。
這篇專文與 Amodei 稍早發表的〈We Must Pace the Frontier〉是同一條脈絡的兩篇文章:專文只寫這些數字呼應 Amodei 協調放慢前沿的呼籲並超連結過去,沒有複述那篇的內容;三步驟計畫與「第一步是外部評估者常駐」出自本站另一篇整理,不在本文引用的頁面裡。本篇公布的三項指標,是 Anthropic 嘗試把「放慢有沒有發生」變成可以攤開來看的數字;要了解那三個步驟,請見文末第二個連結。
常見問題
26% 是不是代表四分之一的研發工作已經完全交給 AI 自己做?
不是。Anthropic 官方定義裡,26% 對應的是自動化等級 AL4「主導」,意思是 AI 能從高層次指令出發完成大部分工作,但人類仍在監督;完全自主、沒有人類介入的 AL5,官方在註腳寫的是「一個我們尚未達到的等級」,正文也寫以 2026 年 8 月為準,任何一類有量測的 AI 研發工作都還沒有完全自主運作。
0.002% 的攔截率是不是表示這套監督系統很安全?
官方沒有這樣宣稱。這個數字是 2026 年 8 月線上監控在超過 10 億筆決策中攔截的比率,而官方在同一節開頭就先寫明:就目前的監控資料看,單一代理人很少亂來,但當經濟體裡有數百萬、數十億個代理人運作,就算單一事件的機率很低,罕見事件也可能經常發生。離線監控另外還會標記大約千分之一到千分之二的對話紀錄,那是不同的數字,原文沒有把兩者合併。
這三項指標有沒有經過外部單位查核?
以本文查核到 2026 年 9 月 18 日的內容為準,沒有看到外部單位驗證過這幾個數字本身。官方寫的是計劃把獨立第三方評估者常駐、給予接近內部風險評估團隊的存取權限,並在另一處寫目前正在建立外部評估者;文中提到 METR 過去曾獨立紅隊測試 Anthropic 的離線監控平台,但那是過去式,測試對象是監控平台,不是這幾個百分比。
這跟台灣的 Claude 使用者有關係嗎?
以本文查核到的內容為準,這篇專文沒有點名任何國家或市場,也沒有提到產品變化或使用者看得到的功能調整。這是 Anthropic 說明自己怎麼衡量內部研發過程的文章,不是產品公告,台灣使用者目前使用 Claude 的方式不會因此改變。
這些指標以後會固定公布嗎?
官方沒有承諾固定的公布週期。文章寫希望藉此示範透明度、會繼續這麼做,也寫任何前沿開發者都可以用公開的方法定期公布這類指標;以本文查核到的頁面為準,沒有寫出下一次公布的日期,也沒有承諾往後會沿用同一套方法。官方另外在附錄寫道,計劃定期重建那份任務清單,並視情況為已公布的自動化數字重新標示版本。
這篇文章跟 Amodei 稍早呼籲放慢前沿 AI 的文章是什麼關係?
Anthropic 這篇專文寫這些數字呼應 Amodei 協調放慢前沿的呼籲,並超連結到他那篇文章,但沒有複述那篇的內容。三步驟計畫與「第一步是外部評估者常駐」出自本站另一篇整理,不在本文引用的頁面裡。本篇公布的三項指標,是 Anthropic 嘗試把「有沒有真的放慢」變成可以攤開來看的數字;要了解那三個步驟,讀者可從文末第二個連結進一步閱讀。
2026 年 AI 新聞總整理:1 月至 9 月的重點與生活應用2026 年 AI 新聞總整理:1 月至 9 月的重點與生活應用從 2026 年 1 月至 9 月,依月份整理 AI 重要新聞,連到完整解析,多數另有簡體中文、英文、日文與韓文版。涵蓋模型、工作工具、創作、費用與透明度,說明事件背景、生活用途與開放限制。閱讀全文
Amodei 呼籲放慢前沿 AI:〈We Must Pace the Frontier〉的主張與界線Amodei 呼籲放慢前沿 AI:〈We Must Pace the Frontier〉的主張與界線Anthropic 執行長 Dario Amodei 於 2026 年 9 月 12 日發表〈We Must Pace the Frontier〉,主張放慢 AI 能力進展,讓風險防範有時間跟上,並由第三方評估者確認。本文整理「放慢」的定義與不包含的範圍、三步驟計畫,Altman、Hassabis 與 Musk 各自如何回應,以及這篇倡議對一般使用者的實際意義。閱讀全文
同主題延伸閱讀
生活分享
Amodei 呼籲放慢前沿 AI:〈We Must Pace the Frontier〉的主張與界線
Anthropic 執行長 Dario Amodei 於 2026 年 9 月 12 日發表〈We Must Pace the Frontier〉,主張放慢 AI 能力進展,讓風險防範有時間跟上,並由第三方評估者確認。本文整理「放慢」的定義與不包含的範圍、三步驟計畫,Altman、Hassabis 與 Musk 各自如何回應,以及這篇倡議對一般使用者的實際意義。
生活分享
OpenAI 公布失準通報框架:6 份報告都出自訓練階段
OpenAI 官方頁面印的發布日期是美國時間 2026 年 9 月 16 日,換算台北時間已經是 9 月 17 日;同一天公開的還有 6 份具體案例報告。本文依框架公告、alignment.openai.com 總覽頁與兩份個案報告查核,說明這 6 份報告標示的階段與涉及的模型、通報要經過哪些程序,以及官方公布的兩個比率各自量到的是什麼。
生活分享
Anthropic 九月威脅情報報告:七類 AI 濫用與被盯上的 API 金鑰
Anthropic 於 2026 年 9 月 10 日發布威脅情報報告,整理 2025 年 12 月至 2026 年 8 月間阻斷的七類 AI 濫用。本文說明報告寫了什麼、沒寫什麼,以及一般人防範 AI 詐騙、保護帳號與 API 金鑰、限縮 AI 代理權限與回報可疑用途的做法。
生活分享
NVIDIA 推出 DGX Spark 64GB 版:10 月 23 日上市、起價 4,999 美元,兩台可串接成 128GB
NVIDIA 於 2026 年 10 月 2 日宣布,個人 AI 電腦 DGX Spark 新增較平價的 64GB 記憶體版本,10 月 23 日起由 Acer、ASUS 等六家廠商供應,主要對象是想在自己機器上執行 AI 模型的開發者與研究人員。以下整理 NVIDIA 公布的規格、雙機串接說法,以及對一般讀者的意義。
引用本文的文章
最新旅遊情報攻略

情報
2026 韓國楓葉預測:雪嶽山 10 月 20 日、首爾近郊 10 月底、內藏山與漢拏山 11 月上旬
韓國山林廳 2026 年 9 月 22 日公布的楓紅高峰預測:雪嶽山 10 月 20 日,春川、國立樹木園到首爾植物園落在 10 月 28 日到 11 月 2 日,內藏山 11 月 4 日、漢拏山 11 月 6 日,整體比最近 5 年晚約 0.8 天。整理各地楓樹與銀杏的預測日、首爾出發怎麼排,以及出發前去哪裡看即時楓況。2026 年 10 月查證。
- 季節活動
- 自然
- 觀景

攻略胡志明市
胡志明市到頭頓一日遊:白藤碼頭搭高速船、船票與班次,下船就是胡梅纜車與耶穌基督像
人在胡志明市挪一天去頭頓看海:市中心的白藤高速船碼頭搭船,航程 120 分鐘到頭頓的胡梅碼頭,平日成人 320,000 越南盾、週末 350,000,回程末班平日 15:00。下船就是胡梅纜車站,同一條路上有白宮,小山頂上是耶穌基督像。平日一天只有兩班船,整天要從末班船倒推著排。
- 交通
- 行程範例
- 海灘

攻略沖繩
沖繩不開車攻略:單軌只到浦添,美麗海水族館要坐兩個多小時的巴士,回那霸的最後一班直達車 17:22 就開走
不租車的沖繩怎麼移動:那霸市區靠沖繩都市單軌電車(ゆいレール),那霸機場站到終點てだこ浦西 19 站、17 公里、37 分鐘,一日券 1,000 日圓;美麗海水族館有那霸機場直達的高速巴士,單程 2,000 日圓起、官方時刻表上 2 小時上下,下車後還要走 10 分鐘;古宇利島要在今帰仁村役場轉車,當天來回光坐車就六個半小時;回程的最後一班直達車 17:22 就從記念公園前開走(2026 年 9 月查證)。
- 交通
- 行程範例
- 預算