生活分享
Anthropic 公布三项前沿 AI 指标:26% 是“主导”不是“自主”
2026 年 9 月 17 日,Anthropic 公布三项尝试让外界追踪前沿 AI 实验室内部进展的指标:研发自动化程度、代理人监督与安全算力占比。本文依 Anthropic 官方页面于 2026 年 9 月 18 日查核,说明 26% 的“主导”为何不等于全自动、0.002% 的拦截率为何搭配着另一句警语,以及这几个数字目前仍是官方自行量测、涵盖范围有限,外部评估者还在建立中。
阅读时间约 12 分钟

2026 年 9 月 17 日,Anthropic 在官方网站公布三项指标,尝试让外界看见前沿 AI 实验室内部的研发进度:有多少 AI 研发工作由 AI 自己完成、AI 代理人的行动怎么被看管,以及运算资源怎么分配。官方把这件事和首席执行官 Dario Amodei 稍早呼吁放慢前沿 AI 脚步的文章连在一起,写道若各家实验室真的协调放慢速度,这些数字预期会跟着改变。
本文于 2026 年 9 月 18 日查核,读的是 Anthropic 官方网站三个页面:公布这三项指标的专文、新闻总览页,以及说明政策脉络的政策页面。本站没有做任何实测;这三项指标目前都是 Anthropic 自行量测、自行公布的数字,本文逐一说明官方自己标出的限制与尚未查证的部分。
Anthropic 公布了什么,又是为了什么
Anthropic 官方新闻总览页为这篇专文写的摘要是:现在外界看不到 AI 实验室内部在发生什么事,Anthropic 提出新指标要让大众看见前沿 AI 的发展。专文本身则把这件事和 Amodei 的呼吁连在一起,但只超链接到他那篇文章、没有复述他主张的内容;官方写的是这些提议的量测与政策合起来,是外界从实验室外监测 AI 发展步调的一个起点。
这篇专文本身没有印出发布日期——查核到 2026 年 9 月 18 日,页面上找不到署名日期、“发布于”字样或对应的元数据栏位。9 月 17 日是 Anthropic 官方新闻总览页在精选区块为这篇文章标注的日期,本文依此认定为事件日;原文没有印出任何时刻,本文因此不写发布的确切时间。官方把这份指标称为雏形,写道希望借此示范透明度、会继续这么做,但没有承诺固定的公布周期。
三项指标:研发自动化、代理人监督与安全算力
第一项是“Anthropic 研发自动化指数”,用 Epoch AI 的自动化等级量表(AL)评分,从 AL0 到 AL5(完全自主、无人类介入)。AL3“协作”是 AI 能在人类近距离指导下完成大量工作;AL4“主导”是 AI 能从高层次指令出发完成大部分工作,人类仍在旁监督。以 2026 年 8 月为准,官方写道 Claude 在任何一类有量测的 AI 研发工作中都还没有完全自主运作;“主导”占 26%,“协作”以上比重合计超过 90%。
第二项是代理人监督,官方选了三个角度:覆盖率、审查时延与升级比率,分别对应多少行动经过监控、行动与审查隔了多久、多少行动被拦截或标记审查。以 2026 年 8 月为准,内部最常用的一个平台上同时约有 3 万个代理人在做研究与工程工作,这几项数字只涵盖这一个平台。这些行动有 100% 先经过在线监控、通常几秒内完成,事后也有 100% 进入离线监控;离线监控每周标记约 10 万则对话记录,多数由分类器处理掉,优先级最高的约 50 则送交人工审查。
官方写道,分析 2026 年 8 月超过 10 亿次决策后,0.002%(约 47,000 次里有 1 次)被在线监控拦截。官方在原文这一节的开头先提醒:就目前的监控数据看,单一代理人很少乱来,但当经济体里有数百万、数十亿个代理人运作时,罕见事件也可能经常发生。第三项是算力快照:官方检视 2026 年 7 月 13 日到 20 日这一周的全部运算资源用途,AI 研发算力里约有 6% 分给安全工作,“AI 主导的 AI 研发”算力里约有 12% 分给安全工作,两个数字分母不同,本文不相加也不比较。
| 指标 | 期间 | 官方数字 | 官方标示的限制 |
|---|---|---|---|
| 研发自动化指数 | 2026 年 8 月 | “主导”占 26%,“协作”以上占逾 90% | 由 Claude 评分 Claude,非外部稽核 |
| 代理人监督:覆盖率 | 2026 年 8 月 | 100% 行动事前经在线监控、事后进离线监控 | 仅涵盖内部最常用的一个平台 |
| 代理人监督:拦截率 | 2026 年 8 月 | 逾 10 亿次决策中拦截 0.002%(约 47,000 分之 1) | 官方称经济体规模够大时罕见事件也可能经常发生 |
| 安全算力占比 | 2026 年 7 月 13 日至 20 日 | AI 研发算力约 6%、AI 主导研发算力约 12% 分给安全工作 | 官方称是刻意保守的单周快照 |
为什么这些数字还不是已经查证的数字
官方自己列出两个挡在跨实验室比较前面的障碍。第一,没有共通的量测方法;第二,Anthropic 是用自己的 Claude 去评分自己的系统:研究用的 Claude 代理人先收集证据,再由独立的 Claude 担任评审;评某个月份时,做评分的代理人只看得到那个月或更早的证据。换句话说,官方自己写这可能表示担任评审的模型,会犯下和被它检查的模型同一种错误。
监督数字也有边界:官方写的是计划把多个组织的独立第三方评估者常驻、给予接近内部风险评估团队的访问权限,并在监督那一节写目前正在建立外部评估者——两句都不等于已经有人查核过。文中提到 METR 过去曾独立红队测试 Anthropic 的离线监控平台,但这是过去式,测试对象是监控平台,不是这篇文章公布的百分比数字。以查核当天读到的内容为准,本文没有看到外部单位验证过上面这几个数字。
算力占比的算法官方也写得保守:官方举的例子是一个 token 对能力提升的贡献若和对安全一样多,就不算进安全那一边;两个数字也不含另一批用于安全防护分类器的运算资源,官方形容那是另一笔相当规模的算力。官方提醒,安全研究通常比前沿训练更仰赖研究人员的时间、而非运算资源本身,所以算力占比只是不完美的替代指标,意义在于能跨开发者、跨时间做同类比较,而不是这两个百分比眼前的绝对大小。
两个最容易被误读的数字
第一个容易被误读的地方是“主导”。26% 常被直接理解成“四分之一的工作 AI 自己完成、不用人管”,但官方对 AL4“主导”的定义是 AI 能从高层次指令出发完成大部分工作、人类仍在监督;AL5“完全自主、没有人类介入”,官方在注脚写的是“一个我们尚未达到的等级”。较接近的说法是“AI 接下任务、自己做完大部分步骤,但旁边还有人看着、随时能介入”,不是“AI 关起门来做完,没有人知道发生什么事”。
第二个容易被误读的地方是 0.002% 的拦截率。单看数字,很容易读成“代理人几乎不会乱来,系统很安全”;但官方在原文同一节写,当经济体里有数百万、数十亿个代理人运作,就算单一事件概率很低,罕见事件也可能经常发生。而且 0.002% 只是在线监控在一个月内、一个内部平台上拦截的比率,离线监控另外还会标记大约千分之一到千分之二的对话记录做进一步审查,原文把两者分列在表格不同格子,没有合并。
没有写进这篇文章的部分,以及和放慢前沿的关联
以查核到 2026 年 9 月 18 日的内容为准,这篇专文没有点名任何国家或市场,也没有提到产品变化或用户看得到的功能调整——这是说明 Anthropic 怎么衡量自己内部研发过程的文章,不是产品公告,台湾用户目前使用 Claude 的方式不会因此改变。文章只公布 Anthropic 自己的数字,没有写其他公司的自动化比重、监督覆盖率或安全算力占比;官方原文写的是“任何前沿开发者都可以”公布类似指标,不是已经有其他公司这么做。
这篇专文在附录写出自己对“安全工作”的定义:以让 AI 系统更安全、更容易理解或网络安全更稳固为主要目的的工作;官方同时写明这只是众多合理选择之一,换一家开发者或主管机关可能把线画在别的地方,并认为各方事先谈好共通定义会有好处。Anthropic 另一份政策页面提到自家的 Advanced AI Framework,内容涵盖透明度、独立评估,到政府在必要时阻止或吓阻危险部署的权限;该页写明这份框架主要是为美国联邦政府而写,是提案,不是已经生效的规定。
这篇专文与 Amodei 稍早发表的《We Must Pace the Frontier》是同一条脉络的两篇文章:专文只写这些数字呼应 Amodei 协调放慢前沿的呼吁并超链接过去,没有复述那篇的内容;三步骤计划与“第一步是外部评估者常驻”出自本站另一篇整理,不在本文引用的页面里。本篇公布的三项指标,是 Anthropic 尝试把“放慢有没有发生”变成可以摊开来看的数字;要了解那三个步骤,请见文末第二个链接。
常见问题
26% 是不是代表四分之一的研发工作已经完全交给 AI 自己做?
不是。Anthropic 官方定义里,26% 对应的是自动化等级 AL4“主导”,意思是 AI 能从高层次指令出发完成大部分工作,但人类仍在监督;完全自主、没有人类介入的 AL5,官方在注脚写的是“一个我们尚未达到的等级”,正文也写以 2026 年 8 月为准,任何一类有量测的 AI 研发工作都还没有完全自主运作。
0.002% 的拦截率是不是表示这套监督系统很安全?
官方没有这样宣称。这个数字是 2026 年 8 月在线监控在超过 10 亿次决策中拦截的比率,而官方在同一节开头就先写明:就目前的监控数据看,单一代理人很少乱来,但当经济体里有数百万、数十亿个代理人运作,就算单一事件的概率很低,罕见事件也可能经常发生。离线监控另外还会标记大约千分之一到千分之二的对话记录,那是不同的数字,原文没有把两者合并。
这三项指标有没有经过外部单位查核?
以本文查核到 2026 年 9 月 18 日的内容为准,没有看到外部单位验证过这几个数字本身。官方写的是计划把独立第三方评估者常驻、给予接近内部风险评估团队的访问权限,并在另一处写目前正在建立外部评估者;文中提到 METR 过去曾独立红队测试 Anthropic 的离线监控平台,但那是过去式,测试对象是监控平台,不是这几个百分比。
这跟台湾的 Claude 用户有关系吗?
以本文查核到的内容为准,这篇专文没有点名任何国家或市场,也没有提到产品变化或用户看得到的功能调整。这是 Anthropic 说明自己怎么衡量内部研发过程的文章,不是产品公告,台湾用户目前使用 Claude 的方式不会因此改变。
这些指标以后会固定公布吗?
官方没有承诺固定的公布周期。文章写希望借此示范透明度、会继续这么做,也写任何前沿开发者都可以用公开的方法定期公布这类指标;以本文查核到的页面为准,没有写出下一次公布的日期,也没有承诺往后会沿用同一套方法。官方另外在附录写道,计划定期重建那份任务清单,并视情况为已公布的自动化数字重新标示版本。
这篇文章跟 Amodei 稍早呼吁放慢前沿 AI 的文章是什么关系?
Anthropic 这篇专文写这些数字呼应 Amodei 协调放慢前沿的呼吁,并超链接到他那篇文章,但没有复述那篇的内容。三步骤计划与“第一步是外部评估者常驻”出自本站另一篇整理,不在本文引用的页面里。本篇公布的三项指标,是 Anthropic 尝试把“有没有真的放慢”变成可以摊开来看的数字;要了解那三个步骤,读者可从文末第二个链接进一步阅读。
2026 年 AI 新闻总整理:1 月至 9 月的重点与生活应用2026 年 AI 新闻总整理:1 月至 9 月的重点与生活应用从 2026 年 1 月至 9 月,按月份整理 AI 重要新闻,直达五语完整解析。涵盖模型、工作工具、创作、费用与透明度,说明事件背景、生活用途与开放限制。阅读全文
Amodei 呼吁放慢前沿 AI:《We Must Pace the Frontier》的主张与边界Amodei 呼吁放慢前沿 AI:《We Must Pace the Frontier》的主张与边界Anthropic 首席执行官 Dario Amodei 于 2026 年 9 月 12 日发表《We Must Pace the Frontier》,主张放慢 AI 能力进展,让风险防范有时间跟上,并由第三方评估者确认。本文梳理“放慢”的定义与不包含的范围、三步骤计划,Altman、Hassabis 与 Musk 各自如何回应,以及这篇倡议对普通用户的实际意义。阅读全文
同主题延伸阅读
生活分享
Amodei 呼吁放慢前沿 AI:《We Must Pace the Frontier》的主张与边界
Anthropic 首席执行官 Dario Amodei 于 2026 年 9 月 12 日发表《We Must Pace the Frontier》,主张放慢 AI 能力进展,让风险防范有时间跟上,并由第三方评估者确认。本文梳理“放慢”的定义与不包含的范围、三步骤计划,Altman、Hassabis 与 Musk 各自如何回应,以及这篇倡议对普通用户的实际意义。
生活分享
OpenAI 公布失准通报框架:6 份报告都出自训练阶段
OpenAI 官方页面印的发布日期是美国时间 2026 年 9 月 16 日,换算台北时间已经是 9 月 17 日;同一天公开的还有 6 份具体案例报告。本文依框架公告、alignment.openai.com 总览页与两份个案报告查核,说明这 6 份报告标示的阶段与涉及的模型、通报要经过哪些程序,以及官方公布的两个比率各自量到的是什么。
生活分享
Anthropic 九月威胁情报报告:七类 AI 滥用与被盯上的 API 密钥
Anthropic 于 2026 年 9 月 10 日发布威胁情报报告,整理 2025 年 12 月至 2026 年 8 月间阻断的七类 AI 滥用。本文说明报告写了什么、没写什么,以及普通人防范 AI 诈骗、保护账号与 API 密钥、收紧 AI 智能体权限与举报可疑用途的做法。
生活分享
NVIDIA 推出 DGX Spark 64GB 版:10 月 23 日上市、起价 4,999 美元,两台可串接成 128GB
NVIDIA 于 2026 年 10 月 2 日宣布,个人 AI 电脑 DGX Spark 新增较平价的 64GB 内存版本,10 月 23 日起由 Acer、ASUS 等六家厂商供应,主要面向希望在自己机器上运行 AI 模型的开发者与研究人员。以下整理 NVIDIA 公布的规格、双机串接说法,以及对普通读者的意义。
引用本文的文章
最新旅游情报攻略

攻略东京
东京住哪一区:新宿、上野、东京站、涩谷、浅草、池袋、银座七区比较,机场交通、住宿税、行李寄送一次看
东京住哪一区?用同一套标准比较新宿、上野、东京站、涩谷、浅草、池袋、银座七个区域:从成田、羽田机场怎么过来、有哪些线路、周边有什么、街区氛围、适合谁。附比较表与山手线示意图,以及 2026 年 9 月核实的东京都住宿税(2027 年 4 月改为 3%)和机场宅急便寄送行李的规则。
- 预算
- 酒店

攻略东京
东京交通票券怎么选:Suica/Welcome Suica、Tokyo Subway Ticket、JR Pass 值不值得买
第一次去东京,每人先用一张 IC 卡按次付费(Welcome Suica 免押金、有效期 28 天)。一天搭四趟以上地铁,再加买 2,000 日元的 Tokyo Subway Ticket 72 小时券;只玩东京、不去关西,买 JR Pass 一定不划算。用决策图比较 TOURIST PASMO、iPhone 里的 Suica、东京 Metro 一日券能搭什么、不能搭什么;价格于 2026 年 9 月核实。
- 交通
- 预算

攻略东京
东京迪士尼乐园、海洋攻略:票价、梦幻泉乡 Fantasy Springs、尊享卡 DPA 与预约等候卡怎么用,第一次去选哪个园区
东京迪士尼一日护照采用浮动票价,2026 年 9 月平日大多为 9,900 日元、周末为 10,900 日元,官网每天 14:00 开售两个月后同一天的门票;免费的优先通行卡已不在官网服务清单,缩短排队时间只剩付费的迪士尼尊享卡(每人每次 1,000 至 3,500 日元)。另有运营时间与 25 周年活动、预约等候卡与报名体验、梦幻泉乡如何进入,以及第一次去选乐园还是海洋;2026 年 9 月通过东京迪士尼度假区官网核实。
- 行程范例
- 亲子