生活分享

Anthropic 九月威胁情报报告:七类 AI 滥用与被盯上的 API 密钥

Anthropic 于 2026 年 9 月 10 日发布威胁情报报告,整理 2025 年 12 月至 2026 年 8 月间阻断的七类 AI 滥用。本文说明报告写了什么、没写什么,以及普通人防范 AI 诈骗、保护账号与 API 密钥、收紧 AI 智能体权限与举报可疑用途的做法。

更新日期: 阅读时间约 9 分钟

AI 滥用报告与账号、密钥防护的原创插图
图片:Mokaair (© Mokaair)

2026 年 9 月 10 日,Anthropic 发布威胁情报报告《Detecting and countering misuse of AI: September 2026》,整理 2025 年 12 月至 2026 年 8 月间检测并阻断的 Claude 滥用,分为网络攻击、影响力行动、监控、诈骗、生物滥用、常规武器开发与非法蒸馏七类。网络攻击部分指出,多数行动已不只是一问一答的聊天,而是由 AI 直接执行或统筹;API 密钥也成了被盗、被转卖的目标。

本文于 2026 年 9 月 15 日核实,依据官方网页、报告 PDF 与 Claude 帮助中心整理。报告的案例、数字与归因都是 Anthropic 的调查结论,本站无法独立验证,也未实测;本文不介绍攻击手法细节,文中生活场景是编辑设计的例子。

这份报告涵盖什么,又不代表什么

报告说明这是继 2025 年 3 月、8 月与 11 月之后的新一期。被滥用的是 Claude Haiku、Sonnet 与 Opus 系列;Anthropic 表示,除一起非法蒸馏案外,没有案例涉及 Fable 或 Mythos 级别的模型。各案处置大致是阻断活动或封禁账号、加强防护,并视情况与政府机构和业界伙伴分享情报。

读这份报告最该记住的,是 Anthropic 自己的说法:这些案例不是典型的滥用,而是它至今发现的最值得关注、手法最新的活动。这是一家厂商从自家平台挑选披露的个案,不是全行业统计,也不能拿来比较哪家 AI 更安全。

报告点名了不少公司与疑似有国家背景的团体,这些归因同样是 Anthropic 的评估,报告没有收录被点名对象的回应。官方页面另附供安全人员使用的入侵指标文件。

七类滥用:报告里的重点案例

网络攻击一节的行为者包括疑似国家支持的团体、以牟利为目的的犯罪团伙与黑客行动主义者,一个人或小团队就能靠 AI 智能体同时对多个受害者下手。影响力行动一节收录 9 个案例,来源涵盖俄罗斯、伊朗、土耳其、海湾地区、南亚、非洲与欧洲,手法包括假账号、假新闻网站与虚构人设,但多数内容很少或没有真实互动。

监控一节整理 2026 年 1 月至 7 月间的案例,涉及中国、伊朗、西非与商业监控厂商。与台湾读者相关的是,Anthropic 认为一个与中国政府立场一致的情报行动用 Claude 为宗教人士建立档案,对象包括台湾基督长老教会的领导层;另一案则被用来监视台湾政治人物等对象。常规武器一节有 6 个案例,3 个在中国、2 个在俄罗斯、1 个在也门。生物滥用一节的 5 个案例刻意不公开机构、国家与病原体,Anthropic 也未断定研究者有意造成伤害。

诈骗一节只有一案:一家中国的 App 工作室用 Claude 打造了超过 20 款交友 App,让 AI 人设冒充真人聊天;Anthropic 在 2026 年 4 月的两周内,发现超过 4,700 个 AI 人设与至少 25,000 名用户对话。非法蒸馏一节是 Anthropic 单方面的指控:它表示自 2026 年 2 月首次披露以来,又阻断了 7 家中国实验室以假账号大量获取 Claude 回答、训练自家模型的攻击,其中几家还把自家用户的对话送进 Claude,用户很可能并不知情。

2026 年 9 月 15 日核实;数字均为 Anthropic 报告所述,本站未独立验证。
类别报告描述官方数字或范围
网络攻击AI 智能体分工侦察与入侵一案约 4 天攻击约 30 家 AI 公司
影响力行动假账号、假新闻网站、虚构人设9 个案例,多数少有真实互动
监控以 AI 替代工程与分析人力2026 年 1 至 7 月间案例
诈骗交友 App 以 AI 人设冒充真人两周内逾 4,700 个人设
生物与常规武器两用生物研究、武器软件生物 5 案、武器 6 案
非法蒸馏假账号大量获取回答指控 7 家中国实验室

从聊天到智能体:API 密钥为何成了战利品

Anthropic 归纳,本期多数网络行动由 AI 直接执行或统筹,不再只是向聊天机器人提问,而是用多智能体框架分头侦察、入侵与窃取数据,人类主要负责选定目标和检查成果。报告同时提醒两点:人类仍掌握最关键的决定;自动化程度和造成的危害也是两回事,几起最严重的入侵反而每一步都由人指挥。

报告也说,这些行动都没有依赖防守方从未见过的新技术,用的仍是被盗的登录凭据、未打补丁的边界设备、暴露在互联网上的服务与网络钓鱼等。改变的是成本:过去要一整个团队做的侦察、工具开发与数据整理,现在交给 AI 智能体并行处理。

报告说,拿到 AI 密钥的人一次得到三样东西:可以转卖的赃物、由原主付费的算力,以及把活动记在原主名下的掩护。报告提到,这些密钥常是合法客户不小心放进公开代码、手机 App 安装包、容器、网站与聊天机器人里的;有一场黑客行动主义者的攻击,整整一个月都靠偷来的密钥运行。Anthropic 说明,有两案的密钥都是从客户环境中被盗,自家系统未被入侵。

报告另记录了一名说俄语的犯罪者,从一家 AI 厂商的自动评测沙箱骗出生产环境密钥,后续又在约 4 天内攻击约 30 家 AI 公司;目标是获取尚未发布的 Claude 模型,但每条途径都失败了。也有团伙低价兜售 Claude,实际把流量转给其他模型并盗取买家凭据。Anthropic 建议 AI 服务只从授权渠道购买,并把 AI 密钥与智能体集成当作生产环境凭据来保护。

API 密钥为何成了战利品:报告归纳的三种用途与自保原则
报告归纳攻击者拿到 AI 密钥的三种好处,以及把密钥当作生产环境凭据保护的原则。 · 图片:Mokaair (© Mokaair)

普通人与小团队可以做的事

先从诈骗说起。以下是编辑设计的例子:小芸在交友 App 上认识的对象回复体贴又及时,却总找理由不视频,App 则不断提示购买点数才能继续聊。报告的案例中,AI 人设被设定为回避视频通话与照片请求,但运营方也招募真人负责视频通话和关注社交账号。所以文字流畅、甚至视频通话过,都不足以证明对方可信;话题一旦转到付款、投资或索要账号信息,就该暂停,改用自己查到的官方渠道确认。

账号方面,为常用的 AI 服务、电子邮箱与云盘开启两步验证是基本功,但并非万能。报告提到,攻击者也会窃取登录后的会话凭据,还有网站以便宜的 AI 服务为诱饵,诱导人安装冒充热门 AI 工具、会窃取登录信息的程序。因此 AI 工具只从官方网站或官方公布的渠道安装;看到非官方中介兜售便宜的 AI 服务,直接略过。

接入 API 的小团队可以对照 Claude 帮助中心的 API Key Best Practices:不分享密钥,也不贴在公开论坛、电子邮件或客服工单里,对象是 Anthropic 也一样;用环境变量或加密的机密存储方式存放,别写进代码;开发、测试与生产环境分别使用不同的密钥;定期轮换,例如每 90 天一次;并在代码仓库开启机密扫描(secret scanning)。报告就举了开发者把服务令牌贴进某中国实验室的编程助手、内容被转发给 Claude 的例子。

给 AI 智能体授权时,原则是最小化。报告列出攻击者搜寻泄露令牌的地方,就包括受害者自己部署的 AI 智能体。以编辑设计的场景来说,三人工作室让 AI 智能体整理客户来信,就只开放读取指定邮箱,不放入付款或云服务管理的密钥;帮助中心也建议定期检查 Console 中的密钥用量记录,及早发现异常。

发现可疑用途怎么举报,以及怎么看待这类报告

如果怀疑自己的 Claude API 密钥泄露,帮助中心建议立即撤销:登录 Claude Console,在 API keys 页面删除该密钥。帮助中心也表示,Anthropic 参与了 GitHub 的机密扫描合作伙伴计划(Secret scanning partner program),公开仓库中被检测到的 Claude API 密钥会被自动停用,并通过邮件通知用户。

若 Claude 的输出或他人分享的 Claude 对话疑似违反使用政策或当地法律,可以通过帮助中心列出的内容举报表单反馈,分享的对话页面上也有举报按钮;模型安全性的问题,帮助中心请用户发邮件到 usersafety@anthropic.com,并附上足以复现问题的细节。举报时不要附上自己的密码或密钥。

这类报告让人看到 AI 被滥用的实际样貌,但不必恐慌:影响力行动的内容多数少有真实互动,Anthropic 也明确表示生物案例不代表 Claude 已带来迫在眉睫的生物威胁。比较实际的做法,是借此检查自己的账号、密钥与 AI 工具权限。

最新旅游情报攻略

资料来源

生活分享