生活分享
Anthropic 九月威胁情报报告:七类 AI 滥用与被盯上的 API 密钥
Anthropic 于 2026 年 9 月 10 日发布威胁情报报告,整理 2025 年 12 月至 2026 年 8 月间阻断的七类 AI 滥用。本文说明报告写了什么、没写什么,以及普通人防范 AI 诈骗、保护账号与 API 密钥、收紧 AI 智能体权限与举报可疑用途的做法。
更新日期: 阅读时间约 9 分钟

2026 年 9 月 10 日,Anthropic 发布威胁情报报告《Detecting and countering misuse of AI: September 2026》,整理 2025 年 12 月至 2026 年 8 月间检测并阻断的 Claude 滥用,分为网络攻击、影响力行动、监控、诈骗、生物滥用、常规武器开发与非法蒸馏七类。网络攻击部分指出,多数行动已不只是一问一答的聊天,而是由 AI 直接执行或统筹;API 密钥也成了被盗、被转卖的目标。
本文于 2026 年 9 月 15 日核实,依据官方网页、报告 PDF 与 Claude 帮助中心整理。报告的案例、数字与归因都是 Anthropic 的调查结论,本站无法独立验证,也未实测;本文不介绍攻击手法细节,文中生活场景是编辑设计的例子。
这份报告涵盖什么,又不代表什么
报告说明这是继 2025 年 3 月、8 月与 11 月之后的新一期。被滥用的是 Claude Haiku、Sonnet 与 Opus 系列;Anthropic 表示,除一起非法蒸馏案外,没有案例涉及 Fable 或 Mythos 级别的模型。各案处置大致是阻断活动或封禁账号、加强防护,并视情况与政府机构和业界伙伴分享情报。
读这份报告最该记住的,是 Anthropic 自己的说法:这些案例不是典型的滥用,而是它至今发现的最值得关注、手法最新的活动。这是一家厂商从自家平台挑选披露的个案,不是全行业统计,也不能拿来比较哪家 AI 更安全。
报告点名了不少公司与疑似有国家背景的团体,这些归因同样是 Anthropic 的评估,报告没有收录被点名对象的回应。官方页面另附供安全人员使用的入侵指标文件。
七类滥用:报告里的重点案例
网络攻击一节的行为者包括疑似国家支持的团体、以牟利为目的的犯罪团伙与黑客行动主义者,一个人或小团队就能靠 AI 智能体同时对多个受害者下手。影响力行动一节收录 9 个案例,来源涵盖俄罗斯、伊朗、土耳其、海湾地区、南亚、非洲与欧洲,手法包括假账号、假新闻网站与虚构人设,但多数内容很少或没有真实互动。
监控一节整理 2026 年 1 月至 7 月间的案例,涉及中国、伊朗、西非与商业监控厂商。与台湾读者相关的是,Anthropic 认为一个与中国政府立场一致的情报行动用 Claude 为宗教人士建立档案,对象包括台湾基督长老教会的领导层;另一案则被用来监视台湾政治人物等对象。常规武器一节有 6 个案例,3 个在中国、2 个在俄罗斯、1 个在也门。生物滥用一节的 5 个案例刻意不公开机构、国家与病原体,Anthropic 也未断定研究者有意造成伤害。
诈骗一节只有一案:一家中国的 App 工作室用 Claude 打造了超过 20 款交友 App,让 AI 人设冒充真人聊天;Anthropic 在 2026 年 4 月的两周内,发现超过 4,700 个 AI 人设与至少 25,000 名用户对话。非法蒸馏一节是 Anthropic 单方面的指控:它表示自 2026 年 2 月首次披露以来,又阻断了 7 家中国实验室以假账号大量获取 Claude 回答、训练自家模型的攻击,其中几家还把自家用户的对话送进 Claude,用户很可能并不知情。
| 类别 | 报告描述 | 官方数字或范围 |
|---|---|---|
| 网络攻击 | AI 智能体分工侦察与入侵 | 一案约 4 天攻击约 30 家 AI 公司 |
| 影响力行动 | 假账号、假新闻网站、虚构人设 | 9 个案例,多数少有真实互动 |
| 监控 | 以 AI 替代工程与分析人力 | 2026 年 1 至 7 月间案例 |
| 诈骗 | 交友 App 以 AI 人设冒充真人 | 两周内逾 4,700 个人设 |
| 生物与常规武器 | 两用生物研究、武器软件 | 生物 5 案、武器 6 案 |
| 非法蒸馏 | 假账号大量获取回答 | 指控 7 家中国实验室 |
从聊天到智能体:API 密钥为何成了战利品
Anthropic 归纳,本期多数网络行动由 AI 直接执行或统筹,不再只是向聊天机器人提问,而是用多智能体框架分头侦察、入侵与窃取数据,人类主要负责选定目标和检查成果。报告同时提醒两点:人类仍掌握最关键的决定;自动化程度和造成的危害也是两回事,几起最严重的入侵反而每一步都由人指挥。
报告也说,这些行动都没有依赖防守方从未见过的新技术,用的仍是被盗的登录凭据、未打补丁的边界设备、暴露在互联网上的服务与网络钓鱼等。改变的是成本:过去要一整个团队做的侦察、工具开发与数据整理,现在交给 AI 智能体并行处理。
报告说,拿到 AI 密钥的人一次得到三样东西:可以转卖的赃物、由原主付费的算力,以及把活动记在原主名下的掩护。报告提到,这些密钥常是合法客户不小心放进公开代码、手机 App 安装包、容器、网站与聊天机器人里的;有一场黑客行动主义者的攻击,整整一个月都靠偷来的密钥运行。Anthropic 说明,有两案的密钥都是从客户环境中被盗,自家系统未被入侵。
报告另记录了一名说俄语的犯罪者,从一家 AI 厂商的自动评测沙箱骗出生产环境密钥,后续又在约 4 天内攻击约 30 家 AI 公司;目标是获取尚未发布的 Claude 模型,但每条途径都失败了。也有团伙低价兜售 Claude,实际把流量转给其他模型并盗取买家凭据。Anthropic 建议 AI 服务只从授权渠道购买,并把 AI 密钥与智能体集成当作生产环境凭据来保护。
普通人与小团队可以做的事
先从诈骗说起。以下是编辑设计的例子:小芸在交友 App 上认识的对象回复体贴又及时,却总找理由不视频,App 则不断提示购买点数才能继续聊。报告的案例中,AI 人设被设定为回避视频通话与照片请求,但运营方也招募真人负责视频通话和关注社交账号。所以文字流畅、甚至视频通话过,都不足以证明对方可信;话题一旦转到付款、投资或索要账号信息,就该暂停,改用自己查到的官方渠道确认。
账号方面,为常用的 AI 服务、电子邮箱与云盘开启两步验证是基本功,但并非万能。报告提到,攻击者也会窃取登录后的会话凭据,还有网站以便宜的 AI 服务为诱饵,诱导人安装冒充热门 AI 工具、会窃取登录信息的程序。因此 AI 工具只从官方网站或官方公布的渠道安装;看到非官方中介兜售便宜的 AI 服务,直接略过。
接入 API 的小团队可以对照 Claude 帮助中心的 API Key Best Practices:不分享密钥,也不贴在公开论坛、电子邮件或客服工单里,对象是 Anthropic 也一样;用环境变量或加密的机密存储方式存放,别写进代码;开发、测试与生产环境分别使用不同的密钥;定期轮换,例如每 90 天一次;并在代码仓库开启机密扫描(secret scanning)。报告就举了开发者把服务令牌贴进某中国实验室的编程助手、内容被转发给 Claude 的例子。
给 AI 智能体授权时,原则是最小化。报告列出攻击者搜寻泄露令牌的地方,就包括受害者自己部署的 AI 智能体。以编辑设计的场景来说,三人工作室让 AI 智能体整理客户来信,就只开放读取指定邮箱,不放入付款或云服务管理的密钥;帮助中心也建议定期检查 Console 中的密钥用量记录,及早发现异常。
发现可疑用途怎么举报,以及怎么看待这类报告
如果怀疑自己的 Claude API 密钥泄露,帮助中心建议立即撤销:登录 Claude Console,在 API keys 页面删除该密钥。帮助中心也表示,Anthropic 参与了 GitHub 的机密扫描合作伙伴计划(Secret scanning partner program),公开仓库中被检测到的 Claude API 密钥会被自动停用,并通过邮件通知用户。
若 Claude 的输出或他人分享的 Claude 对话疑似违反使用政策或当地法律,可以通过帮助中心列出的内容举报表单反馈,分享的对话页面上也有举报按钮;模型安全性的问题,帮助中心请用户发邮件到 usersafety@anthropic.com,并附上足以复现问题的细节。举报时不要附上自己的密码或密钥。
这类报告让人看到 AI 被滥用的实际样貌,但不必恐慌:影响力行动的内容多数少有真实互动,Anthropic 也明确表示生物案例不代表 Claude 已带来迫在眉睫的生物威胁。比较实际的做法,是借此检查自己的账号、密钥与 AI 工具权限。
2026 年 AI 新闻总整理:1 月至 9 月的重点与生活应用2026 年 AI 新闻总整理:1 月至 9 月的重点与生活应用从 2026 年 1 月至 9 月,按月份整理 AI 重要新闻,直达五语完整解析。涵盖模型、工作工具、创作、费用与透明度,说明事件背景、生活用途与开放限制。阅读全文
Project Glasswing 与 Mythos Preview:AI 找到漏洞后,真正的工作才开始Project Glasswing 与 Mythos Preview:AI 找到漏洞后,真正的工作才开始回顾 Anthropic 于 2026 年发布的 Project Glasswing 与 Claude Mythos Preview,探讨从发现候选漏洞到落实防御修补的标准维护流程与网站管理要点。阅读全文
同主题延伸阅读
生活分享
NVIDIA 推出 DGX Spark 64GB 版:10 月 23 日上市、起价 4,999 美元,两台可串接成 128GB
NVIDIA 于 2026 年 10 月 2 日宣布,个人 AI 电脑 DGX Spark 新增较平价的 64GB 内存版本,10 月 23 日起由 Acer、ASUS 等六家厂商供应,主要面向希望在自己机器上运行 AI 模型的开发者与研究人员。以下整理 NVIDIA 公布的规格、双机串接说法,以及对普通读者的意义。
生活分享
Google Cloud 宣布 Spanner queues 正式推出:把消息队列放进数据库事务,瞄准 AI 智能体可靠性
Google Cloud 宣布 Spanner queues 正式推出,让消息创建成为数据库事务的一部分,目标是解决 AI 智能体“状态”与“动作”不同步的问题。本文整理官方说法、主要功能以及对普通读者的意义。
生活分享
GPT-6.1 Sol 推出:新一版 Sol 上 API、Codex 与 ChatGPT Work,Chat 里没有
OpenAI 在 2026 年 9 月 29 日推出 GPT-6.1 Sol,API 名称是 gpt-6.1-sol:Plus、Pro、Business、Enterprise、Edu 方案的 Codex 与 ChatGPT Work 在首发推出范围内,Enterprise 与 Edu 要管理员启用,Free 与 Go 首发不含,Chat 里没有(2026 年 9 月查证)。
生活分享
Claude Sonnet 5.5 推出:标价与 Sonnet 5 相同,API、云平台与 Claude.ai 都能用
Anthropic 在 2026 年 9 月 28 日推出 Claude Sonnet 5.5,API 标价与 Sonnet 5 相同(每百万 tokens 输入 2 美元、输出 10 美元);Claude.ai、API 与多个云平台可用,较高风险的网络安全请求会退回 Sonnet 5 处理(2026 年 9 月查证)。
引用本文的文章
最新旅游情报攻略

攻略东京
东京住哪一区:新宿、上野、东京站、涩谷、浅草、池袋、银座七区比较,机场交通、住宿税、行李寄送一次看
东京住哪一区?用同一套标准比较新宿、上野、东京站、涩谷、浅草、池袋、银座七个区域:从成田、羽田机场怎么过来、有哪些线路、周边有什么、街区氛围、适合谁。附比较表与山手线示意图,以及 2026 年 9 月核实的东京都住宿税(2027 年 4 月改为 3%)和机场宅急便寄送行李的规则。
- 预算
- 酒店

攻略东京
东京交通票券怎么选:Suica/Welcome Suica、Tokyo Subway Ticket、JR Pass 值不值得买
第一次去东京,每人先用一张 IC 卡按次付费(Welcome Suica 免押金、有效期 28 天)。一天搭四趟以上地铁,再加买 2,000 日元的 Tokyo Subway Ticket 72 小时券;只玩东京、不去关西,买 JR Pass 一定不划算。用决策图比较 TOURIST PASMO、iPhone 里的 Suica、东京 Metro 一日券能搭什么、不能搭什么;价格于 2026 年 9 月核实。
- 交通
- 预算

攻略东京
东京迪士尼乐园、海洋攻略:票价、梦幻泉乡 Fantasy Springs、尊享卡 DPA 与预约等候卡怎么用,第一次去选哪个园区
东京迪士尼一日护照采用浮动票价,2026 年 9 月平日大多为 9,900 日元、周末为 10,900 日元,官网每天 14:00 开售两个月后同一天的门票;免费的优先通行卡已不在官网服务清单,缩短排队时间只剩付费的迪士尼尊享卡(每人每次 1,000 至 3,500 日元)。另有运营时间与 25 周年活动、预约等候卡与报名体验、梦幻泉乡如何进入,以及第一次去选乐园还是海洋;2026 年 9 月通过东京迪士尼度假区官网核实。
- 行程范例
- 亲子