Anthropic 这份 9 月威胁报告最刺眼的一点,不是“有人滥用 Claude”,而是一个人带着 AI 代理,已经能跑出过去像小队作战才有的攻击节奏。

我的判断是:AI 安全的主战场正在从“模型会不会回答危险问题”,转到“代理会不会把真实世界里的脏活自动拆开、并行、复盘、再来一轮”。这比聊天窗口里的拒答更难管,因为它碰到的是凭证、云权限、供应链和企业自己多年欠下的补丁账。

“高级攻击”这个信号变钝了

Anthropic 说,它的威胁情报团队在 2025 年 12 月到 2026 年 8 月之间,打断了覆盖七类危害的滥用活动,包括网络攻击、影响行动、监控、诈骗、武器开发、生物滥用和模型蒸馏。报告里最值得警惕的,不是某个科幻式新漏洞,而是攻击流程被 AI 压缩了。

CyberScoop 把这个变化说得很直白:过去,调查人员常用攻击的复杂程度来判断背后是不是国家级团队。现在这个判断开始失灵。一个黑客、犯罪团伙、国家相关行动者,都可能借 AI 把侦察、脚本编写、凭证整理和横向移动拆成并行任务。

SiliconANGLE 引述的案例更具体:有攻击者能在两三个小时内完成过去需要更多人手配合的入侵;ShinyHunters 相关案例里,AI 代理几乎完成了倾倒 40 多个企业租户中 2,100 多组 Azure Active Directory token 的工作,时间大约 34 小时。这里的变化不是攻击者突然更聪明,而是低水平重复劳动被机器吃掉了。

防守方真正缺的是“刹车”

这件事对企业安全的压力很现实。很多公司过去默认,只要不是被顶级团队盯上,攻击者就没有足够时间把每一台边缘设备、每一段泄露 token、每一个云权限都摸透。这个前提正在变弱。

Anthropic 报告里反复出现的仍是老问题:被盗凭证、没打补丁的边缘设备、暴露的 API key、供应链里的权限缝隙。AI 让这些老问题变得更贵,因为攻击者可以让代理持续测试、改写工具、绕过检测,再把经验带到下一个目标。防守方如果还只靠事后告警,就会被拖进一场成本不对称的消耗战。

我更愿意把这份报告看成一张压力测试单。企业要检查的不是“我们有没有买 AI 安全产品”,而是三件更朴素的事:

  • 高权限 token 和 API key 有没有最小化、短期化、可追踪;
  • 边缘设备和身份系统的补丁是不是能按风险优先级推进;
  • 当一个账号连续触发侦察、代码生成、凭证导出这类行为时,系统能不能及时停住。

模型公司也躲不开责任

报告还点名了模型蒸馏风险,称有操作者利用大量账号抽取 Claude 输出,甚至把其他产品的用户请求转发给 Claude 再保存结果。这个部分会有争议,尤其涉及具体公司指控时,需要等待更多独立证据。但它提醒了另一个边界:模型服务不再只是回答问题的接口,它也会成为别人训练数据、代理任务和灰色自动化的上游。

所以,模型公司不能只把安全写成使用条款。账户验证、异常调用识别、推理内容保护、跨行业通报,都会变成基础设施的一部分。对用户来说,判断一家 AI 公司是否可靠,也不能只看模型跑分,还要看它在滥用发生后能不能发现、切断、说明清楚。

这条新闻短期看是 Anthropic 的威胁报告,长期看是一个更硬的规则:当 AI 代理把攻击速度提上去,安全就不能再靠“攻击者没那么多时间”这种侥幸。

消息来源

  • Anthropic:Detecting and countering misuse of AI: September 2026,https://www.anthropic.com/threat-intelligence-report-september-2026
  • CyberScoop:AI lets small actors run state-level hacking campaigns, Anthropic report finds,https://cyberscoop.com/anthropic-report-ai-enabled-cyber-attacks/
  • SiliconANGLE:Anthropic says AI now lets lone operators run state-level hacking campaigns,https://siliconangle.com/2026/09/10/anthropic-says-ai-now-lets-lone-operators-run-state-level-hacking-campaigns/
  • Google News RSS 检索结果用于确认该话题在 9 月 10 日被多家媒体集中报道,https://news.google.com/search?q=Anthropic%20September%202026%20threat%20intelligence%20report%20AI%20misuse

Categorized in:

个人日志,

Last Update: 11 9 月, 2026