安全#安全扫描

Anthropic 一天三连:Cyber Mission、开源扫描、政策收紧

Anthropic 宣布 Cyber Mission 扩大网络防御,为开源项目提供免费 AI 安全扫描(无人工复核),并更新用量政策禁止滥用。

橙色背景上的银色机器人插画,面甲上有 Claude 星形标志

10 月 8 日,Anthropic 在同一天发布了三件事:扩大网络防御计划的「Anthropic Cyber Mission」、面向开源项目的免费 AI 安全扫描,以及一版收紧的用量政策——明令禁止利用模型实施滥用与干预选举。前两件是「出人出模型做防御」,第三件是给防御画边界。对每天被 AI 生成的低质量漏洞报告淹没的开源维护者来说,第二件最值得仔细看。

要点

  • 免费扫开源:任何开源项目都可以报名,由 Anthropic 的模型(包括新模型 Claude Mythos)定期扫描漏洞,费用全免。
  • 明说没有人工复核:官方承认扫描结果未经人工分诊,可能包含误报——省下的成本以「维护者自己过滤」的形式转嫁回来。
  • 政策收紧:新版用量政策把「模型滥用」与「干预选举」写成明文禁令,据 TechCrunch 报道,这是配合防御计划的边界声明。

背景

AI 找漏洞的能力已经被验证过:2026 年 5 月,Linux 内核的「Copy Fail」漏洞就是借助 AI 发现的(The Verge 在报道中回顾了这一案例)。问题在反向供给——The Verge 引用了 Linus Torvalds 等维护者对 AI 生成的低质量漏洞报告泛滥的不满,Google 也曾因 AI 刷报告暂停过一个漏洞赏金项目。Anthropic 自己的安全叙事也有铺垫:我们此前报道过 Hugging Face 沙盒遭恶意智能体入侵引发的诉讼,以及 Google 调整开源赏金以应对 AI 报告泛滥。模型厂商下场做防御,是这个系列里第一次成规模的尝试。

事实部分

公告内容来源
Anthropic Cyber Mission扩大网络防御计划,官方页面同日上线Anthropic 官方
开源免费扫描opt-in 报名,模型定期扫漏洞,免费;官方明说无人工复核与分诊Anthropic 官方、The Verge
2026 用量政策更新明文禁止模型滥用与干预选举Anthropic 官方、TechCrunch

扫描机制的细节值得复述一遍:这是 opt-in 的持续服务,用 Anthropic 自家模型(含新模型 Claude Mythos)对报名的开源项目做周期性扫描;The Verge 的表述是「更快、更频繁」的扫描换「没有人做最后把关」——每一条发现都要由维护者自己判断真假。The Verge 同时给出了批评者的坐标:Torvalds 对 AI 报告质量的抱怨、Google 暂停赏金的先例,都在提示「更多报告」并不自动等于「更多安全」。

各方说法

The Verge 把这次发布放在「AI 帮黑客还是帮防守」的长线报道里,引用维护者社区的怀疑:低质量报告的洪水刚退一点,免费用模型再放大一轮,谁来接住误报。TechCrunch 关注政策面:把滥用与选举干扰写成明文,给了 Anthropic 更清晰的封号与限用依据。官方博客的措辞则强调防御意图——模型能力越强,进攻方的成本曲线越低,防守方必须有同等级的工具。目前还没有开源维护者公开反馈扫描结果质量,第一批用户的实际体验要等后续。

编辑判断

这是模型厂商第一次把「防御」当成产品来发布,方向值得肯定,账也要算清楚:扫描免费,分诊的成本落在了维护者头上——对人力充裕的大项目是「多条报警线」,对单人维护的关键依赖可能反而添乱。真正决定成败的是误报率,这个数字目前没有公布。对关心开源供应链安全的团队,可以先在自己的非关键项目上试水,把结果质量当成评估数据。诚实的不确定性:Cyber Mission 的具体规模与预算未披露,「Claude Mythos」的扫描能力没有独立基准。

怎么试

开源维护者可在 Anthropic 官网报名免费扫描,opt-in 后由其模型周期性扫描项目并产出报告;建议先在分支或非关键仓库上验证误报率,再决定是否接入主仓库的安全流程。