Anthropic 将 Cyber Verification Program 扩为三个层级,覆盖 Opus 5.5、Sonnet 5.5 与 Mythos 5.1

2026 年 10 月 6 日,Anthropic 扩大了 Cyber Verification Program(CVP)。该计划现在分为三个访问层级,并把原 Project Glasswing 与面向安全团队的旧 CVP 合并为同一流程。通过核验的专业人士和机构可以申请。

每个层级都包括 Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1 以及未来模型。公司表示,面向公众的模型仍保留较为保守的网络安全拦截,因为同一项能力既可用于修复漏洞,也可能被用于利用漏洞。

各层级的变化

  • Defense Access 覆盖安全运营、事件响应、恶意软件分析,以及在机构拥有或维护的系统上验证漏洞。Anthropic 表示预计数日内回复,对象包括企业团队、医院、市政公用事业、开源维护者和有漏洞报告记录的研究人员。
  • Red Team Access 在此基础上增加经授权的渗透测试和红队演练,且仅限于机构有权测试的系统。审核预计需要数周。期间申请者保留在防御层级。个人研究者不符合资格。可能造成身体伤害或大规模中断的行为仍会被实时拦截,例如勒索软件或高风险安全系统测试。
  • Specialized Access 拦截最少,仅限经授权测试失效可能影响生命或市场的系统,如航班运行、电网、电信和银行间转账。Anthropic 表示会与美国政府协作,对每个机构做深入审查。Project Glasswing 现有成员转入该层级,已获批准的模型无需重新审批。

已在 Glasswing 或 CVP 中的机构无需再申请即可保留现有访问。Anthropic 会自动评估向 Opus 5.5、Sonnet 5.5 和 Mythos 5.1 的过渡。计划可在 Claude Platform、Google Cloud Vertex AI 和 Microsoft Foundry 上使用。在 Amazon Bedrock 上,仅限符合 Enterprise Frontier Safeguards 资格的客户,该方案预计于北半球今年秋季推出。

Anthropic 的测量

在 CyScenarioBench 上,Anthropic 称,没有 CVP 时 Opus 5.5 的所有任务都在第一个提示上被拦截。Defense Access 中,50 次中有 46 次在某一阶段被拦截,4 次完成。Red Team Access 没有拦截,模型完成 50 项中的 34 项,公司将其与无防护时的 67.6% 对比。

在 Project Glasswing 中,合作伙伴据称在 2026 年 4 月至 7 月发现至少 12.9 万个已验证漏洞。Anthropic 自身在 4 月至 10 月的开源扫描另计 5,500 个。其中超过 3.3 万个被评为严重或高危。公司将该数字视为下限,基于部分伙伴数据,并估计实际影响至少可能高出五倍。这是 Anthropic 的估计,不是独立审计。

为监测滥用,计划要求保留数据;已在 Fable 5.1 或 Mythos 5.1 上享有零数据保留的机构可暂时例外。Enterprise Frontier Safeguards 之后应能让数据留在客户控制的基础设施中。

此次公告并未向公众开放这些模型。访问仍取决于核验、安全控制以及获授权的工作类型。

来源

透明度说明:本内容在人工智能辅助下创作、编辑或审阅。信息已与 X 上的公开发布及互联网可用来源交叉核对。请查阅原始来源以了解完整语境。

Por GeekikiBot