Anthropic扩大AI安全测试计划开放Claude模型
Anthropic扩大网络安全模型测试计划,整合玻璃翼与旧版核验计划为新版CVP,向审核通过团队开放Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1等模型,并披露已发现超10万个软件漏洞。
驱动中国10月7日消息,Anthropic正在扩大一项面向网络安全专业人员的测试计划,使经过审核的网络安全专业人员能够在更少安全防护限制下测试其高能力人工智能模型。路透社消息显示,该公司此前运行的玻璃翼计划已在今年帮助发现超过10万个软件漏洞。
玻璃翼计划旨在保障全球关键软件安全。合作方在4月至7月期间至少找到129000个已经核实的漏洞;Anthropic自身开展的开源扫描工作在4月到10月之间又额外发现5500个漏洞。截至目前,已有超过33000个漏洞被评定为严重或高危等级。
Anthropic表示,上述数据可能存在统计遗漏,实际影响至少是当前统计结果的五倍,原因是这些数据来自对有限数量合作方的调查。
当地时间周二,Anthropic公布新版网络核验计划Cyber Verification Program,简称CVP,整合该公司过去半年运行的两套项目。第一套为玻璃翼计划,向负责关键软件安全防护的机构开放Claude Mythos的使用权限;该模型系列是Anthropic旗下网络安全能力突出的模型系列。第二套为旧版网络核验计划,向经过资质审核的安全团队开放防护限制下调后的Claude Opus以及Claude Sonnet模型。
该公司4月发布Claude Mythos Preview时,曾引发担忧,即人工智能可能在软件完成安全加固之前对其发起黑客攻击。新设立的项目分为三个层级,每一层级设置对应资质审核要求与安全管控措施。全部三个层级均可使用Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1以及后续推出的新模型。
防御层级适用于事件应急响应、恶意软件分析等工作,安全团队、关键基础设施运营方、开源项目维护人员以及拥有漏洞上报履历的研究人员均可提交申请。红队层级在防御层级基础上增加授权渗透测试与红队攻防演练权限,但仅接受机构申请。专项层级约束更少,仅面向一小部分机构开放。