|
10 月 7 日消息,据路透社报道,Anthropic 正在扩大一项计划,允许经过审核的网络安全专业人员在更少安全防护的情况下测试其最强大的人工智能模型,此前该公司的“玻璃翼计划(Project Glasswing)”今年已帮助发现了超过 10 万个软件漏洞。
据了解,玻璃翼计划旨在保障全球关键软件的安全。该计划的合作方在 4 月至 7 月期间,至少找到了 129000 个已经核实的漏洞。而 Anthropic 自身开展的开源扫描工作,在 4 月到 10 月之间又额外发现了 5500 个漏洞。 到目前为止,已有超过 33000 个漏洞被评定为严重或者高危等级。 Anthropic 表示这些数据很可能存在统计遗漏,且实际影响至少是目前数据的五倍,因为该数据来自对有限数量合作方的调查。 新版网络核验计划(Cyber Verification Program,简称 CVP)于当地时间周二正式对外公布,整合了 Anthropic 过去半年运行的两套项目。 第一个就是玻璃翼计划,它为负责关键软件安全防护的机构开放了 Claude Mythos 的使用权限,这是 Anthropic 旗下网络安全能力最强的模型系列。第二个是旧版的网络核验计划,它向经过资质审核的安全团队开放防护限制下调后的 Claude Opus 以及 Claude Sonnet 模型。 该公司在 4 月发布 Claude Mythos Preview 的时候,曾引发担忧:人工智能或许会在软件完成安全加固之前就对其发起黑客攻击。 新设立的项目一共分为三个层级,每一层级都设置了对应的资质审核要求与安全管控措施。全部三个层级都可以使用 Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1 以及后续推出的新模型。 防御层级适用于事件应急响应、恶意软件分析这类工作。安全团队、关键基础设施运营方、开源项目维护人员以及拥有漏洞上报履历的研究人员都可以提交申请。 红队层级在此基础上增加了授权渗透测试与红队攻防演练权限,但仅接受机构申请。 专项层级的约束最少,仅面向一小部分机构开放;这些机构获得许可,可以对电网、航空飞行系统、银行跨行转账基础设施这类事关安全的关键系统开展测试。 Anthropic 会同美国政府一同审核每一名参与成员的资质,原本玻璃翼计划的现有成员将会归入这一专项层级。 AI 解读 开放最强模型意味着什么
这次调整的重点不是模型能力升级,而是把访问权限按用途分级。防御层级面向事件响应和恶意软件分析,门槛相对低;红队层级增加授权渗透测试,但只收机构;专项层级约束最少,却只给少数机构,用来测电网、航空、银行这类关键系统。换句话说,能力最强的模型没有全面放开,而是按风险高低配给不同人群。 对普通用户来说,这件事的直接影响有限,因为申请主体是安全团队、关键基础设施运营方和开源维护者,个人研究者需要靠漏洞上报履历才有机会进入防御层级。真正值得关注的是审核机制:Anthropic 与美国政府共同把关,说明这类高能力模型的开放已经不只是企业行为。 目前新计划的具体价格、申请周期和后续模型型号都还没有公布。 能力开放按风险分级,关键系统的测试权限仍集中在少数机构手里。 以上内容由 AI 依据原文补充生成,不代表本站观点,仅供参考。 |