Anthropic宣布Claude Mythos不向公众开放,转为“Project Glasswing”网络安全专项计划,开创AI能力与安全风险的治理先例

4.11 Anthropic已向美国网络安全与基础设施安全局CISA进行简报,并表示任何更广泛发布的时间表将quot由安全评估结果而非商业考量决定quot

claude-mythos


Anthropic于4月7日正式宣布,其内部代号为"Mythos"的前沿模型将不会进行公众发布,而是转为仅限40余家科技与网络安全公司的专属合作项目"Project Glasswing" 。这一决定标志着AI行业首次因纯粹的安全风险而非商业考量,主动放弃顶级模型的市场投放。Mythos在内部测试中被发现"目前在网络能力方面远超任何其他AI模型",能够"以远超防御者努力的速度利用漏洞" 。


 

参与该计划的企业包括苹果、亚马逊、微软等科技巨头及主要网络安全公司,模型将专门用于识别和修补关键软件程序中的安全漏洞 。Anthropic已向美国网络安全与基础设施安全局(CISA)进行简报,并表示任何更广泛发布的时间表将"由安全评估结果而非商业考量决定"。这一史无前例的举措揭示了AI能力演进与安全防护之间的深层张力:当模型智能跨越某个临界点,其潜在危害可能超过商业收益。


 

行业分析师指出,这或将成为AI治理的"分水岭时刻"。此前,AI实验室的发布决策主要受经济竞争驱动,而Anthropic此次将安全评估置于商业利益之上,可能迫使其他实验室重新审视自身的发布标准。对于企业用户而言,这意味着顶级AI能力的获取将更加分层——普通消费者使用Sonnet 4.6和Opus 4.6,而国家级网络安全能力将通过受控渠道分配。这也提出了一个根本性问题:当AI能够自主发现和利用零日漏洞时,谁有权控制这种能力?Anthropic给出的答案是——在证明安全可控之前,宁可不释放。