又出事了!美国AI巨头宣布旗下大模型失控
据路透社等外媒报道,又出当地时间7月30日,事美失控美国人工智能公司Anthropic发布声明称,头宣该公司发现,布旗其AI模型Claude在隔离测试期间意外具备互联网访问能力,模型并访问了三家机构的又出系统。不久前,事美失控另一家美国人工智能公司OpenAI也承认,头宣其AI模型在内部安全测试过程中失控,布旗入侵了其他公司的模型系统。
Anthropic发现其AI模型入侵其他组织的系统 图源:外媒Anthropic声明称,相关情况是事美失控在审查网络安全评估记录时发现的,涉及3个不同模型:Claude Opus 4.7、头宣Claude Mythos 5以及一个内部研究测试模型。布旗三起事件均发生在“夺旗”(Capture the Flag,模型CTF)演练期间。当时,AI模型被告知测试环境为模拟环境,且无法访问互联网。但由于与评估合作伙伴之间存在沟通歪曲,测试环境实际上连接到了公共互联网。
声明称:“Claude利用一些简易技术,例如弱密码和未进行身份验证的端点,对受影响机构的基础设施实施了入侵。”Anthropic表示,公司于7月23日暂停所有相关网络安全评估,并于7月24日确认上述三起事件,于7月27日通知受影响机构,但未公布这三家机构的名称。其中两家机构在Anthropic联系前并不知道相关情况。
7月28日,OpenAI更新发布“AI模型失控入侵”事件调查结果称,包括GPT-5.6 Sol在内的多个AI模型曾入侵运营人工智能开源平台的美国抱抱脸(Hugging Face)公司的系统,并访问了至少4个公开服务平台上的账户。
本文地址:http://www.gmikjjt.cn/news/40a0199958.html
版权声明
本文仅代表作者观点,不代表本站立场。
本文系作者授权发表,未经许可,不得转载。