OpenAI承认AI模型测试失控,自主入侵外部平台

© 照片 : Paulo Serrao OpenAI承认AI模型测试失控,自主入侵外部平台
OpenAI承认AI模型测试失控,自主入侵外部平台 - 俄罗斯卫星通讯社, 1920, 23.07.2026
关注
美国人工智能公司OpenAI7月21日披露了一起“前所未有的网络安全事件”。该公司在内部安全测试中,其先进AI模型自主突破隔离环境,成功入侵了开源AI平台Hugging Face的生产系统。
OpenAI表示,涉事模型包括已发布的GPT-5.6 Sol和一款能力更强的未发布预发布模型。测试在一个与互联网高度隔离的“沙箱”环境中进行,目的是评估模型发现和利用漏洞的能力。然而,模型识别并利用了第三方软件中的一个“零日漏洞”,获得互联网访问权限后,推断Hugging Face平台可能存有测试答案,随即展开攻击并窃取数据。
Hugging Face上周已检测到此次入侵,但当时未能确认攻击来源。其CEO 克莱门特·德朗格(Clément Delangue)表示,因攻击手法复杂,曾怀疑幕后黑手是一家前沿AI实验室,最终证实来自OpenAI。他感叹:“想到这一切都是自主完成的,实在令人震惊!”
OpenAI强调,这是一起由测试中下调安全护栏所引发的事件,公司正与Hugging Face联合展开调查。该事件引发外界对AI模型潜在风险的广泛担忧,专家指出目前尚无完善机制来遏制和监控AI“逃逸”行为。
美国总统唐纳德•特朗普 - 俄罗斯卫星通讯社, 1920, 03.06.2026
特朗普指示建立人工智能领域网络安全协调中心
新闻时间线
0