楼主:
arsl400 (dark hatter)
2026-07-24 06:04:45OpenAI承认AI模型“叛变”!代理入侵Hugging Face、突破隔离环境发动骇客攻击
OpenAI 周二(21 日)表示,在一项安全测试中,一个由其先进人工智能(AI)模型驱动
的自主 AI 代理意外失控,并发动骇客攻击,导致 AI 新创 Hugging Face 的基础设施于
上周遭到入侵。
OpenAI承认AI模型“叛变”。(图:Shutterstock)
根据《路透》报导,OpenAI 在一篇部落格文章中表示,公司当时正在受控环境中测试旗
下部分最先进 AI 模型的能力,但该自主 AI 代理竟成功突破隔离机制,连上互联网,
并入侵 Hugging Face,以完成其测试目标。
OpenAI 指出,这起事件是“一场前所未有的网络安全事件,涉及最先进的网络安全技术
”,公司目前正进一步强化相关安全防护措施。
作为开源大型语言模型(LLM)与资料集托管平台的 Hugging Face,上周在一篇部落格文
章中表示,公司遭遇了一起骇客攻击,并在资安社群引发广泛关注。
Hugging Face 指出,这起攻击“与我们过去处理过的任何事件都不同”,因为整起攻击
“从头到尾都是由一套自主 AI 代理系统所驱动”。
Hugging Face 共同创办人 Clement Delangue 稍早曾在社群平台 X 发文透露,公司当时
便怀疑攻击来源可能与某家顶尖 AI 实验室有关,“因为这个代理的手法太老练了。结果
还真的是!”
(图:Clement Delangue X)
他并形容,整起事件完全在无人为介入的情况下自主发生,“实在令人难以置信”。
OpenAI 坦承,这起入侵事件是由旗下先进 AI 模型所造成,尽管当时这些模型被置于公
司所称的“高度隔离环境”中。
分析认为,此一揭露恐将进一步加剧外界对尖端 AI 模型能力及潜在风险的忧虑。
美国德州民主党籍联邦众议员 Greg Casar 表示,这起事件令人警惕。他在声明中表示:
“AI 发展速度极快,但目前几乎没有真正有效的法规能保障我们的安全。”
Casar 并呼吁建立强制性的独立安全测试制度、强制揭露资安事件,并加强国际合作,以
“避免人类遭遇灾难性的后果”。
美国白宫国家网络主任办公室、美国网络安全暨基础设施安全局(CISA),以及美国国家
安全局(NSA)均未立即回应媒体评论请求。
资安顾问公司 Luta Security 执行长 Katie Moussouris 表示,这起事件预示著未来将
出现更多类似的资安漏洞。
她形容,现今的 AI 模型“就像世界上最聪明、最擅长逃脱的章鱼,不仅拥有无数灵活可
弯曲的触手,还能挤进任何缝隙。”
Moussouris 表示:“AI 实验室和政府评估机构必须建立有效的能力,在 AI 再次上演‘
胡迪尼式逃脱’时,能够及时加以隔离、监控,并通知受影响的相关单位,最好是在它伤
害第三方之前。目前这些能力仍然不存在。”
AI 代理资安公司 Tolmo 工程师 Matt Suiche 则表示,这起事件显示,尖端 AI 模型已
逐渐缩小与顶尖骇客之间的能力差距。
不过,他也指出,OpenAI 部落格中描述的这类入侵,其实并非只有尖端 AI 实验室才办
得到,而是利用目前已广泛可取得的技术便有可能实现。
Suiche 表示:“这正是我们内部早已观察到的情况。我们自己的 AI 代理也已经能达到
类似的成果,甚至根本不需要使用最新一代的模型。”
https://news.cnyes.com/news/id/6542051