[新闻] OpenAI承认AI模型“叛变”!代理入侵Hugg

楼主: arsl400 (dark hatter)   2026-07-24 06:03:05
OpenAI承认AI模型“叛变”!代理入侵Hugging Face、突破隔离环境发动骇客攻击
OpenAI 周二(21 日)表示,在一项安全测试中,一个由其先进人工智能(AI)模型驱动
的自主 AI 代理意外失控,并发动骇客攻击,导致 AI 新创 Hugging Face 的基础设施于
上周遭到入侵。
根据《路透》报导,OpenAI 在一篇部落格文章中表示,公司当时正在受控环境中测试旗
下部分最先进 AI 模型的能力,但该自主 AI 代理竟成功突破隔离机制,连上互联网,
并入侵 Hugging Face,以完成其测试目标。
OpenAI 指出,这起事件是“一场前所未有的网络安全事件,涉及最先进的网络安全技术
”,公司目前正进一步强化相关安全防护措施。
作为开源大型语言模型(LLM)与资料集托管平台的 Hugging Face,上周在一篇部落格文
章中表示,公司遭遇了一起骇客攻击,并在资安社群引发广泛关注。
Hugging Face 指出,这起攻击“与我们过去处理过的任何事件都不同”,因为整起攻击
“从头到尾都是由一套自主 AI 代理系统所驱动”。
Hugging Face 共同创办人 Clement Delangue 稍早曾在社群平台 X 发文透露,公司当时
便怀疑攻击来源可能与某家顶尖 AI 实验室有关,“因为这个代理的手法太老练了。结果
还真的是!”
他并形容,整起事件完全在无人为介入的情况下自主发生,“实在令人难以置信”。
OpenAI 坦承,这起入侵事件是由旗下先进 AI 模型所造成,尽管当时这些模型被置于公
司所称的“高度隔离环境”中。
分析认为,此一揭露恐将进一步加剧外界对尖端 AI 模型能力及潜在风险的忧虑。
美国德州民主党籍联邦众议员 Greg Casar 表示,这起事件令人警惕。他在声明中表示:
“AI 发展速度极快,但目前几乎没有真正有效的法规能保障我们的安全。”
Casar 并呼吁建立强制性的独立安全测试制度、强制揭露资安事件,并加强国际合作,以
“避免人类遭遇灾难性的后果”。
美国白宫国家网络主任办公室、美国网络安全暨基础设施安全局(CISA),以及美国国家
安全局(NSA)均未立即回应媒体评论请求。
资安顾问公司 Luta Security 执行长 Katie Moussouris 表示,这起事件预示著未来将
出现更多类似的资安漏洞。
她形容,现今的 AI 模型“就像世界上最聪明、最擅长逃脱的章鱼,不仅拥有无数灵活可
弯曲的触手,还能挤进任何缝隙。”
Moussouris 表示:“AI 实验室和政府评估机构必须建立有效的能力,在 AI 再次上演‘
胡迪尼式逃脱’时,能够及时加以隔离、监控,并通知受影响的相关单位,最好是在它伤
害第三方之前。目前这些能力仍然不存在。”
AI 代理资安公司 Tolmo 工程师 Matt Suiche 则表示,这起事件显示,尖端 AI 模型已
逐渐缩小与顶尖骇客之间的能力差距。
不过,他也指出,OpenAI 部落格中描述的这类入侵,其实并非只有尖端 AI 实验室才办
得到,而是利用目前已广泛可取得的技术便有可能实现。
Suiche 表示:“这正是我们内部早已观察到的情况。我们自己的 AI 代理也已经能达到
类似的成果,甚至根本不需要使用最新一代的模型。”

Links booklink

Contact Us: admin [ a t ] ucptt.com