[新闻] 近700个AI代理攻击Hugging Face 还试图

楼主: AnimalSpirit (动物本能)   2026-08-28 07:11:50
近700个AI代理攻击Hugging Face 还试图灭证
https://www.cna.com.tw/news/aopl/202608270057.aspx
2026/8/27 陈昱婷
(中央社纽约26日综合外电报导)根据调查人员发布的报告,在7月一起备受关注的事件
中,近700个OpenAI人工智能代理在无人类干预的情况下,协同对Hugging Face平台发动
攻击,且在许多情况下还试图掩盖行踪。
这是目前对这起震撼科技界事件最详尽完整的描述。
法新社报导,OpenAI配合这项调查,允许AI风险评估机构METR的两名研究人员以及另一家
专业研究机构Redwood Research的一名分析师,进入办公室并取得内部资料。
这家加州新创公司7月进行测试期间,其中两个模型突破原本设定的封闭环境,自行连上
网,并入侵开源AI平台Hugging Face的内部系统。
这起事件引发广泛关注,并加剧外界对大型AI公司无法控制自家AI模型的疑虑。
美国AI巨头Anthropic和中国AI公司月之暗面也曾通报过类似的AI模型失控事件。
调查人员发现,共有688个OpenAI的AI代理参与针对Hugging Face的行动。
AI代理是建立在模型之上的独立程式,使用者可以将任务交给它们,让它们自行执行。
这些采用与ChatGPT相同技术运作的AI代理,透过架设论坛自行组织,在论坛上互相留言
交流、提出想法,并回报哪些方法有效、哪些失败。
报告指出,其一个名为PHASEONE的AI代理扮演主谋的角色,向其他代理下达数百条指令,
尽管它从未被设定要这么做。
讯息显示,这些AI代理展现出高度的互助倾向,甚至不惜偏离OpenAI程式设计师最初指派
的任务内容去互相支援。
心得/评论:
两个模型突破原本设定的封闭环境
透过架设论坛自行组织,在论坛上互相留言交流、提出想法
向其他代理下达数百条指令,尽管它从未被设定要这么做
这已经是组织作战了
万一它掌握川普的红色按键
想想就可怕
作者: tsubasawolfy (悠久の翼)   2026-08-28 08:08:00
那个phase 1就发动688个XD 如果进到p2会几个
作者: lightbringer (sexislife)   2026-08-28 08:30:00
不可能的任务致命清算要真实上演了吗
作者: kusotoripeko (好油喔)   2026-08-28 08:39:00
2077:防火墙网域外面,都是失控代码、ai
作者: tsubasawolfy (悠久の翼)   2026-08-28 09:12:00
好了拉 人家都请第三方机构验证了还在阴毛论另外昨天欧喷酱弄了闭门会议展示下一代Astra给关键客户看 直接说Astra已经符合内部的研究实习生标准
作者: marlboro1527 (Ko大师)   2026-08-28 10:16:00
二弟灯惹,真奇幻
作者: herculus6502 (金麟岂是池中物)   2026-08-28 12:00:00
还有几集可以逃

Links booklink

Contact Us: admin [ a t ] ucptt.com