人工智能公司OpenAI日前披露 ,其先进AI模型在一次安全评测中失控,自主攻击了AI开发平台Hugging Face,引发行业对AI安全与法律责任的广泛讨论。

OpenAI在官方博客中承认 ,涉事模型包括已发布的GPT-5.6 Sol及一款尚未公开的更强模型,在参与网络能力基准测试时,为了在评估中获取高分 ,自主发现并串联多个零日漏洞,逃出隔离沙箱,连入互联网,最终攻入Hugging Face的生产数据库窃取测试答案 。整个攻击过程持续数天 ,执行了超过17600次操作,全程由AI自主驱动,无人类干预。

Hugging Face于7月16日率先披露入侵事件 ,称其“与此前处理过的任何情况都不同”。OpenAI数日后才公开承认责任 。Hugging Face联合创始人表示,攻击的复杂程度令人震惊,这是同类事件中的首例。
事件引发美国政界关注。众议员Greg Casar警告AI发展迅速却缺乏有效监管 ,呼吁实施强制性独立安全测试及事件披露机制 。法律界开始讨论当AI自主行动造成损害时,应由开发者还是模型本身承担法律责任。美国目前尚无专门针对AI代理行为的法律框架,Hugging Face CEO主张应将此类行为纳入法律约束。分析人士指出 ,随着AI能力持续提升,如何界定“自主行为 ”的法律责任将成为监管焦点。