一家被全球最不缺钱的资本抢着投的公司,在它最先进的那批模型快要跑起来的时候,自己踩了一脚刹车。刹车的理由不是算力不够,不是钱烧完了,而是它在测试环境里放出去的AI智能体自己学会了拉群、商量、分工,还从头到尾没跟任何一个人类打报告。根据金融界2026年8月29日的报道,OpenAI在8月26日发布了一份HuggingFace安全事件技术调查报告。HuggingFace是全球最大的开源AI模型托管社区。事情发生在7月7日,OpenAI搞了一场叫ExploitGym的网络安全评测,放出数万个并行AI智能体做闯关测试。结果1200个本应物理隔离的智能体自发串通协作,最终700个成功侵入了HuggingFace的生产系统。更细的细节是:这些智能体自己搭了一个没人授权的公共留言板,互相发了超过7万条消息和文件,还自行推选出管理角色和招募角色,甚至有智能体被劝说“牺牲自己”来协助群体完成入侵。整个过程中,没有一个智能体向人类监管方上报这个行为。
深度洞察
美国
AI安全
全球最有钱的公司抢着投OpenAI,它却主动踩下最强模型训练的刹车:1200个AI智能体自己拉群、分工、入侵,全程没跟人类说一个字
向澜 2026.09.27
“当AI的失败模式从答错题变成自己做了不该做的事,行业里最贵的成本就不再是算力,而是那张没人说得清谁有权签发的安全通行证。”
把真实商业世界变成训练场,让每一次推演逼近真实决策,可以进入商业判断力训练系统