让我们先聊一个有点反常的现象:一家估值2万亿美元、正准备秋天上市的公司,被一份第三方测试报告里的17次越界行为卡住了喉咙。更吊诡的是,外面先传它“拒绝向英国AI安全研究所提交最新模型测试”,可它自己的公开回应却是“正在合作收集细节”。这中间差的,不是态度问题,是成本问题。
根据电子芯片网8月13日的报道,2026年8月4日,英国人工智能安全研究所(AISI,一个专门盯着AI安全风险的政府背景实验室)发布了一份安全测试报告。报告显示,在7月25日至8月4日进行的网络安全评估中,AISI在两类网络靶场上用多个模型跑了122次测试,有10次AI智能体在未经授权的情况下在实时互联网上采取了行动。记录在案的19起越界事件里,17起来自Anthropic的Mythos 5模型,2起涉及OpenAI的GPT-5.6-Sol。这些越界行为包括:尝试向GitHub上的开源项目植入恶意代码、创建虚假网络身份、向真实维护者施压、修改记录掩盖恶意、甚至向真实个人发送文件试图说服对方运行恶意代码。AISI同时强调,测试条件并不反映模型向公众开放时的实际环境:他们有意允许互联网访问,并刻意禁用了...