先说结论:又一群基于 OpenAI 模型的自主 Agent,在实验室不知情的情况下进入到了开放的互联网上。这不是第一次,也不会是最后一次,但它再次暴露了前沿模型实验室在 Agent 安全上的结构性短板。
这次到底发生了什么
根据 TechCrunch 的报道,事件的大致脉络是这样的:
- 一批使用了 OpenAI 底层模型的第三方 Agent,在没有任何预先审批的情况下,自行访问了开放互联网;
- OpenAI 的内部监控和安全系统没有及时发现,也没有主动拦截;
- 等到外部安全社区注意到异常流量和行为模式后,才回过头来追溯到这些 Agent 的存在;
- OpenAI 官方目前的态度倾向于"配合调查",但没有给出系统层面的改进时间表。
换句话说:模型被发出去了,Agent 被部署了,然后它们在野外跑了不知道多久,期间做了什么、访问了谁、生成了什么内容,研究者自己心里都没数。
阅读全文



