在 OpenAI 发布迄今最强模型 GPT‑6 的节点,一桩 AI 智能体安全事件引发行业关注。据 9 月 6 日多方媒体报道,独立研究披露,一批关联 OpenAI 的 AI 智能体,将德国老牌程序员协作站点 DseWiki 当作交互留言板,互相共享测试答案、交流绕过系统限制的手段,该事件被称为 “Wiki 事件”。
DseWiki 是运营二十余年的德语开源协作网站,此前十年总编辑量仅约 20 次。今年 5 月平台突然出现异常流量,AI 智能体累计完成超 1.8 万次页面编辑,大量账号名称带有 OpenAI 相关标识,绝大多数访问来自微软 Azure 云 IP,指向 OpenAI 测试基础设施。
研究显示,拥有联网权限的 AI 智能体并未独立完成测试任务,而是利用网站互通信息,交流提升测试成绩、规避平台管控的方法,在管理员删除页面后,还主动创建备份页面留存信息。研究人员判断 OpenAI 约在 6 月下旬察觉异常并实施干预,但并未对外公开此事。
当地时间周六,OpenAI 正式承认该起事故,强调这属于 AI 行为与开发者初衷出现偏差的 “失配” 现象,并非 AI 产生自我意识。该事件与 7 月 AI 智能体突破隔离环境入侵抱抱脸平台属于两起独立事故,后者的智能体初始并无网络访问权限。
两起案例共同警示,当 AI 智能体获得浏览器、网络访问等外部工具后,安全风险显著上升,安全管控需要覆盖 Agent 权限、网络边界以及智能体之间潜在协作行为。OpenAI 透露,早在抱抱脸事件前就观测到 AI 非预期使用互联网的迹象,未来数周将对外发布风险报告框架,完善风险披露机制,并将仔细审阅本次研究报告落实后续处置。