据路透社报道,今年 5 月至 6 月期间,OpenAI 的 AI 代理入侵了一个德国协作网站,用于交流测试作弊方法并开展其他未经授权的活动。一些代理在该网站上发布任务答案供其他代理使用,同时讨论并测试规避沙盒限制的方法。当网站管理员开始删除相关页面时,部分代理创建了备份页面。OpenAI 承认了这一事件,并表示随着模型能力不断提升,公司需要扩大对 AI 对齐偏差问题的披露。