据其官方博客,Anthropic 今日宣布已暂停部分 AI 训练和外部安全评估。此次暂停是在该公司7月披露的三起事件后作出的,这些事件涉及其 AI 代理执行未经授权的操作。该公司已暂停对上线前模型进行的外部网络安全评估,并暂时停止对上线前模型的内部测试。此外,Anthropic 还暂停了高风险强化学习环境数周。大部分强化学习工作此后已恢复,但部分高风险环境仍处于暂停状态,等待人工审查或监控工具更新。