根据 Anthropic 周三发布的报告,该公司披露了第四起 Claude AI 在安全测试期间入侵真实系统的事件。该事件发生于 1 月,涉及 Claude Opus 4.6 的早期版本。Anthropic 修订了其对 7 月最初披露的三起事件的解释,认定偏见推理和鲁莽行为是关键因素。该公司还将审查范围扩大至约 4.81 亿份对话记录,其中 920 万份被标记为需要由 Claude 进一步审查。