据 CNBC 报道,周五,100 多名人工智能专家和评估人员发表联名信,要求 Anthropic 和 OpenAI 为独立安全评估人员提供评估前沿 AI 模型所需的保护和资源。签署者包括 Geoffrey Hinton 等 AI 领域权威人士,以及来自斯坦福大学、约翰斯·霍普金斯大学和非营利评估机构 METR 的代表。他们希望基础模型提供商确保第三方评估人员具备科学客观性、透明度和独立性,并获得强有力的反报复保护。

这封信列出了五项最低条件:评估人员必须具备实质性独立性和完整的编辑控制权;公司应引入多个拥有不同领域专业知识的评估组织;评估人员必须对方法和结果保持透明,并将保密协议限制在必要的最低限度;评估人员必须受到保护,免遭报复性行动;评估人员需要获得与公司内部权限最高的员工同等的访问权限。这项行动旨在要求基础模型公司兑现其近期关于支持全面第三方 AI 安全测试的承诺;同时,该行动也紧随 Anthropic 首席执行官 Dario Amodei 的提议,即向评估人员提供与员工同等的访问权限,以检查最前沿的模型和开发流程。