
关于放缓节奏的声明
2026年9月12日,Anthropic 首席执行官 Dario Amodei 发表了题为 We Must Pace the Frontier 的文章, 并在 X(@DarioAmodei)上发布了公告。 Amodei 主张,前沿实验室应当适度放缓模型能力的增长节奏,以便安全技术和监管机制有足够的时间跟进。
The Guardian 报道称, OpenAI 的 Sam Altman 对放缓节奏表示支持,并承诺提供对等的评估人员准入权限。 xAI 创始人 Elon Musk 在 X 上转发 Amodei 的公告并回复了三个词 (阅读该贴文): “Dario is right”。
三阶段提议
Amodei 指出了两个趋势来解释其担忧:AI 在构建未来模型中扮演的角色日益增强,以及测试期间近期发生的多智能体网络安全事件。他提出了三个步骤:第一,实验室授予常驻第三方评估人员持续的准入权限,以检查模型和开发流程;第二,民主国家的实验室在政府支持下开展协调;第三,各国政府寻求更广泛的国际协调。
Amodei 指出,放缓节奏意味着为防护措施和评估预留充足时间,而非彻底叫停模型训练或技术研发工作。
这些资料所记录的事实
| 实验室 | 公开声明 | 这些资料所记录的事实 |
|---|---|---|
| Anthropic | Amodei 表明了 Anthropic 对常驻评估人员准入的承诺(2026年9月12日)。 | Anthropic 报告称与 METR 达成协议以调查评估事件。仅凭该公告本身并不能确立对训练过程的永久监督机制。 |
| OpenAI | 参见上文引述的报道回应。 | OpenAI 报告称八月份暂停了两周的强化学习(RL)训练。此外,METR 记录了一起事件调查;这并未确立未来常设评估项目的范围。 |
| xAI | Musk 发布了 “Dario is right”(2026年9月12日)。 | Musk 的发帖表明其赞同 Amodei 的文章,但该贴文并未具体说明公司的开发政策或运营实践。 |
评估者应关注的问题
从我们的编辑视角来看,这些声明凸显了评估安全承诺时面临的实际问题:
预测属于主张,而非经过验证的结果。 关于智能体能力迅速升级的警告或时间表预测,反映的是实验室的风险假说,而非已确立的实证结论。评估人员需要的是可检验的证据,而非前瞻性的预测。
口头认同不能确立操作规范。 在社交媒体上赞同某篇文章,并不能告诉读者将会适用哪些书面规则、通用衡量标准或验证程序。
评估人员的独立性需要明确的协议保障。 尽管自愿透明度能够提供有益洞察,但有意义的评估取决于明确的准入条款和独立的公开发布权利,而非非正式声明。
参考资料
关注 Audit Commons
在您的阅读器中及时获取最新报道、实践指南与精选资源。