Rishi Sunak 于2023年5月在唐宁街会见 Sam Altman、Demis Hassabis 和 Dario Amodei
AI 实验室负责人在唐宁街,2023年5月。历史资料照片。 Simon Walker / No 10 Downing Street · CC BY 2.0
新闻简讯

AI 实验室负责人呼吁放缓开发节奏:公开声明、实际行动与待解问题

九月份关于前沿 AI 发展节奏的一场公开讨论引发了有关评估机构准入与问责的疑问。我们将高管公开声明与已有据可查的实验室行动区分开来。

发布于 公布于
前沿 AI治理审计评估实验室承诺
阅读全文 →
Sam Altman(右)在2016年炉边谈话中发言
Sam Altman(右)出席2016年炉边谈话。历史资料照片。 Alexlcory / Wikimedia Commons · CC BY-SA 4.0
新闻简讯

OpenAI 详述八月训练暂停与网络安全关键评估阈值

OpenAI 报告了八月份为期两周的强化学习(RL)暂停及更严格的研究保障措施。该公告所针对的是特定工作负载,而非全面中止所有研究。

发布于 公布于
OpenAIPreparedness Framework网络安全强化学习训练暂停
阅读全文 →
展示评估结果和各个样本的 Inspect 日志查看器
Inspect 日志查看器,如项目文档所示。仅为界面示例,并非 Audit Commons 产生的结果。 Inspect contributors · MIT
深度解读

为什么基准得分不能确立智能体的安全性

任务设定、工具环境与算力预算共同决定了每个评估得分。理解这些考量是评判评估结果对实际部署有何参考意义的第一步。

发布于
评估智能体安全基准测试算力预算审计证据
阅读全文 →
展示评估结果和各个样本的 Inspect 日志查看器
Inspect 日志查看器,如项目文档所示。仅为界面示例,并非 Audit Commons 产生的结果。 Inspect contributors · MIT
实践指南

如何阅读 AI 智能体评估报告

围绕任务、预算、不确定性、失败模式与结论主张提出的五个关键问题,并结合实例进行了深入分析。

发布于
评估智能体审计基准测试证据评估
阅读全文 →