1. 第一步 · 核心概念

    是什么让 AI 具备可审计性?

    预估用时: 阅读用时:约 2 分钟
    学习目标

    区分评估、监控与审计的边界,并理解为何模型内部文本不能证明外部行动确实发生。

    相关实践资源
  2. 第二步 · 报告评估

    如何阅读 AI 智能体评估报告

    预估用时: 阅读用时:约 4 分钟 | 案例演练:约 10 分钟(共计约 14 分钟)
    学习目标

    围绕任务、算力、样本量、失败模式与结论边界提出五个关键问题,判断评估证据是否支撑其结论。

    展示评估结果和各个样本的 Inspect 日志查看器
    Inspect 日志查看器,如项目文档所示。仅为界面示例,并非 Audit Commons 产生的结果。 Inspect contributors · MIT
    相关实践资源
  3. 预估用时: 阅读用时:约 4 分钟 | 工作表演练:约 15 分钟(共计约 19 分钟)
    学习目标

    对照五项可观察证据要素审查外部工具调用,并在纯文本工作表中记录限定性结论。

    来自 auditable 项目的审计报告示例
    来自维护者项目 auditable 的示例报告。其字段展示了一种具体实现,并非通用的报告标准。 yzhao062/auditable · Apache-2.0
    相关实践资源