第三方评测标准 AEF-1 不是这周才有的,这周变的是实验室终于来了:OpenAI 跟上 Anthropic,xAI 也联署

AEF-1 是 AI Evaluator Forum 推出的自愿性标准,给第三方评测方提供一套用来证明「自己是在什么条件下做出这份评测」的标准与检查清单,合规方式是填完清单并随评测结果一并公布。它覆盖五项原则:充分的访问与资源、最小化利益冲突、分析自主性、方法与结果透明、敏感信息保护;在访问一项上,它建议外部评测方能拿到系统提示词、训练过程与数据的信息、既有的内部评测结果,以及已知漏洞的信息,并要求具备「足以评估所评特性的技术访问」。需要先纠正一个时间线:这个论坛 2025 年 12 月就成立了,标准与一份 40 多位业内人士联署的公开声明同期发布——比这一周的新闻早了约九个月。真正在这周发生变化的是实验室的态度:OpenAI 跟上了 Anthropic 的嵌入式评估者承诺,xAI 也一并联署。Anthropic 一方对开放程度的描述相当具体:办公室工位、门禁卡、公司笔记本,权限大致相当于内部风险评估团队。组织者 Conrad Stosz 曾任美国 AI 标准与创新中心代理主任。

先把时间线摆正

这一周的报道容易读成「一个新标准出现了」。实际上 AEF-1 和它背后的论坛在 2025 年 12 月就已经存在,当时还配了一份 40 多人联署的声明,主张第三方评测的条件应当更透明,论坛成员也说过会在后续的评测里开始采用它。 所以新闻不在标准,在于**实验室走过来了**。这个区别重要,因为它决定了该盯什么:一份自愿标准放着九个月没人用,和三家前沿实验室公开对齐到同一份标准上,是两件完全不同的事。

它回答了我们上周留下的四个问题里的两个

本站 9 月 14 日写过 Amodei 的《We Must Pace the Frontier》和 Altman 数小时后认领的那一条——让独立评估者拿到「类员工级别的访问权限」。当时我们说这句话之所以有分量,是因为它可以拆成四个具体问题:评估者是谁、访问到什么程度、结果公开到什么程度、从哪个模型开始。 AEF-1 把其中两个答上了。 **评估者是谁**:AEF 的成员机构。评论里也顺手点出了这件事的另一面——这些成员大概率会成为头部实验室招募的主要第三方审计方。 **访问到什么程度**:标准给的清单相当具体——系统提示词、训练过程与数据的信息、既有的内部评测结果、已知漏洞的信息,外加一条兜底要求「足以评估所评特性的技术访问」。Anthropic 那边的具体描述更像一份入职清单:办公室工位、门禁卡、公司笔记本,权限大致对应内部风险评估团队。这比「类员工级别」这个形容词落地得多。 剩下两个问题还没有答案:**结果公开到什么程度**,以及**从哪个模型开始**。这是接下来三到六个月该追的两项。

自律模式的老问题没有被解决

必须把批评意见写清楚:如果 AEF 成员同时是标准的制定方和被头部实验室雇来做审计的一方,那「独立」就成了一个需要额外证明的东西——评估者的收入来自被评估者,这是审计行业反复处理过、也反复出问题的结构。 AEF-1 的设计对此有一个部分回应:五项原则里包括「最小化利益冲突」和「分析自主性」,而合规方式是把检查清单随结果一起公布。也就是说它不承诺独立,而是要求**把条件摊开给读者判断**。这个思路是对的——对读评测报告的人,从现在起多了一个具体动作:**看有没有附那份清单,以及清单上访问一栏勾了什么。**没附的评测,和附了但访问项大面积空白的评测,可信度不一样。 另外要说清边界:AEF-1 是自愿性标准,没有强制力,也没有对违反的后果做安排;实验室的承诺目前同样是自愿的公开表态。本站 9 月 14 日说过,pacing 这类主张缺执行机制,这句话在这里依然成立。变化是从「一句主张」到「一套可以被对照的条件清单」——这一步不小,但它还不是约束。

via: AI Evaluator Forum:第三方评测的最低运行条件AI Evaluator Forum 发布公告Latent Space / AINews 对本周实验室联署的梳理