UK AI Security Institute

发布 AISI 工程手册

Releasing AISI’s Engineering Playbook

二〇二六年六月十九日 · 英文原文

2024年5月,AI安全研究所(AISI)开源了Inspect工具包,用于评估前沿AI模型能力。Inspect支持结构化、多步骤、可重复的测试,配套项目Inspect Evals包含200多个预构建评估任务。METR从内部Vivaria平台迁移至Inspect,使用228个任务进行时间跨度评估,结果被2026年国际AI安全报告引用。Apollo Research弃用内部框架,全面采用Inspect。AISI同步发布工程手册,将评估基础设施分为评估、隔离、连接、运行和扩展五个层级,提供技术概述、解释说明及开源代码链接,旨在帮助研究人员和组织构建评估能力。

2024年5月,AI安全研究所开源了Inspect AI,这是一个用于评估前沿AI模型能力的工具包。Inspect支撑了AISI的许多前沿评估工作,将其开源使我们能够与更广泛的社区分享这些评估能力。

基于Inspect的发展势头,今天我们发布了AISI工程手册,这是一份完整的资源,记录了我们在评估前沿AI系统过程中开发的方法和实践。

虽然Inspect提供了开源工具,但大规模评估前沿AI需要复杂的支撑基础设施才能有效运作。研究人员需要运行不可信代码的环境、管理和审计模型提供商调用的方式、托管模型的计算资源,以及将这一切整合起来的工作体系。这些工作大多不可见、鲜有文档记录,并且每个尝试严肃评估的团队都需要从头开始构建。

通过不仅开源Inspect,还在可能的情况下开源我们的方法和基础设施,我们希望帮助研究人员、组织和其他评估者建立起严谨的评估能力,而无需从零开始。我们希望工程手册能为研究人员和组织提供关于我们评估流程的宝贵见解。

访问手册请点击此处

Inspect是什么,它如何被使用?

Inspect使AI研究人员能够为AI模型设置结构化、多步骤且可重复的测试,然后以可衡量的方式对这些测试进行评分、比较模型,并保留详细的评估日志、追踪、指标和报告。配套项目Inspect Evals包含200多个预构建的评估任务,可在任何模型上直接运行,涵盖编码、智能体任务、推理、知识、行为和多模态理解等领域的广泛开放基准测试。

Inspect已被广泛的研究人员、公司和组织使用:

Inspect也发展成了一个社区,汇聚了来自世界各地的研究人员。自从开源Inspect以来,我们见证了它的成长,仅inspect_ai项目就迎来了240多位贡献者。今天标志着评估社区迈出了下一步:发布AISI的工程手册。

新手册包含什么内容?

工程手册是一份关于构建AI评估能力的开放指南,它将评估的广泛基础设施分解为五个层级——评估(Evaluate)、隔离(Isolate)、连接(Connect)、运行(Run)和扩展(Scale)。

用户可以从任何地方开始,但这些能力共同构成了一个用于构建和运行评估的完整平台。

手册概述如下:

除了技术概述和解释说明,手册还深入探讨了每个能力部分,并附有指向现有开源代码的链接。

访问手册请点击此处

谁应该使用手册?

手册是为任何正在构建评估能力的人编写的,无论是首次运行评估的单个研究人员,还是从零开始搭建基础设施的组织。它可以以多种方式使用:

下一步是什么?

AISI花了两年时间构建评估前沿AI系统的技术栈,我们认为分享它可以降低其他人做同样事情的门槛。随着前沿AI变得愈发强大和复杂,保持大规模进行高质量评估的能力变得至关重要。

本次发布是我们当前如何评估前沿AI的一个快照,而非最终产品。随着我们的方法不断演进,以及严谨评估背后的工具和基础设施持续成熟,我们将持续更新手册。

我们希望Inspect框架和新手册能够继续发展,并支持前沿AI评估工作。让我们共同致力于开源、严谨且更好的AI系统评估的持续发展。

“我创建Inspect是因为我想为政府、研究人员和实验室提供一个坚实的技术基础,以便他们合作测试和理解前沿模型。我很高兴看到这么多组织采用它,并接受了数百名用户的贡献。” ——JJ Allaire,Inspect创建者及Meridian Labs创始人

“Inspect绝对是METR评估的核心,我们在此基础上构建了自己的开源云端评估平台,并积极向Inspect代码库贡献代码,以运行更大、更复杂的评估。” ——Mischa Spiegelmock,METR技术团队成员

译自 UK AI Security Institute · 录于 二〇二六年六月十九日