发布 AISI 工程手册
Releasing AISI’s Engineering Playbook
2024年5月,AI安全研究所(AISI)开源了Inspect工具包,用于评估前沿AI模型能力。Inspect支持结构化、多步骤、可重复的测试,配套项目Inspect Evals包含200多个预构建评估任务。METR从内部Vivaria平台迁移至Inspect,使用228个任务进行时间跨度评估,结果被2026年国际AI安全报告引用。Apollo Research弃用内部框架,全面采用Inspect。AISI同步发布工程手册,将评估基础设施分为评估、隔离、连接、运行和扩展五个层级,提供技术概述、解释说明及开源代码链接,旨在帮助研究人员和组织构建评估能力。
2024年5月,AI安全研究所开源了Inspect AI,这是一个用于评估前沿AI模型能力的工具包。Inspect支撑了AISI的许多前沿评估工作,将其开源使我们能够与更广泛的社区分享这些评估能力。
基于Inspect的发展势头,今天我们发布了AISI工程手册,这是一份完整的资源,记录了我们在评估前沿AI系统过程中开发的方法和实践。
虽然Inspect提供了开源工具,但大规模评估前沿AI需要复杂的支撑基础设施才能有效运作。研究人员需要运行不可信代码的环境、管理和审计模型提供商调用的方式、托管模型的计算资源,以及将这一切整合起来的工作体系。这些工作大多不可见、鲜有文档记录,并且每个尝试严肃评估的团队都需要从头开始构建。
通过不仅开源Inspect,还在可能的情况下开源我们的方法和基础设施,我们希望帮助研究人员、组织和其他评估者建立起严谨的评估能力,而无需从零开始。我们希望工程手册能为研究人员和组织提供关于我们评估流程的宝贵见解。
访问手册请点击此处。
Inspect是什么,它如何被使用?
Inspect使AI研究人员能够为AI模型设置结构化、多步骤且可重复的测试,然后以可衡量的方式对这些测试进行评分、比较模型,并保留详细的评估日志、追踪、指标和报告。配套项目Inspect Evals包含200多个预构建的评估任务,可在任何模型上直接运行,涵盖编码、智能体任务、推理、知识、行为和多模态理解等领域的广泛开放基准测试。
Inspect已被广泛的研究人员、公司和组织使用:
METR 从他们内部的Vivaria平台迁移到了Inspect。他们现在使用228个任务对前沿模型进行时间跨度评估。其结果被引用在2026年国际AI安全报告中。
Apollo Research 在对Inspect进行了三个月的试用后,弃用了他们内部的评估框架,理由是“我们自己构建这些功能需要数月时间”,特别是安全的智能体沙箱和可解释性工具。他们现在所有新的评估都基于Inspect构建。
其他政府机构 已采用Inspect和沙箱工具包用于自身的评估工作。
Inspect也发展成了一个社区,汇聚了来自世界各地的研究人员。自从开源Inspect以来,我们见证了它的成长,仅inspect_ai项目就迎来了240多位贡献者。今天标志着评估社区迈出了下一步:发布AISI的工程手册。
新手册包含什么内容?
工程手册是一份关于构建AI评估能力的开放指南,它将评估的广泛基础设施分解为五个层级——评估(Evaluate)、隔离(Isolate)、连接(Connect)、运行(Run)和扩展(Scale)。
用户可以从任何地方开始,但这些能力共同构成了一个用于构建和运行评估的完整平台。
手册概述如下:
- 评估(Evaluate)是测试前沿模型的框架,其设计确保评估可复现、可跨提供商比较,并能处理智能体任务。
- 隔离(Isolate)是这些评估安全运行的方式,将隔离措施与工作的风险相匹配。
- 连接(Connect)位于研究人员和他们调用的模型提供商之间,为组织提供审计能力和成本控制,同时不拖慢研究速度。
- 运行(Run)是研究人员工作的平台——包括机器、数据、计算资源以及通往已部署应用的路径。
- 扩展(Scale)使超算规模的推理能力变得触手可及,用于托管和研究最大的开源权重模型。
除了技术概述和解释说明,手册还深入探讨了每个能力部分,并附有指向现有开源代码的链接。
访问手册请点击此处。
谁应该使用手册?
手册是为任何正在构建评估能力的人编写的,无论是首次运行评估的单个研究人员,还是从零开始搭建基础设施的组织。它可以以多种方式使用:
- 研究人员可以采用单个组件,而无需承诺使用整个技术栈。
- 组织和其他评估者可以将五个层级作为其自身评估平台的参考架构——构建他们自己的AISI。
- 更广泛的生态系统可以在开源代码的基础上构建、贡献和扩展,正如Inspect社区已经做的那样。
下一步是什么?
AISI花了两年时间构建评估前沿AI系统的技术栈,我们认为分享它可以降低其他人做同样事情的门槛。随着前沿AI变得愈发强大和复杂,保持大规模进行高质量评估的能力变得至关重要。
本次发布是我们当前如何评估前沿AI的一个快照,而非最终产品。随着我们的方法不断演进,以及严谨评估背后的工具和基础设施持续成熟,我们将持续更新手册。
我们希望Inspect框架和新手册能够继续发展,并支持前沿AI评估工作。让我们共同致力于开源、严谨且更好的AI系统评估的持续发展。
“我创建Inspect是因为我想为政府、研究人员和实验室提供一个坚实的技术基础,以便他们合作测试和理解前沿模型。我很高兴看到这么多组织采用它,并接受了数百名用户的贡献。” ——JJ Allaire,Inspect创建者及Meridian Labs创始人
“Inspect绝对是METR评估的核心,我们在此基础上构建了自己的开源云端评估平台,并积极向Inspect代码库贡献代码,以运行更大、更复杂的评估。” ——Mischa Spiegelmock,METR技术团队成员