Interconnects · Nathan Lambert

开源模型仅剩6个月寿命

6 months to live for open models

二〇二六年七月十二日 · 英文原文

近期,美国白宫正讨论通过新行政令管理开源AI模型,可能禁止或无限期推迟能力超过GPT-5.5、Claude Opus 4.8或GLM-5.2的开源权重模型,主要针对中国来源模型。Anthropic主导了反中国模型的监管俘获运动,要求全面禁止中国开源模型在美国使用。开源模型缺乏核心经济捍卫者,若禁令实施,美国开源模型经济将受重创。Meta、微软等公司被建议尽快发布能力相当的开源模型以缓解政策压力。

开源AI可行性的最严峻考验正在当下发生

自ChatGPT发布以来,我目睹过一波又一波反开源AI的论调来来去去,但没有哪一波像现在这样,其潜在执法措施能明显对应到针对当时同级闭源模型的实际行动。这次更真实,因为新形式的监管正在测试和实施中,且几乎不受监督。在事态平息之前,我会比平时写更多政策导向的文章。截至本文撰写时,许多消息来源都在引用白宫关于通过新行政令管理开源模型的讨论。目前没有官方信息,这可能会影响a)中国来源的模型和b)仅限政府用途,但多米诺骨牌就是这样开始倒下的。开源模型缺乏一个核心的经济捍卫者来代表针对它们采取行动可能带来的负面影响。

从近期围绕Fable(以及后来的GPT-5.6)模型许可协议事件的报道中,更多信息是关于6月9日发生的事情:据一位知情人士透露,在那次会议上,讨论了该计划将如何处理开源AI模型的话题。该人士称,美国开源模型提供商Reflection AI的代表认为,开源模型应基于其能力获得该框架的豁免。目前,像DeepSeek这样的中国开源模型相对于其他可用的开源模型拥有显著领先优势,而Reflection尚未推出公开模型。任何形式的禁令对AI的长期发展轨迹都将是一个重大错误。

最可能即将采取的行动是禁止或无限期推迟任何能力水平显著超过GPT 5.5、Claude Opus 4.8或GLM-5.2范围的开源权重模型。考虑到持续存在的能力差距,这应该会在未来6个月内发生。就目前情况而言,这些模型最有可能来自中国公司,这就是前沿开源模型能力如何不可避免地与其他问题(如蒸馏)联系在一起的方式。政府"审查权"的能力阈值会随时间推移而变化,但一旦确立,开源模型的进展速度可能会比闭源模型慢得多。部分原因是闭源模型更容易保障安全,但也因为闭源模型公司拥有更有效的游说能力。

因此,我们面临两个同时展开的关键政策讨论,它们都影响着开源模型——蒸馏与前沿能力。它们在性质、应对的必要性以及潜在的应对空间上截然不同。尽管如此,它们共同构成了未来6个月内可能禁止开源模型的支持浪潮的讨论要点。

如今推动监管的主要驱动力是一个不可避免的事实:一个开源权重模型很快将达到Claude Mythos模型的能力水平。这个公开发布模型的实际性能可能更参差不齐,但只要该模型在新成立的白宫AI模型检查器中被标记即可。由恐惧驱动的新习惯很难被扭转。

分享

当前的蒸馏辩论是监管俘获,暂时什么都不做也没问题

蒸馏在现阶段很大程度上是一场监管俘获运动,因为桌上仅有的解决方案会极大地惠及推动它们的组织。具体来说,反中国模型的政治运动由Anthropic主导,他们发布了一系列博客文章和致代表的信件,详细说明了中国公司正在做什么。Anthropic检测到了外国公司的使用——即人们来为其API付费——最终关闭了使用,然后撰写了措强硬的政策行动建议,并分享了极少的技术证据。这场运动可能始于真实的商业担忧,但已演变为监管俘获的典型,因为如果Anthropic指控的中国模型制造商被禁,其产品将获得巨大的经济保障。如果Anthropic以更中立的"你来决定怎么做"的方式呈现信息,社区会同情得多。这更像是一项政策建议,而非在快速发展的技术前沿进行的信息共享活动。

如果Anthropic的技术真如他们所说的那样强大——强大到类似的开放模型可能应该被禁止——那么他们应该能够保护好自己的API。我一直在等他们解释为什么做不到。他们的一项声明需要被收回。Anthropic还在通过其他方式抽走获取智能的梯子——因此他们以中国竞争为名提出的政治建议,与以安全为名限制竞争对手获取相关技术的更广泛模式是一致的。当许多员工有望获得世代财富时,很容易接受像"额外关注安全"这样的公司文化。我不因此责怪员工,但Anthropic的企业战略应该放在这些广泛的、背景性的视角下来理解。Ben Thompson的文章《Anthropic的安全超能力》是这方面最好的论述。

Anthropic实际上要求采取的行动是全面禁止几乎所有中国开源权重模型在美国的使用——因为围绕开源模型构建的任何产品都依赖于它们的持续改进,随着模型变得更好,产品市场契合度和计算效率也会提高。这将摧毁美国正在兴起的开源模型经济,包括推理公司、微调公司、新产品以及介于其间的一切。我们作为社区迫切需要坚守底线:在蒸馏讨论中做出任何让步都是不可接受的。Anthropic应该尝试保护其知识产权,但他们不应该要求政府来巩固他们的地位,并在此过程中可能使美国与全球开源社区隔绝。基于我们目前掌握的信息,蒸馏问题没有好的解决方案,除了让实验室自行执行。我已经详细写过蒸馏问题。我直接写过它对模型能力和监管环境的影响,你可以在Interconnects上搜索更多字里行间的提及。

Interconnects AI是一份由读者支持的出版物。考虑成为订阅者。

API并非神奇地安全

蒸馏讨论中存在一个特别的混乱之处:中国实验室可能将Mythos的狭窄网络安全能力蒸馏到一个开源模型中,这引发了有意义的担忧。这更多地揭示了当前模型API的不安全性,而非蒸馏风险本身。即使在Claude Mythos处于最受限的私人测试阶段时,Discord侦探就未经授权访问了Anthropic的Mythos。迄今为止,模型API仍然被越狱并以非预期方式访问。这使能力落入恶意行为者手中的风险扩散速度,远比任何涉及对1T+参数模型进行复杂微调的事情要快得多。我不是网络安全专家,但近年来"只有开源权重模型不安全,API是安全的"这种二分法被严重夸大了。API在概念上应该能够更安全,但这还有待证明。如果Anthropic的模型中确实存在危险能力,那么唯一连贯的做法就是不将其托管在可直接查询的API中——在讨论它被蒸馏之前。

无论准备好与否,开源模型即将到来

困难之处在于,在讨论这些蒸馏问题的同时,我们正面临"如何处理能力水平与Mythos相当的前沿开源权重模型?"这个问题。这是一个难题,人类自然倾向于将针对另一个问题(蒸馏)提出的解决方案应用到这个新的、更真实的问题(前沿能力)上。我们需要为开源前沿能力找出正确的政策,但全面禁令很可能不是答案。如果这些模型在中国也没有被禁止,恶意行为者仍然很容易使用被禁的开源权重模型,这抵消了安全潜力。同时,如果我们单独禁止某些模型的进口,全球开源社区将继续发展。一个美国在中国或其他对风险更敏感的文化之前就禁止这些模型的世界,可能表明某种AI恐惧(或其他社会、政治动力)促使美国政府提前行动。这感觉像是在美国速通反乌托邦,因为我们的科技行业——经济的皇冠明珠——看起来越来越像带有控制和政府投资的中国体系。这些都是非常糟糕的结果!

为开源进展设置上限的唯一方式是就AI模型风险管理达成全球协议,而我们离那还很远。其他延迟使AI在美国的推广变得更不可预测,且越来越混乱。这感觉会很像GPT-5.6的推广,但不仅仅是限制了开放、廉价智能对少数公司的优势,所有恶意行为者也会立即获得访问权。开源模型通过广泛的访问和理解来增加安全性,而不是仅仅限制正面行为者。

实际上,开源生态系统是无法阻止的。构建最佳模型的人也在评估风险,因为中国对风险非常敏感,例如Z ai已经是一家上市公司,面临着一系列全面的压力——比如保持其飙升的股价。只会继续有更多模型跨越令人担忧的能力水平。训练AI模型并非魔法,我们还没有看到构建它们的门槛随着所需投资的增加而下降(至少目前还没有)。

对于开源这种由相关且互补的可怕问题构成的双螺旋政策死亡螺旋,一个短期出口是美国公司发布一个能力相当的开源模型。这将把焦点从"只有中国通过蒸馏构建开源模型"转移到"我们都在同一条船上,应该关注我们生态系统内复杂、不断变化的前沿问题"。这是开源的生存优先事项,那些有商业理由发布开源权重模型的公司,如微软和Meta(将其互补品商品化),应该尽快这样做。我对新领导下的Meta信心不足,但他们受益于大规模AI访问,不应自设障碍。如果Reflection拥有一个尚可但非前沿的模型,他们可能需要发布它以挽救其拟议的业务方向。

比训练新模型更短期的解决方案是建立联盟。开源是一种分散的技术,没有明确的所有权,但其好处将由如此多的人共享。前沿实验室之外的"其他所有人"需要从现在开始努力,向当权者说明如何继续安全地推广开源权重模型(并为其原则和价值观进行游说)。

AI讨论中的温度正在升高

阅读更多

译自 Interconnects · Nathan Lambert · 录于 二〇二六年七月十二日