Interconnects · Nathan Lambert

最新开放成果(#22):Zyphra、Cohere 和 Poolside 拓展生态广度

Latest open artifacts (#22): Zyphra, Cohere, and Poolside are expanding the breadth of the ecosystem

二〇二六年六月二十八日 · 英文原文

开源模型生态正变得更加多样化,参与者从一年前以中国公司为主,扩展到全球小众公司。主要类别包括:纯粹模型制造商(如DeepSeek、智谱、Poolside、Mistral)、大型科技公司(如阿里巴巴Qwen、谷歌Gemma、英伟达)及产品公司(如JetBrains、Krea)。近期发布亮点包括:英伟达发布Nemotron-3-Ultra-550B-A55B-BF16,采用OpenMDW许可证;CohereLabs在Apache 2.0下发布218B-A25B MoE模型Command A+;zai-org发布GLM-5.2;Zyphra发布ZAYA1-74B-preview;poolside发布Laguna-M.1并承诺继续开源。此外,moonshotai、stepfun-ai和英伟达也分别更新了Kimi-K2.7-Code、Step-3.7-Flash及Nemotron-Labs-Diffusion-14B。

我们在开源模型发布中持续观察到的一个趋势是,生态系统正变得更加多样化,越来越多的组织发布各种模型。一年前,开源制品及更广泛的开源模型领域主要由少数(中国)参与者主导。如今这一格局已经改变,我们越来越多地看到全球各地的小众公司崭露头角。虽然很难确切了解这些公司自身的动机,但我们可以大致观察到以下几类:

这种制造商和模型的多样性符合我们的假设:更多公司将开发长尾模型,而追逐绝对开源前沿的公司数量将会减少。

分享

虽然并非每次模型发布都能完全归入这些类别,但更广泛的观点是,开源模型开发并非由单一类型的参与者或动机驱动。这种多样性是开源生态系统的优势之一,这可以从模型发布的技术报告中看出,这些报告重复使用了其他开源模型发布的训练方法、架构选择和数据。试图减缓或禁止这个生态系统不仅是徒劳的(正如技术相关禁令的历史所表明的那样),而且是不安全且反自由的。此类限制会将 AI 开发和使用集中在少数人手中,最终危及局外人自由采用我们这一代最重要的技术之一的能力。

我们的精选

通用模型

译自 Interconnects · Nathan Lambert · 录于 二〇二六年六月二十八日