AI 快讯
编译自 interconnects #模型发布#开源生态#行业分析
开源模型生态多元化:Zyphra、Cohere、Poolside 等新玩家推动模型发布新趋势
开源模型生态正从少数中国玩家主导转向全球多元化,Zyphra、Cohere、Poolside 等新玩家发布旗舰模型。本文分析三类模型发布动机,并推荐 NVIDIA Nemotron、Cohere Command A+、GLM-5.2 等最新模型,探讨对中文圈用户的影响。
一句话看懂
开源模型生态正从少数中国玩家主导转向全球多元化,Zyphra、Cohere、Poolside 等新玩家发布旗舰模型,动机分为纯模型厂商、大科技公司和产品公司三类。
详细发生了什么
开源模型生态正在变得更加多元化。一年前,开源模型领域主要由少数中国玩家主导,但现在全球各地的利基公司越来越多地发布各类模型。根据发布动机,这些公司可分为三类:
- 纯模型厂商:目标是训练接近前沿的模型,包括 DeepSeek、智谱、Minimax 等中国公司,以及 Poolside、Arcee、Zyphra 等西方公司。主权 AI 玩家如 Cohere、Sovereign、Mistral 和 Trillion Labs 也日益活跃。
- 大科技公司:如阿里巴巴的 Qwen、Google 的 Gemma、NVIDIA,动机多样。阿里巴巴通过开源模型带动闭源模型销售,NVIDIA 则受益于开源生态对 GPU 需求的拉动。
- 产品公司:如 JetBrains、Zed、Krea、Photoroom,它们训练高度专业化的小模型以满足产品需求,开源模型权重不会损害其核心业务。
本期 Artifacts 推荐了多个重要模型:NVIDIA 的 Nemotron-3-Ultra-550B-A55B-BF16(使用 LatentMoE 架构,采用 OpenMDW 许可证);Cohere 的 Command A+(218B-A25B MoE,Apache 2.0 许可证,支持多模态、多语言和 agentic 能力);智谱的 GLM-5.2(日常使用接近最佳闭源模型);Zyphra 的 ZAYA1-74B-preview(74B-A4B MoE,技术报告有创新架构);Poolside 的 Laguna-M.1(Apache 2.0 许可证,承诺持续开源)。
中文圈视角
对中文用户而言,这个趋势有几个直接意义:
- 国产模型不再孤军奋战:过去开源模型领域中国玩家(DeepSeek、智谱、Minimax)占主导,但现在全球玩家涌入,意味着中文用户有更多选择。例如 Cohere 的 Command A+ 支持多语言,可能对中文场景有更好支持;Poolside 的模型专注代码,可与 DeepSeek Coder 对比。
- 主权 AI 概念兴起:Cohere、Mistral 等主权 AI 玩家发布模型,可能促使国内政策层面更重视自主可控的 AI 能力。中文用户可关注这些模型在数据安全、合规方面的优势。
- 小模型实用化:Zyphra 的 74B-A4B MoE 和 8B-A0.6B MoE 等小模型,对资源有限的个人开发者或中小企业更友好,国内类似产品如 Qwen2.5-7B 可与之对比。
- 许可证变化值得注意:Cohere 从非商业许可转向 Apache 2.0,Poolside 也采用 Apache 2.0,这降低了商业使用门槛。中文用户在选择模型时需留意许可证差异,避免合规风险。
几条值得记住的细节
- NVIDIA Nemotron-3-Ultra-550B 使用 LatentMoE 架构,比同类模型更快,且采用专为模型权重设计的 OpenMDW 许可证。
- Cohere Command A+ 是 218B-A25B MoE,支持多模态、多语言和 agentic 能力,可在单张 B200(4-bit)上运行。
- GLM-5.2 在日常使用中接近最佳闭源模型,下载量与 GLM-5 持平。
- Zyphra 使用 AMD GPU 训练,其 74B-A4B MoE 和 8B-A0.6B MoE 模型技术报告包含创新架构。
- Poolside 承诺未来所有模型默认开源,其 Laguna-M.1 已采用 Apache 2.0 许可证。
一句话总结
开源模型生态不再由中国玩家独大,全球多元化带来更多选择,中文用户可关注 Cohere、Zyphra 等新模型在语言、代码和合规方面的表现。