AI 快讯
编译自 the_decoder #模型发布#国产芯片#行业分析
美团LongCat-2.0:1.6万亿参数模型完全基于国产芯片训练,无需英伟达
美团成功训练1.6万亿参数AI模型LongCat-2.0,全程使用国产芯片,未依赖英伟达。这证明中国在高端AI芯片受限下仍能训练超大模型,对国产AI生态和替代方案具有重要意义。
一句话看懂
美团训练出1.6万亿参数的LongCat-2.0模型,全程使用国产芯片,未依赖英伟达GPU。
详细发生了什么
美团宣布成功训练了名为LongCat-2.0的AI模型,参数量高达1.6万亿,且整个训练过程完全基于国产芯片,没有使用任何英伟达产品。这一成果表明,在美国对华芯片出口限制的背景下,中国企业仍能通过自主芯片和优化技术训练大规模AI模型。LongCat-2.0的具体架构和性能细节尚未完全公开,但美团表示该模型在多个内部任务上达到了业界领先水平。训练过程中使用的国产芯片来自华为昇腾系列,通过分布式训练和通信优化克服了单芯片算力不足的问题。
中文圈视角
这对中文AI圈意义重大。首先,它直接回应了“离开英伟达中国AI就会停滞”的论调。华为昇腾芯片虽然单卡算力不如英伟达H100,但通过大规模集群和软件优化,仍能训练万亿参数模型。国内企业如百度、阿里、字节跳动一直在探索国产芯片替代方案,美团的成功为它们提供了可复用的经验。其次,LongCat-2.0的发布可能加速国产AI芯片在训练场景的普及,降低对进口芯片的依赖。不过,普通用户暂时无法直接使用该模型,美团尚未公布开源或API计划。对于开发者而言,这意味着未来国产大模型的训练成本可能进一步下降,但需要关注国产芯片生态的兼容性和工具链成熟度。
几条值得记住的细节
- LongCat-2.0参数量1.6万亿,与GPT-4相当,但训练完全使用国产芯片。
- 训练集群基于华为昇腾910B芯片,通过自研通信库实现高效并行。
- 美团未公布具体训练时间和成本,但表示效率接近英伟达集群的80%。
- 该模型主要用于美团内部业务,如智能配送、搜索推荐等场景。
- 目前没有开源或对外提供API的计划。
一句话总结
美团用国产芯片训练出万亿参数模型,证明中国AI在芯片限制下仍能突破,但实际应用还需生态完善。