6月30日,美团正式发布新一代万亿参数大模型龙猫2.0,并宣布对外开源。这是业界首个在五万卡国产算力集群上完成训练与推理全流程的万亿参数模型。而就在一天前,国务院常务会议刚刚定调“人工智能+”,明确要深入实施该行动,促进智能产品和服务加快规模化商业应用。政策与产业共振之下,大模型的竞速正进入全新阶段。
龙猫2.0:国产算力跑出的“隐形冠军”
据美团官方披露,龙猫2.0总参数达1.6万亿,采用MoE架构,平均激活参数约480亿,原生支持1M超长上下文。该模型从零开始预训练,预训练数据规模超过30T tokens,覆盖中文、英文、多语言和代码等多类数据。
龙猫2.0最引人注目的标签,是“全国产”。公开信息显示,美团龙猫团队自2023年起便聚焦国产算力适配,从千卡规模起步,逐步攻克算子适配、通信优化等底层难题。最终在五万卡集群上完成全流程训练——峰值规模超过5万张国产算力卡,是迄今为止国产算力上完成的最大规模训练任务。团队通过弹性扩缩卡、自动故障恢复等机制,将月均日故障率降低70%以上;通过流水线调度与显存优化,训练MFU提升1.5倍。
有行业人士指出,在国产芯片上完成万亿参数MoE模型的训练,本身即是一项具有突破意义的工程实践。过去业内普遍认为,国产芯片集群在训练稳定性、软件生态兼容性等方面存在明显短板,大规模分布式训练往往面临故障率高、算力利用率低的瓶颈。而龙猫2.0的成果表明,当前国产算力卡虽然在单卡性能上与国际顶尖产品仍有差距,但其计算正确性和精度已能满足前沿大模型的全流程训练需求,通过系统层面的调度优化和故障自愈机制,可以有效弥补硬件层面的不足,为后续国产算力规模化应用提供了可参考的技术路径。
值得一提的是,龙猫2.0并非“横空出世”。今年4月底,其预览版以匿名身份“Owl Alpha”接入全球最大的API路由平台OpenRouter。OpenRouter数据显示,截至6月底,LongCat-2.0-Preview的总调用量已跻身全球前三。在Hermes、Claude Code等核心Agent场景中,其月调用量分别位列全球第一、第二:一个来自中国生活服务平台的大模型,已成为全球开发者社区最受欢迎的模型之一。
政策定调再提速:“人工智能+”从顶层走向落地攻坚
龙猫2.0发布的前一天,6月29日召开的国务院常务会议明确提出,要深刻把握AI演进趋势,加力推进创新突破,加快关键技术攻关和超大规模智算集群建设,并强调“深入实施‘人工智能+’行动”,发挥我国产业体系完备、应用场景丰富等优势,促进智能产品和服务加快规模化商业应用。这一信号被业界视为“人工智能+”从顶层设计走向规模化落地攻坚阶段的关键转折。
而在更早之前,2025年8月印发的《国务院关于深入实施“人工智能+”行动的意见》已提出加快超大规模智算集群技术突破和工程落地,今年政府工作报告亦将其纳入新基建工程,此次国常会则是对行动的再提速。
就在政策定调前后,全球大模型赛道硝烟弥漫。6月27日,OpenAI发布GPT-5.6系列三款模型,但因美国网络安全监管要求,仅向本土少数合作伙伴开放,普通用户与海外开发者暂无法申请。有分析指出,该模型在代码自主编写、高级攻防等领域的突出能力让监管层心存忌惮,前沿AI正面临“能力越强、开放度越低”的悖论。几乎同期,字节跳动火山引擎推出豆包视频生成模型Seedance 2.5,将单段原生视频时长从15秒延至30秒,全模态素材联合生成数量从12个增至50个,豆包2.1 Pro亦被指达到Opus 4.6水平。
国产算力赛道同样动作频频。智谱GLM-5.2上线后已完成与多个国产算力平台的Day0适配,字节跳动也在大规模采购国产芯片。科大讯飞董事长刘庆峰判断,随着中美科技博弈长期化,算力自主可控已从“可选项”变为“必选项”。
从国常会的政策定调,到OpenAI的受限发布,再到字节跳动的多模态发力,直至美团龙猫2.0在国产算力上跑出万亿参数模型,2026年6月最后几天,大模型赛道密集上演多重叙事。龙猫2.0的意义不止于美团的AI能力证明,更在于它证明了:在算力受制的现实约束下,中国企业依然有能力跑出世界级大模型。当“人工智能+”从政策号召走向产业实践,当国产算力从“能不能用”迈向“好不好用”,大模型的角力才真正进入“下半场”。谁能率先跑通技术、场景与商业的闭环,谁就将掌握下一个时代的主动权。
文 | 记者 沈钊
图 | 受访者提供