DefiRWA

 找回密码
 立即注册
搜索
热搜: 活动 交友 discuz
查看: 14|回复: 0

美团LongCat-2.0:5万卡国产算力训出1.6万亿参数,"小院高墙"打破时刻

[复制链接]

895

主题

906

帖子

3035

积分

版主

Rank: 7Rank: 7Rank: 7

积分
3035
发表于 2026-7-1 07:20:39 | 显示全部楼层 |阅读模式
2026年6月30日,国内基础大模型赛道再起波澜。美团正式发布LongCat-2.0,这款总参数规模达1.6万亿的MoE大模型,全程在5万卡国产算力集群上完成训练和推理全流程——这是业界首个达成该里程碑的万亿参数模型。LongCat团队同步宣布,将于近期开源Infra框架、推理引擎和模型参数等核心资产。


一、为什么"5万卡国产算力"才是真正的头条

过去三年,中国大模型公司面对一个尴尬的事实:参数规模越大,对英伟达H100/H200/B200的依赖就越深。即便DeepSeek以"高性价比"路线打破海外定价权,其训练底座仍然以英伟达GPU为主。

LongCat-2.0的突破点不在"1.6万亿"这个数字,而在于"全程国产算力"。

从公开信息看,本次5万卡集群基于华为昇腾、寒武纪、海光等国产AI加速卡组合构建,集群规模在国产AI基础设施中达到第一梯队水位。对应的工程难点包括:
跨厂商硬件统一调度:不同国产芯片在HBM带宽、NVLink替代协议、ROCm/CANN算子库上各有差异,要在5万卡规模下保持线性加速比,需要重写大量通信原语
训练-推理一致性:MoE架构的专家路由在不同硬件上的舍入误差必须对齐,否则训练好的模型在推理时会出现精度漂移
容错与checkpoint机制:5万卡连续训练两周以上的故障率显著高于千卡规模,需要自研高效的检查点恢复方案


二、LongCat-2.0的工程化定位

与DeepSeek走"极致性价比"路线不同,LongCat的对外口径始终是"业务驱动"。美团拥有外卖、闪购、到店酒旅、即时零售等多元业务场景,过去两年一直在用自研模型替代外部API用于智能客服、骑手调度、商家分析等高QPS场景。LongCat-2.0的发布,意味着这套自研体系正式对外公开化。

值得关注的产品组合:

| 维度 | LongCat-2.0关键参数 |
|------|---------------------|
| 总参数 | 1.6万亿(MoE) |
| 训练算力 | 5万卡国产集群 |
| 训练-推理一致性 | 全流程对齐 |
| 即将开源 | Infra框架、推理引擎、模型参数 |
| 业务承接 | 美团全场景智能客服与商家助手 |

开源策略上,LongCat官方明确"模型权重+推理引擎+Infra代码"三位一体同步开源——这是继DeepSeek V3/V4之后,国内第二个把"训练到部署全栈"对外公开的大模型公司。开发者拿到的不只是模型文件,而是可以一键复现整套训练-推理流水线的代码库。


三、对国内AI产业链的三个判断

判断一:算力国产化拐点已至

5万卡国产集群完成1.6万亿模型全流程训练,意味着"国产算力+千亿/万亿参数模型"的可商用闭环已经形成。短期内还会有性能损耗和单位算力成本劣势,但已经不再是"能不能跑"的问题,而是"怎么跑得更便宜"的问题。昇腾、寒武纪、海光等国产芯片厂商的订单密度将进入新阶段。

判断二:基础模型层出现"业务派"vs"技术派"分化

DeepSeek代表"技术极限型"路线(参数、上下文、推理能力优先),Kimi走"垂类专精"(代码Agent见长),智谱主打"本地生态"。LongCat-2.0则开创了"业务派"——模型为自家业务而生,开源后形成的生态服务于更广泛的本地生活服务行业。基础模型层的差异化竞争将比此前预想的更明显。

判断三:开源生态进入"全栈开源"阶段

此前的开源主要集中在模型权重,LongCat这次把Infra框架和推理引擎也纳入开源范围。这说明国产模型厂商已经形成共识:单靠权重开源难以建立生态护城河,必须把"如何高效训练和部署"的工程能力也开放出去,才能吸引真正的高端开发者。


四、对开发者和企业的实操建议

1. 关注开源发布节奏:LongCat-2.0即将开源,第一时间拉到本地做小规模PoC,关注其推理引擎在昇腾/寒武纪/海光不同硬件上的性能差异
2. 对国产算力栈做"两条腿走路":原有英伟达栈不要立刻废弃,但新项目优先考虑国产算力+LongCat/DeepSeek等开源模型的组合
3. 业务场景优先选型:LongCat的优势在多任务指令理解、对话类场景和商家/客服类知识工作,不必把它和编程类模型(如Kimi K2.7 Code)直接比较
4. 关注API价格:LongCat正式开放API后,参考DeepSeek V4-Pro 0.28美元/百万输入tokens的价位,国内大模型API有可能进一步下探到0.1美元/百万tokens区间


五、需要冷静看待的几点
• 5万卡国产集群是"工程成果",不是"性能冠军"——海外旗舰模型在跑分上仍可能领先
• MoE模型的实际激活参数往往远小于总参数,1.6万亿的"震撼度"需要结合激活比例理解
• 国产算力的单位成本(HBM、互联、功耗)仍高于英伟达H100系列,长期需要看良率和工艺迭代

LongCat-2.0的真正意义,不在参数榜单,而在它向产业界传递的信号:国产算力+开源生态+业务驱动的三位一体路线,已经可以跑通万亿参数级别。这是中国AI基础设施从"能用"走向"好用"的关键一步。

数据来源:每日经济新闻(2026.06.30)、美团LongCat官方公告、Artificial Analysis Intelligence Index v4.0、华为昇腾/寒武纪公开技术文档。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

QQ|货物清仓|Archiver|手机版|小黑屋|倒数|舒尔特|好邻卡|RWA+DeFi|融资计划|内购渠道|Github|Web4

GMT+8, 2026-7-22 09:32 , Processed in 0.077022 second(s), 20 queries .

Powered by Discuz! X3.4

Copyright © 2001-2023, Tencent Cloud.