Token导航 LogoToken导航TokenDH.com

美团LongCat-2.0正式开源,训练峰值规模超过五万张国产算力卡

更新时间 2026-07-07来源 腾讯科技正文 584字阅读约 2分钟1 张图片

图片

文|晓静

编辑|徐青阳

7月6日,美团宣布正式开源LongCat-2.0的模型权重、推理引擎与核心技术文档。同日,华为昇腾、摩尔线程、沐曦股份等国产芯片厂商,集体宣布完成对该模型的推理适配工作。 

据悉,LongCat-2.0采用MoE(混合专家)架构,总参数规模1.6万亿,每个Token平均激活约480亿参数,原生支持1M超长上下文;训练峰值规模超过五万张国产算力卡,预训练数据规模超过30万亿Tokens。这是业界首个完全依靠国产算力完成训练和推理全流程的万亿参数大模型。

美团LongCat团队对国产算力的探索始于2023年,从千卡规模起步,逐步攻克算子适配、通信优化、分布式稳定性等基础难题,最终在五万卡集群上完成万亿参数模型的全流程训练与推理。

LongCat-2.0开源后,华为昇腾团队宣布迅速在昇腾910系列上完成适配。新模型总参数量达1.6万亿,如何在单卡显存仅64GB 的昇腾A2上部署且兼顾高性能推理与百万级长序列成为一个难题。CANN推理团队采用业界成熟的PD分离架构,并针对这一难题分别做了部署优化。

此外,摩尔线程、沐曦股份等国产芯片厂商,也在同日宣布完成对LongCat-2.0的推理适配。

据悉,LongCat-2.0已在GitHub和Hugging Face同步开源,提供BF16原始权重、FP8量化和INT8量化三个版本,采用MIT协议,允许免费商用。

资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多