行业新闻

美团开源万亿参数大模型 LongCat-2.0,同步开放国产卡推理代码

美团开源万亿参数大模型 LongCat-2.0,同步开放国产卡推理代码

美团开源了可在国产算力上流畅运行的万亿参数大模型 LongCat-2.0,并提供配套推理优化代码,目标是盘活存量国产芯片。

美团 LongCat-2.0 是一个 1.6 万亿参数的大模型,但每次推理只激活约 480 亿参数(MoE 架构),专为 Agentic Coding 设计。它用稀疏注意力和 N-gram Embedding 提升长上下文效率和代码能力,并通过 Super Kernel、KV-cache 切分等优化,在国产芯片(如华为昇腾)上实现百万级上下文的高效推理。模型和推理代码已开源,存量国产卡也能跑。

正文摘录

![正式开源!美团 LongCat-2.0 同步开放国产卡推理代码](https://p0.meituan.net/meituantechblog/3a15143344d034d9911c1ce45b003297631735.jpg) 正式开源!美团 LongCat-2.0 同步开放国产卡推理代码 美团 LongCat 2026-07-12 LongCat 开源 大模型 本周,美团万亿参数大模型 LongCat-2.0 正式开源! [HuggingFace](https://huggingface.co/meituan-longcat/LongCat-2.0) | [GitHub](https://github.com/meituan-longcat/LongCat-2.0) | [ModelScope](https://www.modelscope.cn/collections/meituan-longcat/LongCat-20) 作为业界首个在五万卡国产算力集群上完成推理的万亿参数模型,LongCat-2.0 已全面开源。 针对显存与带宽受限的国产算力芯片,我们在模型架构、芯片适配到部署策略上进行了深度协同优化,让万亿参数模型在存量卡上同样跑得稳、跑得快。 我们希望以真实 Agentic Coding 任务中的稳定表现为依托,通过开源将模型能力与推理优化成果完整开放,盘活更多存量国产算力,释放国产算力生态的长期价值。 美团 LongCat-2.0 总参数 1.6T,平均激活约 48B,为真实的 Agentic Coding 任务而生,架构上创新性引入 LongCat 稀疏注意力和 N-gram Embedding,提升长上下文处理效率与 Token 级表示能力的同时,结合动态激活进一步强化了代码理解、生成以及执行的表现。

阅读原文(tech.meituan.com)→

行业新闻2026-07-12原文

相关内容