LongCat-2.0发布,全球首个基于国产算力的万亿参数模型
国产算力首次跑通万亿参数大模型全链路,且通过市场匿名验证,证明降本增效的可行性。
美团AI团队推出LongCat-2.0,采用自研MoE架构(混合专家模型,将大模型拆分为多个子网络按需激活),总参数1.6万亿但每次推理仅激活约480亿参数。原生支持100万token超长上下文,完全在国产芯片上完成训练和推理。此前以匿名身份'Owl Alpha'在OpenRouter上成为开发者调用量前三的开源模型。
正文摘录
全球首个英伟达含量为0的万亿模型,成了海外开发者的抢手货 模型采用自研 MoE 混合专家架构,总参数达1.6万亿,每 token 激活约48B参数,原生支持1M超长上下文。 从多项专业评测数据来看,LongCat-2.0 在代码、工具调用和多步逻辑推理等任务上具备较强综合性能。 不过,这位倒也不算开发者的“新朋友”,因为人家早就披着马甲“不小心”成为了全球 Agent 开发者的最爱~ 没错,最近在 OpenRouter 上挺火热的 Owl Alpha ,正是 LongCat-2.0(面具版)。 月调用量在 Hermes、Claude Code 和 OpenClaw 分列全球第一、第二和第三位,成为开发者首选的开源模型。 所以说,这位不仅第一个在国产卡上跑通了万亿级训推,还提前通过了市场的真实流量验证?? 体验方式: https://longcat.chat/platform/product 技术报告: https://longcat.ai/blog/longcat-2.0/ 自己手动拼了一份语料,把几份不同行业的研报、不同领域的几篇论文拼到一起,中英混杂凑了好几万字,be like: 还有被我特意拆分的完整统计报告,LongCat-2.0 也能准确找到,而且感觉速度挺快,就1秒…… 我找了一个开源代码仓库,GitHub上13k star的原版2048,纯 HTML + CSS + JavaScript 架构的项目。 视觉类修改:把整个游戏的配色方案改成赛博朋克风格,要深色背景、霓虹色的方块、发光效果的数字。 功能类修改:把4×4的棋盘改成5×5,同时增加一个计步器显示在棋盘下方,记录玩家一共滑了多少步。 剩下的完全不用我管,LongCat-2.0 自己跑了12分钟,交付了一个完整的结果。