美团正式发布万亿参数 MoE 大模型 LongCat-2.0,公布完整技术方案,主打纯国产算力全链路训练推理、超长上下文、代码智能体能力。

(图源网络,侵删)
当行业还在争论万亿参数模型只能依赖海外高端 GPU 集群时,美团直接甩出王炸 —— 6 月 30 日发布、7 月初全量开源的LongCat-2.0,拿下全球首个五万张国产算力卡完成全流程预训练 + 推理的万亿级大模型头衔,彻底打破 “训万亿模型必靠海外芯片” 的固有认知。
不同于多数大厂先发布再验证的套路,LongCat-2.0 早以匿名代号 Owl Alpha 在海外开发者榜单悄悄霸榜:Hermes 生态月调用全球第一、Claude Code 赛道第二,代码能力对标 GPT-5.5、Claude Opus,用实测成绩证明国产万亿大模型已经具备商用级硬实力。
万亿模型落地背后,绕不开一道核心门槛:超大规模弹性算力供给。不管是大厂自研基座,还是中小企业基于开源模型微调部署,算力成本、集群调度、国产芯片适配三大难题始终卡着行业发展,而这也是算家云长期深耕、针对性解决的赛道。
LongCat-2.0 到底强在哪?

(图源网络,侵删)
1. 架构底层:MoE 稀疏设计,兼顾超大容量与落地成本
LongCat-2.0 采用混合专家 MoE 架构,总参数量 1.6 万亿,但采用动态稀疏激活逻辑,单 Token 平均仅激活 48B 参数,区间浮动 33B~56B,稀疏度高达 97%。
简单说:不用每次推理都加载全部万亿参数,简单短句少调度专家、节省算力;复杂代码、百万字长文档自动拉起更多专家模块,算力按需分配。搭配业界首创零计算专家机制,从根源解决 MoE 模型普遍存在的算力浪费、负载不均衡痛点。
同时自研 LSA 稀疏注意力 + Ngram Embedding 模块,原生解锁1M tokens 百万字超长上下文,一次性读取整仓代码、商家全量运营规则、上万条历史对话,不用分段截断,完美适配代码智能体、本地生活复杂业务处理两大核心场景。
2. 产业里程碑:五万卡国产算力,打通训推全链路闭环
这是本次发布最具战略价值的突破。过往万亿参数模型训练,几乎全部依赖海外 A100/H100 集群,国产算力仅能支撑千亿级小模型推理,大规模预训练长期存在技术空白。
美团本次训练峰值动用 5 万张国产 AI 加速卡,耗时月余完成 35T tokens 预训练,攻克三大行业顽疾:
1.万卡集群跨卡通信拥堵:自研分布式路由均衡算法,集群算力利用率稳定突破 42%;
2.大规模训练稳定性:单卡故障自动分片热重启,月均日故障率下降 70%,全程无 loss 尖刺、无训练回滚;
3.国产芯片精度适配:定制专用算子库,消除稀疏计算精度衰减,训推结果对齐海外高端 GPU 集群。
3. 核心能力:主打代码智能体,开源降低行业使用门槛
LongCat-2.0 核心定位Agentic Coding 代码大模型,SWE-bench Pro 实测 59.5 分,超越 GPT-5.5、Gemini 3.1 Pro,仓库级代码修改、自动调试、终端任务执行能力拉满。
7 月 6 日美团全量开源整套方案,宽松 MIT 商用协议,完整开放模型权重、国产芯片优化推理引擎、分布式训练代码,同步上架 GitHub、Hugging Face、ModelScope 三大平台,企业、开发者均可免费商用,不用从零搭建万亿模型底层框架。
算家云给出普惠算力解决方案

LongCat-2.0 的开源,让无数中小企业、科研团队看到万亿级大模型落地的可能性,但摆在面前的现实难题依旧突出:自建万卡集群成本上亿、国产芯片适配调试门槛高、短期微调 / 推理不需要长期买断整机、多型号算力统一调度困难。
针对万亿 MoE 模型训练、微调、推理全生命周期算力需求,算家云打造一站式异构智算服务平台,完美承接 LongCat-2.0 这类超大模型的落地需求,补齐行业算力基础设施短板:
1. 全规格异构算力池,兼顾海外 GPU 与国产芯片双路线
平台同时上架 RTX5090/4090/4090D、A100 等主流高性能显卡,以及国产算力节点,适配两种部署路线:
快速验证场景:4090 低至 1.24 元 / 卡时,按量计费,短期微调、模型测试零闲置成本;
国产自主可控路线:专属国产算力专区,预装适配国产芯片的算子库,复刻美团五万卡集群的优化逻辑,大幅降低国产大模型迁移调试成本。
2. 自研弹性调度,适配 MoE 模型分布式分片部署
万亿 MoE 模型权重需要跨多卡分片存储,传统云平台调度卡顿、负载失衡问题严重。算家云自研多云异构算力调度引擎,支持万卡级任务分布式拆分,自动均衡专家模块负载,解决 MoE 推理 “热门专家拥堵、冷门算力闲置” 的行业通病,大幅提升集群整体利用率。
3. 开箱即用镜像生态,一键部署热门开源大模型
平台内置海量开源大模型预制镜像,现已完成 LongCat-2.0 环境适配,可一键启动训练、微调任务,无需手动配置框架、驱动,新手也能快速上手万亿模型二次开发,省去数周环境调试周期。
4. 算桥 API 一站式调用,不用自建集群也能跑万亿模型
如果企业仅需要调用大模型的代码能力、不想搭建自有算力集群,可直接接入算家云旗下算桥 API。单一 Key 兼容 OpenAI 标准接口,5 分钟快速接入,依托平台自有 GPU 集群兜底算力,高峰期自动扩容,稳定承接高并发代码生成、智能体业务,Token 精准计费,综合调用成本直降 50%,中小企业零门槛用上万亿级大模型能力。
5. 分层服务模式,覆盖全规模用户需求
从个人开发者、高校科研团队到中大型 AI 企业,算家云提供灵活交付方案:短期弹性容器租赁、按月整机托管、私有化一体机部署三选一,支持云边协同混合调度,训练上云、推理本地,兼顾成本与数据安全;容器沙箱隔离 + SSL 加密传输,保障模型权重、业务数据全程可控,适配政企合规场景。
美团用五万卡国产集群证明,国产算力足以撑起万亿大模型;而算家云则把高门槛的大规模算力资源普惠化,让无法自建超算集群的普通开发者,也能低成本玩转 LongCat-2.0 这类前沿万亿基座,打通 “大模型开源 — 算力供给 — 行业落地” 最后一公里。
LongCat-2.0 背后的产业信号

(图源网络,侵删)
1.国产算力生态正式成型:过去国产芯片只能做轻量化推理,如今完整承载万亿参数全流程训练,昇腾、沐曦等国产硬件配套优化方案逐步成熟,算力自主可控不再是空口号;
2.MoE 稀疏架构成为万亿模型主流路线:密集大模型算力成本过高,MoE 动态激活平衡性能与开销,会成为未来 2-3 年大厂基座统一选型;
3.代码智能体进入规模化落地期:LongCat-2.0 主打全流程开发 Agent,叠加本地生活多场景落地案例,预示 AI 将深度渗透研发、产业服务全链条;
4.开源降低行业创新门槛:美团开放完整工程优化方案,搭配算家云这类普惠算力平台,中小团队不用重资产投入,即可参与万亿大模型二次创新,加速 AI 行业百花齐放。
你认为,未来万亿级大模型落地,核心瓶颈是算力成本、国产芯片适配,还是行业场景落地?如果你的团队要基于 LongCat-2.0 开发垂直行业 AI 应用,会优先选择自建集群还是租赁弹性算力?欢迎在评论区聊聊你的观点。
168

被折叠的 条评论
为什么被折叠?



