标题:美团开源1.6T MoE模型LongCat-2.0,SWE-bench Pro首超GPT-5.5
摘要:美团LongCat-2.0以MIT协议完整开源,总参1.6T、激活48B、支持1M上下文,在SWE-bench Pro上以59.5分超越GPT-5.5(58.6),成为国内首个代码智能体基准超越GPT的开放大模型。技术亮点包括LongCat Sparse Attention、Zero-Compute Experts及MOPD多任务路由,原生集成Claude Code等工具,适配GPU/NPU部署。
美团的LongCat-2.0模型正式以MIT协议完全开源,公开权重与推理代码,这在国内大厂中尚属首次,更是开源大模型在代码智能体领域的一个关键转折点。该模型在SWE-bench Pro上拿到59.5分,超越GPT-5.5的58.6,成为首个在该基准上超越GPT系列的开放模型,且无需任何商业授权限制。
LongCat-2.0采用MoE(混合专家)架构,总参数量达1.6T,每token仅激活约48B参数,在保持高计算效率的同时支持1M token的极端长上下文。技术层面有三个关键创新:LongCat Sparse Attention专门优化长文本处理,在不损失精度的前提下大幅降低注意力计算成本;Zero-Compute Experts机制动态激活33B–56B参数范围,做到每token计算量几乎零浪费;MOPD(Multi-Objective Policy Decomposition)按任务类型将专家划分为Agent、Reasoning、Interaction三组,通过路由算法自动分配最合适的专家组合,提升多任务泛化能力。
除SWE-bench Pro外,LongCat-2.0在多个权威评测中表现亮眼:Terminal-Bench 2.1得分70.8,SWE-bench Multilingual达77.3,FORTE 73.2,RWSearch 78.8,BrowseComp 79.9。这些分数直接对标甚至超越多数闭源模型,尤其在代码生成、工具调用、长文档推理等agentic coding场景中优势明显。
模型原生集成了Claude Code、OpenClaw、Hermes Agent等主流开发工具链,支持GPU与NPU双架构部署,且已在国内大规模集群上完成验证。对于正在构建代码智能体或自动化工作流的团队,LongCat-2.0提供了“开箱即用”的方案——MIT协议意味着可自由商用、修改和再发布,没有任何附加条件,这在国内大厂开源历史上并不多见。
从行业视角看,LongCat-2.0的开源标志着中国大模型在代码智能体领域进入“超越闭源”阶段。此前开源模型多聚焦通用对话或数学推理,而代码智能体基准(如SWE-bench Pro)长期以来被GPT-4.5、Claude 3.5等闭源模型领先。美团的此次突破,本质上是MoE架构、稀疏注意力与多专家路由三项技术协同优化的结果,也为其他团队提供了清晰的技术路线参考。对于开发者而言,现在即可从官方渠道下载权重,接入自己的agent框架,红利窗口值得把握。