美团开源LongCat-2.0:1.6万亿参数,全用国产芯片训练,SWE-Bench超GPT-5.5
一家送外卖的公司,用纯国产芯片训了个跑赢GPT-5.5的模型,然后免费送人。
三个关键信息
美团6月30日正式开源LongCat-2.0,参数量1.6万亿,采用MIT协议,任何人可商用。 模型架构为稀疏混合专家(MoE),总参数1.6万亿但每个token只激活约480亿参数(动态范围330亿到560亿),配备100万token原生上下文窗口。预训练数据超过35万亿token。
全程在5万块以上国产ASIC加速器上训练完成,没用一块Nvidia GPU。 美团称整个训练过程「无回滚、无不可恢复的loss spike」。在开源前,模型以化名Owl Alpha在OpenRouter上匿名运行了两个月,月处理约10.1万亿token,登顶Hermes Agent排行榜。
SWE-Bench Pro得分59.5,超过GPT-5.5的58.6分。 Terminal-Bench 2.1得分70.8,SWE-Bench Multilingual得分77.3。API定价为输入$0.75/百万token、输出$2.95/百万token,推广期降至$0.30/$1.20,缓存读取免费。不过模型权重尚未正式上传GitHub和Hugging Face,页面显示「即将发布」。
王斗视角
这件事最刺激的不是参数量,而是「Owl Alpha」在OpenRouter上匿名跑了两个月,大家用得很爽,没人知道背后是国产芯片。等你反应过来——等等,我写了两个月代码的那个模型,竟然是5万块国产卡训出来的?——故事就已经讲完了。美团不需要论证「国产芯片能行」,它直接让你用了两个月再告诉你答案。SWE-Bench Pro 59.5 vs GPT-5.5的58.6,差距只有0.9分,但叙事杀伤力是核弹级:英伟达禁令的护城河,正在被一家外卖公司的算力团队一铲一铲地填平。
来源:VentureBeat · Decrypt · Cryptopolitan
