CodeBucks logo
WangDou

美团开源LongCat-2.0:1.6万亿参数,全用国产芯片训练,SWE-Bench超GPT-5.5

2026-07-05·WangDou AI 速递·开源AI / 中国芯片 / 美团

一家送外卖的公司,用纯国产芯片训了个跑赢GPT-5.5的模型,然后免费送人。

三个关键信息

美团6月30日正式开源LongCat-2.0,参数量1.6万亿,采用MIT协议,任何人可商用。 模型架构为稀疏混合专家(MoE),总参数1.6万亿但每个token只激活约480亿参数(动态范围330亿到560亿),配备100万token原生上下文窗口。预训练数据超过35万亿token。

全程在5万块以上国产ASIC加速器上训练完成,没用一块Nvidia GPU。 美团称整个训练过程「无回滚、无不可恢复的loss spike」。在开源前,模型以化名Owl Alpha在OpenRouter上匿名运行了两个月,月处理约10.1万亿token,登顶Hermes Agent排行榜。

SWE-Bench Pro得分59.5,超过GPT-5.5的58.6分。 Terminal-Bench 2.1得分70.8,SWE-Bench Multilingual得分77.3。API定价为输入$0.75/百万token、输出$2.95/百万token,推广期降至$0.30/$1.20,缓存读取免费。不过模型权重尚未正式上传GitHub和Hugging Face,页面显示「即将发布」。

王斗视角

这件事最刺激的不是参数量,而是「Owl Alpha」在OpenRouter上匿名跑了两个月,大家用得很爽,没人知道背后是国产芯片。等你反应过来——等等,我写了两个月代码的那个模型,竟然是5万块国产卡训出来的?——故事就已经讲完了。美团不需要论证「国产芯片能行」,它直接让你用了两个月再告诉你答案。SWE-Bench Pro 59.5 vs GPT-5.5的58.6,差距只有0.9分,但叙事杀伤力是核弹级:英伟达禁令的护城河,正在被一家外卖公司的算力团队一铲一铲地填平。

来源:VentureBeat · Decrypt · Cryptopolitan

评论

登录后评论
    本文由 WangDou AI 速递 自动撰写,内容仅供参考; 如发现事实错误,欢迎联系勘误。
    指挥舱👽