美团万亿模型悄悄上线,我用它复刻了Muse前端
美团万亿模型悄悄上线,我用它复刻了Muse前端9月25日,美团LongCat团队上线了新一代预览版模型LongCat-2.5-Preview,并在OpenCode开放了为期两周的限时免费体验。具体能力如何?我们将LongCat-2.5-Preview接入Claude Code,连续测试了三个Coding任务:复刻Meta Muse App、制作SpaceX星舰升空动画,以及开发一款3D赛车游戏。
搜索
9月25日,美团LongCat团队上线了新一代预览版模型LongCat-2.5-Preview,并在OpenCode开放了为期两周的限时免费体验。具体能力如何?我们将LongCat-2.5-Preview接入Claude Code,连续测试了三个Coding任务:复刻Meta Muse App、制作SpaceX星舰升空动画,以及开发一款3D赛车游戏。
Loopit发布了实时互动世界模型Zing-0.5,在美团LongCat与复旦大学联合推出的可交互视频世界模型评测WBench中拿到第一。目前已经开源,并计划在2周内在Loopit APP(海外版)上线对应产品功能。
有知情人士透露,美团LongCat团队基础模型负责人裴鹏即将离职。公开资料显示,裴鹏毕业于北京大学,长期深耕信息检索与自然语言处理方向,职业履历覆盖多家全球顶尖科技企业。
业界首个国产芯片上跑出的万亿参数模型LongCat-2.0于近日发布。
美团今日宣布开源万亿参数大模型LongCat-2.0,同步开放针对国产算力芯片深度优化的推理代码。该模型总参数达1.6万亿,平均激活约480亿参数,是业界首个在五万卡国产算力集群上完成全流程训练与推理的万亿参数模型。
7月2日,据大厂日爆消息,美团内部开始限制使用豆包大模型。消息称,美团向所有涉及到豆包大模型的业务部门下发通知,要求自查并规划迁移至LongCat、DeepSeek等模型,若无法迁移,需单独走审批流程。对此消息,截至发稿,美团暂无官方回应。据媒体报道,这并非美团首次收紧外部大模型的使用。今年4月,美团对内部大模型使用做出调整,不再推荐业务使用阿里云提供的Qwen模型。若业务仍需使用,需上报审批。
最近几个月,一个名为“Owl Alpha”的神秘模型持续霸榜OpenRouter。它调用量长期位居全球前三,在Hermes、Claude Code和OpenClaw几大Agent模型中分别位列第一、第二和第三,不少开发者将其称为今年最令人意外的一匹“黑马”。
上个月也就是昨天,我写了一篇LongCat 2.0的实测,用四个任务测了一下它的编程能力,当时我的评价是「有些地方惊艳,有些地方还差点意思」。
如果只看标题,它很容易被归到“又一个万亿参数大模型”的队伍里:1.6 万亿总参数、MoE 架构、100 万 token 上下文、面向代码和 Agent 场景。但这次真正值得看的,不只是模型有多大,而是它背后的三个问题:国产算力能不能支撑前沿级大模型训练?
当前,测试时扩展范式普遍致力于增加推理长度。然而,已有研究表明,随着推理长度的持续增长,以垂直扩展为核心的计算范式容易陷入探索僵化等问题。因此,从另一维度拓展推理的宽度显得尤为重要。K2.5、Step3-VL 和 LongCat-Flash-Thinking 等模型已在推理宽度方面开展了有益的探索。