美团万亿模型悄悄上线,我用它复刻了Muse前端
美团万亿模型悄悄上线,我用它复刻了Muse前端9月25日,美团LongCat团队上线了新一代预览版模型LongCat-2.5-Preview,并在OpenCode开放了为期两周的限时免费体验。具体能力如何?我们将LongCat-2.5-Preview接入Claude Code,连续测试了三个Coding任务:复刻Meta Muse App、制作SpaceX星舰升空动画,以及开发一款3D赛车游戏。
搜索
9月25日,美团LongCat团队上线了新一代预览版模型LongCat-2.5-Preview,并在OpenCode开放了为期两周的限时免费体验。具体能力如何?我们将LongCat-2.5-Preview接入Claude Code,连续测试了三个Coding任务:复刻Meta Muse App、制作SpaceX星舰升空动画,以及开发一款3D赛车游戏。
Claude Opus 5.5并不具备视频生成能力,它通过编写代码逐帧绘制画面,再由无头浏览器和FFmpeg合成MP4文件,实现所谓的"一句话做视频"。
10个Claude Sonnet 5.5智能体通宵15小时、互发1270条消息并写出17895行Lean代码,在无人类介入的情况下完成悬置122年的汤姆逊问题N=7形式化证明,且通过Lean内核与nanoda双重验证。
Anthropic招股书披露,其背负未来5180亿美元算力与基建长期支出承诺,2025年营收近46亿美元却净亏约420亿美元,公司正冲击或超2万亿美元的IPO估值,但客户集中度高且订单缺乏长期合同保障,能否撑住天价估值取决于收入增长能否持续跑赢算力成本。
AIHOT开发者卡兹克正式开源月活百万的AI热点资讯网站AIHOT,并上线利用Claude Opus 5.5等模型重写的AIHOT 2.0版本,以便法律、金融、HR等各行业用户基于该开源框架构建属于自己的行业热点监控产品。
说好的未来几周,Anthropic只等了6天。上周Opus 5.5发布的时候,官方顺手剧透了一嘴,Sonnet 5.5和Haiku 5.5都在后面。刚刚,Sonnet 5.5先到了。而且Claude家的“中杯”,已经撵着刚发布的旗舰追了。
欧洲开发者 Mario Zechner 开发的极简 Coding Agent Harness Pi 只给模型一个 bash,却在多项 Benchmark 中击败 Claude Code 和 Codex,凭借极简设计和高可扩展性在 2025 年底爆火,团队来自维也纳而非硅谷。
Anthropic发布Claude Sonnet 5.5,运行速度较前代提升30%、单任务成本最高降低30%,以一半的标价在多项基准测试中接近或反超大杯Opus 5.5,凭借代码、视觉理解和办公等能力成为新一代性价比之王。
Opus 5.5因网友用其设计含1113个真实零件的Microduck乐高版本并生成141页说明书、将宜家说明书转为3D配音教学视频以及尝试重现《塞尔达传说:时之笛》等"vibe coding"新玩法持续走红,并在Code Arena: WebDev榜单以低于第二名60%的价格拿下第一。
硅谷DrivingBench测试中,从未专门学过开车的通用大模型GPT-6 Astra操控改装丰田卡罗拉以5分22秒通过锥桶摆出的科目二考场,成为全场唯一通关的大模型,而Claude Fable 5.1、Grok 4.6和GPT-5.6 Sol均未通过。