全网骂Claude变笨,Anthropic下场揭秘:坑你的不是模型
全网骂Claude变笨,Anthropic下场揭秘:坑你的不是模型近日,Anthropic官方发了一篇长文专门来讲这件事。 起因是太多人把Claude Code里的两个选项搞混了:一个是模型选择(Model),一个是努力度(Effort)。过去,大家对这两个选项的理解都很简单:换更大的模型,AI就更聪明;把Effort调高,无非是让AI多想一会儿。
搜索
近日,Anthropic官方发了一篇长文专门来讲这件事。 起因是太多人把Claude Code里的两个选项搞混了:一个是模型选择(Model),一个是努力度(Effort)。过去,大家对这两个选项的理解都很简单:换更大的模型,AI就更聪明;把Effort调高,无非是让AI多想一会儿。
NFX 的 Pete Flint 写了篇文章,讲一个我这一个月一直在旁边打转、但没人替我一句话说清的东西。他说,种子轮的创业者,现在开始拿 Tesla、SpaceX 那套「垂直整合」来 pitch 了——不是「给律师做个 AI 工具」,是「一家 AI 原生的律所」;不是「做个软件采购平台」,是「最终要 own 掉整条供应链」。
量子位不完全统计了97家国内具身数据玩家的情况,其中70家做数据采集,27家做数据infra。过去一年(2025年7月1日至2026年7月1日),15家「不做本体、不做模型、只做数据的独立具身数据服务商」,共融资约44.7亿元。
GraphPlanner通过引入图记忆网络,将多智能体LLM的路由过程升级为动态工作流生成。不仅选择调用哪个模型,还决定每个模型应承担的角色,实现任务分解与协作规划。
我自己花时间,把三款主流国产桌面 Agent 从头到尾测了一遍:Trae、WorkBuddy、ZCode。用三个最日常的工作任务——做 PPT、分析表格、写小游戏,看看它们到底能不能帮普通打工人干活。这篇文章就是完整的实测记录,希望对你选工具有点帮助。
这回,Anthropic要劝你,别太沉迷Claude了。它上线了Reflect功能的Beta测试版,面向Free、Pro、Max用户开放。这个藏在设置里的面板,想帮你搞清楚一件事:什么时候该用Claude,什么时候该关掉它。
一家成立不到两年的 AI 公司,头部客户和交付团队都在长沙,却在启动新一轮战略布局之际,把注册地迁到了两千公里外的上海。这道选择题,昆仑元 AI 首席战略官罗弄琴想了很久。
昨儿刚出的GPT-5.6,用不到一小时,就完成了一道存在了半个世纪的图论猜想证明。而这道题呢,来头也还真不小,就是大名鼎鼎的循环双覆盖猜想(Cycle Double Cover Conjecture)。
我们汇总了两篇文章的要点,想要讲清楚几件事:到底什么是世界模型?什么不是?当下的竞争格局:世界模型将走向何方,哪条路线可能胜出?所有路线都会撞上的那堵墙是什么,有哪些可能的解法?
微软Copilot & Agents Core总裁Nitin Agrawal说,「迫不及待想让客户看到GPT-5.6能做什么」——不管是起草文档、分析数据、做演示,还是跨团队协作,产出都会更精致。除了原生接入模型,微软还会直接通过OpenAI API调用GPT-5.6,服务Microsoft 365客户。双通道,齐上阵。