Agent Memory 走到十字路口:技术路线、评测方法与 AML 首榜
Agent Memory 走到十字路口:技术路线、评测方法与 AML 首榜背后由清华大学、北京大学等一众机构支持的 Agent Memory Leaderboard(中文名「记忆之巅排行榜」)放出了首期成绩,目前该项目上榜 Huggingface Spaces Trending 首屏。
搜索
背后由清华大学、北京大学等一众机构支持的 Agent Memory Leaderboard(中文名「记忆之巅排行榜」)放出了首期成绩,目前该项目上榜 Huggingface Spaces Trending 首屏。
刚刚,阿里千问正式开源Qwen3.8-27B模型权重。Qwen3.8-27B是一款270亿参数的原生多模态稠密模型,支持图像、视频理解,原生上下文长度达到262K,并可通过YaRN扩展至100万Tokens。
昨晚,瑞典AI编程创企Lovable宣布完成4亿美元(约合人民币26.97亿元)C轮融资,估值达133亿美元(约合人民币896.71亿元),7个月时间估值翻倍。本轮融资由美国老牌风投Menlo Ventures领投,腾讯以及Balderton Capital、Carmignac等投资机构参投。
就在刚刚,智谱发布了其最新一代旗舰模型GLM-5.3,并宣布模型将在两周内开源。这是一个拥有7430亿个参数的模型,和此前的GLM模型一样主打编程。在多项主流基准测试中,GLM-5.3位居所有已开源或即将开源模型中的第一;其在编程与智能体任务上的能力,已逼近Claude Fable 5、GPT-5.6 Sol等海外顶尖模型。
在昨天正式发布DeepSeek V4 Pro正式版之后。 预告了很久的,DeepSeek家自己的Agent产品终于也发出来了。 名字叫,DeepSeek Harness。 理念也很清晰,一切皆插件。 可能是有史以来最快的速度,截止到我写完文,它在Github上到了3万7的Star。
8 月 14 日凌晨,OpenAI 联合 AI 芯片厂商 Cerebras 正式预览了其旗舰模型 GPT-5.6 Sol 的全新服务层级「超高速模式」(Ultrafast Mode)。在该模式下,GPT-5.6 Sol 的输出速度最高可达 750 tokens/s,相比目前 Standard(标准)模式约 53 tokens/s 的推理基线,速度提升最高达 14 倍,同时不降低任何质量。
今天凌晨,DeepSeek V4 Pro 正式版发布,引发热潮。现在,半天过去,DeepSeek Harness (开发者预览版)也来了!当然,这并不意外,毕竟该项目之前已经铺垫了很久了,比如 DeepSeek Harness 团队的崔添翼就一直在社交网络上发预热贴以及为该团队招募人才。
8 月 3 日,Genspark 创始人&CEO 景鲲在 AGI Playground 2026 大会上发布了 GenOffice。这是一款 AI 深度集成的本地 Office 客户端,其亮点在于打通了从 AI 生成到工作交付间的链路:通过 GenOffice 打造的软件工程框架,模型得以直接操作 Office 文件最复杂的底层格式,将生成内容转化为可编辑、可交付的 Word 和 PPT 成品。
Discovered Materials便是这一趋势下的最新代表,该公司计划利用大量AI Agent集群,寻找可用于制造更高效集成电路的新材料。这家初创公司表示,公司近期从Y Combinator毕业后,已完成一轮900万美元种子轮融资,由Lightspeed India Partners领投
MiniMax 过去一年的 agent 实践,从一个内部飞书 bot 开始,演化成了桌面应用 MiniMax Code,最终形成了一个训练-服务的闭环:模型在自己的 harness 里训练,通过 harness 服务用户,用户行为变成训练信号反哺下一个模型。这个闭环是模型公司设计 Agent 的核心逻辑。