AI资讯新闻榜单内容搜索-不

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 不
复杂的Harness Evolution,甚至不如多跑几遍

复杂的Harness Evolution,甚至不如多跑几遍

复杂的Harness Evolution,甚至不如多跑几遍

一个 Agent 第一次没把任务做对。

来自主题: AI技术研报
6378 点击    2026-09-16 14:40
高德联合南大、清华、北大发布WorldRoamBench,定义交互式世界模型长时漫游评测新范式

高德联合南大、清华、北大发布WorldRoamBench,定义交互式世界模型长时漫游评测新范式

高德联合南大、清华、北大发布WorldRoamBench,定义交互式世界模型长时漫游评测新范式

随着 Genie 3 的发布,可交互世界模型真正走到台前:用户不再只是观看生成视频,而是可以输入动作实时改变一个持续演化的世界。世界模型开始从「生成一段视频」走向「模拟一个可交互世界」,但能走进去,不等于经得起探索。模型能否持续响应控制、维持视觉与空间一致、遵守物理规律并记住来路,仍缺少系统评测。

来自主题: AI技术研报
8966 点击    2026-09-16 10:35
华为GTS让Agent学会「看着网络排障」,双防火墙难题几乎全拿下

华为GTS让Agent学会「看着网络排障」,双防火墙难题几乎全拿下

华为GTS让Agent学会「看着网络排障」,双防火墙难题几乎全拿下

“智能并不局限于大脑内部。当我们使用纸笔或地图来梳理复杂问题时,这些外部工具就成为了我们‘延展的心智’。”

来自主题: AI技术研报
9681 点击    2026-09-16 10:07
回消息也能有个分身,OKEight记住了你和每个人的关系

回消息也能有个分身,OKEight记住了你和每个人的关系

回消息也能有个分身,OKEight记住了你和每个人的关系

OKEight(回了么)是程梦琪团队开发的AI回复工具,它为每位联系人维护本地人物卡,学习用户与不同人的沟通风格,在Mac端读取当前对话生成候选回复,并记录未完成的约定和事项。

来自主题: AI资讯
8672 点击    2026-09-15 16:17
刚写完V4.1主算子就要“转业”?DeepSeek资深工程师深夜独白

刚写完V4.1主算子就要“转业”?DeepSeek资深工程师深夜独白

刚写完V4.1主算子就要“转业”?DeepSeek资深工程师深夜独白

DeepSeek资深MLSys工程师刘胜与深夜发文,坦承刚完成V4.1核心算子交付后,意识到AI已能自主编写和优化GPU算子,正迫使他从手写底层算子转向驾驭AI Agent的"机甲驾驶员",并警示工程底层能力空心化可能带来系统性风险。

来自主题: AI资讯
8454 点击    2026-09-15 14:21
Meta新研究:字节模型蒸馏后,天花板破了

Meta新研究:字节模型蒸馏后,天花板破了

Meta新研究:字节模型蒸馏后,天花板破了

Token词元替代了Byte字节,但不意味着大模型都得是Token。

来自主题: AI技术研报
5903 点击    2026-09-15 13:59
ECCV 2026|不靠「上帝视角」,也不等「完美指令」:REAL 让具身智能体走向开放世界

ECCV 2026|不靠「上帝视角」,也不等「完美指令」:REAL 让具身智能体走向开放世界

ECCV 2026|不靠「上帝视角」,也不等「完美指令」:REAL 让具身智能体走向开放世界

真实家庭任务往往从「不完整的信息」开始:机器人不知道目标在哪里,用户也未必能一次说清自己想要什么。面对「帮我从餐桌上拿点零食」这样的模糊指令,机器人不仅要主动寻找候选物体,还要在发现面包和多个甜甜圈后进一步询问用户,确认究竟该拿哪一个。

来自主题: AI技术研报
6313 点击    2026-09-15 13:36
3B模型成功率94.5%!Token级奖励打开长链路智能体训练新思路

3B模型成功率94.5%!Token级奖励打开长链路智能体训练新思路

3B模型成功率94.5%!Token级奖励打开长链路智能体训练新思路

多轮智能体任务只有一个终点奖励,但在一条包含搜索、工具调用和多轮决策的轨迹里,决定成败的往往是一个不起眼的查询词、动作或对象选择。

来自主题: AI技术研报
8471 点击    2026-09-15 13:35