AI资讯新闻榜单内容搜索-模型训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型训练
视频世界模型推理最高提速2.59×!浙大新作无需重训,不改参数

视频世界模型推理最高提速2.59×!浙大新作无需重训,不改参数

视频世界模型推理最高提速2.59×!浙大新作无需重训,不改参数

交互式视频世界模型正在从「一次性生成短片」走向「像游戏一样边操作边生成」。但长轨迹交互会迅速放大上下文、显存和多步去噪开销。Light Interaction不改模型参数、不重新训练,只在推理阶段把相机轨迹变成调度信号,动态选择历史上下文、在回访状态复用去噪输出,并用面向自回归生成的3D稀疏注意力降低计算。

来自主题: AI技术研报
9873 点击    2026-07-23 10:39
打通感知-理解-交互链路,全栈视频理解大模型VideoChat3开源了

打通感知-理解-交互链路,全栈视频理解大模型VideoChat3开源了

打通感知-理解-交互链路,全栈视频理解大模型VideoChat3开源了

视频是描述物理世界的重要数据形态,更是人类与物理世界交互的重要载体,视频理解大模型是让 AI 从数字世界走向物理世界最基础、最原生的组成部分。

来自主题: AI技术研报
7991 点击    2026-07-23 10:37
花几百万买的H100在「摸鱼」?英伟达:别怪显卡,是你的模型「长得丑」

花几百万买的H100在「摸鱼」?英伟达:别怪显卡,是你的模型「长得丑」

花几百万买的H100在「摸鱼」?英伟达:别怪显卡,是你的模型「长得丑」

就在最近,英伟达亲自下场,发布了一篇名为《AI Model Co-Design: Hardware-Friendly LLM Design》的技术博客。整篇文章洋洋洒洒,其实就想点醒行业一件事:别光顾着堆算力了,来看看你们是怎么把顶级显卡逼成“磨洋工”的吧。

来自主题: AI技术研报
9446 点击    2026-07-22 15:21
小红书引擎架构团队OSDI 2026新成果:HELMSMAN重塑大规模向量检索基础设施

小红书引擎架构团队OSDI 2026新成果:HELMSMAN重塑大规模向量检索基础设施

小红书引擎架构团队OSDI 2026新成果:HELMSMAN重塑大规模向量检索基础设施

近日,围绕搜索、推荐、广告等核心业务中的大规模向量检索成本与性能问题,小红书引擎架构团队在 OSDI 2026 会议上发表了论文《The Clustering Strikes Back: Building Cost-Effective and High-Performance ANNS at Scale with HELMSMAN》。

来自主题: AI技术研报
9914 点击    2026-07-22 10:35
业内首款超算+智算的大规模计算底座,在WAIC上我们找到了

业内首款超算+智算的大规模计算底座,在WAIC上我们找到了

业内首款超算+智算的大规模计算底座,在WAIC上我们找到了

这几天,全网被WAIC“霸屏”,从具身智能到国产算力,这场一年一度的AI盛典,同样吸引了科技圈所有目光。

来自主题: AI资讯
8641 点击    2026-07-22 10:10
5.83倍加速!PolicyTrim:让VLA机器人少走弯路、更快完成任务

5.83倍加速!PolicyTrim:让VLA机器人少走弯路、更快完成任务

5.83倍加速!PolicyTrim:让VLA机器人少走弯路、更快完成任务

VLA模型已经会做任务,但真实机器人还是慢!PolicyTrim是一种优化VLA机器人执行效率的方法,无需重新训练。它通过扩展可靠动作序列并减少冗余步骤,帮助机器人更直接完成任务,提升整体速度。

来自主题: AI技术研报
6353 点击    2026-07-22 10:09
六位顶尖学者、三大挑战赛道——IROS 2026 Physical World Models Workshop征稿

六位顶尖学者、三大挑战赛道——IROS 2026 Physical World Models Workshop征稿

六位顶尖学者、三大挑战赛道——IROS 2026 Physical World Models Workshop征稿

2026年10月1日,IROS 2026 Workshop——Physical World Models for Scaling Embodied AI将在美国匹兹堡举行。论文征集现已开放,8月10日截止;WorldArena 2.0 Challenge三大赛道已于7月10日开赛,总奖金$7500。

来自主题: AI资讯
7339 点击    2026-07-22 10:09
ICML 2026 | 多智能体系统也能搭积木?Agent Primitives让MAS走向模块化复用

ICML 2026 | 多智能体系统也能搭积木?Agent Primitives让MAS走向模块化复用

ICML 2026 | 多智能体系统也能搭积木?Agent Primitives让MAS走向模块化复用

多智能体系统(Multi-Agent Systems,MAS)展示了令人印象深刻的能力:一个模型负责提出方案,另一个模型进行批评,还有模型承担投票、规划或执行。通过角色分工和多轮协作,系统能够解决单个模型难以稳定完成的数学推理、代码生成和知识问答任务。

来自主题: AI技术研报
7976 点击    2026-07-21 17:05
经得起观众「刁难」,扛得住宁德「检验」:WAIC后重新认识苏度

经得起观众「刁难」,扛得住宁德「检验」:WAIC后重新认识苏度

经得起观众「刁难」,扛得住宁德「检验」:WAIC后重新认识苏度

外界第一次认识苏度,是在今年 4 月。彼时,sudo R1 的开放物体抓取能力给行业留下深刻印象:在开放环境中面对随机物体,机器人能够稳定完成抓取。抓取,这是一个足够基础、又足够难的技能。

来自主题: AI技术研报
8709 点击    2026-07-21 17:04
视觉推理「囫囵吞枣」靠不住!ProLaViT教会多模态大模型在隐空间里「步步为营」

视觉推理「囫囵吞枣」靠不住!ProLaViT教会多模态大模型在隐空间里「步步为营」

视觉推理「囫囵吞枣」靠不住!ProLaViT教会多模态大模型在隐空间里「步步为营」

针对这一挑战,腾讯内容服务部 BAC 提出了一个名为 ProLaViT(Progressive Latent Visual Thought) 的全新框架。它的核心思想是:别急着下结论,先在连续隐空间里像人一样「步步推导」。 即让模型遵循 「定位 → 聚焦 → 分离」(Locate → Focus → Isolate) 的因果链,逐步收紧视觉注意力,最终精准锁定目标。

来自主题: AI技术研报
8828 点击    2026-07-21 16:55