AI资讯新闻榜单内容搜索-模型训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型训练
如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26

如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26

如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26

AI视频生成技术迅猛发展,生成内容的逼真度不断提升,现有检测方法已无法满足需求。最新综述提出「事实保真度验证」新目标,从视觉与语言双视角梳理出四层检测框架,涵盖底层线索、时空一致性、跨模态核验及世界知识推理,强调多层证据耦合与可解释性。

来自主题: AI技术研报
8323 点击    2026-07-07 14:56
15个推理模型集体翻车,详解输出背后的思考链潜藏风险

15个推理模型集体翻车,详解输出背后的思考链潜藏风险

15个推理模型集体翻车,详解输出背后的思考链潜藏风险

哈佛大学、南加州大学、布朗大学、MIT 等多个机构的研究者联合做了一项系统性研究,给出了否定的答案,并举例到「当我们发现大模型的思考链可被用于生成炸弹装置或投毒配方等高风险内容时,便意识到这一问题非同小可」。

来自主题: AI技术研报
8429 点击    2026-07-07 10:21
单次训练横扫9个基准,遥感检测最大数据集与基础模型框架LEVIRDet问世

单次训练横扫9个基准,遥感检测最大数据集与基础模型框架LEVIRDet问世

单次训练横扫9个基准,遥感检测最大数据集与基础模型框架LEVIRDet问世

近日,北京航空航天大学史振威教授和邹征夏教授团队发布了一个面向通用遥感目标检测的大规模数据集与基础模型框架 ——LEVIRDet。该研究构建了目前最大规模、最全面的遥感目标检测数据集 LEVIRDet-159,并在此基础上提出了面向通用遥感检测的基础模型 LEVIRDetNet。

来自主题: AI技术研报
7793 点击    2026-07-07 10:20
谁说3DGS必须靠LiDAR?如视Argus入选ECCV,让图像也能提供LiDAR级位姿约束

谁说3DGS必须靠LiDAR?如视Argus入选ECCV,让图像也能提供LiDAR级位姿约束

谁说3DGS必须靠LiDAR?如视Argus入选ECCV,让图像也能提供LiDAR级位姿约束

近期, ECCV 2026 结果公布,Realsee 团队的成果 Argus: Metric Panoramic 3D Reconstruction for Indoor Scenes 成功入选。它面向室内全景图像,能够从稀疏、无序的全景照片中,直接预测相机位姿、度量深度和点云重建结果,可以为 3DGS 提供更稳定、更精准的几何约束。

来自主题: AI技术研报
8881 点击    2026-07-07 09:55
ICML 2026|如何对Multi-Agent系统进行过程评估?重新认识多智能体系统中的Orchestrator

ICML 2026|如何对Multi-Agent系统进行过程评估?重新认识多智能体系统中的Orchestrator

ICML 2026|如何对Multi-Agent系统进行过程评估?重新认识多智能体系统中的Orchestrator

来自南京大学 NLP 实验室的 ICML 2026 论文 Recognize Your Orchestrator: An Entropy Dynamics Perspective for LLM Multi-Agent Systems 指出:在当前主流的 Orchestrator-Executor 多智能体架构中,系统失败往往并不首先来自某个执行器不会干活,

来自主题: AI技术研报
8760 点击    2026-07-06 15:48
机器人看视频学操作!伯克利首次打通互联网视频到灵巧手真机部署链路

机器人看视频学操作!伯克利首次打通互联网视频到灵巧手真机部署链路

机器人看视频学操作!伯克利首次打通互联网视频到灵巧手真机部署链路

UC Berkeley团队提出的端到端流程旨在解决该问题,研究团队跑通了首条能够从网络视频生成真实灵巧手实机执行轨迹的完整链路:先从真实场景中的单目RGB视频中重建4D手-物交互过程,再将这些交互轨迹重定向到拥有22个自由度的Sharpa Wave灵巧手上。

来自主题: AI技术研报
7980 点击    2026-07-06 15:47
世界模型评测的最大盲区,被新基准MemoBench捅破了

世界模型评测的最大盲区,被新基准MemoBench捅破了

世界模型评测的最大盲区,被新基准MemoBench捅破了

来自哈佛大学、MIT、IBM、波士顿大学、谷歌、JHU、CMU 和 Kempner Institute 的研究者提出了一个新的诊断性基准:MemoBench。这是首个面向动态环境的「消失-重现」世界建模评测基准,并已被计算机视觉顶会 ECCV 2026 接收。其一作 Haoyu Chen 为哈佛大学计算科学与工程专业一年级硕士生,师从哈佛大学计算机科学助理教授 Yilun Du。

来自主题: AI技术研报
8169 点击    2026-07-06 12:24
上海交大提出ICRDrag:首个上下文区域拖拽模型,实现精准可控图像编辑

上海交大提出ICRDrag:首个上下文区域拖拽模型,实现精准可控图像编辑

上海交大提出ICRDrag:首个上下文区域拖拽模型,实现精准可控图像编辑

还在用 DragGAN、DragDiffusion 拖拽修图?点选拖拽容易变形、边界割裂、细节丢失的时代落幕了!ECCV 2026 ICRDrag 首创上下文区域拖拽模型,用掩码精准定位局部区域,移动、缩放、变形全都丝滑自然,兼顾精准度与画面真实感。

来自主题: AI技术研报
8375 点击    2026-07-05 09:47
Vibe一下能自动画工程图、做3D装配的AI来了丨上海AI Lab

Vibe一下能自动画工程图、做3D装配的AI来了丨上海AI Lab

Vibe一下能自动画工程图、做3D装配的AI来了丨上海AI Lab

近日,上海AI Lab等团队提出了一种面向专业软件智能体的新范式——ComAct(COM-as-Action)。它的核心思想在于:不再把鼠标点击和键盘输入作为Agent的action,而是让Agent直接生成COM代码,通过软件底层对象模型操纵真实专业软件。

来自主题: AI技术研报
9389 点击    2026-07-05 09:43
Router的作用被低估了?vLLM这个神器,让单次调用背后藏了一支模型协作小队

Router的作用被低估了?vLLM这个神器,让单次调用背后藏了一支模型协作小队

Router的作用被低估了?vLLM这个神器,让单次调用背后藏了一支模型协作小队

vLLM 社区推出的 Semantic Router 除了专注上面三个方向,正在更进一步:我们认为:router 不只是选择模型,还可以提升模型能力。用户不用改权重,也不用让每个 Agent 团队都自己搭一套 Graph,而是在一次普通 Model API 调用的内部,组织出一支有边界、有预算、有验证、有回退的 “小队”。

来自主题: AI技术研报
9071 点击    2026-07-05 09:43