AI资讯新闻榜单内容搜索-模型训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型训练
ECCV 2026|Google等推出VGGRPO:用4D隐空间奖励实现世界一致的视频生成

ECCV 2026|Google等推出VGGRPO:用4D隐空间奖励实现世界一致的视频生成

ECCV 2026|Google等推出VGGRPO:用4D隐空间奖励实现世界一致的视频生成

最近,来自 Google、哥本哈根大学、牛津大学等机构的研究者提出了 VGGRPO(Visual Geometry GRPO,收录于 ECCV 2026)。这项工作聚焦于一个核心问题:如何在不牺牲预训练模型泛化能力的前提下,高效地提升视频生成的几何一致性,并使其适用于动态场景。其核心思路是,在隐空间(latent space)中利用 4D 几何奖励,进行几何感知的视频后训练。

来自主题: AI技术研报
10065 点击    2026-07-18 10:09
FreeStyle来了!从社区LoRA中挖掘风格与内容,让双参考图像生成更可控

FreeStyle来了!从社区LoRA中挖掘风格与内容,让双参考图像生成更可控

FreeStyle来了!从社区LoRA中挖掘风格与内容,让双参考图像生成更可控

最近,一篇名为 FreeStyle: Free Control of Style-Content Dual-Reference Generation from Community LoRA Mining 的工作引起了不少关注。换句话说,FreeStyle 研究的是 style-content dual-reference generation,也就是「内容 - 风格双参考生成」。

来自主题: AI技术研报
7975 点击    2026-07-18 10:09
RoboTwin原班团队再下场,构建具身评测珠峰

RoboTwin原班团队再下场,构建具身评测珠峰

RoboTwin原班团队再下场,构建具身评测珠峰

曾推出 RoboTwin 系列基准的团队发布了 RoboDojo,一套统一覆盖仿真与真实机器人操作的具身智能评测体系。它包含 42 个仿真任务、18 个真实机器人任务,并将 30 个代表性机器人策略放到同一套标准下比较。

来自主题: AI技术研报
9043 点击    2026-07-18 10:08
机器人需要「看到三维未来」!RynnWorld-4D重塑4D具身世界模型

机器人需要「看到三维未来」!RynnWorld-4D重塑4D具身世界模型

机器人需要「看到三维未来」!RynnWorld-4D重塑4D具身世界模型

近两年,视频生成模型在具身智能领域受到持续关注。从 UniPi、SuSIE 到各类 action-conditioned video generation 变体,其核心思路一致:先由模型生成一段未来视频,再从中提取动作信号供机器人执行。

来自主题: AI技术研报
9877 点击    2026-07-17 10:12
ECCV'26| 看起来会动,还要动得合理:从生成模型中主动寻找物理证据

ECCV'26| 看起来会动,还要动得合理:从生成模型中主动寻找物理证据

ECCV'26| 看起来会动,还要动得合理:从生成模型中主动寻找物理证据

PhyMAGIC通过让物体动起来,从视频中提取物理证据,帮助准确推断材料属性。它结合图生视频与视觉语言模型,生成针对性运动探针,并不断修正物理参数,最终构建出可微分的3D动态模型,实现更符合现实的视频生成。

来自主题: AI技术研报
5845 点击    2026-07-17 10:09
让动态投机解码不再局限于DSpark:LightSpec首个开源动态MTP系统实现

让动态投机解码不再局限于DSpark:LightSpec首个开源动态MTP系统实现

让动态投机解码不再局限于DSpark:LightSpec首个开源动态MTP系统实现

随着 DeepSeek 发布 DSpark,动态 MTP(多 Token 预测)成为了对抗高并发、提升 GPU 利用率的绝对焦点。然而,DSpark 高度绑定特定模型且需要额外训练。

来自主题: AI技术研报
9405 点击    2026-07-17 10:08
Lychee-FD:哈工大张民教授团队在全双工语音大模型领域取得重要突破,斩获ACL 2026杰出论文奖

Lychee-FD:哈工大张民教授团队在全双工语音大模型领域取得重要突破,斩获ACL 2026杰出论文奖

Lychee-FD:哈工大张民教授团队在全双工语音大模型领域取得重要突破,斩获ACL 2026杰出论文奖

全双工语音对话是人类最自然的交流方式,是语音对话研究的梦想。相比文本输入,语音天然更接近人的交流方式,但现有语音对话常常停留在 “一问一答、听完再说” 的轮次式交互范式。

来自主题: AI技术研报
10053 点击    2026-07-16 14:55
翁荔长文谈Harness自进化:Agent越用越强,评测难点怎么破?

翁荔长文谈Harness自进化:Agent越用越强,评测难点怎么破?

翁荔长文谈Harness自进化:Agent越用越强,评测难点怎么破?

近日,翁荔发布长文 《Harness Engineering for Self-Improvement》,系统梳理了 harness engineering 在 AI 自我改进中的作用。

来自主题: AI技术研报
9043 点击    2026-07-16 10:31
大模型RL训练为何会「越训越窄」?ACL Outstanding Paper从token-level熵变揭示RLVR训练机制

大模型RL训练为何会「越训越窄」?ACL Outstanding Paper从token-level熵变揭示RLVR训练机制

大模型RL训练为何会「越训越窄」?ACL Outstanding Paper从token-level熵变揭示RLVR训练机制

基于可验证奖励的强化学习(Reinforcement Learning with Verifiable Rewards,RLVR)正在成为大模型后训练的关键技术。数学题能判对错,代码能跑测试,可验证奖励让大模型可以通过强化学习持续提升推理能力。

来自主题: AI技术研报
10446 点击    2026-07-16 10:10