AI资讯新闻榜单内容搜索-数据

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 数据
一个模型,搞定所有音频生成任务!多项基准SOTA | ICLR'26

一个模型,搞定所有音频生成任务!多项基准SOTA | ICLR'26

一个模型,搞定所有音频生成任务!多项基准SOTA | ICLR'26

港科大团队提出音频生成统一模型AudioX,只需一个模型,就能从文本、视频、图像等任意模态生成高质量音效和音乐,在多项基准上超越专家模型。团队同时开源了700万样本的细粒度标注数据集IF-caps与可控T2A评测基准T2A-bench,并在该基准上大幅领先现有方法。论文已被ICLR 2026接收。

来自主题: AI技术研报
7384 点击    2026-03-09 14:29
OpenClaw最强外挂出现:小龙虾抓不到数据有救了!

OpenClaw最强外挂出现:小龙虾抓不到数据有救了!

OpenClaw最强外挂出现:小龙虾抓不到数据有救了!

用OpenClaw挂机,抓取网页时频频翻车的烦人bug终于有解了。一个名为Scrapling的数据采集神器,几乎一夜之间就成了OpenClaw的“最强外挂”。这玩意儿不仅能穿透各种防爬虫的网页护盾,还能把网上杂乱的网页源码生扒下来,直接清洗成干净的结构化数据。

来自主题: AI资讯
9000 点击    2026-03-08 13:41
如何训练VLA?丰田研究院发布史上最大实验规模「保姆级」教程

如何训练VLA?丰田研究院发布史上最大实验规模「保姆级」教程

如何训练VLA?丰田研究院发布史上最大实验规模「保姆级」教程

是不是经常纠结于 VLA(视觉 - 语言 - 动作)模型的训练技巧?面对层出不穷的 VLA 算法,是不是常常感到眼花缭乱,不知道哪种数据模态、训练策略最有效? 别急,丰田研究院(TRI)和清华大学刚刚

来自主题: AI技术研报
8638 点击    2026-03-08 10:38
用Rust重写OpenClaw,Transformer作者下场造了安全版「龙虾」

用Rust重写OpenClaw,Transformer作者下场造了安全版「龙虾」

用Rust重写OpenClaw,Transformer作者下场造了安全版「龙虾」

面对 OpenClaw(龙虾)可能存在的「恶意利用用户数据和资金」的重大风险,Transformer 八子之一 Illia Polosukhin 出手了。今天,Illia Polosukhin 在 Reddit 上发了一则帖子,深谈了其使用 Rust 来构建安全版 OpenClaw 的心路历程,引起了热议。

来自主题: AI资讯
8270 点击    2026-03-07 11:10
Anthropic失业报告炸场!22-25岁年轻人被斩杀,AI淘汰75%编程

Anthropic失业报告炸场!22-25岁年轻人被斩杀,AI淘汰75%编程

Anthropic失业报告炸场!22-25岁年轻人被斩杀,AI淘汰75%编程

Anthropic最新报告炸场了:调查显示,程序员75%的任务已被AI覆盖!客服、数据录入紧随其后。更可怕的是,这还只是开始,报告预警:AI对劳动力市场的影响,是一场长达十年的「温水煮青蛙」!

来自主题: AI技术研报
8835 点击    2026-03-06 15:15
弯道超车?国产具身,千小时人类数据激发智能涌现

弯道超车?国产具身,千小时人类数据激发智能涌现

弯道超车?国产具身,千小时人类数据激发智能涌现

导读:近日,位于中关村的深度机智全球首次使用全新范式——人类学习,在多个国际 Benchmark 上取得 SOTA,史无前例地使用全新架构(仅使用人类第一视角数据、零真机数据)击败 Physical Intelligence 和英伟达等头部巨头二十多个百分点,并在两会开幕首日被央视报道。

来自主题: AI技术研报
8517 点击    2026-03-05 14:29
数据邪修大法好:仅用文本数据就能预训练多模态大模型

数据邪修大法好:仅用文本数据就能预训练多模态大模型

数据邪修大法好:仅用文本数据就能预训练多模态大模型

没有图片,也能预训练多模态大模型?在多模态大模型(MLLM)的研发中,行业内长期遵循着一个昂贵的共识:没有图文对(Image-Text Pairs),就没有多模态能力。

来自主题: AI技术研报
8391 点击    2026-03-03 14:25
美团首款AI浏览器Tabbit正式开启免费公测

美团首款AI浏览器Tabbit正式开启免费公测

美团首款AI浏览器Tabbit正式开启免费公测

今日,美团旗下光年之外团队宣布其首款AI浏览器Tabbit正式开启免费公测。 相比于传统浏览器,Tabbit的最大特色是支持“智能代理模式”。该模式能帮你执行复杂的网页操作任务,模拟人工操作,自动打开网页、提取信息、填写表单、跨平台整合数据等操作,把结果交付给你。

来自主题: AI资讯
9637 点击    2026-03-03 10:40
第一次,多模态大模型学会边看边听,Meta新作性能暴涨113%

第一次,多模态大模型学会边看边听,Meta新作性能暴涨113%

第一次,多模态大模型学会边看边听,Meta新作性能暴涨113%

Meta联合多所高校发布首个可规模化自动生成第一视角音视频理解数据的引擎EgoAVU ,让多模态大模型首次真正「听懂世界」。

来自主题: AI技术研报
8781 点击    2026-02-28 15:26