统一transformer与diffusion!Meta融合新方法剑指下一代多模态王者
统一transformer与diffusion!Meta融合新方法剑指下一代多模态王者本文引入了 Transfusion,这是一种可以在离散和连续数据上训练多模态模型的方法。
搜索
本文引入了 Transfusion,这是一种可以在离散和连续数据上训练多模态模型的方法。
最近 ACL 2024 论文放榜,扫了下,SMoE(稀疏混合专家)的论文不算多,这里就仔细梳理一下,包括动机、方法、有趣的发现,方便大家不看论文也能了解的七七八八,剩下只需要感兴趣再看就好。
Midjourney认怂了兄弟姐妹们
在人工智能领域,图像生成技术一直是一个备受关注的话题。近年来,扩散模型(Diffusion Model)在生成逼真且复杂的图像方面取得了令人瞩目的进展。然而,技术的发展也引发了潜在的安全隐患,比如生成有害内容和侵犯数据版权。这不仅可能对用户造成困扰,还可能涉及法律和伦理问题。
视频时代需要自己的基础设施。VideoSys 的目标是使视频生成对于每个人而言都简便、迅速且成本低廉。
除了扩大模型规模,AI 公司还有其他路可以走吗?只靠模型 API 赚不到钱了怎么办?Aidan Gomez 在访谈中谈到了目前困扰 AI 公司的诸多难题。
只要不到10行代码,就能让大模型数学能力(GSM8k)提升20%!
Transformer八子中最年轻的Aidan Gomez在最新的采访中感叹:
什么是顶流?
哈佛大学的一项最新研究表明,大语言模型已经深入学生的日常生活。为何学生们对AI的兴趣如此浓厚,背后的原因恐怕是这所大学的教授们。