零样本学习的目标,是让模型识别训练时从未出现过的类别。
继ICLR 2025论文ZeroDiff之后,其扩展工作《ZeroDiff++: Generative Test-Time Adaptation for Zero-shot Learning》(以下简称ZeroDiff++)已发表于IEEE TPAMI 2026。
新框架继续使用扩散机制缓解少样本训练中的过拟合,并把研究重点推进到测试阶段:让生成器利用真实测试样本适应未见类别,再沿扩散路径生成可追溯的部分合成特征。

生成式零样本学习通常先在已见类别上学习视觉特征与属性、文本等语义之间的关系,再根据未见类别语义合成特征,用这些“虚拟样本”训练分类器。
问题在于,类别语义是静态概括,单张图片却只呈现部分属性;训练样本越少,生成器越容易记住偶然关系。到了测试阶段,传统方法又冻结生成器并从纯高斯噪声出发,合成特征即使类别边界清楚,也可能离真实未见类分布很远。论文把两类偏差统一概括为虚假视觉-语义关联。
论文还用判别器对训练特征、留出的已见类与未见类测试特征的critic score差值观察虚假关联:差距越大,模型越容易把真实测试样本判作“假”。数据越少,两类差距越明显。由此,少样本过拟合与未见类分布断裂被放进同一问题框架。
论文Figure2把五个问题与五项设计一一对齐:训练阶段的有限数据、静态语义、单视角判别,以及测试阶段的不适应生成器、完全噪声生成。右侧可视化显示,训练数据降至10%时,ZeroDiff++仍能生成接近真实分布的特征。

前三项设计构成ZeroDiff的核心,也是ZeroDiff++的训练基础。它们不是简单“加噪”,而是从数据、语义和判别三个角度共同加固已见类别上的视觉—语义关系。
ZeroDiff++的主要新增部分位于生成阶段。传统生成器只见过已见类别,测试时却直接为未见类别造数据;这种“训练完即冻结”的流程,正是生成分布与真实分布脱节的来源。ZeroDiff++通过DiffTTA和DiffGen让真实测试特征进入闭环。
DiffGen可理解为“以真实样本为草稿的特征想象”。中等扩散时间在复制与完全合成间取得折中:步数太小多样性不足,太大又会引入分布漂移,消融实验也验证了这一点。

由于每次生成都从具体测试特征出发,生成器还能同时接收与该样本配对的实例级对比语义,减少条件语义与视觉输入错配。最终,每个星形生成特征都能沿箭头追溯到某个真实测试特征;这不仅缩短真假分布之间的距离,也为失败样本定位、筛选和误差分析提供了路径证据。
图中的两种颜色代表两个未见类别。沿箭头观察,可以看到生成特征从具体真实样本出发形成连续轨迹,而不是成为无法解释来源的孤立点;一旦某条轨迹偏离类别簇,便能回查其真实起点和中间生成状态。

在AWA2、CUB和SUN三个基准上,ZeroDiff++的标准零样本准确率分别达到93.5%、87.7%和80.2%,对应ZeroDiff的87.3%、87.5%和77.3%。在更难的广义零样本设置中,模型需要同时识别已见类与未见类;ZeroDiff++的调和平均值H分别达到92.3%、85.4%和69.6%,相较ZeroDiff提升10.9、3.8和9.8个百分点。
尤其在AWA2上,H的两位数提升说明改进并非单纯偏向未见类,而是同时保持了已见类与未见类之间的识别平衡;这正对应了ZeroDiff++在测试阶段缩小真实—生成分布差距的设计目标。


数据越少,框架的优势越直观。只使用10%已见类训练样本时,ZeroDiff++在AWA2、CUB和SUN上的广义零样本H仍达到92.0%、77.3%和41.0%。推理方式对比进一步显示:不开启DiffTTA时,DiffGen在三套数据上的标准零样本准确率已达92.9%、87.0%和80.0%,AWA2的H为88.0%;开启DiffTTA后,AWA2的未见类/已见类准确率达到90.7%/93.9%,H提升到92.3%。

ZeroDiff++的价值不只在指标。它把扩散过程从训练增强工具变成测试阶段连接真实样本与生成特征的可控路径,为生成式零样本学习增加适应性和可追溯性。DiffTTA仍依赖伪标签质量;论文显示过滤高熵样本可继续改善结果,未来也可结合伪标签校正和不确定性加权。
作者:Zihan Ye(1)、Shreyank N Gowda(2)、Kaile Du(3)、Weijian Luo(4)、Ling Shao(1,*)(通讯作者)
研究机构:(1)中国科学院大学工程科学学院;(2)诺丁汉大学计算机科学学院;(3)东南大学;(4)小红书Hi Lab
ZeroDiff++(TPAMI 2026)论文:
https://ieeexplore.ieee.org/abstract/document/11672276
ZeroDiff(ICLR 2025)论文:
https://proceedings.iclr.cc/paper_files/paper/2025/file/9796170d31d42b943534df40bdee68d3-Paper-Conference.pdf
个人主页:https://fouriye.github.io/
文章来自于"量子位",作者 "ZeroDiff++ 团队"。