时序预测机器学习(SoftDiffusion谷歌新框架从通用扩散中正确调度)
时序预测机器学习(SoftDiffusion谷歌新框架从通用扩散中正确调度)
2024-11-24 12:49:39  作者:他说全是爱  网址:https://m.xinb2b.cn/know/vpp317840.html

选自arXiv

机器之心编译

编辑:蛋酱

近来,扩散模型成为 AI 领域的研究热点。谷歌研究院和 UT-Austin 的研究者在最新的一项研究中充分考虑了「损坏」过程,并提出了一个用于更通用损坏过程的扩散模型设计框架。

我们知道,基于分数的模型和去噪扩散概率模型(DDPM)是两类强大的生成模型,它们通过反转扩散过程来产生样本。这两类模型已经在 Yang Song 等研究者的论文《Score-based generative modeling through stochastic differential equations》中统一到了单一的框架下,并被广泛地称为扩散模型。

目前,扩散模型在包括图像、音频、视频生成以及解决逆问题等一系列应用中取得了巨大的成功。Tero Karras 等研究者在论文《Elucidating the design space of diffusionbased generative models》中对扩散模型的设计空间进行了分析,并确定了 3 个阶段,分别为 i) 选择噪声水平的调度,ii) 选择网络参数化(每个参数化生成一个不同的损失函数),iii) 设计采样算法。

近日,在谷歌研究院和 UT-Austin 合作的一篇 arXiv 论文《Soft Diffusion: Score Matching for General Corruptions》中,几位研究者认为扩散模型仍有一个重要的步骤:损坏(corrupt)。一般来说,损坏是一个添加不同幅度噪声的过程,对于 DDMP 还需要重缩放。虽然有人尝试使用不同的分布来进行扩散,但仍缺乏一个通用的框架。因此,研究者提出了一个用于更通用损坏过程的扩散模型设计框架。

具体地,他们提出了一个名为 Soft Score Matching 的新训练目标和一种新颖的采样方法 Momentum Sampler。理论结果表明,对于满足正则条件的损坏过程,Soft Score MatchIng 能够学习它们的分数(即似然梯度),扩散必须将任何图像转换为具有非零似然的任何图像。

在实验部分,研究者在 CelebA 以及 CIFAR-10 上训练模型,其中在 CelebA 上训练的模型实现了线性扩散模型的 SOTA FID 分数——1.85。同时与使用原版高斯去噪扩散训练的模型相比,研究者训练的模型速度显著更快。


论文地址:https://arxiv.org/pdf/2209.05442.pdf

方法概览

通常来说,扩散模型通过反转逐渐增加噪声的损坏过程来生成图像。研究者展示了如何学习对涉及线性确定性退化和随机加性噪声的扩散进行反转。


具体地,研究者展示了使用更通用损坏模型训练扩散模型的框架,包含有三个部分,分别为新的训练目标 Soft Score Matching、新颖采样方法 Momentum Sampler 和损坏机制的调度。

首先来看训练目标 Soft Score Matching,这个名字的灵感来自于软过滤,是一种摄影术语,指的是去除精细细节的过滤器。它以一种可证明的方式学习常规线性损坏过程的分数,还在网络中合并入了过滤过程,并训练模型来预测损坏后与扩散观察相匹配的图像。

只要扩散将非零概率指定为任何干净、损坏的图像对,则该训练目标可以证明学习到了分数。另外,当损坏中存在加性噪声时,这一条件总是可以得到满足。

具体地,研究者探究了如下形式的损坏过程。


在过程中,研究者发现噪声在实证(即更好的结果)和理论(即为了学习分数)这两方面都很重要。这也成为了其与反转确定性损坏的并发工作 Cold Diffusion 的关键区别。

其次是采样方法 Momentum Sampling。研究者证明,采样器的选择对生成样本质量具有显著影响。他们提出了 Momentum Sampler,用于反转通用线性损坏过程。该采样器使用了不同扩散水平的损坏的凸组合,并受到了优化中动量方法的启发。

这一采样方法受到了上文 Yang Song 等人论文提出的扩散模型连续公式化的启发。Momentum Sampler 的算法如下所示。


下图直观展示了不同采样方法对生成样本质量的影响。图左使用 Naive Sampler 采样的图像似乎有重复且缺少细节,而图右 Momentum Sampler 显著提升了采样质量和 FID 分数。


最后是调度。即使退化的类型是预定义的(如模糊),决定在每个扩散步骤中损坏多少并非易事。研究者提出一个原则性工具来指导损坏过程的设计。为了找到调度,他们将沿路径分布之间的 Wasserstein 距离最小化。直观地讲,研究者希望从完全损坏的分布平稳过渡到干净的分布。

实验结果

研究者在 CelebA-64 和 CIFAR-10 上评估了提出的方法,这两个数据集都是图像生成的标准基线。实验的主要目的是了解损坏类型的作用。

研究者首先尝试使用模糊和低幅噪声进行损坏。结果表明,他们提出的模型在 CelebA 上实现了 SOTA 结果,即 FID 分数为 1.85,超越了所有其他仅添加噪声以及可能重缩放图像的方法。此外在 CIFAR-10 上获得的 FID 分数为 4.64,虽未达到 SOTA 但也具有竞争力。


此外,在 CIFAR-10 和 CelebA 数据集上,研究者的方法在另一项指标采样时间上也表现更好。另一个额外的好处是具有显著的计算优势。与图像生成去噪方法相比,去模糊(几乎没有噪声)似乎是一种更有效的操纵。

下图展示了 FID 分数如何随着函数评估数量(Number of Function Evaluations, NFE)而变。从结果可以看到,在 CIFAR-10 和 CelebA 数据集上,研究者的模型可以使用明显更少的步骤来获得与标准高斯去噪扩散模型相同或更好的质量。


  • 广东潮阳萧氏四序堂(广东潮阳第一祠)
  • 2024-11-24广东潮阳第一祠萧氏肇基祖祠“四序堂”,位于潮汕市区南中路东侧,是潮阳唯一主体建筑保存较完好、十分珍贵的宋代古建筑,具有非常高的历史研究价值独具特色的建造方法宋代缩影|人文写照“四序堂”始建于宋代,距今已有八百多年的。
  • 蜜蜂的天敌吗(饲养蜜蜂蜜蜂的天敌)
  • 2024-11-24饲养蜜蜂蜜蜂的天敌食虫虻食虫虻又称之为盗虻,双翅目短角亚目,大约有7100种分,布在世界各地长着刺的腿,脸部有浓密的胡子状的鬃毛,两只大的复眼中间有3个单眼,所有的食虫虻都有梯,体质粗壮食虫虻图片双翅目(Diptera。
  • 杨幂阮经天勠力同心沸血不凉(论社交谁能超过杨幂)
  • 2024-11-24论社交谁能超过杨幂杨幂在舞台上当众撕开黄晓明诚意黄晓明一脸的惊诧这么敢的也只有杨幂了吧撩人完全不看场合和华晨宇在一起不停的拽华晨宇的衣服带子华晨宇拽回以后她又开始玩华晨宇的头发就连禁欲系男神黄轩都经不住杨幂的撩黄轩看手。
  • 大众途观发动机轻微抖动(11万公里的大众途观)
  • 2024-11-2411万公里的大众途观正常情况下,汽车上发动机只要不出故障,它是不会无缘无故发生抖动问题的,一旦发动机出现抖动的问题,肯定是发动机上的有关部件出现了问题,此时我们车主就应该及时的上4S店或者修理店去检修,如果检修不及时,很。
  • 女人生理周期提示两三天正常吗(女性频频缺乏兴致)
  • 2024-11-24女性频频缺乏兴致当身体缺乏维生素时会导致手指脱皮、牙龈出血等,甚至会引起一系列的疾病,如果女性体内缺乏大量维生素b2的话,也可能会伤害到女性生殖器官,导致性冷淡女性缺乏维生素b2会性冷淡吗?维生素b2是我们身体中最重。
  • 梦见红头发什么意思(梦见红头发什么预兆)
  • 2024-11-24梦见红头发什么预兆梦里的头通常象征权威和社会职位,而且和尊严、烦恼、聪明智慧等方面含义都有联系准备考试的人梦见红头发,意味着一切顺利,可以录取,参加北区考试谈婚论嫁的人梦见红头发,说明意见不和,难成创业的人梦见红头发,。
  • 香辣鱼的制作方法和配料(怎么做香辣鱼)
  • 2024-11-24怎么做香辣鱼主料:新鲜鱼块适量辅料:辣椒适量、老抽适量、生姜适量、花椒适量、蒜头适量、醋适量、生抽适量、胡椒适量、盐适量鱼块用生姜,蒜头,花椒,辣椒,老抽,盐,胡椒腌制腌制鱼块一晚上挑出作料下油锅炸炸至两面金黄锅。
  • 迪士尼乐高动画 风靡全球的动画角色乐高化
  • 2024-11-24迪士尼乐高动画 风靡全球的动画角色乐高化加菲猫是由美国漫画家吉姆·戴维斯创作的一只动漫角色,于1978年6月19日开始连载这只橙色的,爱吃人类美食的,胖胖的宠物很快就风靡全球,成为著名的动漫卡通角色几十年来,加菲猫除了通过漫画推广传播外,也。
  • 秋刀鱼怎么做减肥(秋刀鱼可以减肥吗)
  • 2024-11-24秋刀鱼可以减肥吗秋刀鱼可以减肥吗秋刀鱼的热量热量:310大卡(100克)分类:水产类评价:一种高蛋白的食品,减肥时不宜多食营养信息营养素含量(每100克)热量(大卡)310.00碳水化合物(克)0.10脂肪(克)24。