0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

Stable Diffusion采样速度翻倍!仅需10到25步的扩散模型采样算法

智能感知与物联网技术研究所 来源:智能感知与物联网技术研 作者:智能感知与物联网 2022-11-21 11:55 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

清华大学计算机系朱军教授带领的 TSAIL 团队提出 DPM-Solver(NeurIPS 2022 Oral,约前 1.7%)和 DPM-Solver++,将扩散模型的快速采样算法提升到了极致:无需额外训练,仅需 10 到 25 步就可以获得极高质量的采样。

要说 AI 领域今年影响力最大的进展,爆火的 AI 作图绝对是其中之一。设计者只需要输入对图片的文字描述,就可以由 AI 生成一张质量极高的高分辨率图片。目前,使用范围最广的当属 StabilityAI 的开源模型 Stable Diffusion,模型一经开源就在社区引起了广泛的讨论。

然而,扩散模型在使用上最大的问题就是其极慢的采样速度。模型采样需要从纯噪声图片出发,一步一步不断地去噪,最终得到清晰的图片。在这个过程中,模型必须串行地计算至少 50 到 100 步才可以获得较高质量的图片,这导致生成一张图片需要的时间是其它深度生成模型的 50 到 100 倍,极大地限制了模型的部署和落地。

为了加速扩散模型的采样,许多研究者从硬件优化的角度出发,例如 Google 使用 JAX 语言将模型编译运行在 TPU 上,OneFlow 团队 [1] 使用自研编译器将 Stable Diffusion 做到了“一秒出图”。这些方法都基于 50 步的采样算法 PNDM[2],该算法在步数减少时采样效果会急剧下降。

就在几天前,这一纪录又被刷新了!Stable Diffusion 的官方 Demo[3]更新显示,采样 8 张图片的时间从原来的 8 秒钟直接被缩短至了 4 秒钟!快了整整一倍!

9575e1e4-68e0-11ed-8abf-dac502259ad0.png

而基于自研深度学习编译器技术的 OneFlow 团队更是在不降低采样效果的前提下,成功将之前的 “一秒出图” 缩短到了 “半秒出图”!在 GPU 上仅仅使用不到 0.5 秒就可以获得一张高清的图片!相关工作已经发布在[1] 中。

事实上,这些工作的核心驱动力都来自于清华大学朱军教授带领的 TSAIL 团队所提出的DPM-Solver,一种针对于扩散模型特殊设计的高效求解器:该算法无需任何额外训练,同时适用于离散时间与连续时间的扩散模型,可以在 20 到 25 步内几乎收敛,并且只用 10 到 15 步也能获得非常高质量的采样。在 Stable Diffusion 上,25 步的 DPM-Solver 就可以获得优于 50 步 PNDM 的采样质量,因此采样速度直接翻倍!

项目链接:

DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps:https://arxiv.org/abs/2206.00927(NeurIPS 2022 Oral)

DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models:https://arxiv.org/abs/2211.01095

项目开源代码:https://github.com/LuChengTHU/dpm-solver

项目在线 Demo:https://huggingface.co/spaces/LuChengTHU/dpmsolver_sdm

扩散模型的定义与采样方法

扩散模型通过定义一个不断加噪声的前向过程来将图片逐步变为高斯噪声,再通过定义了一个逆向过程将高斯噪声逐步去噪变为清晰图片以得到采样:

9596931c-68e0-11ed-8abf-dac502259ad0.png

在采样过程中,根据是否添加额外的噪声,可以将扩散模型分为两类:一类是扩散随机微分方程模型(Diffusion SDE),另一类是扩散常微分方程(Diffusion ODE)。两种模型的训练目标函数都一样,通过最小化与噪声的均方误差来训练一个“噪声预测网络”:

95a8fab6-68e0-11ed-8abf-dac502259ad0.png

基于 Diffusion SDE 的采样过程可以视为离散化如下随机微分方程:

95bb02c4-68e0-11ed-8abf-dac502259ad0.png

并且 [4] 中证明,DDPM[5] 是对上述 SDE 的一阶离散化。

而基于 Diffusion ODE 的采样过程可以视为离散化如下常微分方程:

95cb322a-68e0-11ed-8abf-dac502259ad0.png

并且 [6] 中证明,DDIM[7]是对上述 ODE 的一阶离散化。

然而,这些一阶的离散化方法收敛速度极慢,扩散模型的采样通常需要 100 到 1000 次串行计算才可以得到高质量的图片。通常情况下,为了加速扩散模型的采样,研究者往往通过对 Diffusion ODE 使用高阶求解器来进行加速,例如经典的 Runge-Kutta 方法(RK45),这是因为 ODE 不会带来额外的随机性,离散化步长可以相对选取得更大一些。在给定 s 时刻的解后,Runge-Kutta 方法基于离散化如下积分:

95dadee6-68e0-11ed-8abf-dac502259ad0.png

这样的离散化将 Diffusion ODE 整体看做一个黑盒,损失了 ODE 的已知信息,在小于 50 步的情况下就难以收敛了。

DPM-Solver:专为扩散模型设计的求解器

DPM-Solver 基于 Diffusion ODE 的半线性(semi-linear)结构,通过精确且解析地计算 ODE 中的线性项,我们可以得到:

95ec8fec-68e0-11ed-8abf-dac502259ad0.png

剩余的积分项是一个关于时间的复杂的积分。然而,DPM-Solver 的提出者发现,该积分可以通过对 log-SNR(对数信噪比)做换元后得到一个非常简单的形式:

96082ec8-68e0-11ed-8abf-dac502259ad0.png

剩余的积分是一个关于噪声预测模型的指数积分(exponentially weighted integral)。通过对噪声预测模型做泰勒展开,我们可以得到该积分的一个估计:

9619a540-68e0-11ed-8abf-dac502259ad0.png

该估计中存在两项:一项是全导数部分(向量),另一项是系数部分(标量)。DPM-Solver 的另一个核心贡献是,该系数可以通过分部积分被解析地计算:

962ae364-68e0-11ed-8abf-dac502259ad0.png

而剩余的全导数部分则可以通过传统 ODE 求解器的数值方法来近似估计(无需任何求导运算):

9661a340-68e0-11ed-8abf-dac502259ad0.png

基于以上 4 点,DPM-Solver 做到了尽可能地准确计算所有已知项,只对神经网络部分做近似,因此最大程度地减小了离散化误差:

966eb1d4-68e0-11ed-8abf-dac502259ad0.png

此外,基于该推导,我们可以得到 DDIM 本质上是 DPM-Solver 的一阶形式,这也能解释为什么 DDIM 在步数较少时依然可以获得很好的加速效果:

967fe9fe-68e0-11ed-8abf-dac502259ad0.png

在实验中,DPM-Solver 获得了远超其它采样算法的加速效果,仅仅在 15-20 步就几乎可以收敛:

96956df6-68e0-11ed-8abf-dac502259ad0.png

并且在论文中定量的结果显示,DPM-Solver 引入的额外计算量完全可以忽略,即对于步数的加速效果直接正比于时间上的加速效果——因此,基于 25 步的 DPM-Solver,Stable-Diffusion 模型的采样速度直接翻倍!例如,下图展示了不同采样算法在 Stable-Diffusion 上随着步数变化的效果,可见 DPM-Solver 在 10 到 15 步就可以获得非常高质量的采样:

96afc732-68e0-11ed-8abf-dac502259ad0.png

使用 DPM-Solver

DPM-Solver 的使用非常简单,既可以基于作者提供的官方代码,也可以使用主流的 Diffusers 库。例如,基于作者提供的官方代码(https://github.com/LuChengTHU/dpm-solver),只需要 3 行:

96c72aee-68e0-11ed-8abf-dac502259ad0.png

官方代码对 4 种扩散模型都进行了支持:

96d330fa-68e0-11ed-8abf-dac502259ad0.png

并且同时支持 unconditional sampling、classifier guidance 和 classifier-free guidance:

96e60f0e-68e0-11ed-8abf-dac502259ad0.png

而基于 Diffusers 库的 DPM-Solver 同样很简单,只需要定义 scheduler 即可:

96f3548e-68e0-11ed-8abf-dac502259ad0.png

此外,作者团队还提供了一个在线 Demo:https://huggingface.co/spaces/LuChengTHU/dpmsolver_sdm

下图是 15 步的例子,可以看到图像质量已经非常高:

9703f2a8-68e0-11ed-8abf-dac502259ad0.png

相信基于 DPM-Solver,扩散模型的采样速度将不再是瓶颈。

关于作者

DPM-Solver 论文一作是来自清华大学 TSAIL 团队的路橙博士,他在知乎上关于扩散模型的讨论中也写了一篇关于扩散模型原理的入门介绍,目前已有 2000 + 赞:https://www.zhihu.com/question/536012286/answer/2533146567

清华大学 TSAIL 团队长期致力于贝叶斯机器学习的理论和算法研究,是国际上最早研究深度概率生成模型的团队之一,在贝叶斯模型、高效算法和概率编程库方面取得了系统深入的研究成果。团队另一位博士生鲍凡提出Analytic-DPM [8][9],为扩散模型的最优均值和方差给出了简单、令人吃惊的解析形式,获得 ICLR 2022 Outstanding Paper Award。在概率编程方面,机器之心早在 2017 年就报道了该团队发布的 “ZhuSuan” 深度概率编程库(https://zhusuan.readthedocs.io/en/latest/)[10],是国际上最早的面向深度概率模型的编程库之一。另外,值得一提的是,扩散概率模型的两位核心作者宋飏和宋佳铭,本科时均在朱军教授的指导下做科研训练,后来都去了斯坦福大学读博士。论文的合作者周聿浩、陈键飞、李崇轩,也是TSAIL组培养的优秀博士生,周聿浩为在读,陈键飞和李崇轩分别在清华大学计算机系、人民大学高瓴人工智能学院任教。

审核编辑 :李倩

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 算法
    +关注

    关注

    23

    文章

    4760

    浏览量

    97144
  • 模型
    +关注

    关注

    1

    文章

    3648

    浏览量

    51712
  • 深度学习
    +关注

    关注

    73

    文章

    5590

    浏览量

    123905

原文标题:Stable Diffusion采样速度翻倍!仅需10到25步的扩散模型采样算法

文章出处:【微信号:tyutcsplab,微信公众号:智能感知与物联网技术研究所】欢迎添加关注!文章转载请注明出处。

收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    ADC的采样滤波算法利用卡尔曼滤波算法

    1 ADC采样模型 (本文为笔者早期所写,当时对卡尔曼滤波器理解尚未透彻,如今回顾,该模型还有所缺陷, 假设ADC采样的值已经为稳定状态,设 k + 1 k+1 k+1时刻ADC
    发表于 12-01 07:44

    本地部署Stable Diffusion实现AI文字生成高质量矢量图片应用于电子商务

    本地部署Stable Diffusion
    的头像 发表于 11-28 07:19 462次阅读

    如何判断电能质量在线监测装置的采样率是否达标?

    判断电能质量在线监测装置采样率是否达标,核心是 **“核对参数是否符合国标 + 实际测试验证数据准确性”**,结合装置配置、标准要求和场景需求,分 3 落地:
    的头像 发表于 11-08 16:51 1769次阅读

    如何检测电能质量在线监测装置采样电阻是否损坏?

    检测电能质量在线监测装置采样电阻是否损坏,遵循 “ 先非侵入式数据判断(初步定位)→ 再侵入式硬件检测(精准验证) ” 的流程,结合 “数据异常现象” 和 “硬件实测阻值” 双重维度,同时排除其他
    的头像 发表于 10-22 15:07 405次阅读

    CANFD节点的采样点如何测量?

    本文导读为提升CAN/CANFD网络的通信可靠性,各节点尽可能配置合适且一致的采样点。然而在设备CAN通信采样点参数未知的情况下,如何验证各节点采样点设置的一致性?本文结合ZPS-C
    的头像 发表于 07-31 11:34 935次阅读
    CANFD节点的<b class='flag-5'>采样</b>点如何测量?

    记忆示波器的采样率应如何选择

    更高采样率(如10倍以上)以捕捉快速上升沿和细节。 高频噪声或毛刺:更高采样率(如20倍以上)以避免遗漏。 二、结合测量需求调整
    发表于 04-10 14:46

    Diffusion生成式动作引擎技术解析

    Diffusion生成式动作引擎 Diffusion生成式动作引擎是一种基于扩散模型Diffusion Models)的生成式人工智能技术
    的头像 发表于 03-17 15:14 2706次阅读

    FOC中的三种电流采样方式,你真的会选择吗?(可下载)

    一、前言:电流采样的作用在 FOC 控制算法中,采样电流是算法实现的基础且又相当重要的一部分,准确的电流 采样能给
    发表于 03-12 15:04 3次下载

    DiffusionDrive首次在端端自动驾驶中引入扩散模型

    多样性是提升自动驾驶鲁棒性和安全性的关键,但现有方法往往受限于单一轨迹回归或固定锚点采样,难以全面建模驾驶决策空间。 扩散模型 (Diffusion Model) 凭借强大的多模态建模
    的头像 发表于 03-08 13:59 1469次阅读
    DiffusionDrive首次在端<b class='flag-5'>到</b>端自动驾驶中引入<b class='flag-5'>扩散</b><b class='flag-5'>模型</b>

    安装OpenVINO™工具包稳定扩散后报错,怎么解决?

    :\\stable-openvino2\\stable-diffusion-webui-master\\venv\\lib\\site-packages\\diffusers\\models
    发表于 03-05 06:56

    AFE4400将占空设置为25%以下时,采样率该如何计算?

    1、 术手册中有关ADC采样频率的说明,在第10页中说采样率为4*PRF 而在第40页中关于ADC Data的中可以采样率为16*PRF 但是如果我将占空设置为
    发表于 12-31 07:18

    AMC1304M25采样电机相电流时候的采样电阻如何计算?

    电机一般启动电流会比额定电流大4~7倍,那选取相电流采样电阻的时候应该得按照“AMC1304M25量程(250mv)/启动电流”来计算采样电阻吧。如果按照额定电流来选取采样电阻那开机
    发表于 12-27 08:04

    关于ADS1299采样速度的疑问求解答

    在ADS1299的datasheet上面,关于采样速度的说明是:250sps~16Ksps。现在想问一个问题。16Ksps的采样速度,是单个通道采集是能达到16ksps的
    发表于 12-13 07:01

    如何开启Stable Diffusion WebUI模型推理部署

    如何开启Stable Diffusion WebUI模型推理部署
    的头像 发表于 12-11 20:13 1154次阅读
    如何开启<b class='flag-5'>Stable</b> <b class='flag-5'>Diffusion</b> WebUI<b class='flag-5'>模型</b>推理部署

    LHA6916双路同步采样DAS中文手册

    LHA6916 是一款 16 位 DAS,支持对 16 个通道 进行双路同步采样。LHA6916 采用 5 V 单电源供电, 可以处理±10 V、±5 V 和±2.5 V 真双极性输入信号, 同时
    发表于 12-09 14:59 0次下载