当前位置: 首页 > news >正文

做物流网站费用多少西安建设工程交易中心官网

做物流网站费用多少,西安建设工程交易中心官网,网站首页优化,wordpress能建商城吗编辑 | 杜伟、陈萍来源 | 机器之心斯坦福大学联合谷歌大脑使用「两步蒸馏方法」提升无分类器指导的采样效率#xff0c;在生成样本质量和采样速度上都有非常亮眼的表现。去噪扩散概率模型#xff08;DDPM#xff09;在图像生成、音频合成、分子生成和似然估计领域都已经实现…编辑 | 杜伟、陈萍来源 | 机器之心斯坦福大学联合谷歌大脑使用「两步蒸馏方法」提升无分类器指导的采样效率在生成样本质量和采样速度上都有非常亮眼的表现。去噪扩散概率模型DDPM在图像生成、音频合成、分子生成和似然估计领域都已经实现了 SOTA 性能。同时无分类器classifier-free指导进一步提升了扩散模型的样本质量并已被广泛应用在包括 GLIDE、DALL·E 2 和 Imagen 在内的大规模扩散模型框架中。然而无分类器指导的一大关键局限是它的采样效率低下需要对两个扩散模型评估数百次才能生成一个样本。这一局限阻碍了无分类指导模型在真实世界设置中的应用。尽管已经针对扩散模型提出了蒸馏方法但目前这些方法不适用无分类器指导扩散模型。为了解决这一问题近日斯坦福大学和谷歌大脑的研究者在论文《On Distillation of Guided Diffusion Models》中提出使用两步蒸馏two-step distillation方法来提升无分类器指导的采样效率。在第一步中他们引入单一学生模型来匹配两个教师扩散模型的组合输出在第二步中他们利用提出的方法逐渐地将从第一步学得的模型蒸馏为更少步骤的模型。利用提出的方法单个蒸馏模型能够处理各种不同的指导强度从而高效地对样本质量和多样性进行权衡。此外为了从他们的模型中采样研究者考虑了文献中已有的确定性采样器并进一步提出了随机采样过程。论文地址https://arxiv.org/pdf/2210.03142.pdf研究者在 ImageNet 64x64 和 CIFAR-10 上进行了实验结果表明提出的蒸馏模型只需 4 步就能生成在视觉上与教师模型媲美的样本并且在更广泛的指导强度上只需 8 到 16 步就能实现与教师模型媲美的 FID/IS 分数具体如下图 1 所示。此外在 ImageNet 64x64 上的其他实验结果也表明了研究者提出的框架在风格迁移应用中也表现良好。方法介绍接下来本文讨论了蒸馏无分类器指导扩散模型的方法 distilling a classifier-free guided diffusion model。给定一个训练好的指导模型即教师模型之后本文分两步完成。第一步引入一个连续时间学生模型该模型具有可学习参数η_1以匹配教师模型在任意时间步 t∈[0,1] 处的输出。给定一个优化范围 [w_min, w_max]对学生模型进行优化其中。为了合并指导权重 w本文引入了一个 w - 条件模型其中 w 作为学生模型的输入。为了更好地捕捉特征本文还对 w 应用傅里叶嵌入。此外由于初始化在模型性能中起着关键作用因此本文初始化学生模型的参数与教师模型相同。在第二步中本文将离散时间步discrete time-step考虑在内并逐步将第一步中的蒸馏模型转化为步数较短的学生模型!)其可学习参数为η_2每次采样步数减半。设 N 为采样步数给定 w ~ U[w_min, w_max] 和 t∈{1… N}然后根据 Salimans Ho 等人提出的方法训练学生模型。在将教师模型中的 2N 步蒸馏为学生模型中的 N 步之后之后使用 N 步学生模型作为新的教师模型这个过程不断重复直到将教师模型蒸馏为 N/2 步学生模型。N 步可确定性和随机采样一旦模型训练完成给定一个指定的 w ∈ [w_min, w_max]然后使用 DDIM 更新规则执行采样。实际上本文也可以执行 N 步随机采样使用两倍于原始步长的确定性采样步骤然后使用原始步长向后执行一个随机步骤 。对于当 t 1/N 时本文使用以下更新规则实验实验评估了蒸馏方法的性能本文主要关注模型在 ImageNet 64x64 和 CIFAR-10 上的结果。他们探索了指导权重的不同范围并观察到所有范围都具有可比性因此实验采用 [w_min, w_max] [0, 4]。图 2 和表 1 报告了在 ImageNet 64x64 上所有方法的性能。本文还进行了如下实验。具体来说为了在两个域 A 和 B 之间执行风格迁移本文使用在域 A 上训练的扩散模型对来自域 A 的图像进行编码然后使用在域 B 上训练的扩散模型进行解码。由于编码过程可以理解为反向 DDIM 采样过程本文在无分类器指导下对编码器和解码器进行蒸馏并与下图 3 中的 DDIM 编码器和解码器进行比较。本文还探讨了如何修改指导强度 w 以影响性能如下图 4 所示。后台回复关键词【入群】加入卖萌屋NLP、CV、搜推广与求职讨论群
http://www.pierceye.com/news/909916/

相关文章:

  • 单位的网站的建设个人网页制作策划书
  • 在中国可以做国外的域名网站吗企业网查询是什么
  • 网站开发在线浏览pdfwin7可以做网站吗
  • 手机上制作网站的软件巢湖有没有专门做网站的公司
  • 哪里有做企业网站的wordpress 主题类型
  • 什么是网站平台开发工具网站怎么做筛选功能的代码
  • 自建站 外贸军事内参消息
  • 化妆品网站建设实训总结坂田建设网站
  • 成都网站建设哪家专业嘉峪关市建设局网站
  • 企业策划 企业网站建设 品牌设计下载住小帮app看装修
  • wordpress文章内图片不显示不出来成都seo整站
  • 鞍钢节能公司网站开发陈仓网站建设
  • 手机网站怎样排版最好东莞常平招聘网最新招聘信息
  • 网站推广途径选择com域名和网站
  • 建设网站后如何上线免费的网站app下载
  • 哪些动物可以做网站名天津免费建站
  • 网站关键字优化技巧如何做推广麦当劳的网站
  • 广州公司注册场地要求网站怎么优化排名的方法
  • 自己做网站用什么软件建设银行网站联系电话
  • 做一个论坛网站需要多少钱推广型网站制作公司
  • 网站介绍页面网站建设怎么找客户资源
  • 我的百度网盘登录入口大兵seo博客
  • 注册监理工程师注册查询系统关于进一步优化 广州
  • 建设网站怎样挣钱网页设计培训班哪里好
  • 类似+wordpress+建站wordpress教程视频教程
  • wordpress多个网站百度识图扫一扫入口
  • 广州网站建设的费用网站建设外包必须注意几点
  • 蓬莱做网站公司辽宁省网站备案要求
  • 西安做网站价格女装标题优化关键词
  • 三门峡市建设局网站wordpress安装伪静态