NVIDIA 自动引导技术:改善扩散模型中的图像质量和变化
划重点:
- 💡 NVIDIA 提出的自动引导方法在扩散模型中使用较小的模型来引导生成过程,显著改善了图像生成的质量和多样性。
- 💡 通过自动引导方法,研究人员在 ImageNet-512和 ImageNet-64等基准测试中取得了新的记录成绩,实现了对图像生成质量的显著提升。
- 💡 这一创新方法在解决当前方法存在的局限性的同时,为生成高质量和多样化图像提供了更高效、更有效的解决方案。
NVIDIA 近期提出了一种名为自动引导的新方法,旨在改善扩散模型中图像的质量和变化,而不影响其与给定条件(如类标签或文本提示)的一致性。当前的方法通常会以牺牲多样性为代价来提高图像质量,从而限制了它们在医学诊断和自动驾驶等各种现实场景中的适用性。然而,克服这一挑战可以提升人工智能系统在生成逼真且多样化图像方面的性能,推动当前人工智能能力的边界。
目前解决这一挑战的方法主要是使用无分类器引导(CFG),它使用无条件模型来引导有条件模型。虽然 CFG 改善了提示对齐和图像质量,但降低了图像变化。这种权衡发生在图像质量和变化的影响在本质上是纠缠在一起的,难以独立控制它们。此外,CFG 局限于有条件生成,并存在任务差异问题,导致图像构成的偏斜和过于简化的图像。这些限制影响了方法的性能,并限制了它在生成多样化和高质量图像方面的应用。
NVIDIA 的研究人员提出了一种名为自动引导的新方法,它涉及使用主模型的规模较小、训练时间较短的版本来引导生成过程,而不是使用无条件模型。这种方法通过将图像质量与变化解耦,从而更好地控制这些方面,同时保持与主模型相同的条件,确保生成图像的一致性。这种创新方法显著提高了图像生成的质量和变化,在 ImageNet-512和 ImageNet-64等基准测试中刷新了记录,可以应用于有条件和无条件模型。
该方法的核心是训练主模型的规模较小、训练时间较短的引导模型。论文详细介绍了去噪扩散过程,通过反转随机损坏过程生成合成图像。研究人员使用 Fréchet Inception Distance(FID)和 FDDINOv2等指标对模型进行评估,结果显示图像生成质量有了显著提高。例如,在 ImageNet-512中使用小模型(EDM2-S),自动引导将 FID 从2.56提高到1.34,超越了现有方法。
广泛的定量结果证明了自动引导的有效性。该方法在公开可用的网络上实现了64×64和512×512图像分辨率的 FID 记录,表明图像质量有了显著提升,而没有牺牲多样性。评估包括比较不同方法的表格,展示了自动引导在 CFG 和其他基线方法上的优越性能。例如,该方法在 ImageNet 数据集上实现了87.5% 的准确率,超过了先前的最先进水平。
这种改进扩散模型中图像质量的新方法涉及使用模型的规模较小、训练时间较短的引导模型。所提出的自动引导方法克服了像 CFG 这样的现有方法的局限性。这种创新方法在基准测试中取得了最先进的成绩,显著推进了人工智能研究领域,为生成高质量和多样化图像提供了更高效、更有效的解决方案。
Astra Starter Templates 集成 ZipWP AI 网站生成器,能在 60 秒内创建整个网站
站长之家(ChinaZ.com)12月12日消息:BrainstormForce的AstraStarterTemplates,一款拥有超过一百万活跃安装量的网站模板,宣布整合ZipWPAI网站构建器,使用户能够创建整个网站,包括内容和图像。0000抖音更新公益内容治理规范 7月1日起正式生效
抖音发布《关于更新公益内容治理规范的公告》称,极个别创作者利用互联网平台,试图以“助农”“助困”“助残”为由,通过编造不实“贫困生活”“破旧住房”等场景,实施虚假“捐赠救助”等“公益”行为,骗取流量、钱财和爱心,影响恶劣。针对这一现象,近日,抖音更新了关于抖音公益内容治理的最新规范。新规明确要求,“公益类账号,不得进行直播打赏、电商销售等营利性行为。”站长网2023-06-03 16:23:2100020站在中国服饰主战场,他们这样做出万亿大生意
深秋已至,中国北方的很多城市已飘下了今年的第一场雪。南方人也已经裹上了厚外套,迎接寒潮的到来。剁手党们已按捺不住,研究起秋冬装囤货攻略,将毛衣、羽绒、貂皮大衣、保暖睡衣等加入购物车,要在双11把今年的“必囤好物”买个够。每年的双11,都是人们囤秋装、冬装的最佳时节。面对爆棚的囤货需求,服饰商家也早早就开始了备货,准备在双11大干一场。0000用AI抓取你的直播“高光”时刻 Framedrop助你捕获精彩剪辑
Framedrop是一款基于人工智能技术的网页工具,旨在帮助游戏主播自动识别和编辑直播中的精彩片段。它可以通过简单的流URL就能准确定位直播视频中的亮点时刻,从而大幅减少主播手动搜索剪辑的时间。站长网2023-08-25 10:54:060003荣耀 Magic V2 折叠手机将于 7 月 12 日 19:30 发布
今日,荣耀手机官方宣布,荣耀MagicV2折叠屏手机将于7月12日19:30发布。目前,消费者已经开始预约购买。荣耀CEO赵明表示,在折叠屏手机的开发中,需要打破原有的演进思维,将消费者最需要的产品放在首位,打破行业中固有的不可能,从而为消费者带来更优良的体验。据了解,荣耀MagicV2的厚度将在5.2mm左右,比竞争对手薄0.1mm。站长网2023-07-04 00:57:030000