谷歌DeepMind新方法Gecko,为测试AI图像生成器引入严格新标准
划重点:
⭐ 谷歌 DeepMind 发布了新的基准 Gecko,揭示了当前文本到图像 AI 评估方法的缺陷,并引入了一个包含超过10万份人类评分的严格新标准。
⭐ “Gecko” 基准通过2000个文本提示对文本到图像模型全面评估,同时提供了增强的自动评估指标,揭示了先前未被发现的模型优和劣势。
⭐ 研究人员希望通过 “Gecko” 基准的引入,能够更准确地评估和诊模型的能力,促进 AI 技术的进一步发展。
谷歌 DeepMind 最近的研究示了当前我们对文本到图像 AI 模型性能评估的隐藏局限性。在其发布在预印本服务器 ariv 上的研究中,他们引入了一种全新的方法称为 “Gecko”,承诺提供一个更全和可靠的基准,以评估这一蓬勃发展的技术。
研究团队在其题为 “用 Gecko 审视文本到图像评估:对度量、提示和人类评分” 的论文中警告称:“虽然文到图像生成模型已经变得无处不在,但它们并不一定生成与给定提示相一致的图。” 他们指出,目前主要用于评估 DALL-E、Midjourney 和 Stable Diffusion 等模型能力数据集和自动度量并不能全面反映实际情况。
小规模的人类评估提供了有限的解,而自动度量可能会忽略重要细微之处,甚至与人类评委产生分歧。 为了揭示这些问题,研究人员开发了 “Gecko”—— 一个新的基准套件,它为文本到图模型提供了更高难度的测试。Gecko基准通过2000个文本提示对模型进行全面考核,探究各种技能和复杂程度。它将这些提示分成具体的子技能,超越模糊的类,以准确找出限制模型的确切弱点。
研究人员还收集了对数个领先模型生成的图像进行的超过10万份人类评分。这一基准可以揭示模型性能差距是源自模型真正的局限性、模糊的提示,还是评估方法的不一致。
“Gecko” 基准还采用了一个基于问的增强自动评估指标,与人类判断更为相关。当用于比较新基准下的最先进模型时,这一组合揭示了先前未被发现的模型优势和劣势。 研究人员希望他的工作能够证明使用多样的基准和评估方法来真正了解文本到图像 AI 在实际部署前能做什么,不能做什么的重要性。他们计划免费公开 “Gecko” 代码和数据,推动进一步的进展。 因此,尽管那些看似令人印象深刻的作品可能乍一看令人印象深刻,但我们仍然需要严格的测试来区分真假。Gecko为我们展示了如何做到这一。
论文:https://arxiv.org/pdf/2404.16820
超逼真!普林斯顿大学推3D场景生成模型Infinigen
普林斯顿大学研究人员AlexanderRaistrick日前发布了一款名为“Infinigen”的开源AI模型,可以帮助人们生成逼真的3D场景。据了解,Infinigen是一款基于开源建模软件Blender的免费开源模型,能够通过随机数学规则生成一系列自然界的“植物、动物”场景,并且可以通过输入提示词来自定义地形,并添加“云、雨、雪、雷暴、天火”等自然现象。生成的场景例站长网2023-06-20 17:10:320002支付宝首页新增3个固定流量入口 可直接跳转至短视频、商家商品页
近日,支付宝首页新增了三块核心场景固定流量“入口”,用户在支付宝首页点击卡片即可进入短视频信息流,或直接进入“消费圈”商品卖场,享受优惠购物。把新增的固定卡片入口置于仅次于首页宫格的首屏核心位置,不难看出,支付宝对内容创作者和商家经营的流量开放正在持续加大。站长网2023-09-27 10:56:060000苹果在英国推出iPhone的轻触支付 支持iPhone XS以上机型
据macrumors消息,苹果公司宣布在英国推出了iPhone上的TaptoPay(轻触支付)功能,让该国的独立卖家、小商户和大型零售商可以使用iPhone作为支付终端。这项功能于2022年2月推出,允许兼容的iPhone通过ApplePay、无接触式信用卡和借记卡以及其他数字钱包接受支付,只需要一部iPhone,无需额外的硬件或信用卡机。站长网2023-07-14 01:57:490000优酷上线银发剧场 支持大字体/字幕
站长之家(ChinaZ.com)5月27日消息:优酷今日重磅推出全新升级的“银发剧场”,为长辈们带来前所未有的观影体验。此次升级不仅体现在大字体、大字幕的贴心设计,更在界面操作上进行了优化,确保长辈们能够轻松上手。站长网2024-05-27 19:47:120000美图公司:上半年AIGC推动净利润同比增长320.4%
2023年8月28日,美图公司正式发布2023上半年财报:总收入12.61亿元,同比增长29.8%。经调整后归属于母公司权益持有人的净利润1.51亿元,同比增长320.4%。截止2023年6月30日,美图公司月活跃用户数2.47亿,同比增长2.5%。站长网2023-08-28 17:50:250000