谷歌DeepMind新方法Gecko,为测试AI图像生成器引入严格新标准
划重点:
⭐ 谷歌 DeepMind 发布了新的基准 Gecko,揭示了当前文本到图像 AI 评估方法的缺陷,并引入了一个包含超过10万份人类评分的严格新标准。
⭐ “Gecko” 基准通过2000个文本提示对文本到图像模型全面评估,同时提供了增强的自动评估指标,揭示了先前未被发现的模型优和劣势。
⭐ 研究人员希望通过 “Gecko” 基准的引入,能够更准确地评估和诊模型的能力,促进 AI 技术的进一步发展。
谷歌 DeepMind 最近的研究示了当前我们对文本到图像 AI 模型性能评估的隐藏局限性。在其发布在预印本服务器 ariv 上的研究中,他们引入了一种全新的方法称为 “Gecko”,承诺提供一个更全和可靠的基准,以评估这一蓬勃发展的技术。
研究团队在其题为 “用 Gecko 审视文本到图像评估:对度量、提示和人类评分” 的论文中警告称:“虽然文到图像生成模型已经变得无处不在,但它们并不一定生成与给定提示相一致的图。” 他们指出,目前主要用于评估 DALL-E、Midjourney 和 Stable Diffusion 等模型能力数据集和自动度量并不能全面反映实际情况。
小规模的人类评估提供了有限的解,而自动度量可能会忽略重要细微之处,甚至与人类评委产生分歧。 为了揭示这些问题,研究人员开发了 “Gecko”—— 一个新的基准套件,它为文本到图模型提供了更高难度的测试。Gecko基准通过2000个文本提示对模型进行全面考核,探究各种技能和复杂程度。它将这些提示分成具体的子技能,超越模糊的类,以准确找出限制模型的确切弱点。
研究人员还收集了对数个领先模型生成的图像进行的超过10万份人类评分。这一基准可以揭示模型性能差距是源自模型真正的局限性、模糊的提示,还是评估方法的不一致。
“Gecko” 基准还采用了一个基于问的增强自动评估指标,与人类判断更为相关。当用于比较新基准下的最先进模型时,这一组合揭示了先前未被发现的模型优势和劣势。 研究人员希望他的工作能够证明使用多样的基准和评估方法来真正了解文本到图像 AI 在实际部署前能做什么,不能做什么的重要性。他们计划免费公开 “Gecko” 代码和数据,推动进一步的进展。 因此,尽管那些看似令人印象深刻的作品可能乍一看令人印象深刻,但我们仍然需要严格的测试来区分真假。Gecko为我们展示了如何做到这一。
论文:https://arxiv.org/pdf/2404.16820
伯克利研究人员推出AI智能体Dynalang:可接收复杂指令
加州大学伯克利分校研究人员推出了一种名为Dynalang的智能体,这是一种通过在线体验获取世界语言和视觉模型的智能体,并利用该模型来理解人类行为。站长网2023-08-08 10:05:540001沙特阿美CEO警告生成式人工智能的新威胁
划重点:1.🚨能源行业面临新威胁:沙特阿美首席执行官警告,随着产生式人工智能等新技术的出现,能源行业变得更加脆弱。2.🤝全球合作呼吁:沙特阿美CEO呼吁全球合作,建立国际标准以应对人工智能的负面影响。3.💼跨行业合作必要:他指出,各方需要共同合作,以确保集体安全,并建立国际标准和最佳实践,以防范潜在威胁。站长网2023-11-03 16:25:200000妙鸭相机推出免费体验版 8张照片即可生成专属数字分身
妙鸭相机宣布推出免费版,用户上传8张照片即可生成个人专属的数字分身,并赠送一套“都市正装”写真模板。此前用户需上传20张照片并支付9.9元。妙鸭相机通过技术优化,实现8张照片版数字分身的相似度达到7到8成。同时,专业版数字分身升级后照片门槛下降到15张。妙鸭相机表示,希望通过这种方式让更多用户体验到ai写真的乐趣,并逐步将用户圈层从写真爱好者向普通用户拓展。站长网2023-09-20 14:00:080000特斯拉:受欧盟关税影响 中国产的出口Model 3下月涨价
快科技6月13日消息,特斯拉官方宣布,由于欧盟即将实施的关税政策,预计从2024年7月1日起对中国制造并在欧盟销售的Model3汽车价格进行上调。目前,特斯拉德国官网在售的Model3后轮驱动版售价为40990欧元(约合人民币32.1万元),长续航版本为49990欧元(约39.2万元),全轮驱动性能版为56990欧元(约44.7万元)。站长网2024-06-14 16:37:380000接入Llama 2等33个大模型,上线Prompt模板,百度智能云千帆大模型平台重磅升级
最近,Meta开源的Llama2系列模型引发了不小的轰动。这些模型包含7B、13B、70B三种版本,最大的70B版本性能接近GPT-3.5,小一点的版本甚至可以在移动端运行,且整个系列都允许商用,有望成为众多大模型应用的底层支撑。很多人预言说,「大模型的安卓时代就要来了」。站长网2023-08-04 17:57:460001