会员登录 - 用户注册 - 设为首页 - 加入收藏 - 网站地图 谷歌DeepMind新方法Gecko,为测试AI图像生成器引入严格新标准!

谷歌DeepMind新方法Gecko,为测试AI图像生成器引入严格新标准

时间:2024-07-02 03:47:05 来源:带水拖泥网 作者:自媒体 阅读:535次

谷歌DeepMind新方法Gecko,为测试AI图像生成器引入严格新标准

划重点:

⭐ 谷歌 DeepMind 发布了新的谷歌基准 Gecko,揭示了当前文本到图像 AI 评估方法的新方像生新标缺陷,并引入了一个包含超过10万份人类评分的为测严格新标准。

⭐ “Gecko” 基准通过2000个文本提示对文本到图像模型全面评估,成器同时提供了增强的引入严格自动评估指标,揭示了先前未被发现的谷歌模型优和劣势。

⭐ 研究人员希望通过 “Gecko” 基准的新方像生新标引入,能够更准确地评估和诊模型的为测能力,促进 AI 技术的成器进一步发展。

CSS站长资源(ChinaZ.com)4月30日 消息:谷歌 DeepMind 最近的引入严格研究示了当前我们对文本到图像 AI 模型性能评估的隐藏局限性。在其发布在预印本服务器 ariv 上的谷歌研究中,他们引入了一种全新的新方像生新标方法称为 “Gecko”,承诺提供一个更全和可靠的为测基准,以评估这一蓬勃发展的成器技术。

研究团队在其题为 “用 Gecko 审视文本到图像评估:对度量、引入严格提示和人类评分” 的论文中警告称:“虽然文到图像生成模型已经变得无处不在,但它们并不一定生成与给定提示相一致的图。” 他们指出,目前主要用于评估 DALL-E、Midjourney 和 Stable Diffusion 等模型能力数据集和自动度量并不能全面反映实际情况。

小规模的人类评估提供了有限的解,而自动度量可能会忽略重要细微之处,甚至与人类评委产生分歧。 为了揭示这些问题,研究人员开发了 “Gecko”—— 一个新的基准套件,它为文本到图模型提供了更高难度的测试。Gecko基准通过2000个文本提示对模型进行全面考核,探究各种技能和复杂程度。它将这些提示分成具体的子技能,超越模糊的类,以准确找出限制模型的确切弱点。

研究人员还收集了对数个领先模型生成的图像进行的超过10万份人类评分。这一基准可以揭示模型性能差距是源自模型真正的局限性、模糊的提示,还是评估方法的不一致。

“Gecko” 基准还采用了一个基于问的增强自动评估指标,与人类判断更为相关。当用于比较新基准下的最先进模型时,这一组合揭示了先前未被发现的模型优势和劣势。 研究人员希望他的工作能够证明使用多样的基准和评估方法来真正了解文本到图像 AI 在实际部署前能做什么,不能做什么的重要性。他们计划免费公开 “Gecko” 代码和数据,推动进一步的进展。 因此,尽管那些看似令人印象深刻的作品可能乍一看令人印象深刻,但我们仍然需要严格的测试来区分真假。Gecko为我们展示了如何做到这一。

论文:https://arxiv.org/pdf/2404.16820

(责任编辑:业界)

相关内容
  • 活了这么久 次见高铁10码速度缓慢行驶
  • 雷军力荐米家洗车机2:自带电池 洗车确实方便
  • 法拉第未来两天暴涨超1000% 股价从6分涨到7毛
  • 比iPhone 15 Pro Max高198%!余承东:华为Pura 70 Ultra实现业内进光量
  • 2B小钢炮碾压Mistral-7B,旗舰级端侧模型炸场开年黑马!1080Ti可训,170万tokens成本仅1元
  • 儿子打碎20多个瓜爸妈脸上笑哈哈 网友点赞:情绪稳定的父母
  • 杭州一小区松鼠泛滥成灾 网友:太可爱 不忍心伤害
  • 问界新M5正式开启全国大规模交付 余承东亲自交付讲解
推荐内容
  • 百度智能云与汽车之家宣布全面开展大模型战略合作
  • 《阿凡达2》团队操刀 电影《猩球崛起:新世界》票房破亿
  • 杭州一小区松鼠泛滥成灾 网友:太可爱 不忍心伤害
  • 雷军力荐米家洗车机2:自带电池 洗车确实方便
  • 怕不怕:调查称单身更容易使人变傻、死亡率更高
  • 腾讯阿里,有点像抖音拼多多了