AI生成的图像太逼真,为什么不能拿来训练AI呢?

可别说,现在还真有人这么做了。

来自香港大学、牛津大学和字节跳动的几名研究人员,决定尝试一下能否使用高质量AI合成图片,来提升图像分类模型的性能。

为了避免AI合成的图像过于单一、或是质量不稳定,他们还提出了几类提升数据多样性和可靠性的方法,帮助AI合成更好的数据集(来喂给AI的同类doge)。

结果他们发现,不仅效果不错,有的AI在训练后,效果竟然比用真实数据训练还要好!

作者们分别从零样本(zero-shot)、少样本(few-shot)图像分类、模型预训练(pre-training)与迁移学习三个⽅⾯进⾏了探讨,并给出了提升数据多样性与可靠性的方法。

零样本图像分类

零样本(Zero-shot)图像分类任务,指没有任何⽬标类别的训练图⽚,只有对⽬标类别的描述。

作者们先是提出了一种名为语言增强(Language Enhancement,LE)的⽅法,用于增强合成数据多样性。

具体来说,这种方法会给标签“扩句”,如果原标签是简单的“飞机”,那么经过“扩句”后的提示词就会变成“一架盘旋在海滩和城市上空的白色飞机”。

随后,还采用了一种叫做CLIP过滤器(CLIP Filter)的⽅法确保合成数据的可靠性,即过滤掉合成质量不行的图片,确保AI数据质量过硬。

在17个数据集上,相⽐此前效果最好的CLIP模型,相关⼤⼩模型均获得了显著提升(4.31%/2.90%),展示了合成数据的有效性。

少样本图像分类

少样本图像(Few-shot)分类任务,通常仅有极少数量(1~16张)的⽬标类别图⽚,与零样本任务的区别是增加了类别与任务特定领域信息。

因此,作者们决定将域内数据(in-domain)的知识⽤于图像⽣成,即将少量的⽬标类别图⽚⽤于噪声叠加的初始状态(Real Guidance),进⼀步发挥⽣成模型的能⼒,从而进⼀步提升性能。

预训练与迁移学习

模型预训练(pre-training)任务,即将模型在⼤量数据上进⾏训练,将训练后的模型作为“起始点”,来帮助提升下游任务的性能。

作者们利⽤合成数据,对模型进⾏了预训练,并对数据量、数据多样性程度、预训练模型结构和预训练⽅法进⾏了实验研究。

最终发现:

  1. ⽤合成数据进⾏预训练。已经可以达到甚⾄超越⽤真实数据预训练的效果。

  2. ⽤更⼤的数据量和数据多样性的合成数据,可以获得更好的预训练效果。

  3. 从模型结构和预训练⽅法来看,ViT-based模型(相比convolutional-based模型)、⾃监督⽅法(相比有监督⽅法)会更适合合成数据下的预训练。

论文认为,利⽤⽣成模型产⽣的合成数据来帮助图像分类任务是可行的,不过也存在⼀定的局限性。

例如,如何处理特定任务的domain gap和数据多样性之间的trade-off,以及如何更有效地利⽤潜在⽆穷量的合成图⽚⽤于预训练,都是需要进一步去解决的问题。

一作何睿飞,香港大学在读博士生@CVMI Lab,指导老师为齐晓娟老师,本科毕业于浙江大学竺可桢学院,研究方向是data-efficient learning, vision-language model, knowledge distillation, semi/self-supervised learning。CVMI Lab 正在招收计算机视觉与深度学习方向的博士生,感兴趣的伙伴可以直接email老师!

对于将AI合成图像用于预训练模型这件事,你还能想到更高效的方法吗?

欢迎感兴趣的小伙伴一起讨论~ whaosoft aiot http://143ai.com

论文地址:
https://arxiv.org/abs/2210.07574

项目地址:
https://github.com/CVMI-Lab/SyntheticData

把AI生成的数据喂给AI相关推荐

  1. 大数据中台向AI中台演进是大势所趋?

    来源 | 宜信技术学院(ID:CE_TECH) 导读:自从阿里巴巴提出"中台"的概念之后,这个词汇就成为各领域企业关注的焦点,很多人在考虑建设自己的中台.然而,构建中台是否真有必要 ...

  2. AIGC 后下一个巨大的风口:AI生成检测

    文章大纲 简介 应用样例 OpenAI 自家的工具 GPTKit ChatGPT 对比与检测项目 用AI识别AI生成的文本 抵抗AI生成图像的攻击 识别AI 生成的难度在那? 参考文献与学习路径 简介 ...

  3. 英特尔® 至强® 平台集成 AI 加速构建数据中心智慧网络

    英特尔® 至强® 平台集成 AI 加速构建数据中心智慧网络 SNA 通过 AI 方法来实时感知网络状态,基于网络数据分析来实现自动化部署和风险预测,从而让企业网络能更智能.更高效地为最终用户业务提供支 ...

  4. AI 生成的代码可信吗?编写的代码有 Bug 吗?

    编译 | 禾木木 出品 | AI科技大本营(ID:rgznai100) 即使是帮助开发人员编写软件的工具也会产生类似的bug. 目前,大部分的软件开发人员会让 AI 帮助开发者们编写代码,但是开发人员 ...

  5. 隐私数据在隐私AI框架中的安全流动

    作者 | Rosetta技术团队 责编 | 晋兆雨 出品 | AI科技大本营 本文中,我们将介绍为了保护用户的隐私数据,在隐私  AI  框架的计算任务全流程中,数据是如何以密文形式流动,同时仍正确完 ...

  6. AI和大数据如何落地智能城市?京东城市这6篇论文必读 | KDD 2019

    来源 | 京东城市(ID: icity-jd)作为世界数据挖掘领域的最高级别的学术会议,ACM SIGKDD(国际数据挖掘与知识发现大会,简称 KDD)将于 2019 年 8 月 4 日-8 日在美国 ...

  7. Nat. Biotech.|药物设计的AI生成模型

    今天介绍2020年1月30日发表在Nature Biotechnology上的评论,作者为Relay Therapeutics公司的Walters和Murcko,该论文评价了当前几种基于AI的药物生成 ...

  8. AI生成中国山水画!普林斯顿姑娘本科毕业作品,骗过70%中国人

    来源:大数据文摘 本文约1700字,建议阅读5分钟 实验结果很惊人,不管对中国文化的熟悉程度如何,参与者都很难区分绘画的来源. 用GAN创作似乎已经不是新鲜事了. 2019,英伟达在GTC大会上推出了 ...

  9. 北大校友马里千:计算机视觉商用的下一个十年,AI 生成应占有一席之地

    导语:近几年,人工智能在国内的商业落地趋于同质化,以识别与检测为主.当人们谈论AI创业,首先想到的总是以感知技术为代表的"AI四小龙"(商汤.云从.依图.旷视).除了感知,人工智能 ...

最新文章

  1. Java注解和xml_Spring注解配置和xml配置优缺点比较
  2. IPv4_数据报文首部格式
  3. 分享一下收到的微软CRM云分享计划 邮件
  4. MongodDB数据库安装和简单使用
  5. fft ocean注解
  6. python中对数组合并的方法
  7. Swift 3 0 FMDB 初试
  8. 研究人员发现Office Word 0Day攻击 这个漏洞绕过了word宏安全设置 绿盟科技、McAfee及FireEye发出警告...
  9. C#的多线程机制探索5
  10. block,inline和inline-block
  11. vue 监听浏览器页面关闭_前方高能,这是最新的一波Vue实战技巧,不用则已,一用惊人...
  12. TCP/IP模型的简单解释
  13. wps office有计算机应用吗,wps office
  14. 一本通1665【例 3】移棋子游戏
  15. 朴素贝叶斯——R语言
  16. 实验名称:在VB中对于随机数ab的比较大小
  17. HTML制作3D樱花漫天飞舞及浪漫信封
  18. iwnpi 5621ds RF测试指令
  19. 吴莫愁新专辑出炉 承认哈林老师是她生命中的贵人
  20. APK查壳软件(根据so名)

热门文章

  1. 不要迷恋哥,哥只是个传说……
  2. 我们约会吧魏荔嵩 不要迷恋姐,姐容易让你胃出血
  3. Linux下安装jdk1.8
  4. 香橙派4 2. 驱动usb2.0芯片cy7c68013
  5. Gitlab----管理员如何创建用户并邮件通知
  6. gitlab如何创建用户并登录
  7. php调用mysql存储过程报错,php | iMySQL | 老叶茶馆
  8. 微信小程序云开发服务怎么关闭?
  9. 【深度学习知识点扫盲】病态、病态条件
  10. Docker#Docker当做虚拟机使用