从23年初,ChatGPT火遍全球,通过其高拟人化的回答模式,大幅提升了人机对话的体验和效率,让用户拥有了一个拥有海量知识的虚拟助手,根据UBS发布的研究报告显示,ChatGPT在1月份的月活跃用户数已达1亿,成为史上用户数增长最快的应用软件。表面上看,ChatGPT是一个受欢迎的聊天机器人,但我们认为其背后的GPT大模型能称得上是一个技术爆炸,并且目前处于飞速的进化过程中。

图:各大热门平台突破1亿月活用户所用的时间

当用户逐渐开始熟悉这款“无所不知”的对话机器人的时候,ChatGPT的母公司OpenAI又在3月14日发布了新一代的GPT4,这是一款支持多模态(大量文字+图片)输入的对话机器人。它的强大智能在几个月时间内又一次进化了一大步,例如:它可以根据一个草图在很短时间内生成做出这个网站所需要的HTML代码。若这样的功能放在几个月前,估计也很少有人相信会在2023年就能出现。

GPT不只是在对话领域有巨大的成功,而且它在众多人类的标准化的测试中,也是非常的厉害。它在多个学术和职业考试中超过人类,比如在美国律师考试中,GPT4的分数打败了90%的人类;在美国高考SAT中拿到700+的分数(满分800),这样的分数远高于美国顶级大学-常青藤八校录取新生的平均分数。当笔者看到了GPT4在众多考试中的得分后,也陷入了沉思:未来的AI会在绝大多数领域都超过我们人类,它的出现必将改变社会对于我们知识技能结构的需求。所以理解GPT,也能帮助我们去判断,未来积累什么样的知识,培养什么样的技能才是有价值的。

(GPT-4,https://openai.com/research/gpt-4)

首先,我们先简单的介绍一下ChatGPT和AIGC:

他们都是人工智能的应用场景。

  1. ChatGPT:Chat Generative Pretrained
    Transformer,即可生成式预训练对话系统,ChatGPT是由OpenAI开发的一种基于自然语言处理的人工智能技术,它是一种大型预训练语言模型,使用了GPT(Generative
    Pretrained
    Transformer)的架构,并使用深度学习算法进行训练。ChatGPT可以生成高质量、连贯的自然语言对话,它可以对话生成、问答系统、文本摘要、语言翻译等自然语言处理任务进行处理。

  2. AIGC:Artifical Intelligence Generated
    Content,即人工智能所生成的内容。可以看出,两者都是人工智能应用的场景,而AIGC的范畴比ChatGPT更广,ChatGPT是AIGC的在文字和语言类内容的子领域。

这样令人惊奇的技术背后最重要的原理是什么呢?

原理一:全域知识

拥有在其巨大数据库和互联网中几乎所有的知识,目前千亿量级的,未来会随着模型的进化,进一步变多,变得更加“无所不知”。它把所有领域的知识都看做语言的模式,这里的语言不是狭义我们说的语言,而是统一了代码,公式,符号等所有人类传输信息的语言。所以当用户与之交谈的时候,ChatGPT让用户感觉到的是一个无所不知的系统。

原理二:大语言模型

ChatGPT通过背后的GPT大语言模型(Large Language Model, LLM)回答问题的时候,会逐字打出答案。它是根据前面的文字来输出后面的文字,所以它所输出的答案并不是由检索数据库中的已有答案来生成的, 也不像搜索引擎中按照引用次数来判断关联性,而是数学计算的结果 – 他是通过计算上一段文字后续会出现的文字的条件概率来生成答案。

这个原理的深刻意义:人类产生的所有文本,无论是一种科学原理,历史知识还是程序代码,他们都可以用大语言模型来表达。

所以只要拥有足够好的语言模型,那么现实生活中的任何信息都是完美语言模型的一种采样结果。大语言模型不直接掌握知识,它的本质是一个拥有几千亿参数的超大公式。它输出的回答是概率模型判定后的随机答案,不是人类大脑那种通过analog形态来积累(经验,归纳,建模的过程),所以它的回答不可回溯(traceability);但由于它读取了世界上公开的全部知识,所以他通过条件概率得出的不同组合的回答往往能看起来合理,也有了类似人类的创作力。它是通过“隐性”的方式积累知识,然后“显性”的表达知识。

那么ChatGPT的局限在哪呢?由于它积累的“知识”是来自于历史和公开数据,且它没有人类的推理能力,所以如果我们问它关于预测未来或者某些细分专业问题的时候,ChatGPT大概率会给出一个看似一本正经,实际胡说八道的答案。

也正因为大模型上述的局限性,拥有细分领域数据和知识的公司可以通过大模型的API接口来训练拥有内部数据和知识的小模型,专门提供给内部员工和客户使用。所以从商业的角度来看,GPT这样的超级大模型会成为技术底座,它可以赋能各个行业的公司去开发它们内部的小模型,而拥有这样的小模型可以极大的提高公司内部和上下游伙伴的效率。Open AI等拥有这样大模型的公司最终会形成类似苹果和安卓的生态体系,有无数的公司围绕这个生态进行生产和开发。

原理三:训练路径

使用时,我们会发现ChatGPT会说人话,有普世价值观,很多时候能做到知之为知之,并且能给出推理过程。那么他是怎么练成的的呢?为了让ChatGPT懂得与人类对话,大语言模型都需要经过训练。

  1. 首先需要标注的数据进行监督学习,缺点是这种监督学习体量有限;
  2. 第二步是用人工做微调(fine-tuning),对第一步产生的回答进行打分,得到奖励模型;
  3. 第三步用第二步得出的模型进行大量的无监督训练,自动让模型自我做调整。用的人越多,也会让模型得到更好的训练结果。经过了千亿规模参数训练后的模型,就变成了呈现在我们面前,那个无所不知,对答如流的聊天机器人。

综上来说,Open AI找到了一种在当下技术的基础设施所能支持的情况下,最适合AI去积累“知识”和输出结果的算法,和我们聊天的ChatGPT其实只是它应用场景的一部分。它最具革命意义的产品是在ChatGPT这个聊天机器人背后的大语言模型,它相当于构建出了一个人类和机器之间的无缝桥梁。我们之前为了让机器执行我们的命令,需要通过软件工程师进行大量的编程来实现,实际上是我们在“迁就”不懂人类语言的机器,而现在有了大语言模型,机器可以“无障碍”的听懂我们的语言,并很快的用机器执行我们的命令,这样的功能会极大的提升人类社会的生产力和发展速度,所以我们将其称为一个技术爆炸也不为过。

在不久的未来,随着这种技术的成熟应用,几乎所有行业都会发生巨大的变化。类似于30年前的互联网对我们所带来的变化。从90年代到现在,随着互联网的普及,它逐渐成为了我们生活中不可缺少的一部分,我们在网上进行办公,购物,学习,娱乐等方方面面的事。而接下来的几十年,随着大语言模型的普及,它给我们生活所带来的变化将绝不小于互联网在上一个30年给我们的变化。

为什么我们认为GPT是一个技术爆炸相关推荐

  1. 如何踩中下一个技术节拍

    关键字:5G,区块链,人工智能,物联网,产业互联网 时间 最近半年的时间,博客的更新近乎停滞.这期间笔者将之前所有EOS相关的技术知识整理总结出了一本书<EOS实战与源码分析>.出书的过程 ...

  2. 顾险峰:技术爆炸的亲历观察

    忧虑和企盼 近几年来,商业资本对于技术发展推波助澜,许多挑战人类底线的技术正在改变着人类社会:例如网络巨头垄断.DNA编辑.人类胚胎克隆.人工智能博弈等等.依照技术达尔文主义信徒的哲学观念,文明的根本 ...

  3. 技术爆炸中的蒙日:安培方程

    来源:老顾谈几何 本文约8600字,建议阅读10+分钟. 计算机科学的发展必然要应用偏微分方程理论,由简单到复杂,由线性到非线性,这是历史的必然. 图1. Blowhole at Kiama. 人生最 ...

  4. 一个技术总监的忠告:精通那么多技术,你为何还是受不到重用?

    这篇文章我们继续说架构师大刘的故事: 老田升职了,年薪涨到了百万级别!这时大刘在加班搞技术攻坚的时候,听别的同事聊了那么一嘴.大刘心里不是滋味儿.老田和大刘其实在这家公司之前就是同事了,老田能到这家公 ...

  5. 一个技术总监的忠告:精通那么多技术有毛用啊,你还不是不被重用?

    这篇文章我们继续说架构师大刘的故事: 老田升职了,年薪涨到了百万级别! 这是大刘在加班搞技术攻坚的时候,听别的同事聊了那么一嘴. 大刘心里不是滋味儿.老田和大刘其实在这家公司之前就是同事了,老田能到这 ...

  6. 《快速搞垮一个技术团队的20个“必杀技”》

    来源| 技术领导力(ID:jishulingdaoli) 前几天老K组局,约了几位沪上互联网公司技术大佬,共同研讨一个话题:如何快速搞垮一个技术团队?你没看错,这是一直困扰我的问题. 聊下来发现,这个 ...

  7. SAP PM 初级系列21 - 一个技术关闭的维修工单不能再被修改了!

    SAP PM 初级系列21 - 一个技术关闭的维修工单不能再被修改了! 维修工单号:102333362已经被Techical completion了, 试图执行IW32去修改它, 系统提示说:Noti ...

  8. 沈向阳:微软每一个技术研发都会进行AI伦理道德评审

    2019-10-20 13:47:43 第六届世界互联网大会在乌镇开幕,微软全球执行副总裁沈向洋出席大会并发表演讲. 他提到,微软一直努力打造负责任的人工智能,今天,微软的每一个技术产品.每一项服务的 ...

  9. 如何搞垮一个技术大牛?

    作者| Mr.K 来源| 技术领导力(ID:jishulingdaoli) IT界有个说法:杀死一个技术大牛,不用枪,只需要改三次需求.技术大牛的死法,就是那样朴实无华且枯燥. 俗话说得好,搞垮一个技 ...

最新文章

  1. 2022图神经网络5篇最新的研究综述:双曲/图分类/联邦/等变/异质性
  2. 转 AIX7.2+11.2.0.4RAC实施
  3. harbor安装_Harbor镜像仓库搭建
  4. 数据结构源码笔记(C语言):二路归并排序
  5. python中matrix函数_使用python解线性矩阵方程(numpy中的matrix类)
  6. python中try_python中try...excpet多种使用方法
  7. spring boot中使用ehcache
  8. 今天没事做了个MBTI职业倾向测试
  9. python stdout_python 之sys.stdout小记
  10. git进阶(撤销pull、撤销merge、撤销add)
  11. 终于回应!GitHub 承认解雇犹太员工的错误并道歉,HR 负责人辞职
  12. 微服务模式下API测试
  13. FindWindowEX应用实例二则
  14. 访问被拒绝:“Interop.jmail”
  15. getX,getRawX,getWidth,getTranslationX等的区别
  16. 本科毕设研究记录(一)————小样本综述
  17. clodop配置SSL证书 WEB打印机服务
  18. Java企业汽车调度系统
  19. gtk之G_LIKELY(expr)和G_UNLIKELY(expr)
  20. 彩色图片和深度图片生成点云文件

热门文章

  1. 计算机绝对引用公式是什么意思,会计电算化中公式里的绝对引用是指什?
  2. SH35D喇叭扩音器:大功率喊话,彻底解放你的嗓子
  3. sn 强名称工具 (Sn.exe) 创建密钥对生成工具
  4. Cesium中实时显示经纬度及视角高
  5. ubuntu20.04设置中文输入法
  6. 钗头凤/红酥手/世情薄——陆游/唐婉
  7. Codeforces2000分左右DP泛刷
  8. js根据汉字拼音首字母排序分组
  9. 图片底色怎么换成透明?几个步骤教你操作
  10. Python如何绘制误差直方图?曲线的阴影图?shade range graph