来源:机器之心

摘要:Alphabet(谷歌)旗下公司 DeepMind 的人工智能 AlphaGo 曾在国际象棋、围棋等项目中取得了超越人类的表现,其研究不仅震惊世界,也两次登上 Nature。如今,该公司已将人工智能技术应用到最具挑战性的科学研究问题中,其刚刚推出的 AlphaFold 可以仅根据基因「代码」预测生成蛋白质的 3D 形状。

DeepMind 表示,AlphaFold 是「该公司首个证明人工智能研究可以驱动和加速科学新发现的重要里程碑」。看来,人类医学研究要前进一步了。

周日,在墨西哥坎昆举办的一场国际会议中,DeepMind 的最新 AI——AlphaFold 在一项极其困难的任务中击败了所有对手,成功地根据基因序列预测出蛋白质的 3D 形状。

「蛋白质折叠」是一种令人难以置信的分子折叠形式,科学界以外很少有人讨论,但却是一个非常重要的问题。生物由蛋白质构成,生物体功能由蛋白质形状决定。理解蛋白质的折叠方式可以帮助研究人员走进科学和医学研究的新纪元。

「对于我们来说,这真的是一个关键时刻,」DeepMind 联合创始人兼 CEO Demis Hassabis 表示,「这个项目就像灯塔,这是我们关于人和资源的首次重大投资,用于解决一个根本性的、现实世界的重要问题。」

在 2016 年 AlphaGo 击败李世乭后,DeepMind 就开始将目光转向蛋白质折叠。尽管实践证明,游戏是 DeepMind AI 项目的优秀试验场,但在游戏中取得高分并非他们的终极目标。「我们的目标从来就不是赢得围棋或雅达利比赛的胜利,而是开发能够解决蛋白质折叠这类问题的算法,」Hassabis 表示。

为什么要预测蛋白质结构

人体能够产生数万甚至数百万的蛋白质。每个蛋白质都是一个氨基酸链,而后者的类型就有 20 种。蛋白质可以在氨基酸之间扭曲、折叠,因此一种含有数百个氨基酸的蛋白质有可能呈现出数量惊人(10 的 300 次方)的结构类型。

蛋白质的 3D 形状取决于其中包含的氨基酸数量和类型,而这一形状也决定了其在人体中的功能。例如,心脏细胞蛋白质的折叠方式可以使血流中的任何肾上腺素都粘在它们上面,以加速心率。免疫系统中的抗体是折叠成特定形状的蛋白质,以锁定入侵者。几乎身体的每一种功能——从收缩肌肉和感受光线到将食物转化为能量——都和蛋白质的形状及运动相关。

通常情况下,蛋白质会呈现出能量效率最高的任何形状,但它们可能会纠缠在一起或者折叠错误,导致糖尿病、帕金森和阿茨海默症等疾病。如果科学家可以根据蛋白质的化学构成来预测其形状,他们就能知道它是做什么的,会如何出错并造成伤害,并设计新的蛋白质来对抗疾病或履行其它职责,比如分解环境中的塑料污染。

AI 如何改变研究方法?

正因为蛋白质的结构如此重要,在过去的五十年中,科学家已经能使用低温电子显微镜和核磁共振等实验技术确定蛋白质的形状,但是每一种方法都依赖大量的试验与误差反馈,每种结构可能需要花费数万美元、历时数年进行研究。因此生物学家转攻 AI 方法,以完成这一困难且单调的过程。

幸运的是,由于基因测序成本快速降低,基因组领域的数据非常丰富。因此在过去几年中,依赖于基因组数据的预测问题正越来越多地借助深度学习方法。DeepMind 非常关注这一问题,并提出了 AlphaFold,这一项工作目前已经提交到了Critical Assessment of Structure Prediction (CASP)。

DeepMind 用 AlphaFold 参加了 CASP,这是一年两次的蛋白质折叠奥运会,吸引了来自世界各地的研究小组。比赛的目的是根据氨基酸列表来预测蛋白质的结构,这些氨基酸列表会在几个月内每隔几天发送给参赛团队。这些蛋白质的结构最近已经通过费力又费钱的传统方法破解,但还没有公开。提交最准确预测的团队将获胜。

尽管是首次参加比赛,AlphaFold  就在 98 名参赛者中名列榜首,准确地从 43 种蛋白质中预测出了 25 种蛋白质的结构。而同组比赛中获得第二名的参赛者仅准确预测出了 3 种。值得一提的是,AlphaFold 关注从头开始建模目标形状,且并不使用先前已经解析的蛋白质作为模板。AlphaFold 在预测蛋白质结构的物理性质上达到了高度的准确性,然后基于这些预测可以使用两种不同的方法预测构建完整的蛋白质结构。

使用神经网络预测物理属性

AlphaFold 构建的模型都依赖深度神经网络,这些经过训练的神经网络可以从基因序列中预测蛋白质的属性。DeepMind 的研究人员表示,神经网络预测的蛋白质属性主要有:(a)氨基酸对之间的距离;(b)连接这些氨基酸的化学键及它们之间的角度。这些方法的首要进步就是对常用技术的提升,它们可以估计氨基酸对是否彼此接近。

为了构建 AlphaFold,DeepMind 在数千已知的蛋白质上训练了一个神经网络,直到它可以仅凭氨基酸预测蛋白质的 3D 结构。给定一种新的蛋白质,AlphaFold 利用神经网络来预测氨基酸对之间的距离,以及连接它们的化学键之间的角度。接着,AlphaFold 调整初步结构以找到能效最高的排列。该项目花了两周时间来预测其第一个蛋白质结构,但现在几小时内就可以完成了。

根据神经网络预测的两种物理属性,DeepMind 还训练了一个神经网络以预测蛋白质成对残基(residues)之间距离的独立分布,这些概率能组合成估计蛋白质结构准确率的评分。此外,DeepMind 还训练了另一个独立的神经网络,该网络使用集群中的所有距离来估计预测的结构与实际结构之间的差距。

预测蛋白质结构的新方法

这些评分函数可以用来探索蛋白质内部,以找到与预测匹配的结构。DeepMind 的第一种方法建立在结构生物学的常用技术上,用新的蛋白质片段反复替换蛋白质整体结构的某个部分。他们训练了一个生成神经网络来创造新的片段,这些片段被用来不断提高蛋白质结构的评分。

先通过神经网络预测氨基酸之间的距离和化学键角度,然后再根据两种物理属性对结构进行评分,最后通过梯度下降优化评分。

第二种方法是通过梯度下降来优化评分,得到的结构高度精确。梯度优化被用在整个蛋白质链,而不是组装前必须单独折叠的片段,这种做法降低了预测过程的复杂性。

未来可期

首次涉足蛋白质折叠领域的成功表明,机器学习系统可以整合各种信息来源,帮助科学家快速找到各种复杂问题的创造性解决方案。人工智能已经通过 AlphaGo 和 AlphaZero 等系统掌握了复杂的游戏,与此类似,利用人工智能攻克基本科学问题的未来同样可期。

雷丁大学的研究人员 Liam McGuffin 在比赛中带领得分最高的英国学术团体。他表示,「DeepMind 今年似乎取得了更大的进展,我想进一步了解他们的方法。我们的资源并不充足,但我们仍然有很强的竞争力。」

「预测蛋白质折叠形状非常重要,对解决很多世纪难题有重大影响。这种能力可以影响健康、生态、环境,基本上可以解决任何涉及生命系统的问题。」

「包括我们在内的很多团队几年来一直都在使用基于机器学习的方法,而深度学习和人工智能的进步似乎也产生了越来越重要的影响。我对这个领域很乐观,我觉得我们会在 21 世纪 20 年代真正解决这个问题。」McGuffin 表示。

Hassabis 也表示还有很多工作要做。「我们还没有解决蛋白质折叠问题,目前只是迈出了第一步。这是一个极具有挑战性的问题,但我们有一个良好的体系,还有很多想法尚未付诸实践。」

蛋白质折叠的早期进展令人兴奋,它证明了人工智能对科学发现的效用。尽管在能够对疾病治疗、环境管理等方面产生量化影响之前,我们还有很多工作要做,但我们知道人工智能的潜力是巨大的。在一个专注于研究机器学习如何推进科学发展的专业团队的努力下,我们期待看到技术能够有所作为。

未来智能实验室是人工智能学家与科学院相关机构联合成立的人工智能,互联网和脑科学交叉研究机构。

未来智能实验室的主要工作包括:建立AI智能系统智商评测体系,开展世界人工智能智商评测;开展互联网(城市)云脑研究计划,构建互联网(城市)云脑技术和企业图谱,为提升企业,行业与城市的智能水平服务。

  如果您对实验室的研究感兴趣,欢迎加入未来智能实验室线上平台。扫描以下二维码或点击本文左下角“阅读原文”

AlphaGo之后,DeepMind重磅推出AlphaFold:基因序列预测蛋白质结构相关推荐

  1. 击败一半参赛程序员,DeepMind 重磅推出 AlphaCode

    作者 | 马超       责编 | 张红月 出品 | CSDN博文 最近,世界著名的编程竞赛网站Codeforces发布了一篇名为<AlphaCode(DeepMind) Solves Pro ...

  2. 百度输入法发布AI版本10.0,重磅推出“AI助聊”功能

    近日,拥有深厚AI实力.相关功能落地广泛的百度输入法迎来年度重大AI版本10.0发布,在领先的自然语言处理等AI能力加持下重磅推出"AI助聊"功能.升级后的百度输入法将更懂用户所想 ...

  3. 直击产业落地 | 飞桨重磅推出业界首个模型选型工具

    本文已在飞桨公众号发布,查看请戳链接: 直击产业落地 | 飞桨重磅推出业界首个模型选型工具 随着技术发展,AI算法已经逐渐渗透到各行各业.AI算法固然高效,然而在实际项目中,开发者往往面临众多复杂的应 ...

  4. 东方日升重磅推出白色双玻组件 助力推动度电成本下滑

    近日,为期3天的日本国际太阳能展览会PVExpo2017在日本东京圆满落幕.A股光伏龙头企业东方日升携60片单多晶组件.72片单多晶组件与白色多晶双玻组件等一系列高效产品亮相展会,并凭借良好的抗PID ...

  5. 炸裂!微软重磅推出混合现实平台 Mesh、基于 Excel 的低代码语言 Power Fx,Ignite 2021 太精彩!...

    作者 | 伍杏玲 出品 | CSDN(ID:CSDNnews) "一开始,这就是混合现实的梦想." 在微软 Ignite 2021 大会上,微软 HoloLens 之父 Alex ...

  6. 重磅推出校园疫情填报系统,永洪BI助力疫情防控

    鉴于当前疫情范围之广,传播速度之快令人担忧,疫情信息上报工作就显得尤为重要,那么用什么工具能够快速的填报学生信息这个问题摆在全国各校园眼前,现永洪重磅推出校园疫情填报系统解决广大校园收集信息困难的问题 ...

  7. 阿里云ARMS重磅推出小程序监控,助力小程序稳定运行

    2018年是小程序蓬勃发展的一年,各大公司如腾讯.阿里.百度.头条等都陆续推出了自己的小程序,小程序已成为一个未来必然的趋势.移动互联网的新风口.据数据统计,目前已上线的微信小程序已超过100万,支付 ...

  8. Quick BI V4.0功能“炸弹”来袭,重磅推出即席分析、模板市场、企业微信免密登录等强势功能

    简介: 2021年7月,Quick BI公共云版本迭代新功能:重磅推出即席分析.模板市场,分析门槛再降低:推出企业微信无缝对接,移动端类目个性配置及管理提升多端能力:数据建模配置交互升级至拖拽模式提升 ...

  9. 阿里云 EMAS HTTPDNS 联合函数计算重磅推出 SDNS 服务,三大能力获得突破

    阿里云 EMAS HTTPDNS 联合函数计算重磅推出 SDNS 服务,三大能力获得突破 1. 什么是 HTTPDNS ? 传统的 DNS(Domain Name System)使开发者常面临着域名劫 ...

最新文章

  1. 2021-2027全球与中国经颅磁刺激仪(TMS)市场现状及未来发展趋势
  2. 【数据结构】单链表的逆序输出(两种方法)
  3. 【Paper】2013_Autonomous Cooperation Between UAV and UGV to Improve Navigation and Environmental
  4. java对cookie的操作_java对cookie的操作
  5. Quartz.net 开源job调度框架(一)
  6. Asp.Net Core Mvc Razor之RazorPage
  7. ios支付宝支付失败不回调_iOS 支付宝网页支付回调问题
  8. 搬家请搬家公司好还是请朋友帮忙好?
  9. win10更新后C盘空间变小解决方法
  10. 正确解决:关于Lattic Diamond软件注册不成功(license问题)
  11. 哲学思考之否定之否定规律
  12. 区块链究竟有什么价值体现?
  13. 社群怎么建立,怎么做好社群营销?
  14. 计算机网络中的OSI模型和TCP/IP模型
  15. Oracle中序列的操作以及使用前对序列的初始化
  16. uniapp 画布绘制二维码,图片,文字的方法
  17. 理解冲突域与广播域,交换机与路由器
  18. 用java代码怎样打开网址_写了一段打开网页java代码报错: 求大神解救
  19. 用Wireshark或MNM捕获WIFI包
  20. 第9期 | 家系、肿瘤临床基因组/外显子组数据分析实战

热门文章

  1. 站立潮头、无问西东 | 第二届“大数据在清华”高峰论坛成功举办
  2. GitHub推出云端IDE,几秒完成开发环境配置,今后可以在浏览器里使用VS Code了
  3. 麻省理工正式宣布人工智能独立设系!人工智能与电子工程、计算机科学系将三分天下...
  4. SAP IDoc 报错- Function module not allowed SPEIDOC_INPUT_DESADV1 –
  5. SAP HUM 嵌套HU初探 II
  6. SAP PP COR3不能看工单后续的备料TO单号?
  7. 为什么 NLP 跑不出独角兽?
  8. 美国劳工统计局使用机器学习自动执行数据编码
  9. AI算法领域常用的39个术语(下)
  10. TensorFlow产品总监:机器学习进步让AI应用成可能