阿里云发布大数据产品ODPS 6小时处理100PB数据

阿里云发布ODPS 可分析PB级海量数据

  新浪科技讯 7月8日下午消息,阿里云计算发布大数据产品——ODPS。通过ODPS在线服务,小型公司花几百元即可分析海量数据。ODPS可在6小时内处理100PB数据,相当于1亿部高清电影。此前,全球掌握这种能力的公司仅有Google、亚马逊(311.39, -3.98, -1.26%)等少数几家。

  阿里云ODPS团队在一封公开信《人人都可以成为BAT》中表示:工业革命后的200多年里,人类对物理资源的利用登峰造极,对数据资源的利用却仍处于起步阶段。Google、Facebook(72.91, -3.00, -3.95%)、阿里巴巴(滚动资讯)等互联网公司先行一步,触碰到了大数据的魅力。然而,人类拥有的绝大部分数据还无法产生价值。

  采用传统方案处理大规模数据,一般得耗资数千万自建数据中心,请专业技术人员维护运作。一旦数据总量超过100TB,技术挑战会非常大。Hadoop开源运动降低了这一成本,不过自建一个像样的Hadoop集群,仍然需要上百万的起步资金。专业的Hadoop人才则更加稀缺。

  相比而言,使用ODPS的成本和门槛则低得多。ODPS采取按量收费的模式,目前定价0.3元/GB,即开即用,一个月内免费。根据大部分公司的数据量来测算,一般每月只需花费数百元。

  在对外商用之前,ODPS只是阿里巴巴内部秘密使用。阿里小贷最先将ODPS应用到商业领域。如今,超过36万人从阿里小贷借款,最小贷款额为1元,并实现3分钟申请、1秒放款、0人工干预。要做到这一点,阿里小贷每天得处理30PB数据,包括店铺等级、收藏、评价等800亿个信息项,运算100多个数据模型,甚至得测评小企业主对假设情景的掩饰和撒谎程度。阿里小贷每笔贷款成本3毛钱,不到普通银行的1/1000。

  据悉,淘宝、支付宝等阿里巴巴最核心的数据业务,都运行在ODPS平台。比如阿里妈妈广告的核心算法,点击预测模型的训练等。ODPS商用,意味着阿里云将这种大数据处理能力对外开放,此举将大幅降低社会创新成本。

  目前,全球提供类似服务的仅有Google和亚马逊,国内尚无同类产品可供比较。阿里云方面表示,ODPS将比Google BigQuery更强大,不仅支持更丰富的SQL语法,还将提供MapReduce编程模型和机器学习建模能力,可以服务更多应用场景。(木南)

  以下为阿里云ODPS团队公开信《人人都可以成为BAT》全文:

  阿里云计算最重要的一款产品——ODPS,正式开放商用。从今天起,花个几百块钱,人人都能来玩大数据。

  简单来说,ODPS(Open Data Processing Service)是一项Web服务,大家不用花大钱建数据中心,就能分析海量数据。我们测过,100PB的数据任务可在6小时内跑完。这个数据量相当于1亿部高清电影。

  工业革命后的200多年里,人类对物理资源的利用登峰造极。第一次信息革命过去70年了,我们对数据资源的利用却只是刚开了头。Google、Facebook、阿里巴巴等先行一步,摸到了大数据的冰山一角。然而,人类拥有的大部分数据,还无法产生价值。

  如何让数据产生价值?先得拥有大规模处理能力,然后才是挖掘、算法和分析。传统的做法是这样的:租个机房,买一堆昂贵的设备搭建数据仓库,再请一帮技术人员来维护运转。一旦触发bug,或者当数据总量超过100TB时,你的工程师们可能会被这些麻烦搞崩溃。

  Hadoop开源系统很伟大,大大降低了成本。阿里是中国玩Hadoop玩得最好的几家公司之一,Hadoop支撑了淘宝、支付宝早期业务的快速发展。不过,自建一个像样的Hadoop集群,得百万起步资金,专业的Hadoop人才更是稀缺。门槛还是太高。

  有没有更好的方案?从2009年初,写下“飞天”第一行代码时,我们就坚信这一方案存在。我们用了五年时间,写下250万行代码,终于在自主研发的“飞天”平台上成功搭建ODPS。我们把数据海洋里的“水”灌进ODPS,设定好一套参数,拧开水龙头,出来的就是“鲜榨果汁”!

  100年前,福特推出了全球第一条流水生产线。一个个零部件扔进流水线,90分钟后,一辆崭新的汽车摆在面前。不知道福特工程师们当时是怎样的心情。当我们拧开ODPS的水龙头时,感受大抵如此。这个比喻还不完全恰当,福特生产线只为福特服务,一条生产线也只能生产一种车型。而ODPS任何人都可以来用,水龙头里流出来的“果汁”,随着原始数据和算法的改变可以千变万化。

  我们来看看ODPS都可以榨哪些“果汁”吧。

  ODPS之前一直在阿里内部试用。第一个“小白鼠”是阿里小贷。你见过敢贷1块钱给你的银行吗?如今,超过36万人从阿里小贷借款,最小贷款额1块钱,并实现3分钟申请、1秒放款、0人工干预。要做到这一点,阿里小贷每天得处理30PB数据,包括店铺等级、收藏、评价等800亿个信息项,运算100多个数据模型,甚至得测评小企业主对假设情景的掩饰和撒谎程度。另外,阿里小贷每笔贷款成本3毛钱。什么?你问普通银行的贷款成本?先乘个1000再说。

  华大基因,2003年国内抗SARS研究的主力军。去年,我们邀请华大在ODPS上试了下基因测序,耗时不到传统方式的十分之一。2010年,欧洲E.coli污染危机,测序和组装耗时两天以上。如果用ODPS,只要几个小时甚至几十分钟。一旦未来真有生物危机爆发,人类可以赢得宝贵的破译时间。

  这么高精尖的领域你可能觉得太遥远。说说当前最火的世界杯吧。Google拿英国体育数据提供商Opta Sports的数据,在BigQuery上跑了跑,成功预测了本届世界杯8强名单。ODPS是一款跟Google BigQuery类似的产品,如果哪位有数据,也可以来算一算接下来的比赛。

  公共领域的数据挖掘,可以用ODPS吗?当然!结合中国气象局的精准预报数据,高德(20.9, 0.00, 0.00%)地图不久后就能告诉你:“前方道路已严重积水,您的车辆驶入可能会遭水淹,建议绕道行驶。”如今,每盒药品上都有一张电子身份证,从生产、流通、储存、配送、销售到使用,全过程的数据都跑在ODPS上,一旦发现问题药品,监管部门可以立即采取措施。我们期待未来每一桶油、每一道菜的数据都跑在ODPS上,食品安全问题需要通过创新的方式来解决。

  生产电饭煲的工厂,应该跟ODPS没什么关系吧?别说,未来还真可能有关系。手机、电视、手表、汽车、空调……这些工业时代的经典产品,现在都变成了互联网终端。谁说电饭煲、鞋子、衣服不会呢?如果未来的制造工厂都变成互联网公司,数据将成为最基本的生产要素。你不懂算法、不会建模、不会分析,没关系,那些有数据分析能力的公司会帮你做。

  眼下,阿里巴巴各项数据业务都在用ODPS“榨果汁”,比如淘宝在算你最中意哪个淘女郎,天猫在算你什么时候想吃车厘子,菜鸟在算卡车走哪条路可能会被雷劈,支付宝在算你何时会从屌丝变成高富帅。如果大家也想“榨果汁”,欢迎来试。ODPS的水龙头就装在阿里云官网aliyun.com上,一个月内免费。

  The World Is Flat. 从某种意义上而言,人人都可以成为BAT,哪怕你的公司只有几号人。我们希望,在技术这件事情上,大家变得更加平等!

  阿里云ODPS团队

  2014年7月8日

阿里云发布大数据产品ODPS 6小时处理100PB数据相关推荐

  1. 【云周刊】第134期:阿里云发布ECS企业级产品家族 19款实例族涵盖173个应用场景

    摘要: 阿里云发布ECS企业级产品家族,19款实例族涵盖173个应用场景 .阿里云发布T级数据压测的终极秘笈,一步步带你探究如何高效使用TensorFlow,程序员真的适合跑步健身吗?...更多精彩技 ...

  2. 【云周刊】第134期:阿里云发布ECS企业级产品家族 19款实例族涵盖173个应用场景...

    摘要: 阿里云发布ECS企业级产品家族,19款实例族涵盖173个应用场景 .阿里云发布T级数据压测的终极秘笈,一步步带你探究如何高效使用TensorFlow,程序员真的适合跑步健身吗?...更多精彩技 ...

  3. 阿里云发布ECS企业级产品家族 19款实例族涵盖173个应用场景

    为满足企业级客户对计算的高标准需求,8月9日,阿里云正式发布云服务器ECS企业级产品家族,目前已推出面向173种企业应用场景的19款实例.该系列适合在复杂的企业计算环境下,满足对于高性能.高可靠的计算 ...

  4. 【公测中】阿里云发布国内首个大数据双活容灾服务,满足高要求大数据灾备场景...

    在6月上旬举行的云栖大会上海峰会上,阿里云发布了国内首个大数据集群双活容灾产品-混合云容灾服务下的混合云大数据容灾服务(HDR for Big Data, 简称 HDR-BD),并已经在7月份开始邀测 ...

  5. 阿里云发布新一代CDN 6.0 主打云与大数据融合

    3月18日,阿里云发布极速CDN 6.0版,在业界首次提出Cloud Delivery Network(云分发网络)理念.新版CDN融合云计算和大数据技术,涵盖视频和移动两个解决方案以及大数据分析.H ...

  6. 【公测中】阿里云发布国内首个大数据双活容灾服务,满足高要求大数据灾备场景

    在6月上旬举行的云栖大会上海峰会上,阿里云发布了国内首个大数据集群双活容灾产品-混合云容灾服务下的混合云大数据容灾服务(HDR for Big Data, 简称 HDR-BD),并已经在7月份开始邀测 ...

  7. 阿里云发布“神龙云服务器”,甲骨文成“区块链即服务”生态新成员 | 大数据24小时

    甲骨文公布企业级区块链战略,成"区块链即服务"新成员:阿里云发布计算类服务器产品--"神龙云服务器":印度深度学习创企ParallelDots完成140万美元融 ...

  8. 数梦工场联手阿里云 推出大数据一体机

    本文讲的是数梦工场联手阿里云 推出大数据一体机[IT168 云计算]8月19日消息,作为全球领先的云计算和大数据场景化开发与服务提供商,数梦工场依托阿里云"飞天"大规模分布式计算系 ...

  9. 下一代智能数据工厂,阿里云发布全新DataWorks

    大数据的开发能力已经成为企业的核心竞争力之一, 企业对数据资产的管理.加工.利用的诉求也越来越强烈. 9月5日,阿里云发布了DataWorks V2版本, 可提升数据开发的效率并简化数据操作,为企业提 ...

最新文章

  1. python核心-类-1
  2. nodejs中使用RabbitMq消息中心系统的方式
  3. UA MATH564 概率论 QE练习题1
  4. 石油采集(求联通区域) 2018多校寒假集训 (dfs+二分匹配)
  5. 腾讯手游助手android版本,腾讯游戏助手下载-腾讯游戏助手 安卓版v3.3.4.22-PC6安卓网...
  6. php protobuf 二进制,PHP环境中使用ProtoBuf数据格式
  7. Docker 学习资料
  8. 用OKR拆解法,做产品规划
  9. conda安装tensorflow-gpu简洁版_【DP系列教程02】DeePMDkit:conda安装 amp; 离线安装
  10. IDEA设置Maven组合命令一键编译打包发布
  11. openwrt编译smartdns_ubuntu下交叉编译PandoraBox/潘多拉 k2p/mipsel软件openssl和smartdns
  12. PHP8.0正式版的编译安装与使用
  13. 出走的门徒之二—摩拜 王晓峰:给岁月以文明
  14. 如何运行从网上下载的iWatch项目详细步骤.
  15. 龙格现象 matlab,龙格现象的matlab实现
  16. 大神之路-起始篇 | 第16章.计算机科学导论之【网络安全】学习笔记
  17. 超低功耗Wifi片上系统WizFi 210 !应用笔记--多路连接
  18. 对射式红外传感器模块、测速传感器模块、计数器模块、电机测试模块、槽型光耦模块
  19. [译] 2019 年了,为什么我还在用 jQuery?
  20. Java架构师知识体系结构导图

热门文章

  1. 网站服务器蜘蛛日志怎么看,如何查看百度蜘蛛,google蜘蛛爬取记录?《网站日志分析篇》...
  2. 第一章c语言基础知识答案,第一章 C语言的基础知识练习题
  3. android自动填充包名,debug/release 修改包名,取不同包名下的agconnect-services.json 文件...
  4. etal斜体吗 参考文献_参考文献类有关论文范例,与日语文提纲2016年,日语文提纲科目相关本科毕业论文范文...
  5. xdeepfm算法思维导图与代码
  6. python字符串替换空格_python - 用pandas中的NaN替换空白值(空格)
  7. 两个多精度十进制数加法程序设计_翁恺老师的程序设计入门——C语言 第四周习题...
  8. 文巾解题 1433. 检查一个字符串是否可以打破另一个字符串
  9. Tableau实战系列浏览 Tableau 环境(二) -工作区域
  10. 数学符号的读法和英文表示