我们很荣幸能够见证Hadoop十年从无到有,再到称王。感动于技术的日新月异时,希望通过今天的有问有答深入解读Hadoop的昨天、今天和明天,憧憬下一个十年。

1

Q:Hadoop是什么?


A:Hadoop 是一个由 Apache 基金会所开发的分布式系统基础架构,它可以使用户在不了解分布式底层细节的情況下开发分布式程序,充分利用集群的威力进行高速运算和存储。

从其定义就可以发现,它解決了两大问题:大数据存储、大数据分析。也就是 Hadoop 的两大核心:HDFS 和 MapReduce。

  1. HDFS(Hadoop Distributed File System)是可扩展、容错、高性能的分布式文件系统,异步复制,一次写入多次读取,主要负责存储。

  2. MapReduce 为分布式计算框架,包含map(映射)和 reduce(归约)过程,负责在 HDFS 上进行计算。

我们先来了解下 Hadoop 的发展历史,如图 1-1 所示。

2

Q: Hadoop 有哪些优点呢?

A:Hadoop 是一个能够让用户轻松架构和使用的分布式计算的平台。用户可以轻松地在 Hadoop 发和运行处理海量数据的应用程序。其优点主要有以下几个:

(1) 高可靠性 : Hadoop 按位存储和处理数据的能力值得人们信赖。

(2) 高扩展性 : Hadoop 是在可用的计算机集簇间分配数据并完成计算任务的,这些集簇可以方便地扩展到数以干计的节点中。

(3) 高效性 : Hadoop能够在节点之间动态地移动数据,并保证各个节点的动态平衡,因此处理速度非常快。

(4) 高容错性 : Hadoop能够自动保存数据的多个副本,并且能够自动将失败的任务重新分。

(5) 低成本 : 与一体机、商用数据仓库以及 QlikView、 Yonghong Z- Suites 等数据集市相比,Hadoop 是开源的,项目的软件成本因此会大大降低。

Hadoop 带有用 Java 语言编写的框架,因此运行在 linux 生产平台上是非常理想的, Hadoop 上的应用程序也可以使用其他语言编写,比如 C++。

3

Q:Hadoop解决哪些问题?

A:海量数据需要及时分析和处理

  • 海量数据需要深入分析和挖掘

  • 数据需要长期保存

海量数据存储的问题:

  • 磁盘IO称为一种瓶颈,而非CPU资源

  • 网络带宽是一种稀缺资源

  • 硬件故障成为影响稳定的一大因素

4

Q:Hadoop 和Spark有什么区别?

A:Hadoop 和Spark 两者都是大数据框架,但解决问题的层面有所不同。Hadoop更多是一个分布式数据基础设施,将巨大的数据集分派到一个由普通计算机组成的集群中的多个节点进行存储,节省了硬件成本 ,而Spark,则是那么一个专门用来对那些分布式存储的大数据进行处理的工具,依赖于分布式数据存储。

其次, Spark要比Hadoop的MapReduce计算速度快很多。Spark,它会在内存中以接近“实时”的时间完成所有的数据分析,从集群中读取数据,完成所有必须的分析处理,将结果写回集群。对于动态数据实时分析而言,Spark要比Hadoop性能较为优越。

5

Q:Hadoop在大数据中的作用是什么?

A:Hadoop大数据处理的相关产品有很多,如Hive、HBase、Spark、Storm、Mahout等等,用户的需求也能够日益得到满足。相比于使用场景已基本固化的关系型数据库,Hadoop功能更加灵活。并且Hadoop是开源项目,有开源社区和大多技术者的支持,开发维护也较为方便。在Hive中,关系型数据主要基于SQL语言,并且Hadoop有SQL型,同时也可以用Java、Python等进行开发。

小伙伴们冲鸭,后台留言区等着你!

关于Hadoop,今天你学到了什么?还有哪些不懂的?除此还对哪些话题感兴趣?快来留言区打卡啦!留言方式:打开第XX天,答:……

同时欢迎大家搜集更多问题,投稿给我们!风里雨里留言区里等你~

福利

1、扫描添加小编微信,备注“姓名+公司职位”,加入【云计算学习交流群】,和志同道合的朋友们共同打卡学习!

2、公众号后台回复:白皮书,获取IDC最新数据白皮书整理资料!

推荐阅读:

  • 全面剖析企业私有云

  • 30 秒?!Chrome 插件带你速成编程学习 | 程序员硬核评测

  • 为什么程序员下班后只关显示器从不关电脑?

  • 算法警告!该图片涉嫌违规不予显示

  • 交易机器人春天已来?先看完这篇再说吧

  • 2019年中国IT市场趋势热点

  • 2019年最值得关注的五大微服务发展趋势

喜欢就点击“好看”吧

Hadoop精华问答 | Hadoop 和Spark有什么区别?相关推荐

  1. Hadoop精华问答 | hadoop能干什么?

    Hadoop能够进行大批量数据的离线处理,但是在实时计算上的表现实在是不尽如人意;而Storm就可以担当这部分的角色,今天,就让我们看看关于Storm的精华问答吧. 1 Q:hadoop是什么 A:H ...

  2. Hadoop精华问答 | Hadoop框架中最核心的设计是什么?

    Hadoop能够进行大批量数据的离线处理,但是在实时计算上的表现实在是不尽如人意;而Storm就可以担当这部分的角色,今天,就让我们看看关于Storm的精华问答吧. 1 Q:hadoop发展史 A: ...

  3. Hadoop精华问答 | 基于Hadoop的数据中心有什么好处?

    戳蓝字"CSDN云计算"关注我们哦! 2006年项目成立的一开始,"Hadoop"这个单词只代表了两个组件--HDFS和MapReduce.到现在的13个年头, ...

  4. Hadoop精华问答 | NameNode的工作特点

    我们很荣幸能够见证Hadoop十年从无到有,再到称王.感动于技术的日新月异时,让我们再来看看关于Hadoop的精华问答. 1 Q:NameNode的工作特点 A:NameNode始终在内存中保存met ...

  5. Hadoop精华问答 | NameNode是什么?

    戳蓝字"CSDN云计算"关注我们哦! 2006年项目成立的一开始,"Hadoop"这个单词只代表了两个组件--HDFS和MapReduce.到现在的13个年头, ...

  6. Hadoop精华问答:Hadoop框架最核心的设计是?

    2006年项目成立的一开始,"Hadoop"这个单词只代表了两个组件--HDFS和MapReduce.到现在的13个年头,这个单词代表的是"核心",今天我们就来 ...

  7. Hadoop精华问答 | 非大数据的项目能否用Hadoop?

    戳蓝字"CSDN云计算"关注我们哦! 技术的日新月异,让我们见证了Hadoop十年从无到有,再到称王.2006年项目成立的一开始,"Hadoop"这个单词只代表 ...

  8. hadoop是什么_Hadoop精华问答 | hadoop能干什么?

    Hadoop能够进行大批量数据的离线处理,但是在实时计算上的表现实在是不尽如人意;而Storm就可以担当这部分的角色,今天,就让我们看看关于Storm的精华问答吧. 1 Q:hadoop是什么 A:H ...

  9. Hadoop精华问答 | 如何设置单个任务占用的内存量和CPU数目?

    我们很荣幸能够见证Hadoop十年从无到有,再到称王.感动于技术的日新月异时,让我们再来看看关于Hadoop的精华问答. 1 Q:默认情况下,各个节点的负载不均衡(任务数目不同),有的节点很多任务在跑 ...

最新文章

  1. duilib拖动控制功能的实现(源代码)
  2. android自定义下载框架,Android_DownloadUtil
  3. Struts值栈与Ognl
  4. 将结构体数据存储到一段字符串string中
  5. 2019CSP-S初赛知识点汇总
  6. [转]Linux平台下的service程序编写指南
  7. mysql 批量查询插入,MySQL批量插入查询出来的数据
  8. Access2016学习4
  9. 利用 0day 双杀-java 环境-宏感染-安卓客户端渗透
  10. chrome浏览器在https网站中打开http图片,打不开的解决方案
  11. python生成春联图片,并包装为GUI工具
  12. Sublime中文乱码问题!今天星期四~
  13. Openwrt Lede koolshare固件下屏蔽固定MAC地址以及屏蔽某些网站
  14. TTL肖特基触发器是什么?
  15. 了解无人驾驶汽车原理
  16. 助力智慧医疗|解析i.MX8MM在麻醉系统中的应用方案
  17. 基于Android的小区物业管理源码,基于Android的智能小区物业管理系统的设计与实现...
  18. 2023年小程序游戏发展前景分析
  19. z17mini android 8,努比亚Z17mini与荣耀8哪个好?荣耀8与Nubia Z17mini区别对比 (全文)
  20. [转]XBRL应用软件分类

热门文章

  1. 捷达vs7测试_捷达VS5话题:防撞钢梁,溃缩梁。第200311期
  2. 100999凑整到万位进一_四年级数学专项练习
  3. python中使用什么导入模块-Python中使用语句导入模块或包的机制研究
  4. 俺是如何在3个月内写出博士论文的?
  5. 师从施一公,4年8篇CNS,西湖大学博士后获世界最具潜力女科学家奖
  6. 数学国里有座天才云集的“疯人院”
  7. 加加减减的奥秘——从数学到魔术的思考(一)
  8. 直观秒懂:这波动图全是泵,应有尽有!
  9. php redis存储位置,redis数据保存在哪里
  10. org.attoparser.ParseException: Could not parse as expression: “