整理了一下最近图灵出版的大数据相关的书,有2本R语言+2本基于Python语言环境+1本Spark+1本数据清洗,最后还有一本大众阅读的经典好评畅销的数据分析。

1、示例讲解如何用R语言玩转数据——《R语言入门与实践》

作者:Garrett Grolemund

译者:冯凌秉

■ 将R编程所需的方方面面巧妙融合在三个精心挑选的示例中,助你轻松掌握R语言

■ 跟随世界一流的RStudio培训师掌握宝贵的编程技能

《R语言入门与实践》涵盖R语言编程的方方面面,内容涉及R对象的类型、R的记号体系和环境系统、自定义函数、if else语句、for循环、S3类、R的包系统以及调试工具等。本书还通过示例演示如何进行向量化编程,从而对代码进行提速并最大化地发挥R的潜能。

“如果你想跟世界一流的RStudio培训师学习R编程,却没有机会与其当面交流,那么这本书就是不二之选。读这本书于我而言是一种享受,希望你也有同感。”

——Hadley Wickham,RStudio首席科学家,《R包开发》(R Packages)作者

《R语言入门与实践》还没上市,预计6月上市。

2、一本全面而细致的R指南——《R语言实战(第2版)》

作者:Robert I. Kabacoff

译者:王小宁,刘撷芯,黄俊文

■ 用R轻松实现数据挖掘、数据可视化

■ 从实际数据分析出发,全面掌握R编程

■ 新增预测性分析、简化多变量数据等近200页内容

《R语言实战(第2版)》从解决实际问题入手,尽量跳脱统计学的理论阐述来讨论R语言及其应用,讲解清晰透澈,极具实用性。作者不仅高度概括了R语言的强大功能,展示了各种实用的统计示例,而且对于难以用传统方法分析的凌乱、不完整和非正态的数据也给出了完备的处理方法。第2版新增6章内容,涵盖时间序列、聚类分析、分类、高级编程、创建包和创建动态报告等,并分别详细介绍了如何使用ggplot2和lattice进行高级绘图。通读本书,你将全面掌握使用R语言进行数据分析、数据挖掘的技巧,领略大量探索和展示数据的图形功能,并学会如何撰写动态报告,从而更加高效地进行分析与沟通。

3、Google数据科学家作品——数据科学入门

作者:Joel Grus

译者:高蓉,韩波

■ 数据科学基本知识的重量级读本

《数据科学入门》基于易于理解且具有数据科学相关的丰富的库的Python语言环境,从零开始讲解数据科学工作。具体内容包括:Python速成,可视化数据,线性代数,统计,概率,假设与推断,梯度下降法,如何获取数据,k近邻法,朴素贝叶斯算法,等等。作者借助大量具体例子以及数据挖掘、统计学、机器学习等领域的重要概念,详细展示了什么是数据科学。书中涵盖的所有代码和数据都可以在GitHub上下载。

4、全面剖析网络数据采集技术——Python网络数据采集

作者:Ryan Mitchell

译者:陶俊杰,陈小莉

■ 用简单高效的Python语言,展示网络数据采集常用手段,剖析网络表单安全措施,完成大数据采集任务!

《Python网络数据采集》适合熟悉Python的程序员、安全专业人士、网络管理员阅读。书中不仅介绍了网络数据采集的基本原理,还深入探讨了更高级的主题,比如分析原始数据、用网络爬虫测试网站等。此外,书中还提供了详细的代码示例,以帮助你更好地理解书中的内容。

5、Spark实战指南——《Spark最佳实践》

作者:陈欢,林世飞

■ UCloud季昕华、Databricks连城,阿里胡熠,棒米科技武泽胜,腾讯肖磊\靳志辉\徐羽等联袂推荐!

■ 腾讯专家首次分享Spark最佳实践

■ 基于真实数据,用案例分析全面解读大数据应用设计

■ 腾讯资深研发者的Spark实践,揭秘广告和推荐系统核心技术

《Spark最佳实践》全书共分8章。前4章介绍Spark的部署、工作机制和内核,后4章分别通过实战项目介绍Spark SQL、Spark Streaming、Spark GraphX和Spark MLib功能模块。此外,本书详细介绍了常见的实战问题,比如大数据环境下的配置设置、程序调优等。本书附带的一键安装脚本,更能为初学者提供很大帮助。

6、数据清洗入门与实践——《干净的数据》

作者:Megan Squire

译者:任政委

■ 掌握高效数据清洗方法,为数据挖掘提供便利,让用户更好地体验大数据价值!

《干净的数据:数据清洗入门与实践》从文件格式、数据类型、字符编码等基本概念讲起,通过真实的示例,探讨如何提取和清洗关系型数据库、网页文件和PDF文档中的数据。最后提供了两个真实的项目,让读者将所有数据清洗技术付诸实践,完成整个数据科学过程。

7、精益系列丛书——《精益数据分析》

作者:Alistair Croll,Benjamin Yoskovitz

译者:韩知白,王鹤达

■ 《精益创业》作者埃里克·莱斯主编

《精益数据分析》围绕精益创业展开讨论,融合了精益创业法、客户开发、商业模式画布和敏捷/ 持续集成的精华。本书汇聚了100多位创始人、投资人、内部创业者和创新者的成功创业经验,呈现了30多个极具价值的案例分析,可以为各阶段的创业者提供行为准则。

学懂分析,玩转大数据相关推荐

  1. 《一本书读懂大数据营销 玩透大数据营销 创造网络营销奇迹》pdf下载 百度云

    <一本书读懂大数据营销  玩透大数据营销  创造网络营销奇迹>pdf下载请到文末! 在使用低对比度光源的摄影作品中,辣椒的阴影不再是清晰可见的,阴影的线条也不再"生硬" ...

  2. 孟凯想玩转大数据,得先看懂《小时代》

    湘鄂情在餐饮行业已经无路可走,这一点湘鄂情董事长孟凯理解得非常透彻.它高度依赖公务消费,现在政府说不做了,你有天大的本事也扭转不过来,这对湘鄂情是非常致命的. 和湘鄂情同为上市高端餐饮企业的全聚德也正 ...

  3. 什么是大数据口子_大数据分析师年薪几十万,学什么专业才能从事大数据?

    近几年,大数据为各个领域带来了全新的变革,大数据的重要性越来越被企业和国家所看到,大数据工作者的需求再次被无限放大,他们的薪资和社会地位也在不断上涨.马云在演讲中就提到,未来的时代将不是IT时代,而是 ...

  4. 独家直播双十一全网动态?前黑客“劳改”带你玩转大数据

    独家直播双十一全网动态?前黑客"劳改"带你玩转大数据 发表于2015-11-24 10:26| 4044次阅读| 来源CSDN| 7 条评论| 作者蒲婧 CTO俱乐部CTOCTO讲 ...

  5. 大数据项目一般金额多少_大数据分析师年薪一般多少?学什么专业才能从事大数据?...

    近几年,大数据为各个领域带来了全新的变革,大数据的重要性越来越被企业和国家所看到,大数据工作者的需求再次被无限放大,他们的薪资和社会地位也在不断上涨.马云在演讲中就提到,未来的时代将不是IT时代,而是 ...

  6. 大数据分析师年薪几十万,学什么专业才能从事大数据?

    近几年,大数据为各个领域带来了全新的变革,大数据的重要性越来越被企业和国家所看到,大数据工作者的需求再次被无限放大,他们的薪资和社会地位也在不断上涨.马云在演讲中就提到,未来的时代将不是IT时代,而是 ...

  7. 大数据分析师年薪有多少,学什么专业才能从事大数据?

    近几年,大数据为各个领域带来了全新的变革,大数据的重要性越来越被企业和国家所看到,大数据工作者的需求再次被无限放大,他们的薪资和社会地位也在不断上涨.马云在演讲中就提到,未来的时代将不是IT时代,而是 ...

  8. Nature Methods:Rob Knight发布Striped UniFrac算法轻松分析微生物组大数据

    Striped UniFrac微生物组大尺度分析算法 Striped UniFrac: enabling microbiome analysis at unprecedented scale Natu ...

  9. 玩转大数据系列之三:数据报表与展示

    为什么80%的码农都做不了架构师?>>>    经过了数据采集与数据同步.数据分析和处理,我们应该考虑将处理好的数据做成报表或者大屏展示给老板们看,以便老板们可以更加精准地做出战略决 ...

最新文章

  1. 汇编语言——键盘输入字符
  2. CentOS7-64bit 编译 Hadoop-2.5.0,并分布式安装
  3. 二叉树的前序、中序和后序遍历介绍及案例
  4. MJiOS底层笔记--KVO本质
  5. python发送json数据_在Websockets上发送JSON
  6. 2、nginx配置文件
  7. Spring Boot笔记-接收RabbitMQ队列中的消息
  8. C#中ref和out的使用小结
  9. 解决报错OMP: Error #15: Initializing libiomp5.dylib, but found libomp.dylib already initialized
  10. ReactJS基础(续)
  11. 组织结构及权限模型设计
  12. php 管理员界面源码,ThinkPHP通用后台管理系统TP-Admin
  13. 基于51单片机的16键电子琴音乐盒仿真原理图方案设计
  14. JDBC Connection [com.alibaba.druid.proxy.jdbc.ConnectionProxyImpl@xxx] will not be managed by Spring
  15. python 定义变量x格式_Python变量
  16. 使用移动云MAS HTTP接口发送短信BASE64加密中文乱码
  17. 加密货币工具和算法大合集
  18. arduino 版 PID 算法模板(程序可直接套模板实用)
  19. C语言—求数组的对角线和副对角线之和
  20. Go生成Excel文件并下载及问题

热门文章

  1. 没有任何基础学编程从哪开始_没有任何的绘画基础,该怎么学绘画?
  2. 华为 日志服务器 配置文件,配置日志服务器
  3. 向量时钟同步算法_如何让超级下载算法在不同CortexM内核下也能跑?
  4. python中类和对象的内容_python中的类和对象
  5. 损失函数的意义和作用_哈佛CASTER | 基于化学子结构表征预测药物相互作用
  6. 概要设计实例_多核片上系统(SoC)架构的嵌入式DSP软件设计
  7. 【c语言】2020蓝桥杯校内模拟赛c组
  8. 阿里开源混沌工程工具 ChaosBlade
  9. C语言基础知识【常量】
  10. iOS SQLite解密之SQLCipher