学懂分析,玩转大数据

原创 2016年05月30日 15:58:29

整理了一下最近图灵出版的大数据相关的书,有2本R语言+2本基于Python语言环境+1本Spark+1本数据清洗,最后还有一本大众阅读的经典好评畅销的数据分析。

1、示例讲解如何用R语言玩转数据——《R语言入门与实践》

这里写图片描述

作者:Garrett Grolemund

译者:冯凌秉

■ 将R编程所需的方方面面巧妙融合在三个精心挑选的示例中,助你轻松掌握R语言

■ 跟随世界一流的RStudio培训师掌握宝贵的编程技能

《R语言入门与实践》涵盖R语言编程的方方面面,内容涉及R对象的类型、R的记号体系和环境系统、自定义函数、if else语句、for循环、S3类、R的包系统以及调试工具等。本书还通过示例演示如何进行向量化编程,从而对代码进行提速并最大化地发挥R的潜能。

“如果你想跟世界一流的RStudio培训师学习R编程,却没有机会与其当面交流,那么这本书就是不二之选。读这本书于我而言是一种享受,希望你也有同感。”

——Hadley Wickham,RStudio首席科学家,《R包开发》(R Packages)作者

《R语言入门与实践》还没上市,预计6月上市。

2、一本全面而细致的R指南——《R语言实战(第2版)》

这里写图片描述

作者:Robert I. Kabacoff

译者:王小宁,刘撷芯,黄俊文

■ 用R轻松实现数据挖掘、数据可视化

■ 从实际数据分析出发,全面掌握R编程

■ 新增预测性分析、简化多变量数据等近200页内容

《R语言实战(第2版)》从解决实际问题入手,尽量跳脱统计学的理论阐述来讨论R语言及其应用,讲解清晰透澈,极具实用性。作者不仅高度概括了R语言的强大功能,展示了各种实用的统计示例,而且对于难以用传统方法分析的凌乱、不完整和非正态的数据也给出了完备的处理方法。第2版新增6章内容,涵盖时间序列、聚类分析、分类、高级编程、创建包和创建动态报告等,并分别详细介绍了如何使用ggplot2和lattice进行高级绘图。通读本书,你将全面掌握使用R语言进行数据分析、数据挖掘的技巧,领略大量探索和展示数据的图形功能,并学会如何撰写动态报告,从而更加高效地进行分析与沟通。

3、Google数据科学家作品——数据科学入门

这里写图片描述

作者:Joel Grus

译者:高蓉,韩波

■ 数据科学基本知识的重量级读本

《数据科学入门》基于易于理解且具有数据科学相关的丰富的库的Python语言环境,从零开始讲解数据科学工作。具体内容包括:Python速成,可视化数据,线性代数,统计,概率,假设与推断,梯度下降法,如何获取数据,k近邻法,朴素贝叶斯算法,等等。作者借助大量具体例子以及数据挖掘、统计学、机器学习等领域的重要概念,详细展示了什么是数据科学。书中涵盖的所有代码和数据都可以在GitHub上下载。

4、全面剖析网络数据采集技术——Python网络数据采集

这里写图片描述

作者:Ryan Mitchell

译者:陶俊杰,陈小莉

■ 用简单高效的Python语言,展示网络数据采集常用手段,剖析网络表单安全措施,完成大数据采集任务!

《Python网络数据采集》适合熟悉Python的程序员、安全专业人士、网络管理员阅读。书中不仅介绍了网络数据采集的基本原理,还深入探讨了更高级的主题,比如分析原始数据、用网络爬虫测试网站等。此外,书中还提供了详细的代码示例,以帮助你更好地理解书中的内容。

5、Spark实战指南——《Spark最佳实践》

这里写图片描述

作者:陈欢,林世飞

■ UCloud季昕华、Databricks连城,阿里胡熠,棒米科技武泽胜,腾讯肖磊\靳志辉\徐羽等联袂推荐!

■ 腾讯专家首次分享Spark最佳实践

■ 基于真实数据,用案例分析全面解读大数据应用设计

■ 腾讯资深研发者的Spark实践,揭秘广告和推荐系统核心技术

《Spark最佳实践》全书共分8章。前4章介绍Spark的部署、工作机制和内核,后4章分别通过实战项目介绍Spark SQL、Spark Streaming、Spark GraphX和Spark MLib功能模块。此外,本书详细介绍了常见的实战问题,比如大数据环境下的配置设置、程序调优等。本书附带的一键安装脚本,更能为初学者提供很大帮助。

6、数据清洗入门与实践——《干净的数据》

这里写图片描述

作者:Megan Squire

译者:任政委

■ 掌握高效数据清洗方法,为数据挖掘提供便利,让用户更好地体验大数据价值!

《干净的数据:数据清洗入门与实践》从文件格式、数据类型、字符编码等基本概念讲起,通过真实的示例,探讨如何提取和清洗关系型数据库、网页文件和PDF文档中的数据。最后提供了两个真实的项目,让读者将所有数据清洗技术付诸实践,完成整个数据科学过程。

7、精益系列丛书——《精益数据分析》

这里写图片描述

作者:Alistair Croll,Benjamin Yoskovitz

译者:韩知白,王鹤达

■ 《精益创业》作者埃里克·莱斯主编

《精益数据分析》围绕精益创业展开讨论,融合了精益创业法、客户开发、商业模式画布和敏捷/ 持续集成的精华。本书汇聚了100多位创始人、投资人、内部创业者和创新者的成功创业经验,呈现了30多个极具价值的案例分析,可以为各阶段的创业者提供行为准则。

美国电商是如何用大数据玩转“双十一”的?

美国电商是如何用大数据玩转“双十一”的? 硅星闻 11月09日 15:56 硅谷 创投 分类 :互联网 阅读:13521  抢沙发 年底购物季,美国不少电商网站通...

从技术角度看中国谁能玩转大数据技术

毫无疑问,世界上所有关注开发技术的人都意识到“大数据”对企业商务所蕴含的潜在价值,其目的都在于解决在企业发展过程中各种业务数据增长所带来的痛苦。 现实是,许多问题阻碍了大数据技术的发展和实际应用...

人人皆可大数据!SACC教你玩转阿里ODPS

 人人皆可大数据!SACC教你玩转阿里ODPS                【IT168 专稿】为什么我们使用搜索引擎时,不同的用户搜索同样的关键词看到的广告却不同?为什么我们到电子...

程序员想玩转大数据:需要知晓的12种工具

无论是在构建大数据的应用程序,还是仅仅只想从开发的移动应用中得到一点点启发,程序员现在比以往任何时候都需要数据分析工具。这绝对是一个好东西,所以很多公司从程序员的需求和技能出发,构建了一些数据分析工具...

两个月玩转大数据之HDFS

我也来标题党凑个热闹,博主冬学期有一门大数据基础的课程。课程主要是由华为公司培训中心的讲师来上,课程32个课时,分为八周,一周4课时。博主的课程主要是理论加上实践。理论知识华为的讲师讲的还是十分的快的...

玩转大数据,你需要了解这8种项目类型!

本文作者为大数据咨询公司 Mammoth Data 的创始人 Andrew Oliver,主要介绍适宜应用大数据的8大项目类型。文章系国内 ITOM 管理平台 OneAPM 编译呈现,以下为正文。...

小企业玩转大数据的N多招数

大数据时代,不管是IT巨头还是中小企业,都非常重视大数据技术,那么对于小企业来说,在这个大数据人才高度缺乏的情形下,怎么样才能发展好大数据呢?科多大数据带你一起来了解下方法。     大...

玩转大数据系列之Apache Pig如何与MySQL集成(三)

上篇介绍了如何把Pig的结果存储到Solr中,那么可能就会有朋友问了,为什么不存到数据库呢? 不支持还是? 其实只要我们愿意,我们可以存储它的结果集到任何地方,只需要重写我们自己的StoreFunc类...

玩转营销先了解大数据营销的十大切入点

2013年似乎人人都在谈论大数据,然而说得云里雾里者多。许多企业家更关心的事是:如何才能真正找到大数据营销的切入点?     许多人感觉到大数据时代正在到来,但往往只是一种朦胧的感觉,对于其...

玩转大数据_顺利渡过34岁裁退危机!

某菊花厂要把34岁以上的员工都裁退,中年都没到就危机了,票子木有了,工作木有了,连最热爱的数据库都没机会玩了,还好,有一个快速上手玩转大数据的机会!一定要好好珍惜啊!阿里云有一款大数据产品,云HBas...
内容举报
返回顶部
收藏助手
不良信息举报
您举报文章:学懂分析,玩转大数据
举报原因:
原因补充:

(最多只允许输入30个字)