学懂分析,玩转大数据

原创 2016年05月30日 15:58:29

整理了一下最近图灵出版的大数据相关的书,有2本R语言+2本基于Python语言环境+1本Spark+1本数据清洗,最后还有一本大众阅读的经典好评畅销的数据分析。

1、示例讲解如何用R语言玩转数据——《R语言入门与实践》

这里写图片描述

作者:Garrett Grolemund

译者:冯凌秉

■ 将R编程所需的方方面面巧妙融合在三个精心挑选的示例中,助你轻松掌握R语言

■ 跟随世界一流的RStudio培训师掌握宝贵的编程技能

《R语言入门与实践》涵盖R语言编程的方方面面,内容涉及R对象的类型、R的记号体系和环境系统、自定义函数、if else语句、for循环、S3类、R的包系统以及调试工具等。本书还通过示例演示如何进行向量化编程,从而对代码进行提速并最大化地发挥R的潜能。

“如果你想跟世界一流的RStudio培训师学习R编程,却没有机会与其当面交流,那么这本书就是不二之选。读这本书于我而言是一种享受,希望你也有同感。”

——Hadley Wickham,RStudio首席科学家,《R包开发》(R Packages)作者

《R语言入门与实践》还没上市,预计6月上市。

2、一本全面而细致的R指南——《R语言实战(第2版)》

这里写图片描述

作者:Robert I. Kabacoff

译者:王小宁,刘撷芯,黄俊文

■ 用R轻松实现数据挖掘、数据可视化

■ 从实际数据分析出发,全面掌握R编程

■ 新增预测性分析、简化多变量数据等近200页内容

《R语言实战(第2版)》从解决实际问题入手,尽量跳脱统计学的理论阐述来讨论R语言及其应用,讲解清晰透澈,极具实用性。作者不仅高度概括了R语言的强大功能,展示了各种实用的统计示例,而且对于难以用传统方法分析的凌乱、不完整和非正态的数据也给出了完备的处理方法。第2版新增6章内容,涵盖时间序列、聚类分析、分类、高级编程、创建包和创建动态报告等,并分别详细介绍了如何使用ggplot2和lattice进行高级绘图。通读本书,你将全面掌握使用R语言进行数据分析、数据挖掘的技巧,领略大量探索和展示数据的图形功能,并学会如何撰写动态报告,从而更加高效地进行分析与沟通。

3、Google数据科学家作品——数据科学入门

这里写图片描述

作者:Joel Grus

译者:高蓉,韩波

■ 数据科学基本知识的重量级读本

《数据科学入门》基于易于理解且具有数据科学相关的丰富的库的Python语言环境,从零开始讲解数据科学工作。具体内容包括:Python速成,可视化数据,线性代数,统计,概率,假设与推断,梯度下降法,如何获取数据,k近邻法,朴素贝叶斯算法,等等。作者借助大量具体例子以及数据挖掘、统计学、机器学习等领域的重要概念,详细展示了什么是数据科学。书中涵盖的所有代码和数据都可以在GitHub上下载。

4、全面剖析网络数据采集技术——Python网络数据采集

这里写图片描述

作者:Ryan Mitchell

译者:陶俊杰,陈小莉

■ 用简单高效的Python语言,展示网络数据采集常用手段,剖析网络表单安全措施,完成大数据采集任务!

《Python网络数据采集》适合熟悉Python的程序员、安全专业人士、网络管理员阅读。书中不仅介绍了网络数据采集的基本原理,还深入探讨了更高级的主题,比如分析原始数据、用网络爬虫测试网站等。此外,书中还提供了详细的代码示例,以帮助你更好地理解书中的内容。

5、Spark实战指南——《Spark最佳实践》

这里写图片描述

作者:陈欢,林世飞

■ UCloud季昕华、Databricks连城,阿里胡熠,棒米科技武泽胜,腾讯肖磊\靳志辉\徐羽等联袂推荐!

■ 腾讯专家首次分享Spark最佳实践

■ 基于真实数据,用案例分析全面解读大数据应用设计

■ 腾讯资深研发者的Spark实践,揭秘广告和推荐系统核心技术

《Spark最佳实践》全书共分8章。前4章介绍Spark的部署、工作机制和内核,后4章分别通过实战项目介绍Spark SQL、Spark Streaming、Spark GraphX和Spark MLib功能模块。此外,本书详细介绍了常见的实战问题,比如大数据环境下的配置设置、程序调优等。本书附带的一键安装脚本,更能为初学者提供很大帮助。

6、数据清洗入门与实践——《干净的数据》

这里写图片描述

作者:Megan Squire

译者:任政委

■ 掌握高效数据清洗方法,为数据挖掘提供便利,让用户更好地体验大数据价值!

《干净的数据:数据清洗入门与实践》从文件格式、数据类型、字符编码等基本概念讲起,通过真实的示例,探讨如何提取和清洗关系型数据库、网页文件和PDF文档中的数据。最后提供了两个真实的项目,让读者将所有数据清洗技术付诸实践,完成整个数据科学过程。

7、精益系列丛书——《精益数据分析》

这里写图片描述

作者:Alistair Croll,Benjamin Yoskovitz

译者:韩知白,王鹤达

■ 《精益创业》作者埃里克·莱斯主编

《精益数据分析》围绕精益创业展开讨论,融合了精益创业法、客户开发、商业模式画布和敏捷/ 持续集成的精华。本书汇聚了100多位创始人、投资人、内部创业者和创新者的成功创业经验,呈现了30多个极具价值的案例分析,可以为各阶段的创业者提供行为准则。

精益数据分析-pdf

  • 2016年08月22日 14:42
  • 54.13MB
  • 下载

精益数据分析pdf

  • 2017年08月28日 21:28
  • 53.1MB
  • 下载

精益数据分析-阿利斯泰尔·克罗尔.pdf

  • 2017年07月25日 10:09
  • 9.37MB
  • 下载

精益数据分析Lean.Analytics.2013.3.Alistair.Croll.文字版.pdf

  • 2017年07月08日 21:59
  • 11.63MB
  • 下载

《一本书玩转数据分析》

1.数据分析注意事项 (1)分析数据是否完整,有效,真实 (2)数据分析目的是否明确 (3)是否能有效实行数据分析结论 2.数据分析思维 (1)假设:利用假设获得数据结论 (2)对...
  • zlo0o0oo00
  • zlo0o0oo00
  • 2017年01月18日 16:44
  • 408

【资源分享】玩转大数据:深入浅出大数据挖掘技术(Apriori算法、Tanagra工具、决策树)

【资源分享】玩转大数据:深入浅出大数据挖掘技术(Apriori算法、Tanagra工具、决策树) 课程讲师:艾伦 课程分类:.Net 适合人群:中级 课时数量:10课时 更新程度:完毕 服...
  • u013819115
  • u013819115
  • 2015年01月19日 10:40
  • 1183

大数据产品推荐:Stratifyd大数据智能分析平台

1、产品名称 Stratifyd大数据分析平台 2、所属分类 金融科技·智能获客 3、产品介绍 Stratifyd大数据分析平台是Stratifyd大数据团队设计...
  • qq_36852006
  • qq_36852006
  • 2017年09月30日 10:10
  • 316

跳槽必备|给数据分析师转型升级的100G学习资料+40个大数据/AI课程

2017年IT行业与大数据相关的职位需求已经占比70%以上,到明年需求还会更大。就目前而言人才缺失是一个重要板块,高校大数据专业才刚刚兴起,毕业生数量远远小于企业需求量。据了解,在美国的大数据分析师平...
  • Tw6cy6uKyDea86Z
  • Tw6cy6uKyDea86Z
  • 2018年01月16日 00:00
  • 175

大数据实战:用户流量分析系统

本文是结合hadoop中的mapreduce来对用户数据进行分析,统计用户的手机号码、上行流量、下行流量、总流量的信息,同时可以按照总流量大小对用户进行分组排序等。是一个非常简洁易用的hadoop项目...
  • sdksdk0
  • sdksdk0
  • 2016年06月11日 13:14
  • 7193

基于大数据的房价分析

大二自学的是python和java,大三却找了个和前端相关的实习工作,好在不是很忙,工作之余做一些自己以前想做懒得做的东西,复习一下python和java,也能增强自己的工作技能,第一个项目就是基于房...
  • qq_35488769
  • qq_35488769
  • 2017年12月10日 16:48
  • 129
内容举报
返回顶部
收藏助手
不良信息举报
您举报文章:学懂分析,玩转大数据
举报原因:
原因补充:

(最多只允许输入30个字)