Hadoop权威指南:大数据的存储与分析(第4版)+HBase权威指南+Hive编程指南-so88
Hadoop权威指南:大数据的存储与分析(第4版)+HBase权威指南+Hive编程指南 pdf epub mobi txt 电子书 下载 2022
图书介绍
☆☆☆☆☆
||
店铺: 蓝墨水图书专营店 出版社: 清华大学出版社 ISBN:9787302465133 商品编码:19864790881 出版时间:2017-07-01
套装三册:
HBase权威指南
Hive编程指南
Hadoop权威指南:大数据的存储与分析(第4版)修订版
9787302465133 9787115333834 9787115318893
本书结合理论和实践,由浅入深,全方位介绍了Hadoop这一高性能的海量数据处理和分析平台。全书5部分24章,第Ⅰ部分介绍Hadoop基础知识,主题涉及Hadoop、MapReduce、Hadoop分布式文件系统、YARN、Hadoop的I/O操作。第Ⅱ部分介绍MapReduce,主题包括MapReduce应用开发;MapReduce的工作机制、MapReduce的类型与格式、MapReduce的特性。第Ⅲ部分介绍Hadoop的运维,主题涉及构建Hadoop集群、管理Hadoop。第Ⅳ部分介绍Hadoop相关开源项目,主题涉及Avro、Parquet、Flume、Sqoop、Pig、Hive、Crunch、Spark、HBase、ZooKeeper。第Ⅴ部分提供了三个案例,分别来自医疗卫生信息技术服务商塞纳(Cerner)、微软的人工智能项目ADAM(一种大规模分布式深度学习框架)和开源项目Cascading(一个新的针对MapReduce的数据处理API)。
本书是一本专业、全面的Hadoop参考书和工具书,阐述了Hadoop生态圈的新发展和应用,程序员可以从中探索海量数据集的存储和分析,管理员可以从中了解Hadoop集群的安装和运维。
第Ⅰ部分Hadoop基础知识
第1章初识Hadoop3
1.1数据!数据!3
1.2数据的存储与分析5
1.3查询所有数据6
1.4不仅仅是批处理7
1.5相较于其他系统的优势8
1.6ApacheHadoop发展简史12
1.7本书包含的内容16
第2章关于MapReduce19
2.1气象数据集19
2.2使用Unix工具来分析数据21
2.3使用Hadoop来分析数据22
2.4横向扩展31
2.5HadoopStreaming37
第3章Hadoop分布式文件系统42
3.1HDFS的设计42
3.2HDFS的概念44
3.3命令行接口50
3.4Hadoop文件系统52
3.5Java接口56
3.6数据流68
3.7通过distcp并行复制76
第4章关于YARN78
4.1剖析YARN应用运行机制79
4.2YARN与MapReduce1相比82
4.3YARN中的调度85
电子书下载地址:
相关电子书推荐:
- 文件名
- 奥秘探索 世界奇闻怪事
- 现代信息材料导论 吕银祥 等 9787562824350
- 气的传奇
- 礼乐的风景 城市文明演变下的宋代公共园林/建筑意匠与历史中国书系
- 他们应当行走:美国往事之小儿麻痹症 9787302393900 [美]戴维M. 奥辛斯基(
- 非线性编辑:Adobe Premiere pro CS4 中文版标准教程
- 高斯和太阳系中的行星 9787544077323
- 实时数字信号处理——实践方法与应用(第2版)(配光盘) (美)郭森楙,梁维谦 978730
- 一步学科学:显微镜下的怪物 9787542757647
- 电子线路
- 传统文化中的科学-二十四节气
- 基于OPNET的通信网仿真
- 图解机器的奥秘——机器是怎样工作的 正版图书
- 深藏记忆遗产中的圆明园:样式房图档4
- 科学探索系列 大自然的礼物 关于空气和水的科学之旅 (法)勒内·莫罗著;王晓东