Hadoop权威指南:大数据的存储与分析(第4版)+HBase权威指南+Hive编程指南-so88
Hadoop权威指南:大数据的存储与分析(第4版)+HBase权威指南+Hive编程指南 pdf epub mobi txt 电子书 下载 2022
图书介绍
☆☆☆☆☆
||
店铺: 蓝墨水图书专营店 出版社: 清华大学出版社 ISBN:9787302465133 商品编码:19864790881 出版时间:2017-07-01
套装三册:
HBase权威指南
Hive编程指南
Hadoop权威指南:大数据的存储与分析(第4版)修订版
9787302465133 9787115333834 9787115318893
本书结合理论和实践,由浅入深,全方位介绍了Hadoop这一高性能的海量数据处理和分析平台。全书5部分24章,第Ⅰ部分介绍Hadoop基础知识,主题涉及Hadoop、MapReduce、Hadoop分布式文件系统、YARN、Hadoop的I/O操作。第Ⅱ部分介绍MapReduce,主题包括MapReduce应用开发;MapReduce的工作机制、MapReduce的类型与格式、MapReduce的特性。第Ⅲ部分介绍Hadoop的运维,主题涉及构建Hadoop集群、管理Hadoop。第Ⅳ部分介绍Hadoop相关开源项目,主题涉及Avro、Parquet、Flume、Sqoop、Pig、Hive、Crunch、Spark、HBase、ZooKeeper。第Ⅴ部分提供了三个案例,分别来自医疗卫生信息技术服务商塞纳(Cerner)、微软的人工智能项目ADAM(一种大规模分布式深度学习框架)和开源项目Cascading(一个新的针对MapReduce的数据处理API)。
本书是一本专业、全面的Hadoop参考书和工具书,阐述了Hadoop生态圈的新发展和应用,程序员可以从中探索海量数据集的存储和分析,管理员可以从中了解Hadoop集群的安装和运维。
第Ⅰ部分Hadoop基础知识
第1章初识Hadoop3
1.1数据!数据!3
1.2数据的存储与分析5
1.3查询所有数据6
1.4不仅仅是批处理7
1.5相较于其他系统的优势8
1.6ApacheHadoop发展简史12
1.7本书包含的内容16
第2章关于MapReduce19
2.1气象数据集19
2.2使用Unix工具来分析数据21
2.3使用Hadoop来分析数据22
2.4横向扩展31
2.5HadoopStreaming37
第3章Hadoop分布式文件系统42
3.1HDFS的设计42
3.2HDFS的概念44
3.3命令行接口50
3.4Hadoop文件系统52
3.5Java接口56
3.6数据流68
3.7通过distcp并行复制76
第4章关于YARN78
4.1剖析YARN应用运行机制79
4.2YARN与MapReduce1相比82
4.3YARN中的调度85
电子书下载地址:
相关电子书推荐:
- 文件名
- 如果舌尖能思考 一节生姜著 食品安全科普书 舌尖上的安全科普读物 美食文化书 美食鉴赏品鉴书 百科知
- Z2-美味凉拌菜-华姨 浙江科学技术出版社 9787534159190
- 溯源探幽:熵的世界 冯端,冯少彤
- 转基因生物技术的经济影响——中国Bt抗虫棉10年 科学出版社
- 你一定爱读的科学故事:培养探索精神的理想读本
- 川味家常菜——现代人 大众美食系列 9787501949533
- 地球上的 动植物 黄宇,王元媛
- 农田水利学-(西藏地区适用)
- 硅谷启示录2:怦然心动
- 嘴巴去旅行
- 正版 科学文化工程科学史系列 图说中国古代四大发明:造纸术 9787553628561 汤
- 中华鳖高效养殖致富技术与实例(全国主推高效水产养殖技术丛书)1
- 舌尖上的丁香——中国的外来植物 香料 9787553507026 姚欢远-RT
- 厦门大屿岛白鹭自然保护区 9787502769536
- 九型人格(越简单越实用)