Hadoop权威指南:大数据的存储与分析(第4版)+HBase权威指南+Hive编程指南-so88
Hadoop权威指南:大数据的存储与分析(第4版)+HBase权威指南+Hive编程指南 pdf epub mobi txt 电子书 下载 2022
图书介绍
☆☆☆☆☆
||
店铺: 蓝墨水图书专营店 出版社: 清华大学出版社 ISBN:9787302465133 商品编码:19864790881 出版时间:2017-07-01
套装三册:
HBase权威指南
Hive编程指南
Hadoop权威指南:大数据的存储与分析(第4版)修订版
9787302465133 9787115333834 9787115318893
本书结合理论和实践,由浅入深,全方位介绍了Hadoop这一高性能的海量数据处理和分析平台。全书5部分24章,第Ⅰ部分介绍Hadoop基础知识,主题涉及Hadoop、MapReduce、Hadoop分布式文件系统、YARN、Hadoop的I/O操作。第Ⅱ部分介绍MapReduce,主题包括MapReduce应用开发;MapReduce的工作机制、MapReduce的类型与格式、MapReduce的特性。第Ⅲ部分介绍Hadoop的运维,主题涉及构建Hadoop集群、管理Hadoop。第Ⅳ部分介绍Hadoop相关开源项目,主题涉及Avro、Parquet、Flume、Sqoop、Pig、Hive、Crunch、Spark、HBase、ZooKeeper。第Ⅴ部分提供了三个案例,分别来自医疗卫生信息技术服务商塞纳(Cerner)、微软的人工智能项目ADAM(一种大规模分布式深度学习框架)和开源项目Cascading(一个新的针对MapReduce的数据处理API)。
本书是一本专业、全面的Hadoop参考书和工具书,阐述了Hadoop生态圈的新发展和应用,程序员可以从中探索海量数据集的存储和分析,管理员可以从中了解Hadoop集群的安装和运维。
第Ⅰ部分Hadoop基础知识
第1章初识Hadoop3
1.1数据!数据!3
1.2数据的存储与分析5
1.3查询所有数据6
1.4不仅仅是批处理7
1.5相较于其他系统的优势8
1.6ApacheHadoop发展简史12
1.7本书包含的内容16
第2章关于MapReduce19
2.1气象数据集19
2.2使用Unix工具来分析数据21
2.3使用Hadoop来分析数据22
2.4横向扩展31
2.5HadoopStreaming37
第3章Hadoop分布式文件系统42
3.1HDFS的设计42
3.2HDFS的概念44
3.3命令行接口50
3.4Hadoop文件系统52
3.5Java接口56
3.6数据流68
3.7通过distcp并行复制76
第4章关于YARN78
4.1剖析YARN应用运行机制79
4.2YARN与MapReduce1相比82
4.3YARN中的调度85
电子书下载地址:
相关电子书推荐:
- 文件名
- 乐高神奇之旅(XX卷)-宇宙飞船、海盗、龙与更多创意搭建 [美]Megan H. Roth
- 美国航运法研究
- 嗨 元素 元素使者和化合物精灵 化学科普书 趣味化学 化学元素化合物基础知识全集 元素之旅 化学科普
- 工伤保险条例(新修订版)
- 《大设计》(霍金全新著作,阐释宇宙问题) 9787535765444 湖南科技出版社
- 中华人民共和国民事诉讼法注释本(全新修订版)
- 视觉天下探索发现丛书:解秘古今悬疑大案
- 国学经典(第3辑 套装共20种)
- 狡猾的发明 绝妙的机器 9787200107487
- 陶渊明诗/民国国学文库
- 全世界孩子都爱做2000个思维游戏
- 中华人民共和国劳动人事法典(注释法典35 新四版)
- 解析动物的凶猛天性(完全典藏版)/探索生物密码
- 书寻法意:法学经典名著导读
- 力学故事 昂热桥惨案