Hadoop权威指南:大数据的存储与分析(第4版)+HBase权威指南+Hive编程指南-so88
Hadoop权威指南:大数据的存储与分析(第4版)+HBase权威指南+Hive编程指南 pdf epub mobi txt 电子书 下载 2022
图书介绍
☆☆☆☆☆
||
店铺: 蓝墨水图书专营店 出版社: 清华大学出版社 ISBN:9787302465133 商品编码:19864790881 出版时间:2017-07-01
套装三册:
HBase权威指南
Hive编程指南
Hadoop权威指南:大数据的存储与分析(第4版)修订版
9787302465133 9787115333834 9787115318893
本书结合理论和实践,由浅入深,全方位介绍了Hadoop这一高性能的海量数据处理和分析平台。全书5部分24章,第Ⅰ部分介绍Hadoop基础知识,主题涉及Hadoop、MapReduce、Hadoop分布式文件系统、YARN、Hadoop的I/O操作。第Ⅱ部分介绍MapReduce,主题包括MapReduce应用开发;MapReduce的工作机制、MapReduce的类型与格式、MapReduce的特性。第Ⅲ部分介绍Hadoop的运维,主题涉及构建Hadoop集群、管理Hadoop。第Ⅳ部分介绍Hadoop相关开源项目,主题涉及Avro、Parquet、Flume、Sqoop、Pig、Hive、Crunch、Spark、HBase、ZooKeeper。第Ⅴ部分提供了三个案例,分别来自医疗卫生信息技术服务商塞纳(Cerner)、微软的人工智能项目ADAM(一种大规模分布式深度学习框架)和开源项目Cascading(一个新的针对MapReduce的数据处理API)。
本书是一本专业、全面的Hadoop参考书和工具书,阐述了Hadoop生态圈的新发展和应用,程序员可以从中探索海量数据集的存储和分析,管理员可以从中了解Hadoop集群的安装和运维。
第Ⅰ部分Hadoop基础知识
第1章初识Hadoop3
1.1数据!数据!3
1.2数据的存储与分析5
1.3查询所有数据6
1.4不仅仅是批处理7
1.5相较于其他系统的优势8
1.6ApacheHadoop发展简史12
1.7本书包含的内容16
第2章关于MapReduce19
2.1气象数据集19
2.2使用Unix工具来分析数据21
2.3使用Hadoop来分析数据22
2.4横向扩展31
2.5HadoopStreaming37
第3章Hadoop分布式文件系统42
3.1HDFS的设计42
3.2HDFS的概念44
3.3命令行接口50
3.4Hadoop文件系统52
3.5Java接口56
3.6数据流68
3.7通过distcp并行复制76
第4章关于YARN78
4.1剖析YARN应用运行机制79
4.2YARN与MapReduce1相比82
4.3YARN中的调度85
电子书下载地址:
相关电子书推荐:
- 文件名
- WL-常见鸟类野外识别手册-郭冬生 重庆大学出版社 9787562428459
- 世界文学名著典藏·全译本:小王子(新版)
- 蝴蝶-第一次发现丛书
- 动物园
- 正版 3D打印 打印未来 中国机械工程学会 9787504663771
- Tableau商业分析从新手到高手+Microsoft Power BI数据可视化
- 贪婪的狐狸-做最棒的自己双语绘本-汉英对照
- 亦舒作品:幸运星(精装典藏版)
- 探秘百科 无限探索版:树的秘密
- Spark内核设计的艺术:架构设计与实现
- BF-科技失控-用科技思维重新看透未来-温德尔·瓦拉赫 萧黎黎 江苏文艺出版社 9787
- 正版L C++ Primer中文版(第5版) (美)李普曼 等 电子工业出版社 97871
- 大脑赋能术
- 雨果文集:九三年(第9卷·小说卷)(最新修订版)
- {RT}海滨自然笔记-在海边发现季节的更迭-[英]赛莉亚·刘易斯,杨红珍 商务印书馆 97