全新正版现货,以书名为准,放心购买,购书咨询18515909251朱老师
¥ 44.03 4.5折 ¥ 97 全新
库存100件
作者刘俊修,王丹,陈冬主编
出版社电子科技大学出版社
ISBN9787577019376
出版时间2026-03
装帧平装
开本24cm
定价97元
货号200080584
上书时间2026-08-25
第1章 走进大数据
1.1 大数据概述
1.2 大数据技术发展史
1.3 大数据处理技术基础:分布式计算
1.4 大数据处理技术基础:数据库技术
1.5 大数据的下一次变革:数据湖
1.6 小结
第2章 Hadoop
2.1 Hadoop概述
2.2 HDFS基本组成和原理
2.3 HDFS的高可用架构
2.4 Hadoop运维实践
2.5 小结
第3章 MapReduce
3.1 MapReduce概述
3.2 MapReduce v1编程模型
3.3 MapReduce v1计算框架
3.4 MapReduce容错机制
3.5 YARN资源调度
3.6 MapReduce程序开发实践
3.7 小结
第4章 HBase
4.1 HBase概述
4.2 HBase逻辑视图和物理视图
4.3 HBase架构原理
4.4 HBase应用实践
4.5 小结
第5章 Hive
5.1 Hive概述
5.2 Hive基本原理
5.3 HiveQL基础
5.4 Hive on Spark架构
5.5 Hive实践
5.6 小结
第6章 大数据常用工具
6.1 数据采集和ETL
6.2 常用工具介绍
6.3 常用工具使用实践
6.4 小结
第7章 Spark核心
7.1 Spark概述
7.2 RDD编程基础
7.3 Spark任务调度原理
7.4 Spark内存管理
7.5 Spark基础实践
7.6 小结
第8章 Spark SQL
8.1 Spark SQL概述
8.2 Spark SQL优化引擎
8.3 DataFrame编程基础
8.4 Spark SQL实践
8.5 小结
第9章 Spark流处理基础
9.1 Spark Streaming概述
9.2 Structured Streaming概述
9.3 Structured Streaming计算模型
9.4 流处理关键技术
9.5 Structured Streaming实践
9.6 小结
第10章 Flink
10.1 Flink概述
10.2 Flink Core编程基础
10.3 Flink核心算子
10.4 Flink实践
10.5 小结
本书依据大数据行业主流技术及应用实践编写,在内容上较全面地覆盖了大数据开发与运维的各方面。本书共分10章,分为5个部分:第1部分(第1章)介绍大数据基础知识,发展历史和行业新动态;第2部分(第2-4章)介绍了经典的Hadoop大数据生态,大数据计算框架核心设计思想;第3部分(第5-6章)介绍了经典的批处理技术和常用大数据工具使用;第4部分(第7-9章)介绍了大数据行业使用最广泛的计算引擎-Spark及应用最佳实践;第5部分(第10章)介绍了新一代大数据计算引擎-Flink及其应用。本书理论结合实践,是较为系统的大数据教材,致力于为高职高专培养更多的具有大数据背景的老师。本书既可作为高职高专大数据师资的培训教材,也可作为高职高专大数据及计算机相关专业教材,同时也可供对大数据开发与运维感兴趣的自学者阅读使用。
以下为对购买帮助不大的评价