# 大数据处理框架Apache Spark设计与实现

> 金屋电子书图书详情的 Markdown 版本。

- 规范页面：https://pdfs.top/book/59t0b
- Markdown 版本：https://pdfs.top/book/59t0b.md
- 作者：许利杰
- ISBN：9787121391712
- 出版日期：2020-01-01
- 语言：中文
- 分类：计算机、数据科学与大数据
- 评分：9.1
- 可用格式：PDF+EPUB（42.81 MB，276 页）
- 更新时间：2026-08-04 12:23:20

## 下载方式

本站不在 Markdown 页面直接提供文件地址。请前往规范页面，点击对应格式的下载按钮完成下载。

### PDF+EPUB

- 文件格式：PDF+EPUB
- 文件大小：42.81 MB
- 页数：276 页
- 下载说明：请打开规范页面 https://pdfs.top/book/59t0b，点击 PDF+EPUB 的下载按钮完成下载。


## 内容简介

近年来，以Apache Spark为代表的大数据处理框架在学术界和工业界得到了广泛的使用。《大数据处理框架Apache Spark设计与实现》以Apache Spark框架为核心，总结了大数据处理框架的基础知识、核心理论、典型的Spark应用，以及相关的性能和可靠性问题。

本书分9章，主要包含四部分内容。

- 第一部分 大数据处理框架的基础知识（第1～2章）：介绍大数据处理框架的基本概念、系统架构、编程模型、相关的研究工作，并以一个典型的Spark应用为例概述Spark应用的执行流程。

- 第二部分 Spark大数据处理框架的核心理论（第3～4章）：介绍Spark框架将应用程序转化为逻辑处理流程，进而转化为可并行执行的物理执行计划的一般过程及方法。

- 第三部分 典型的Spark应用（第5章）：介绍迭代型的Spark机器学习应用和图计算应用。

- 第四部分 大数据处理框架性能和可靠性保障机制（第6～9章）：介绍Spark框架的Shuffle机制、数据缓存机制、错误容忍机制、内存管理机制等。
