# 用Python写网络爬虫（第2版）

> 金屋电子书图书详情的 Markdown 版本。

- 规范页面：https://pdfs.top/book/4b4d13afbdc34460a678d7f2055bfa7d
- Markdown 版本：https://pdfs.top/book/4b4d13afbdc34460a678d7f2055bfa7d.md
- 作者：[德] 凯瑟琳·雅姆尔（Katharine Jarmul），[澳] 理查德·劳森（Richard Lawson）
- ISBN：9787115479679
- 出版社：人民邮电出版社
- 出版日期：2018-07-22
- 语言：中文
- 分类：计算机、Web开发
- 评分：8
- 可用格式：PDF（4.70 MB，212 页）、EPUB（3.50 MB，212 页）
- 更新时间：2026-08-04 12:23:20

## 下载方式

本站不在 Markdown 页面直接提供文件地址。请前往规范页面，点击对应格式的下载按钮完成下载。

### PDF

- 文件格式：PDF
- 文件大小：4.70 MB
- 页数：212 页
- 下载说明：请打开规范页面 https://pdfs.top/book/4b4d13afbdc34460a678d7f2055bfa7d，点击 PDF 的下载按钮完成下载。

### EPUB

- 文件格式：EPUB
- 文件大小：3.50 MB
- 页数：212 页
- 下载说明：请打开规范页面 https://pdfs.top/book/4b4d13afbdc34460a678d7f2055bfa7d，点击 EPUB 的下载按钮完成下载。


## 内容简介

本书包括网络爬虫的定义以及如何爬取网站，如何使用几种库从网页中抽取数据，如何通过缓存结果避免重复下载的问题，如何通过并行下载来加速数据抓取，如何利用不同的方式从动态网站中抽取数据，如何使用叔叔及导航等表达进行搜索和登录，如何访问被验证码图像保护的数据，如何使用 Scrapy 爬虫框架进行快速的并行抓取，以及使用 Portia 的 Web 界面构建网路爬虫。
