本书从零开始,循序渐进地介绍了目前最流行的网络爬虫框架Scrapy。即使你没有任何编程基础,阅读本书也不会有压力。另外,本书在讲解过程中以案例为导向,通过对案例的不断迭代、优化,让读者加深对知识的理解,并通过13 个项目案例,提高读者解决实际问题的能力。 本书共13 章。其中,第1~4 章为基础篇,介绍了Python基础、网络爬虫基础、Scrapy 框架及基本的爬虫功能。第5~10 章为进阶篇,介绍了如何将爬虫数据存储于MySQL、MongoDB和Redis数据库中;如何实现异步的AJAX 数据的爬取;如何使用Selenium 和Splash 实现动态网站的爬取;如何实现模拟登录功能;如何突破反爬虫技术,以及如何实现文件和图片的下载。第11~13 章为高级篇,介绍了使用Scrapy-Redis 实现分布式爬虫;使用Scrapyd 和Docker 部署分布式爬虫;使用Gerapy 管理分布式爬虫,并实现了一个抢票软件的综合项目。 本书适合爬虫初学者、爬虫爱好者及高校相关专业的学生,也适合数据爬虫工程师作为参考读物,同时也适合各大院校和培训机构作为教材使用。