精通Python爬虫框架Scrapy

[美]迪米特里奥斯 考奇斯-劳卡斯

出版时间

2018-01-31

ISBN

9787115474209

评分

★★★★★

标签

计算机

书籍介绍

Scrapy是使用Python开发的一个快速、高层次的屏幕抓取和Web抓取框架,用于抓Web站点并从页面中提取结构化的数据。《精通Python爬虫框架Scrapy》以Scrapy 1.0版本为基础,讲解了Scrapy的基础知识,以及如何使用Python和三方API提取、整理数据,以满足自己的需求。

本书共11章,其内容涵盖了Scrapy基础知识,理解HTML和XPath,安装Scrapy并爬取一个网站,使用爬虫填充数据库并输出到移动应用中,爬虫的强大功能,将爬虫部署到Scrapinghub云服务器,Scrapy的配置与管理,Scrapy编程,管道秘诀,理解Scrapy性能,使用Scrapyd与实时分析进行分布式爬取。本书附录还提供了各种软件的安装与故障排除等内容。

本书适合软件开发人员、数据科学家,以及对自然语言处理和机器学习感兴趣的人阅读。

目录
目录
第 1章 Scrapy简介 1
1.1 初识Scrapy 1
1.2 喜欢Scrapy的更多理由 2
1.3 关于本书:目标和用途 3

显示全部
用户评论
挺有深度的,至少还分析了下Scrapy底层的原理
还好吧
不适合新手,有一定爬虫基础才能看。时隔两年,还是看不懂....
距离上一本技术书籍,这是过去多少年了,真是惭愧。感觉这真是一本好书,由浅入深,轻松愉悦。很快就看完了。此前看文档和网上零碎的文章学 Scrapy,真是痛苦死了,这书是个很好的路径规划。打 4 星,扣分在 5毛 的插图上面…… 补充两句,感觉不要太纠结版本的问题,现在软件版本翻新很快的,不过我看着 1.8 的文档学了半天,回来看这个老版本,没觉得有什么地方老旧过时,核心概念都没变化。如果用的时候,发现不对了,那顺便看看文档,正好当作复习和巩固了。
中间的衔接有点差,不太适合初学者,适合专职爬虫开发者,日常轻量开发中很少用到最后几章的内容
好好的一本书,翻译是真的垃圾。
@2019-03-13 19:01:37
基础要求较高。
下载
收藏