Scrapy是使用Python開發的一個快速、高層次的屏幕抓取和Web抓取框架,用於抓Web站點並從頁麵中提取結構化的數據。《精通Python爬蟲框架Scrapy》以Scrapy 1.0版本為基礎,講解瞭Scrapy的基礎知識,以及如何使用Python和三方API提取、整理數據,以滿足自己的需求。
本書共11章,其內容涵蓋瞭Scrapy基礎知識,理解HTML和XPath,安裝Scrapy並爬取一個網站,使用爬蟲填充數據庫並輸齣到移動應用中,爬蟲的強大功能,將爬蟲部署到Scrapinghub雲服務器,Scrapy的配置與管理,Scrapy編程,管道秘訣,理解Scrapy性能,使用Scrapyd與實時分析進行分布式爬取。本書附錄還提供瞭各種軟件的安裝與故障排除等內容。
本書適閤軟件開發人員、數據科學傢,以及對自然語言處理和機器學習感興趣的人閱讀。
##这本书总体来说还不错,xpath基础讲的蛮不错的。整个逻辑思路还是蛮清晰,但是有一点特别蛋疼,就是版本太久,有些东西都不能用了。比如第三章中的urljoin()现在属于urllib库中的一个方法,MapCompose(unicode.strip)方法已经不能使用。我就我就粗略地将后面给看了一遍,后面难度有点大。发现不怎么适合用来入门scrapy框架。不过里面的知识点也属于干货,学到不少新东西。总体来说当做一本读物还是不错了,如果想依靠这本书学习scrapy框架的话,可能会有点遗憾。
评分##第 8 章 Twisted 编程、接口图、第 9 章非阻塞 pipeline,第 10 章 scrapy 性能分析,这些比较有价值,其他一般。第4章、第6章都是软广。
评分##第 8 章 Twisted 编程、接口图、第 9 章非阻塞 pipeline,第 10 章 scrapy 性能分析,这些比较有价值,其他一般。第4章、第6章都是软广。
评分##这本书总体来说还不错,xpath基础讲的蛮不错的。整个逻辑思路还是蛮清晰,但是有一点特别蛋疼,就是版本太久,有些东西都不能用了。比如第三章中的urljoin()现在属于urllib库中的一个方法,MapCompose(unicode.strip)方法已经不能使用。我就我就粗略地将后面给看了一遍,后面难度有点大。发现不怎么适合用来入门scrapy框架。不过里面的知识点也属于干货,学到不少新东西。总体来说当做一本读物还是不错了,如果想依靠这本书学习scrapy框架的话,可能会有点遗憾。
评分##这本书总体来说还不错,xpath基础讲的蛮不错的。整个逻辑思路还是蛮清晰,但是有一点特别蛋疼,就是版本太久,有些东西都不能用了。比如第三章中的urljoin()现在属于urllib库中的一个方法,MapCompose(unicode.strip)方法已经不能使用。我就我就粗略地将后面给看了一遍,后面难度有点大。发现不怎么适合用来入门scrapy框架。不过里面的知识点也属于干货,学到不少新东西。总体来说当做一本读物还是不错了,如果想依靠这本书学习scrapy框架的话,可能会有点遗憾。
评分##作者的水平还是很高的。不过不太适合初学者,比较适合进阶的读者
评分##基础要求较高。
评分##还算实用,最后几章twisted和性能解释太难啦
评分##挺有深度的,至少还分析了下Scrapy底层的原理
本站所有內容均為互聯網搜索引擎提供的公開搜索信息,本站不存儲任何數據與內容,任何內容與數據均與本站無關,如有需要請聯繫相關搜索引擎包括但不限於百度,google,bing,sogou 等
© 2026 tushu.tinynews.org All Rights Reserved. 求知書站 版权所有