Python网络爬虫权威指南(第2版)读书介绍
类别 | 页数 | 译者 | 网友评分 | 年代 | 出版社 |
---|---|---|---|---|---|
书籍 | 260页 | 7.5 | 2019 | 人民邮电出版社 |
定价 | 出版日期 | 最近访问 | 访问指数 |
---|---|---|---|
79.00元 | 2019-04-01 … | 2020-03-08 … | 52 |
主题/类型/题材/标签
爬虫,Python,编程,python,再版,计算机,計算機,网络生活,
作者
[美] 瑞安 • 米切尔 ISBN:9787115509260 原作名/别名:《》
内容和作者简介
Python网络爬虫权威指南(第2版)摘要
本书采用简洁强大的Python语言,全面介绍网页抓取技术,解答诸多常见问题,是掌握从数据爬取到数据清洗全流程的系统实践指南。书中内容分为两部分。第一部分深入讲解网页抓取的基础知识,重点介绍BeautifulSoup、Scrapy等Python库的应用。第二部分介绍网络爬虫编写相关的主题,以及各种数据抓取工具和应用程序,帮你深入互联网的每个角落,分析原始数据,获取数据背后的故事,轻松解决遇到的各类网页抓取问题。第2版全面更新,新增网络爬虫模型、Scrapy和并行网页抓取相关章节。
- 解析复杂的HTML页面
- 使用Scrapy框架开发爬虫
- 学习存储数据的方法
- 从文档中读取和提取数据
- 清洗格式糟糕的数据
- 自然语言处理
- 通过表单和登录窗口抓取数据
- 抓取JavaScript及利用API抓取数据
- 图像识别与文字处理
- 避免抓取陷阱和反爬虫策略
- 使用爬虫测试网站
作者简介瑞安·米切尔(Ryan Mitchell)
数据科学家、软件工程师,有丰富的网络爬虫和数据分析实战经验,目前就职于美国格理集团,经常为网页数据采集项目提供咨询服务,并在美国东北大学和美国欧林工程学院任教。
本书后续版本
未发行或暂未收录
喜欢读〖Python网络爬虫权威指南(第2版)〗的人也喜欢:
友情提示
剧情呢,免费看分享剧情、挑选影视作品、精选好书简介分享。