课程目录

1-1 [初识爬虫] 初识爬虫 (47:24)
1-2 [初识爬虫] urllib库介绍请求&保存&编码 (26:48)
2-1 [互联网爬虫常见请求方式及存储] GET请求获取贴吧扣丁学堂内容并保存 (13:34)
2-2 [互联网爬虫常见请求方式及存储] POST请求— 百度翻译接口获取并保存json格式 (20:36)
2-3 [互联网爬虫常见请求方式及存储] 综合案例-批量请求自定义数据并保存到json文件中 (28:02)
3-1 [互联网爬虫数据精准定位方式] 通过正则进行数据提取 (33:15)
3-2 [互联网爬虫数据精准定位方式] 通过xpath语法获取数据 (32:40)
3-3 [互联网爬虫数据精准定位方式] 通过BS4语法获取数据 (10:51)
4-1 [互联网动态获取数据技术-selenium综合使用] selenium基本语法 (38:22)
4-2 [互联网动态获取数据技术-selenium综合使用] 利用selenium语法实现百度一下点击 (11:36)
4-3 [互联网动态获取数据技术-selenium综合使用] selenium+phantomjs模拟点击百度一下 (07:06)
4-4 [互联网动态获取数据技术-selenium综合使用] selenium+headless模拟请求扣丁官网页面操作 (09:31)
5-1 [互联网常用requests技术和反爬手段] request_get请求贴吧数据 (09:33)
5-2 [互联网常用requests技术和反爬手段] request_post请求必应数据 (09:39)
5-3 [互联网常用requests技术和反爬手段] request_session模拟用户登陆 (15:35)
5-4 [互联网常用requests技术和反爬手段] request_代理请求服务器免费和付费方式 (19:32)
5-5 [互联网常用requests技术和反爬手段] 云打码平台-验证码识别SDK封装和服务使用 (13:04)
6-1 [爬虫经典框架scrapy及scrapy-shell使用] 初体会工程化概念引出scrapy(1) (23:00)
6-2 [爬虫经典框架scrapy及scrapy-shell使用] 初体会工程化概念引出scrapy(2) (19:00)
6-3 [爬虫经典框架scrapy及scrapy-shell使用] 初体会工程化概念引出scrapy(3) (10:47)
6-4 [爬虫经典框架scrapy及scrapy-shell使用] scrapy安装及工作原理 (13:21)
6-5 [爬虫经典框架scrapy及scrapy-shell使用] 利用scrapy命令初创建工程 (20:59)
6-6 [爬虫经典框架scrapy及scrapy-shell使用] scrapy工程项目数据爬取 (19:43)
6-7 [爬虫经典框架scrapy及scrapy-shell使用] scrapy-并行爬取数据及日志设置 (44:14)
6-8 [爬虫经典框架scrapy及scrapy-shell使用] scrapy_shell终端调试工具使用 (16:17)
7-1 [scrapy-redis分布式框架] scrapy-redis分布式爬取(干货) (12:20)
7-2 [scrapy-redis分布式框架] 项目--爬取网易云评论并生成词云 (13:32)