<Python爬虫>爬取豆瓣图书/豆瓣电影系列

DouBan Crawler Series

代码托管在Github -> DouBanCrawls

完成豆瓣读书/电影相关的爬取,豆瓣电影爬虫(DouBanMovie)使用了简单的多线程极大地提高了爬虫效率,可与原始版本的读书爬虫(DouBanReading)相比较,更多信息待加入补充。

豆瓣图书爬虫 [Python 3.6.1]

爬取结果在Result_Book文件夹,可直接查看

实现功能:
  • 按标签名称进行相关图书信息的抓取,排序后存入本地excel,可自行进行进一步筛选,按Tag存取在不同的Sheet
  • 使用User Agent伪装成不同的浏览器进行爬取,并加入随机延时来更好的模仿浏览器行为,避免爬虫被封
豆瓣页面截图:

Page

运行时截图:

Running

Excel结果截图:
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值