团队-张文然-需求分析-python爬虫分类爬取豆瓣电影信息

Posted 2020-10-05

tags:

篇首语：本文由小常识网(cha138.com)小编为大家整理，主要介绍了团队-张文然-需求分析-python爬虫分类爬取豆瓣电影信息相关的知识，希望对你有一定的参考价值。

首先要明白爬网页实际上就是：
找到包含我们需要的信息的网址（URL）列表
通过 HTTP 协议把页面下载回来
从页面的 HTML 中解析出需要的信息
找到更多这个的 URL，回到 2 继续
其次还要明白：
一个好的列表应该：
包含足够多的电影的 URL
通过翻页，可以遍历到所有的电影
一个按照更新时间排序的列表，可以更快抓到最新更新的电影
最后模拟过程知道豆瓣网站不能一次性爬取所有信息，只能分类爬取
使用工具pyspider
分析完成实现代码，测试模拟运行，按照时间列表爬取每类最新电影资讯

代码分解，便于加入团队后组员理解代码

团队成员：张文然，张宸

以上是关于团队-张文然-需求分析-python爬虫分类爬取豆瓣电影信息的主要内容，如果未能解决你的问题，请参考以下文章

Forward团队-爬虫豆瓣top250项目-需求分析

《团队-爬取豆瓣电影TOP250-需求分析》