[Python3网络爬虫开发实战] 1.8.1-pyspider的安装

Posted Palace_Y

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了[Python3网络爬虫开发实战] 1.8.1-pyspider的安装相关的知识,希望对你有一定的参考价值。

pyspider是国人binux编写的强大的网络爬虫框架,它带有强大的WebUI、脚本编辑器、任务监控器、项目管理器以及结果处理器,同时支持多种数据库后端、多种消息队列,另外还支持JavaScript渲染页面的爬取,使用起来非常方便,本节介绍一下它的安装过程。

1. 相关链接

2. 准备工作

pyspider是支持JavaScript渲染的,而这个过程是依赖于PhantomJS的,所以还需要安装PhantomJS(具体的安装过程详见1.2.5节)。

3. pip安装

这里推荐使用pip安装,命令如下:

 

 

命令执行完毕即可完成安装。

4. 常见错误

Windows下可能会出现这样的错误提示:

 

 

这是PyCurl安装错误,此时需要安装PyCurl库。从http://www.lfd.uci.edu/~gohlke/pythonlibs/#pycurl找到对应的Python版本,然后下载相应的wheel文件即可。比如Windows 64位、Python 3.6,则需要下载pycurl?7.43.0?cp36?cp36m?win_amd64.whl,随后用pip安装即可,命令如下:

 

 

如果在Linux下遇到PyCurl的错误,可以参考本文:https://imlonghao.com/19.html

5. 验证安装

安装完成之后,可以直接在命令行下启动pyspider:

 

 

此时控制台会有类似如图1-74所示的输出。

技术分享图片图1-74 控制台

这时pyspider的Web服务就会在本地5000端口运行。直接在浏览器中打开http://localhost:5000/,即可进入pyspider的WebUI管理页面,如图1-75所示,这证明pyspider已经安装成功了。

技术分享图片图1-75 管理页面

后面,我们会详细介绍pyspider的用法。

以上是关于[Python3网络爬虫开发实战] 1.8.1-pyspider的安装的主要内容,如果未能解决你的问题,请参考以下文章

我的爬虫入门书 —— 《Python3网络爬虫开发实战(第二版)》

Python 3网络爬虫开发实战书籍

《python3网络爬虫开发实战》--模拟登陆

[Python3网络爬虫开发实战] 1.5.1-PyMySQL的安装

[Python3网络爬虫开发实战] 1.8.1-pyspider的安装

《python3网络爬虫开发实战》--基本库的使用