[Python3网络爬虫开发实战] 1.3.1-lxml的安装
Posted Palace_Y
tags:
篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了[Python3网络爬虫开发实战] 1.3.1-lxml的安装相关的知识,希望对你有一定的参考价值。
lxml是Python的一个解析库,支持HTML和XML的解析,支持XPath解析方式,而且解析效率非常高。本节中,我们了解一下lxml的安装方式,这主要从Windows、Linux和Mac三大平台来介绍。
1. 相关链接
- 官方网站:http://lxml.de
- GitHub:https://github.com/lxml/lxml
- PyPI:https://pypi.python.org/pypi/lxml
2. Windows下的安装
在Windows下,可以先尝试利用pip安装,此时直接执行如下命令即可:
1
|
pip3 install lxml
|
如果没有任何报错,则证明安装成功。
如果出现报错,比如提示缺少libxml2库等信息,可以采用wheel方式安装。
推荐直接到这里(链接为:http://www.lfd.uci.edu/~gohlke/pythonlibs/#lxml)下载对应的wheel文件,找到本地安装Python版本和系统对应的lxml版本,例如Windows 64位、Python 3.6,就选择lxml?3.8.0?cp36?cp36m?win_amd64.whl,将其下载到本地。
然后利用pip安装即可,命令如下:
1
|
pip3 install lxml?3.8.0?cp36?cp36m?win_amd64.whl
|
这样我们就可以成功安装lxml了。
3. Linux下的安装
在Linux平台下安装问题不大,同样可以先尝试pip安装,命令如下:
1
|
pip3 install lxml
|
如果报错,可以尝试下面的解决方案。
CentOS、Red Hat
对于此类系统,报错主要是因为缺少必要的库。
执行如下命令安装所需的库即可:
1
2
|
sudo yum groupinstall -y development tools
sudo yum install -y epel-release libxslt-devel libxml2-devel openssl-devel
|
主要是libxslt-devel和libxml2-devel这两个库,lxml依赖它们。安装好之后,重新尝试pip安装即可。
Ubuntu、Debian和Deepin
在这些系统下,报错的原因同样可能是缺少了必要的类库,执行如下命令安装:
1
|
sudo apt-get install -y python3-dev build-essential libssl-dev libffi-dev libxml2 libxml2-dev libxslt1-dev zlib1g-dev
|
安装好之后,重新尝试pip安装即可。
4. Mac下的安装
在Mac平台下,仍然可以首先尝试pip安装,命令如下:
1
|
pip3 install lxml
|
如果产生错误,可以执行如下命令将必要的类库安装:
1
|
xcode-select --install
|
之后再重新尝试pip安装,就没有问题了。
lxml是一个非常重要的库,后面的Beautiful Soup、Scrapy框架都需要用到此库,所以请一定安装成功。
5. 验证安装
安装完成之后,可以在Python命令行下测试:
1
2
|
$ python3
>>> import lxml
|
如果没有错误报出,则证明库已经安装好了。
以上是关于[Python3网络爬虫开发实战] 1.3.1-lxml的安装的主要内容,如果未能解决你的问题,请参考以下文章
我的爬虫入门书 —— 《Python3网络爬虫开发实战(第二版)》
[Python3网络爬虫开发实战] 1.5.1-PyMySQL的安装