Python_爬虫_爬取网络图片信息01
Posted 橘子Jane
tags:
篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了Python_爬虫_爬取网络图片信息01相关的知识,希望对你有一定的参考价值。
源代码:
import requests
path = "D:abc.jpg" #用或/(老师用的)存疑
r.encoding = r.apparent_encoding
kv = {‘user-agent‘:‘Mozilla/5.0‘}
url = "见列表"
r = requests.get(url,headers = kv)
r.status_code
url地址及状态码
编号 | url地址 | 状态码 |
1 | https://img9.doubanio.com/view/photo/raw/public/p2550336184.jpg | 403 |
2 | http://www.ngchina.com.cn/photography/photo_of_the_day/6324.html### | 200 |
3 | https://movie.douban.com/celebrity/1330012/photos/ | 200 |
4 | https://movie.douban.com/celebrity/1330012/photo/2550336184/ | 200 |
我感觉这个状态码可能是HTTP的状态码,所以百度了一下找到了这篇详细介绍HTTP状态码的文章——https://blog.csdn.net/yumon321/article/details/78597481
403是服务器拒绝请求,服务器为什么拒绝请求呢?网上没查到啥玩意,我自己尝试了把headers设置成Mozilla/5.0,也没有用。所以我怀疑是网页的问题。
以上是关于Python_爬虫_爬取网络图片信息01的主要内容,如果未能解决你的问题,请参考以下文章