图片爬取和思路分析

Posted 纯情

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了图片爬取和思路分析相关的知识,希望对你有一定的参考价值。

//我先准备一个记事本准备页面网址

s=页数

q=搜索值

//爬取相对的网页数据

//找到图片的网址在源代码中ctrl+f 找到TB1xjf5dFhM8kjiszfwxxcib的代码复制用正则精准爬取

//遍历结果

import urllib.request
import re
suo="夹克男"
key=urllib.request.quote(suo)
for i in range(0,1):
url="http://s.taobao.com/list?spm=a21bo.2017.201867-links-0.5.5af911d9M4bXRK&q="+str(key)+"&cat=16&style=grid&seller_type=taobao&bcoffset=12&s="+str(i*60)
jie=urllib.request.urlopen(url).read().decode("utf-8","ignore")
string=\'"pic_url":"//(.*?)"\'
go=re.compile(string).findall(str(jie))
for j in range(len(go)):
temg=go[i]
temg1="http://"+temg
dom="D:/image/"+str(i)+str(j)+".jpg"
urllib.request.urlretrieve(temg1,filename=dom)

以上是关于图片爬取和思路分析的主要内容,如果未能解决你的问题,请参考以下文章

实例4:网络图片的爬取和存储

验证码的爬取和识别详解

验证码的爬取和识别详解

爬虫基础:验证码的爬取和识别详解

用python脚本爬取和解析指定页面的数据

.去重url,爬取和去重分离