python实现简单爬虫--爬图片

Posted

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了python实现简单爬虫--爬图片相关的知识,希望对你有一定的参考价值。

首先有两个功能需求:

第一:获取到要爬的页面html内容;

第二:使用正则表达式进行匹配并进行保存到本地。

#!/usr/bin/env python
#encoding:utf-8
import urllib
import re
def getHtml(url):
    ‘‘‘获取到url的html内容‘‘‘
    page = urllib.urlopen(url)
    html = page.read()
    return html
html1 = getHtml(‘http://image.baidu.com/search/index?tn=baiduimage&ct=201326592&lm=-1&cl=2&ie=gbk&word=%C3%C0%C5%AE&ala=1&fr=ala&alatpl=cover&pos=0‘)
# print html1
# print re.findall(r‘"objURL":"(.+?\.jpg)"‘,html1)
def downloadImg(html1):
    ‘‘‘下载页面里的jpg图片‘‘‘
    reg = r‘"objURL":"(.+?\.jpg)"‘
    #预编译正则表达式提高运行速度
    imgreg = re.compile(reg)
    urllist = re.findall(imgreg,html1)
    num = 0
    #for循环遍历下载每个图片
    for i in urllist:
        urllib.urlretrieve(i,‘%s.jpg‘ % num)
        num+=1
downloadImg(html1)


本文出自 “song” 博客,请务必保留此出处http://song1230.blog.51cto.com/5595296/1882753

以上是关于python实现简单爬虫--爬图片的主要内容,如果未能解决你的问题,请参考以下文章

Python练习册 第 0013 题: 用 Python 写一个爬图片的程序,爬 这个链接里的日本妹子图片 :-),(http://tieba.baidu.com/p/2166231880)(代码片段

Python最简单的图片爬虫,20行代码带你爬遍整个网站

Python爬虫 自动爬取图片并保存

Python学习 —— 实现简单爬虫

Python简单爬取图片实例

Python爬虫--简单爬取图片