爬取校花网大学校花代码

Posted zuihoudebieli

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了爬取校花网大学校花代码相关的知识,希望对你有一定的参考价值。

import re
import os
import requests
count = 0
for i in range(10):
url = f"http://www.xiaohuar.com/list-1-count.html"
response = requests.get(url)
data = response.text

result_list = re.findall('src="(.*?)" /></a>',data)
# print(type(result_list))

for result in result_list:
    # print(result,type(result))
    if not result.startswith('http'): # 取出
        res = f"http://www.xiaohuar.com/result"  # 拼接图片网址
        print(res)  # 打印拼接好的图片路径
        img_response = requests.get(res)  # 获取图片
        img_name = res.split('/')[-1]  # 文件名字
        img_data = img_response.content  #将图片转化为二进制

        BASE_PATH = os.path.dirname(__file__)
        img_path = os.path.join(BASE_PATH,'datas',f'img_name')

        with open(img_path,'ab') as fw:
            fw.write(img_data)
            fw.flush()

count += 1
print(f'爬取了count页')

"""

http://www.xiaohuar.com/hua/
http://www.xiaohuar.com/list-1-1.html
http://www.xiaohuar.com/list-1-0.html
http://www.xiaohuar.com/list-1-1.html
http://www.xiaohuar.com/list-1-2.html

src="/d/file/20190726/small6880259bcb61b80ce246e497a448185c1564117785.jpg"

"""

以上是关于爬取校花网大学校花代码的主要内容,如果未能解决你的问题,请参考以下文章

爬虫----爬取校花网视频

最网最全python框架--scrapy(体系学习,爬取全站校花图片),学完显著提高爬虫能力(附源代码),突破各种反爬

爬虫练习3 爬取堆糖网校花照片

轻松入门Python爬虫,三个爬虫版本,带你以各种方式爬取校花网

Scrapy爬取照片

爬虫网页解析之css用法及实战爬取中国校花网