爬取校花网大学校花代码
Posted zuihoudebieli
tags:
篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了爬取校花网大学校花代码相关的知识,希望对你有一定的参考价值。
import re
import os
import requests
count = 0
for i in range(10):
url = f"http://www.xiaohuar.com/list-1-count.html"
response = requests.get(url)
data = response.text
result_list = re.findall('src="(.*?)" /></a>',data)
# print(type(result_list))
for result in result_list:
# print(result,type(result))
if not result.startswith('http'): # 取出
res = f"http://www.xiaohuar.com/result" # 拼接图片网址
print(res) # 打印拼接好的图片路径
img_response = requests.get(res) # 获取图片
img_name = res.split('/')[-1] # 文件名字
img_data = img_response.content #将图片转化为二进制
BASE_PATH = os.path.dirname(__file__)
img_path = os.path.join(BASE_PATH,'datas',f'img_name')
with open(img_path,'ab') as fw:
fw.write(img_data)
fw.flush()
count += 1
print(f'爬取了count页')
"""
http://www.xiaohuar.com/hua/
http://www.xiaohuar.com/list-1-1.html
http://www.xiaohuar.com/list-1-0.html
http://www.xiaohuar.com/list-1-1.html
http://www.xiaohuar.com/list-1-2.html
src="/d/file/20190726/small6880259bcb61b80ce246e497a448185c1564117785.jpg"
"""
以上是关于爬取校花网大学校花代码的主要内容,如果未能解决你的问题,请参考以下文章
最网最全python框架--scrapy(体系学习,爬取全站校花图片),学完显著提高爬虫能力(附源代码),突破各种反爬