用requests库和BeautifulSoup4库爬取新闻列表
Posted 刘己铉
tags:
篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了用requests库和BeautifulSoup4库爬取新闻列表相关的知识,希望对你有一定的参考价值。
1、用requests库和BeautifulSoup4库,爬取校园新闻列表的时间、标题、链接、来源。
import requests from bs4 import BeautifulSoup mt="http://news.gzcc.cn/html/xiaoyuanxinwen/" res=requests.get(mt) res.encoding=\'utf-8\' soup=BeautifulSoup(res.text,"html.parser") for news in soup.select(\'li\'): if len(news.select(\'.news-list-title\'))>0: title=(news.select(\'.news-list-title\')[0].text) url=news.select(\'a\')[0][\'href\'] day=(news.select(\'.news-list-info\')[0].contents[0].text) sorce=(news.select(\'.news-list-info\')[0].contents[1].text) print(day,title,url,sorce)
2、选一个自己感兴趣的主题,做类似的操作,为“爬取网络数据并进行文本分析”做准备。
import requests from bs4 import BeautifulSoup mt="http://gz.meituan.com/shop/2380968" res=requests.get(mt) res.encoding=\'utf-8\' soup=BeautifulSoup(res.text,"html.parser") for news in soup.select(\'li\'): if len(news.select(\'.title\'))>0: titles=(news.select(\'.title\')) print(titles)
以上是关于用requests库和BeautifulSoup4库爬取新闻列表的主要内容,如果未能解决你的问题,请参考以下文章
用requests库和BeautifulSoup4库爬取新闻列表
用requests库和BeautifulSoup4库爬取新闻列表
用requests库和BeautifulSoup4库爬取新闻列表
用requests库和BeautifulSoup4库爬取新闻列表