用requests库和BeautifulSoup4库爬取新闻列表

Posted 刘己铉

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了用requests库和BeautifulSoup4库爬取新闻列表相关的知识,希望对你有一定的参考价值。

1、用requests库和BeautifulSoup4库,爬取校园新闻列表的时间、标题、链接、来源。

 
 
import requests
from bs4 import BeautifulSoup

mt="http://news.gzcc.cn/html/xiaoyuanxinwen/"
res=requests.get(mt)
res.encoding=\'utf-8\'
soup=BeautifulSoup(res.text,"html.parser")

for news in soup.select(\'li\'):
    if len(news.select(\'.news-list-title\'))>0:
        title=(news.select(\'.news-list-title\')[0].text)
        url=news.select(\'a\')[0][\'href\']
        day=(news.select(\'.news-list-info\')[0].contents[0].text)
        sorce=(news.select(\'.news-list-info\')[0].contents[1].text)
        print(day,title,url,sorce)
 
 

 

2、选一个自己感兴趣的主题,做类似的操作,为“爬取网络数据并进行文本分析”做准备。

 
 
import requests
from bs4 import BeautifulSoup

mt="http://gz.meituan.com/shop/2380968"
res=requests.get(mt)
res.encoding=\'utf-8\'
soup=BeautifulSoup(res.text,"html.parser")

for news in soup.select(\'li\'):
    if len(news.select(\'.title\'))>0:
        titles=(news.select(\'.title\'))
     
        print(titles)
 
 

以上是关于用requests库和BeautifulSoup4库爬取新闻列表的主要内容,如果未能解决你的问题,请参考以下文章

用requests库和BeautifulSoup4库爬取新闻列表

用requests库和BeautifulSoup4库爬取新闻列表

用requests库和BeautifulSoup4库爬取新闻列表

用requests库和BeautifulSoup4库爬取新闻列表

用requests库和BeautifulSoup4库爬取新闻列表

用requests库和BeautifulSoup4库爬取新闻列表