最新操作

Posted 095罗冠达

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了最新操作相关的知识,希望对你有一定的参考价值。

1. 用requests库和BeautifulSoup库,爬取校园新闻首页新闻的标题、链接、正文。

import requests
from bs4 import BeautifulSoup

url="http://news.gzcc.cn/html/xiaoyuanxinwen/"
res=requests.get(url)
res.encoding="utf-8"

soup=BeautifulSoup(res.text,html.parser)
# for news in soup.select(‘li‘):
#     if len(news.select(‘.news-list-title‘)) >0:
#         print(news.select(‘.news-list-title‘))


for newc in soup.select(li):
    if len(newc.select(.news-list-title))>0:
d=newc.select(‘a‘)[0].attrs[‘href‘]
res1=requests.get(d)
res1.encoding="utf-8"
e=BeautifulSoup(res1.text,‘html.parser‘)
content=e.select(‘#content‘)[0].text
show=e.select(‘.show-info‘)[0].text
print(content,show)

 

2. 分析字符串,获取每篇新闻的发布时间,作者,来源,摄影。

 

3. 将其中的发布时间由str转换成datetime类型。

以上是关于最新操作的主要内容,如果未能解决你的问题,请参考以下文章

VSCode自定义代码片段——git命令操作一个完整流程

VSCode自定义代码片段15——git命令操作一个完整流程

VSCode自定义代码片段15——git命令操作一个完整流程

如何使用模块化代码片段中的LeakCanary检测内存泄漏?

VSCode 如何操作用户自定义代码片段(快捷键)

代码片段 - Golang 实现集合操作