网站建设资讯

NEWS

网站建设资讯

怎样使用python爬虫新闻-创新互联

这篇文章给大家分享的是有关怎样使用python爬虫新闻的内容。小编觉得挺实用的,因此分享给大家做个参考。一起跟随小编过来看看吧。

创新互联公司专注于宁夏企业网站建设,响应式网站开发,商城网站定制开发。宁夏网站建设公司,为宁夏等地区提供建站服务。全流程按需求定制制作,专业设计,全程项目跟踪,创新互联公司专业和态度为您提供的服务

首先,打开开发者模式,分析网页。

具体做法:按F12,并用ctrl+f对elements进行搜索,关键字为新闻内容的几个字即可。

找到内容文字

利用这个方法,我们很轻松就找到了新闻文字内容的位置,通过分析发现其内容都为p标签下的字符串,并且其class="one-p",这可以作为定位该内容的特征。

通过以上的分析,我们确定了定位关键信息的方法,接下来就可以编写python程序了:

实例代码:

# -*- coding:utf-8 -*-import requests
 
from bs4 import BeautifulSoup
 
url = "/tupian/20230522/pgv_ref=apub
 
rr = r.content
 
bs = BeautifulSoup(rr,"lxml")
 
news_contents = bs.find_all("p",{'class':'one-p'})
 
news_final = ""for i in news_contents:
 
print(i.string)
 
if i.string:
 
news_final = news_final +i.string + "\n"f = open("news_contents.txt",'w')
 
f.write(news_final)
 
f.close()

最终打开保存的文件,里面就是获取的新闻内容了哦~

感谢各位的阅读!关于怎样使用python爬虫新闻就分享到这里了,希望以上内容可以对大家有一定的帮助,让大家可以学到更多知识。如果觉得文章不错,可以把它分享出去让更多的人看到吧!


文章名称:怎样使用python爬虫新闻-创新互联
链接地址:http://cdweb.net/article/dhihhd.html