怎样使用python爬虫新闻

发布时间：2020-11-12 09:21:57 来源：亿速云阅读：161 作者：小新栏目：编程语言

这篇文章给大家分享的是有关怎样使用python爬虫新闻的内容。小编觉得挺实用的，因此分享给大家做个参考。一起跟随小编过来看看吧。

首先，打开开发者模式，分析网页。

具体做法：按F12，并用ctrl+f对elements进行搜索，关键字为新闻内容的几个字即可。

找到内容文字

利用这个方法，我们很轻松就找到了新闻文字内容的位置，通过分析发现其内容都为p标签下的字符串，并且其class="one-p"，这可以作为定位该内容的唯一特征。

通过以上的分析，我们确定了定位关键信息的方法，接下来就可以编写python程序了：

实例代码：

# -*- coding:utf-8 -*-import requests
 
from bs4 import BeautifulSoup
 
url = "https://new.qq.com/omn/20190704/20190704A0EHMR00.html"r = requests.get(url)
 
rr = r.content
 
bs = BeautifulSoup(rr,"lxml")
 
news_contents = bs.find_all("p",{'class':'one-p'})
 
news_final = ""for i in news_contents:
 
print(i.string)
 
if i.string:
 
news_final = news_final +i.string + "\n"f = open("news_contents.txt",'w')
 
f.write(news_final)
 
f.close()

最终打开保存的文件，里面就是获取的新闻内容了哦~

感谢各位的阅读！关于怎样使用python爬虫新闻就分享到这里了，希望以上内容可以对大家有一定的帮助，让大家可以学到更多知识。如果觉得文章不错，可以把它分享出去让更多的人看到吧！

向AI问一下细节

怎样使用python爬虫新闻

猜你喜欢

最新资讯

相关推荐

相关标签