python中怎么使用XPath爬取小说

发布时间：2021-04-28 14:08:08 来源：亿速云阅读：243 作者：小新栏目：编程语言

这篇文章将为大家详细讲解有关python中怎么使用XPath爬取小说，小编觉得挺实用的，因此分享给大家做个参考，希望大家阅读完这篇文章后可以有所收获。

python的五大特点是什么

python的五大特点：1.简单易学，开发程序时，专注的是解决问题,而不是搞明白语言本身。2.面向对象，与其他主要的语言如C++和Java相比, Python以一种非常强大又简单的方式实现面向对象编程。3.可移植性，Python程序无需修改就可以在各种平台上运行。4.解释性，Python语言写的程序不需要编译成二进制代码,可以直接从源代码运行程序。5.开源，Python是 FLOSS(自由/开放源码软件)之一。

1、说明

xpath是一种在XML文档中搜索信息的语言。

2、过程

获得浏览器中的标题和作者测试。

在谷歌安装xpath插件:

在html中找到book-mid-info:

找到我们想得到小说的名字、作者

即//div[@class='book-mid-info']/h5/a/txt()

3、实例

import requests
from lxml import etree
url="https://www.qidian.com/rank/yuepiao"
headers={'user-agent':'Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/70.0.3538.25 Safari/537.36 Core/1.70.3861.400 QQBrowser/10.7.4313.400'}
#发送请求
resp=requests.get(url,headers)
e=etree.HTML(resp.text) #类型转换，把str转变为class 'lxml.etree._ELement
print(type(e))
names=e.xpath('//div[@class="book-mid-info"]/h5/a/text()')
authors=e.xpath('//p[@class="author"]/a[1]/text()')
print(names)
print(authors)
#名称和作者对应
for name,authors in zip(names,authors):
    print(name,":",authors)

关于“python中怎么使用XPath爬取小说”这篇文章就分享到这里了，希望以上内容可以对大家有一定的帮助，使各位可以学到更多知识，如果觉得文章不错，请把它分享出去让更多的人看到。

向AI问一下细节

python中怎么使用XPath爬取小说

python的五大特点是什么

猜你喜欢

最新资讯

相关推荐

相关标签