e.xpath('//tr[@class="item"]/td[2]/div[1]/a/text()如果按标签没有值给一个空字符串

可以使用以下代码来实现： ``` result = e.xpath('//tr[@class="item"]/td[2]/div[1]/a/text()') if not result: result = [''] ``` 这里先将xpath查询结果赋值给`result`变量，然后通过判断`result`是否为空来决定是否将一个空字符串添加到`result`中。这样通过`result[0]`就可以获取到最终的结果，即如果原xpath查询结果为空，则为一个空字符串。

def parse(self, response): res = Selector(response) items = RenrenchesipderItem() items['id'] = res.xpath('//div[@class="detail-wrapper"]/@data-encrypt-id').extract()[0] # 标题 items['title'] = res.xpath('//div[@class="title"]/h1/text()').extract()[0] # 客户出价 items['price'] = res.xpath('//div[@class="middle-content"]/div/p[2]/text()').extract()[0] # 市场价 items['new_car_price'] = res.xpath('//div[@class="middle-content"]/div/div[1]/span/text()').extract()[0] # 首付款 down_payment = res.xpath('//div[@class="list"]/p[@class="money detail-title-right-tagP"]/text()') # 月供 monthly_payment = res.xpath('//[@id="basic"]/div[2]/div[2]/div[1]/div[3]/div[2]/p[5]/text()') # 判断是否可以分期购买 if down_payment and monthly_payment: items['staging_info'] = [down_payment.extract()[0], monthly_payment.extract()[0]] # 服务费 items['service_fee'] = res.xpath('///div[1]/p[2]/strong/text()').extract()[0] # 服务项 items['service'] = res.xpath('//[@id="js-box-service"]/table/tr/td/table/tr/td/text()').extract() # 车辆上牌时间里程外迁信息 items['info'] = res.xpath('///div[2]/div[2]/div[1]/div[4]/ul/li/div/p/strong/text()').extract() # 车辆排量 items['displacement'] = \ res.xpath('//[@id="basic"]/div[2]/div[2]/div[1]/div[4]/ul/li[4]/div/strong/text()').extract()[0] # 车辆上牌城市 items['registration_city'] = res.xpath('///@licensed-city').extract()[0] # 车源号 items['options'] = \ res.xpath('//*[@id="basic"]/div[2]/div[2]/div[1]/div[5]/p/text()').extract()[0].strip().split("：")[1] # 判断是都有图片 if res.xpath('//div[@class="info-recommend"]/div/img/@src'): # 车辆图片 items['car_img'] = res.xpath('//div[@class="info-recommend"]/div/img/@src').extract()[0] # 车辆所在城市 items['city'] = res.xpath('//div[@rrc-event-scope="city"]/a[@class="choose-city"]/text()').extract()[0].strip() # 车辆颜色 items['color'] = res.xpath('//div[@class="card-table"]/table/tr/td[2]/text()').extract()[0] 解释一下每一句话

这是一个 Python 的 scrapy 爬虫程序中的一个解析函数，主要作用是从网页中提取出需要的数据并存储到 items 中。具体解释如下： ```python def parse(self, response): res = Selector(response) # 使用 scrapy 的 Selector 对象解析 response items = RenrenchesipderItem() # 定义一个 items 对象用于存储数据 # 从网页中提取出 id、标题、客户出价、市场价、首付款、月供、服务费、服务项、车辆上牌时间、里程、外迁信息、车辆排量、车辆上牌城市、车源号、车辆颜色等数据 items['id'] = res.xpath('//div[@class="detail-wrapper"]/@data-encrypt-id').extract()[0] items['title'] = res.xpath('//div[@class="title"]/h1/text()').extract()[0] items['price'] = res.xpath('//div[@class="middle-content"]/div/p[2]/text()').extract()[0] items['new_car_price'] = res.xpath('//div[@class="middle-content"]/div/div[1]/span/text()').extract()[0] down_payment = res.xpath('//div[@class="list"]/p[@class="money detail-title-right-tagP"]/text()') monthly_payment = res.xpath('//[@id="basic"]/div[2]/div[2]/div[1]/div[3]/div[2]/p[5]/text()') if down_payment and monthly_payment: items['staging_info'] = [down_payment.extract()[0], monthly_payment.extract()[0]] items['service_fee'] = res.xpath('///div[1]/p[2]/strong/text()').extract()[0] items['service'] = res.xpath('//[@id="js-box-service"]/table/tr/td/table/tr/td/text()').extract() items['info'] = res.xpath('///div[2]/div[2]/div[1]/div[4]/ul/li/div/p/strong/text()').extract() items['displacement'] = res.xpath('//[@id="basic"]/div[2]/div[2]/div[1]/div[4]/ul/li[4]/div/strong/text()').extract()[0] items['registration_city'] = res.xpath('///@licensed-city').extract()[0] items['options'] = res.xpath('//*[@id="basic"]/div[2]/div[2]/div[1]/div[5]/p/text()').extract()[0].strip().split("：")[1] if res.xpath('//div[@class="info-recommend"]/div/img/@src'): items['car_img'] = res.xpath('//div[@class="info-recommend"]/div/img/@src').extract()[0] items['city'] = res.xpath('//div[@rrc-event-scope="city"]/a[@class="choose-city"]/text()').extract()[0].strip() items['color'] = res.xpath('//div[@class="card-table"]/table/tr/td[2]/text()').extract()[0] return items # 返回 items 对象 ``` 其中，Selector 对象是 scrapy 中提供的一种选择器，可以方便地从 HTML 或 XML 中提取数据。extract() 方法用于获取提取的数据，[0] 则是因为返回的是一个列表，需要取出其中的第一个元素。此外，还有一些判断语句用于处理数据缺失或判断是否存在该数据，如 if down_payment and monthly_payment: 判断是否可以分期购买。最后，将所有数据存储在 items 对象中并返回。

为什么 e.xpath('//tr[@class="item"]/td[2]/div[1]/a|span/text() ')获取到的是元素而不是元素的文本

这是因为XPath表达式 `//tr[@class="item"]/td[2]/div[1]/a|span/text()` 中的 `a` 和 `span` 都是元素节点，而不是文本节点。如果要获取元素节点的文本内容，应该在节点名称后面加上 `/text()`。因此，正确的XPath表达式应该是 `//tr[@class="item"]/td[2]/div[1]/a/text()|//tr[@class="item"]/td[2]/div[1]/span/text()`。这样才能获取到 `a` 和 `span` 元素节点下的文本内容。

阅读全文

e.xpath('//tr[@class="item"]/td[2]/div[1]/a/text()如果按标签没有值给一个空字符串

为什么 e.xpath('//tr[@class="item"]/td[2]/div[1]/a|span/text() ')获取到的是元素而不是元素的文本

相关推荐

xsoup:当jsoup遇到XPath时

李琰恢HTML CSS/JavaScript PHP/Bootstrap教程

selenium自动化测试之xpath进阶

读一读，猜一猜。什么鸟跑得快，不爱树林爱沙漠？（ ）A. 山椒鸟B. 鸵鸟C. 犀鸟 这么html中判断是否有D选项 java代码怎么写

解决以下代码错误： File "C:\Users\zhihao\PycharmProjects\pythonProject2\main.py", line 35, in get_company type = tree.xpath('/html/body/div[4]/table/tbody/tr[4]/td[2]/span[3]/i/text()')[0] IndexError: list index out of range

Xpath常用语法示例

15. 在软件测试中使用XPath定位元素

使用python、requests、正则表达式、xpath、beautifulsoup4等工具实现一个爬虫程序，目标网址： https://www.qdmm.com/rank/readindex/, 阅读指数榜。

用pycharm scrapy框架爬取https://www.shanghairanking.cn/institution校名、地区、管理部门、类别、双一流的内容并写入excel文件的代码

爬取上证指数近30天数据注:1网站: http://quote.eastmoney.com/zs000001.html具体数据源自k线图(k线图如下图所示)2爬取数据包括: 开盘、收盘、最高、最低、换手率每个编程接口最多可能有365个数据

总市值的结果是包含在一个div中的tbody中的tr中的td，其中div和tbody都有对应的class

最新推荐

Spring Cloud 全面学习案例集，含多种功能示例与教程.zip

AudioStream 1.5.unitypackage

高清艺术文字图标资源，PNG和ICO格式免费下载

管理建模和仿真的文件

DMA技术：绕过CPU实现高效数据传输

SGM8701电压比较器如何在低功耗电池供电系统中实现高效率运作？

mui框架HTML5应用界面组件使用示例教程

"互动学习：行动中的多样性与论文攻读经历"

【数据传输高速公路】：总线系统的深度解析

如何结合PID算法调整PWM信号来优化电机速度控制？请提供实现这一过程的步骤和代码示例。

读一读，猜一猜。什么鸟跑得快，不爱树林爱沙漠？（）A. 山椒鸟B. 鸵鸟C. 犀鸟这么html中判断是否有D选项 java代码怎么写