Python爬取YY评级分数并保存数据实现过程解析 - CSDN文库

162 浏览量更新于2023-10-20 评论收藏 50KB PDF 举报

身份认证购VIP最低享 7 折!

领优惠券(最高得80元）

资源详情

资源评论

资源推荐

Python爬取爬取YY评级分数并保存数据实现过程解析评级分数并保存数据实现过程解析

前言前言

当需要进行大规模查询时（比如目前遇到的情形：查询某个省所有发债企业的YY评级分数），人工查询显然太过费时，那就

写个爬虫吧。

由于该爬虫实在过于简单，就只简单概述下。

一、请求端一、请求端

通过观察YY评级的网页信息，如下图（F12或右击进入检查，点击network—>XHR—>headers）。

红色框表明是个get请求（其实这种网页基本都是Ajax get，需要总结实际url的规律的）。

绿色框即为实际URL，通过分析该URL，其由两部分组成。前半部分为“

https://web.ratingdog.cn/v1/search?”，后半部分为黄色框内内容用“&”符号连接后的结果。黄色框内的内容，只有企业名称为

变量，且为已知变量，那URL即可据此确定了。

另外需注意，YY评级需要登录才可查询数据，在构建头部信息进行访问时，一定要提前登录，并在头部信息中放入登录信息

和登录状态。

二、响应端二、响应端

通过观察网页的响应信息（F12或右击进入检查，点击network—>XHR—>response），如下图。响应信息及其简单，我们所

需要的YY评级分数安详地躺在那里，简单到一个正则表达式就可以提取出该数据。正则如下：

“msg”.*?”IssuerName”:”(.*?)”,”YYRating”:”(.*?)/10″,”IntrinsicRating”.*?”

三、代码三、代码

所需数据较少，代码相对简单，就不建立函数了，直接一路到底吧。如下：

运行代码后，得到结果如下。安徽省的100多条数据，就到了本地了

您可能感兴趣的文章您可能感兴趣的文章:Python3直接爬取图片URL并保存示例python requests库爬取豆瓣电视剧数据并保存到本地详解Python

爬取数据保存为Json格式的代码示例Python3爬虫学习之将爬取的信息保存到本地的方法详解Python3爬虫爬取百姓网列表并

保存为json功能示例【基于request、lxml和json模块】Python3实现爬取指定百度贴吧页面并保存页面数据生成本地文档的方

法Python使用Scrapy爬虫框架全站爬取图片并保存本地的实现代码python爬取网站数据保存使用的方法

本内容试读结束，登录后可阅读更多

下载后可阅读完整内容，剩余0页未读，立即下载

评论0

weixin_38516491

粉丝: 6
资源: 950

会员权益专享

图片转文字

全年可省5，000元立即开通

最新资源

资源上传下载、课程学习等过程中有任何疑问或建议，欢迎提出宝贵意见哦~我们会及时处理！点击此处反馈