Python爬取YY评级分数并保存数据实现过程解析

作者：Chloemw | 2022-12-25 19:45

这篇文章主要介绍了Python爬取YY评级分数并保存数据实现过程解析,文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值,需要的朋友可以参考下

前言

当需要进行大规模查询时（比如目前遇到的情形：查询某个省所有发债企业的YY评级分数），人工查询显然太过费时，那就写个爬虫吧。

由于该爬虫实在过于简单，就只简单概述下。

一、请求端

通过观察YY评级的网页信息，如下图（F12或右击进入检查，点击network—>XHR—>headers）。

红色框表明是个get请求（其实这种网页基本都是Ajax get，需要总结实际url的规律的）。

绿色框即为实际URL，通过分析该URL，其由两部分组成。前半部分为“
https://web.ratingdog.cn/v1/search?”，后半部分为黄色框内内容用“&”符号连接后的结果。黄色框内的内容，只有企业名称为变量，且为已知变量，那URL即可据此确定了。

另外需注意，YY评级需要登录才可查询数据，在构建头部信息进行访问时，一定要提前登录，并在头部信息中放入登录信息和登录状态。

二、响应端

通过观察网页的响应信息（F12或右击进入检查，点击network—>XHR—>response），如下图。响应信息及其简单，我们所需要的YY评级分数安详地躺在那里，简单到一个正则表达式就可以提取出该数据。正则如下：

"msg".*?"IssuerName":"(.*?)","YYRating":"(.*?)/10","IntrinsicRating".*?"

三、代码

所需数据较少，代码相对简单，就不建立函数了，直接一路到底吧。如下：

运行代码后，得到结果如下。安徽省的100多条数据，就到了本地了

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持。

推荐阅读

程序员
在混合Android应用程序中导航时,在chrome设备中看到多个分离的webview实例

如何解决《在混合Android应用程序中导航时,在chrome设备中看到多个分离的webview实例》经验，为你挑选了1个好方法。 ... [详细]
程序员
通过基于两列随机选择值来子集数据帧

如何解决《通过基于两列随机选择值来子集数据帧》经验，为你挑选了1个好方法。 ... [详细]
程序员
旋转UIButton 360度

如何解决《旋转UIButton360度》经验，为你挑选了4个好方法。 ... [详细]
程序员
bootstrap switch setState使用jquery函数

如何解决《bootstrapswitchsetState使用jquery函数》经验，为你挑选了1个好方法。 ... [详细]
程序员
VS2015 Visualiser,(*.natvis)DisplayString调用一个函数来显示值

如何解决《VS2015Visualiser,(*.natvis)DisplayString调用一个函数来显示值》经验，为你挑选了0个好方法。 ... [详细]
程序员
使用spaCy进行POS标记

如何解决《使用spaCy进行POS标记》经验，为你挑选了1个好方法。 ... [详细]
程序员
以编程方式为iOS制作带有名称缩写的图像,如Swift中的Gmail

如何解决《以编程方式为iOS制作带有名称缩写的图像,如Swift中的Gmail》经验，为你挑选了3个好方法。 ... [详细]
程序员
MySQL ERROR 1290(HY000)--secure-file-priv选项

如何解决《MySQLERROR1290(HY000)--secure-file-priv选项》经验，为你挑选了4个好方法。 ... [详细]
程序员
图像亮度对比度搜索栏

如何解决《图像亮度对比度搜索栏》经验，为你挑选了1个好方法。 ... [详细]
程序员
检索Android/Cloudinary上传的图片网址

如何解决《检索Android/Cloudinary上传的图片网址》经验，为你挑选了1个好方法。 ... [详细]
程序员
为什么我不能直接访问属性".SingleAsync().Property"？

如何解决《为什么我不能直接访问属性".SingleAsync().Property"？》经验，为你挑选了1个好方法。 ... [详细]
程序员
当键盘打开时,Recyclerview不会滚动结束

如何解决《当键盘打开时,Recyclerview不会滚动结束》经验，为你挑选了5个好方法。 ... [详细]
程序员
如何将组合框中的项添加到数组中

如何解决《如何将组合框中的项添加到数组中》经验，为你挑选了1个好方法。 ... [详细]
程序员
Nginx的; 如何使用OCSP验证SSL客户端证书

如何解决《Nginx的;如何使用OCSP验证SSL客户端证书》经验，为你挑选了0个好方法。 ... [详细]
程序员
如何使用Microsoft.SqlServer.Management.SqlParser中的类将T-SQL解析为AST

如何解决《如何使用Microsoft.SqlServer.Management.SqlParser中的类将T-SQL解析为AST》经验，为你挑选了0个好方法。 ... [详细]
程序员
部署应用程序的java.lang.AbstractMethodError(Spring 4 MVC + Hibernate 4/5)

如何解决《部署应用程序的java.lang.AbstractMethodError(Spring4MVC+Hibernate4/5)》经验，为你挑选了1个好方法。 ... [详细]
程序员
Gulp:并行运行多个节点脚本

如何解决《Gulp:并行运行多个节点脚本》经验，为你挑选了0个好方法。 ... [详细]
程序员
Elixir Phoenix帮助关联模型列表

如何解决《ElixirPhoenix帮助关联模型列表》经验，为你挑选了1个好方法。 ... [详细]
程序员
Linux中没有符号插入的共享对象,-fno-semantic-interposition error

如何解决《Linux中没有符号插入的共享对象,-fno-semantic-interpositionerror》经验，为你挑选了1个好方法。 ... [详细]
程序员
无法打开文件"***.app",因为您无权查看该文件

如何解决《无法打开文件"***.app",因为您无权查看该文件》经验，为你挑选了1个好方法。 ... [详细]

Chloemw

这个屌丝很懒，什么也没留下！

关注作者

Tags | 热门标签

RankList | 热门文章