Python爬虫基础之requestes模块

作者：mylvfamily | 2022-01-05 15:01

这篇文章主要介绍了Python爬虫基础之requestes模块,文中有非常详细的代码示例,对正在学习python爬虫的小伙伴们有非常好的帮助,需要的朋友可以参考下

一、爬虫的流程

开始学习爬虫，我们必须了解爬虫的流程框架。在我看来爬虫的流程大概就是三步，即不论我们爬取的是什么数据，总是可以把爬虫的流程归纳总结为这三步：

1.指定 url,可以简单的理解为指定要爬取的网址

2.发送请求。requests 模块的请求一般为 get 和 post

3.将爬取的数据存储

二、requests模块的导入

因为 requests 模块属于外部库，所以需要我们自己导入库

导入的步骤：

1.右键Windows图标

2.点击“运行”

3.输入“cmd”打开命令面板

4.输入“pip install requests”,等待下载完成

如图：

在这里插入图片描述

如果还是下载失败，我的建议是百度一下，你就知道（我也是边学边写，是在是水平有限）

欧克，既然导入成功后我们就简单的来爬取一下搜狗的首页吧！

三、完整代码

import requests

if __name__ == "__main__":
    # 指定url
    url = "https://www.sougou.com/"

    # 发起请求
    # get方法会返回一个响应数据
    response = requests.get(url)

    # 获取响应数据
    page_txt = response.text # text返回一个字符串的响应数据
    # print(page_txt)

    # 存储
    with open("./sougou.html", "w", encoding = "utf-8") as fp:
        fp.write(page_txt)

    print("爬取数据结束！！！")

我们打开保存的文件，如图

在这里插入图片描述

欧克，这就是最基本的爬取，如果学会了，那就试一试爬取 B站的首页吧。

到此这篇关于Python爬虫基础之requestes模块的文章就介绍到这了,更多相关Python requestes模块内容请搜索以前的文章或继续浏览下面的相关文章希望大家以后多多支持！

推荐阅读

程序员
在Rcpp中操作NumericMatrix

如何解决《在Rcpp中操作NumericMatrix》经验，为你挑选了0个好方法。 ... [详细]
程序员
类型'int'的参数在我的函数中是不可迭代的

如何解决《类型'int'的参数在我的函数中是不可迭代的》经验，为你挑选了1个好方法。 ... [详细]
程序员
几个Azure AD.New-MsolServicePrincipal:访问被拒绝

如何解决《几个AzureAD.New-MsolServicePrincipal:访问被拒绝》经验，为你挑选了1个好方法。 ... [详细]
程序员
将负整数传递给OCaml中的函数时出错

如何解决《将负整数传递给OCaml中的函数时出错》经验，为你挑选了1个好方法。 ... [详细]
程序员
在Entity Framework Core中选择多个嵌套级别的子表

如何解决《在EntityFrameworkCore中选择多个嵌套级别的子表》经验，为你挑选了1个好方法。 ... [详细]
程序员
如何使用单点+多边形在GeoJSON中创建GeometryCollection？

如何解决《如何使用单点+多边形在GeoJSON中创建GeometryCollection？》经验，为你挑选了1个好方法。 ... [详细]
程序员
Hibernate 5序列生成问题

如何解决《Hibernate5序列生成问题》经验，为你挑选了1个好方法。 ... [详细]
程序员
在Restful API中添加'x-frame-options'是否有意义

如何解决《在RestfulAPI中添加'x-frame-options'是否有意义》经验，为你挑选了2个好方法。 ... [详细]
程序员
使用Angular 1.29和最新的Chrome 47选择模态下拉列表

如何解决《使用Angular1.29和最新的Chrome47选择模态下拉列表》经验，为你挑选了1个好方法。 ... [详细]
程序员
智能单元测试:参考Microsoft.Pex.Framework.dll的正确方法是什么？

如何解决《智能单元测试:参考Microsoft.Pex.Framework.dll的正确方法是什么？》经验，为你挑选了1个好方法。 ... [详细]
程序员
Theano CUDA例外

如何解决《TheanoCUDA例外》经验，为你挑选了0个好方法。 ... [详细]
程序员
WPF Adorner Layer Outside Window

如何解决《WPFAdornerLayerOutsideWindow》经验，为你挑选了1个好方法。 ... [详细]
程序员
Sequelize通过Unix套接字连接到Postgres

如何解决《Sequelize通过Unix套接字连接到Postgres》经验，为你挑选了0个好方法。 ... [详细]
程序员
XlsxWriter python在特定单元格中写入数据帧

如何解决《XlsxWriterpython在特定单元格中写入数据帧》经验，为你挑选了1个好方法。 ... [详细]
程序员
使用Tensorflow的多变量时间序列RNN.这可能是LSTM细胞或类似的吗？

如何解决《使用Tensorflow的多变量时间序列RNN.这可能是LSTM细胞或类似的吗？》经验，为你挑选了0个好方法。 ... [详细]
程序员
C中的代码:64位系统中的int数组函数参数问题

如何解决《C中的代码:64位系统中的int数组函数参数问题》经验，为你挑选了1个好方法。 ... [详细]
程序员
jquery中数据的用途？(vs将我自己的字段添加到Jquery对象)

如何解决《jquery中数据的用途？(vs将我自己的字段添加到Jquery对象)》经验，为你挑选了1个好方法。 ... [详细]
程序员
在Spring Rest中使用JSON的HTTP POST

如何解决《在SpringRest中使用JSON的HTTPPOST》经验，为你挑选了1个好方法。 ... [详细]
程序员
swagger JSON文件的空值

如何解决《swaggerJSON文件的空值》经验，为你挑选了1个好方法。 ... [详细]
程序员
MSBuild"sgen.exe"丢失了

如何解决《MSBuild"sgen.exe"丢失了》经验，为你挑选了1个好方法。 ... [详细]

mylvfamily

这个屌丝很懒，什么也没留下！

关注作者

Tags | 热门标签

RankList | 热门文章