Python使用爬虫抓取美女图片并保存到本地的方法【测试可用】

作者：吻过彩虹的脸_378 | 2022-01-26 09:33

这篇文章主要介绍了Python使用爬虫抓取美女图片并保存到本地的方法,涉及Python基于正则、爬虫实现的图片抓取与保存相关操作技巧,需要的朋友可以参考下

本文实例讲述了Python使用爬虫抓取美女图片并保存到本地的方法。分享给大家供大家参考，具体如下：

图片资源来自于www.qiubaichengren.com

代码基于Python 3.5.2

友情提醒：血气方刚的骚年。请

谨慎阅图！
谨慎阅图！！
谨慎阅图！！！

code：

#!/usr/bin/env python
# -*- coding: utf-8 -*-
import os
import urllib
import urllib.request
import re
from urllib.error import URLError
class QsSpider:
  def __init__(self):
    self.user_agent = 'Mozilla/4.0 (compatible; MSIE 5.5; Windows NT)'
    self.header = {'User-Agent': self.user_agent}
    self.save_dir = './pic'
    self.url = 'http://www.qiubaichengren.com/%s.html'
  def start(self):
    for i in range(1, 10):
      self.load_html(str(i))
  def load_html(self, page):
    try:
      web_path = self.url % page
      request = urllib.request.Request(web_path, headers=self.header)
      with urllib.request.urlopen(request) as f:
        html_content = f.read().decode('gb2312')
        # print(html_content)
        self.pick_pic(html_content)
    except URLError as e:
      print(e.reason)
    return
  def save_pic(self, img):
    print(img)
    save_path = self.save_dir + "/" + img.replace(':', '@').replace('/', '_')
    if not os.path.exists(self.save_dir):
      os.makedirs(self.save_dir)
    print(save_path)
    urllib.request.urlretrieve(img, save_path)
    pass
  def pick_pic(self, html_content):
    regex = r'src="(http:.*?\.(?:jpg|png|gif))'
    patten = re.compile(regex)
    pic_path_list = patten.findall(html_content)
    for i in pic_path_list:
      self.save_pic(str(i))
      print(i)
spider = QsSpider()
spider.start()

代码运行后可得到如下N多大饱眼福的美女图：

更多关于Python相关内容可查看本站专题：《Python Socket编程技巧总结》、《Python正则表达式用法总结》、《Python数据结构与算法教程》、《Python函数使用技巧总结》、《Python字符串操作技巧汇总》、《Python入门与进阶经典教程》及《Python文件与目录操作技巧汇总》

希望本文所述对大家Python程序设计有所帮助。

推荐阅读

程序员
Dynamics CRM 2013图表DrillDown排序

如何解决《DynamicsCRM2013图表DrillDown排序》经验，为你挑选了0个好方法。 ... [详细]
程序员
如何在Visual Studio 2015中切换已登录的用户？

如何解决《如何在VisualStudio2015中切换已登录的用户？》经验，为你挑选了1个好方法。 ... [详细]
程序员
是不是可以为ForkJoinPool提供线程库或名称模式？

如何解决《是不是可以为ForkJoinPool提供线程库或名称模式？》经验，为你挑选了1个好方法。 ... [详细]
程序员
Flask:如何在蓝图中的每个路径之前运行方法？

如何解决《Flask:如何在蓝图中的每个路径之前运行方法？》经验，为你挑选了1个好方法。 ... [详细]
程序员
Textarea字段在提交时返回空

如何解决《Textarea字段在提交时返回空》经验，为你挑选了1个好方法。 ... [详细]
程序员
如何在OSx更新后修复损坏的python 2.7.11

如何解决《如何在OSx更新后修复损坏的python2.7.11》经验，为你挑选了2个好方法。 ... [详细]
程序员
如何使用HTML,CSS和JS制作基于音频标签的自定义音乐播放器

如何解决《如何使用HTML,CSS和JS制作基于音频标签的自定义音乐播放器》经验，为你挑选了0个好方法。 ... [详细]
程序员
在嵌入代码和非嵌入代码之间维护单个代码库

如何解决《在嵌入代码和非嵌入代码之间维护单个代码库》经验，为你挑选了1个好方法。 ... [详细]
程序员
我们可以直接将Parquet文件加载到Hive吗？

如何解决《我们可以直接将Parquet文件加载到Hive吗？》经验，为你挑选了2个好方法。 ... [详细]
程序员
如何在app进入前台之前准备UI更新

如何解决《如何在app进入前台之前准备UI更新》经验，为你挑选了0个好方法。 ... [详细]
程序员
如何在Ipython(py 2.7)笔记本中更改markdown单元格的字体大小和颜色

如何解决《如何在Ipython(py2.7)笔记本中更改markdown单元格的字体大小和颜色》经验，为你挑选了1个好方法。 ... [详细]
程序员
Django Queryset过滤列表中的参数

如何解决《DjangoQueryset过滤列表中的参数》经验，为你挑选了1个好方法。 ... [详细]
程序员
Lua coroutines - setjmp longjmp clobbering？

如何解决《Luacoroutines-setjmplongjmpclobbering？》经验，为你挑选了1个好方法。 ... [详细]
程序员
主持人是否知道MVP模式中的活动/上下文是个坏主意？

如何解决《主持人是否知道MVP模式中的活动/上下文是个坏主意？》经验，为你挑选了2个好方法。 ... [详细]
程序员
AngularJS 1.4.8 - 当我在选项之前以编程方式设置模型时,选择 - 无限$ digest()循环中的ngOptions在ngOptions中

如何解决《AngularJS1.4.8-当我在选项之前以编程方式设置模型时,选择-无限$digest()循环中的ngOptions在ngOptions中》经验，为你挑选了0个好方法。 ... [详细]
程序员
时间(NULL)是否会返回失败？

如何解决《时间(NULL)是否会返回失败？》经验，为你挑选了2个好方法。 ... [详细]
程序员
如何在Visual Studio 2015上隐藏团队活动行？

如何解决《如何在VisualStudio2015上隐藏团队活动行？》经验，为你挑选了1个好方法。 ... [详细]
程序员
在Spring启动时编写自定义查询

如何解决《在Spring启动时编写自定义查询》经验，为你挑选了1个好方法。 ... [详细]
程序员
用javascript替换图像上的src

如何解决《用javascript替换图像上的src》经验，为你挑选了1个好方法。 ... [详细]
程序员
Java JComboBox故障图形

如何解决《JavaJComboBox故障图形》经验，为你挑选了0个好方法。 ... [详细]

吻过彩虹的脸_378

这个屌丝很懒，什么也没留下！

关注作者

Tags | 热门标签

RankList | 热门文章