5赞

Python 识别12306图片验证码物品的实现示例

作者：臭小子 | 2022-10-17 07:09

这篇文章主要介绍了Python识别12306图片验证码物品的实现示例，文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值，需要的朋友们下面随着小编来一起学习学习吧

1、PIL介绍以及图片分割

Python 3 安装: pip3 install Pillow

1.1 image 模块

Image模块是在Python PIL图像处理中常见的模块，主要是用于对这个图像的基本处理，它配合open、save、convert、show…等功能使用。

from PIL import Image
#打开文件代表打开pycharm中的文件
im = Image.open('1.jpg')
#展示图片
im.show()

1、Crop类

拷贝这个图像。如果用户想粘贴一些数据到这张图，可以使用这个方法，但是原始图像不会受到影响。

im.crop(box) ⇒ image

从当前的图像中返回一个矩形区域的拷贝。变量box是一个四元组，定义了左、上、右和下的像素坐标。用来表示在原始图像中截取的位置坐标，如box(100,100,200,200)就表示在原始图像中以左上角为坐标原点，截取一个100*100（像素为单位）的图像。

from PIL import Image
im = Image.open("pic1.jpg")
##确定拷贝区域大小
box = (5, 41, 72, 108)
##将im表示的图片对象拷贝到region中，大小为box
region = im.crop(box)
region.show()

实战一:12306图像分割并保存

from PIL import Image
#切割图像，由于下载的图片都是有固定的位置，所以直接控制像素进行切割就行了
def cut_img(im, x, y):
  assert 0 <= x <= 3
  assert 0 <= y <= 2
  left = 5 + (67 + 5) * x
  top = 41 + (67 + 5) * y
  right = left + 67
  bottom = top + 67
  return im.crop((left, top, right, bottom))
 
if __name__ == '__main__':
  im = Image.open("./pic1.jpg")
  #控制y轴
  for y in range(2):
    #控制x轴
    for x in range(4):
      im2 = cut_img(im, x, y)
      im2.save('./images/%s_%s.png'%(y,x))

2、百度平台接口实现

2.1.平台接入：

1.打开https://ai.baidu.com/进入控制台，选择文字识别服务。

2.创建应用，如图示：

3.输入应用名称、描述，并选择应用类型，之后点击“立即创建”按钮。

4.创建完毕，点击“返回应用列表”。

5.此处显示AK,SK，后面程序中会用到

3. 官方文档的读取

1.打开https://ai.baidu.com/docs#/OCR-API/top 文档说明

需要用到的信息有：

（1）图像识别URL: https://aip.baidubce.com/rest/2.0/image-classify/v2/advanced_general

（2）Header格式：Content-Type：application/x-www-form-urlencoded

（3）请求参数：image和multi_detect两个参数，image为图像数据，base64编码后进行urlencode，要求base64编码和urlencode后大小不超过4M。

（4）返回参数：车牌颜色Color、车牌号码number等。

#!/usr/bin/python
# -*- coding: utf-8 -*-
import base64
import requests
import os
import time
#todo:获取百度权限验证码access_token
def get_token():
  get_token_url = "https://aip.baidubce.com/oauth/2.0/token"
  params = {
    "grant_type": "client_credentials",
    "client_id": "7ax98QuWU5l2zTbaOkzvKgxE",
    "client_secret": "INugQTM2DAfNFgfxtvgR7eF8AHPFGP5t",
  }
  res = requests.get(get_token_url, params).json()
  return res["access_token"]
#todo:通过权限验证码和图片进行识别物品
def get_result(access_token,image):
  url = "https://aip.baidubce.com/rest/2.0/image-classify/v2/advanced_general"
  #打开文件并进行编码
  with open(image, 'rb')as f:
    image = base64.b64encode(f.read())
  # image =
  #头部信息
  headers = {
    'Content-Type': 'application/x-www-form-urlencoded'
  }
  #发送数据
  data = {
    "access_token": access_token,
    "image": image
  }
  #发送请求，并返回识别数据
  res = requests.post(url, headers=headers, data=data).json()
  if res:
    result = res['result']
    return result
#todo:获取图片关键物品
def get_keywords(result):
  #按照最大匹配率进行排序，并获取左最后一个
  max_score = sorted(result,key=lambda x:x['score'])[-1]
  # print(max_score['keyword'])
  keyword = max_score['keyword']
  return keyword
 
if __name__ == '__main__':
  access_token = get_token()
  get_result(access_token,'pic1.jpg')
  datas = []
  for root,dir,files in os.walk('images'):
    for file in files:
      image = os.path.join(root,file)
      result = get_result(access_token,image)
      keyword = get_keywords(result)
      print(keyword)
      time.sleep(1)
      datas.append(keyword)
  print(datas)

总结：

PIL介绍以及图片分割
百度AI图像识别实例搭建
识别12306类别码

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持。

推荐阅读

程序员
使用node.js child_process调用python脚本

如何解决《使用node.jschild_process调用python脚本》经验，为你挑选了1个好方法。 ... [详细]
程序员
Pyspark RDD首先收集163排

如何解决《PysparkRDD首先收集163排》经验，为你挑选了1个好方法。 ... [详细]
程序员
Android蓝牙低功耗代码兼容API> = 21 AND API <21

如何解决《Android蓝牙低功耗代码兼容API>=21ANDAPI<21》经验，为你挑选了1个好方法。 ... [详细]
程序员
如何在python中获取SQL查询的表列名/标题

如何解决《如何在python中获取SQL查询的表列名/标题》经验，为你挑选了1个好方法。 ... [详细]
程序员
如何在Python的scikit-learn中访问树深度？

如何解决《如何在Python的scikit-learn中访问树深度？》经验，为你挑选了1个好方法。 ... [详细]
程序员
Linq反向字符串c#

如何解决《Linq反向字符串c#》经验，为你挑选了1个好方法。 ... [详细]
程序员
如何匹配Rust宏中表达式的类型？

如何解决《如何匹配Rust宏中表达式的类型？》经验，为你挑选了1个好方法。 ... [详细]
程序员
Python:只保留字符串中的字母

如何解决《Python:只保留字符串中的字母》经验，为你挑选了2个好方法。 ... [详细]
程序员
如何在石墨/ grafana中查询"all but one"

如何解决《如何在石墨/grafana中查询"allbutone"》经验，为你挑选了1个好方法。 ... [详细]
程序员
如果bool数组中的所有元素都为真？

如何解决《如果bool数组中的所有元素都为真？》经验，为你挑选了2个好方法。 ... [详细]
程序员
如何删除字符串末尾的换行符？

如何解决《如何删除字符串末尾的换行符？》经验，为你挑选了1个好方法。 ... [详细]
程序员
XPages REST服务和外部系统身份验证

如何解决《XPagesREST服务和外部系统身份验证》经验，为你挑选了1个好方法。 ... [详细]
程序员
为什么redux建议只连接到顶级组件？

如何解决《为什么redux建议只连接到顶级组件？》经验，为你挑选了2个好方法。 ... [详细]
程序员
php -l:抑制有效文件的输出

如何解决《php-l:抑制有效文件的输出》经验，为你挑选了1个好方法。 ... [详细]
程序员
我可以将ionic serve设置为默认不打开浏览器吗？

如何解决《我可以将ionicserve设置为默认不打开浏览器吗？》经验，为你挑选了2个好方法。 ... [详细]
程序员
是否可以将perror()生成的消息发送到/ var/log/syslog？

如何解决《是否可以将perror()生成的消息发送到/var/log/syslog？》经验，为你挑选了1个好方法。 ... [详细]
程序员
Django:自定义用户模型的返回字段

如何解决《Django:自定义用户模型的返回字段》经验，为你挑选了2个好方法。 ... [详细]
程序员
免费滚动粘贴侧边栏没有jQuery

如何解决《免费滚动粘贴侧边栏没有jQuery》经验，为你挑选了1个好方法。 ... [详细]
程序员
python 2.7 windows silent installer(.msi) - 命令行选项设置路径？

如何解决《python2.7windowssilentinstaller(.msi)-命令行选项设置路径？》经验，为你挑选了1个好方法。 ... [详细]
程序员
Haskell - 构造如何从Monad调用失败函数？

如何解决《Haskell-构造如何从Monad调用失败函数？》经验，为你挑选了1个好方法。 ... [详细]

臭小子

这个屌丝很懒，什么也没留下！

关注作者

Tags | 热门标签

RankList | 热门文章