当前位置：首页 > news >正文

【进阶OpenCV】（9）--摄像头操作---＞答题卡识别改分项目

news 2025/7/7 9:29:37

文章目录

项目：答题卡识别改分
- 1. 图片预处理
- 2. 描绘轮廓
- 3. 轮廓近似
- 4. 透视变换
- 5. 阈值处理
- 6. 找每一个圆圈轮廓
- 7. 将每一个圆圈轮廓排序
- 8. 找寻所填答案，比对正确答案
- - 8.1 思路
  - 8.2 图解
  - 8.3 代码体现
- 9. 计算正确率
总结

项目：答题卡识别改分

本篇我们来介绍，如何识别一张答题卡，并为其答案验证对错，进行打分。

在这里插入图片描述

思路：

图片预处理
边缘检测
描绘轮廓
找到每一个圆圈轮廓
比对答案
计算正确率

1. 图片预处理

对识别的图片进行灰度处理
使用高斯滤波cv2.GaussianBlur()函数平滑处理去噪
接着使用cv2.Canny()函数再进行边缘检测，检测图片中的边缘。

def cv_show(name,img):cv2.imshow(name,img)cv2.waitKey(0)
"""-----预处理-----"""
image = cv2.imread(r'./images/test_01.png')
contours_img = image.copy()
gray = cv2.cvtColor(image,cv2.COLOR_RGB2GRAY)
blurred = cv2.GaussianBlur(gray,(5,5),0)
cv_show('blurred',blurred)
edged = cv2.Canny(blurred,75,200)
cv_show('edged',edged)

在这里插入图片描述

2. 描绘轮廓

使用cv2.findContours()函数查找图像的轮廓，再通过cv2.drawContours()函数将其绘制出来：

"""-----轮廓检测-----"""
cnts = cv2.findContours(edged.copy(),cv2.RETR_EXTERNAL,cv2.CHAIN_APPROX_SIMPLE)[1]
cv2.drawContours(contours_img,cnts,-1,(0,0,255),3)
cv_show('contours_img',contours_img)

在这里插入图片描述

3. 轮廓近似

通过轮廓近似找到答题卡，为接下来的透视变换做准备：

判断条件：当近似轮廓可以用四个点绘制出时（因为答题卡是长方形的），将其保留。

"""-----根据轮廓大小进行排序，准备透视变换-----"""
cnts = sorted(cnts,key=cv2.contourArea,reverse=True)
docCnt = None
for c in cnts: # 遍历每一个轮廓peri = cv2.arcLength(c,True)approx = cv2.approxPolyDP(c,0.02 * peri,True) #轮廓近似if len(approx) == 4:docCnt = approxbreak

通过以上代码，得到答题卡的四个角点坐标docCnt。

4. 透视变换

定义两个函数：

order_point(pts)：将给定的四个点（通常是从图像中检测到的轮廓点或角点）按照特定的顺序排列：左上角（tl）、右上角（tr）、右下角（br）和左下角（bl）。
four_point_transform(image,pts)：这个函数使用 order_point 函数得到的点来对输入图像进行透视变换，使得这四个点映射到一个矩形上。

def order_point(pts):rect = np.zeros((4,2),dtype="float32")s = pts.sum(axis=1)rect[0] = pts[np.argmin(s)]rect[2] = pts[np.argmax(s)]diff = np.diff(pts,axis=1)rect[1] = pts[np.argmin(diff)]rect[3] = pts[np.argmax(diff)]return rectdef four_point_transform(image,pts):# 获取输入坐标点rect = order_point(pts)(tl,tr,br,bl) = rect# 计算输入的w和h值widthA = np.sqrt(((br[0] - bl[0]) ** 2) + ((br[1] - bl[1]) ** 2))widthB = np.sqrt(((tr[0] - tl[0]) ** 2) + ((tr[1] - tl[1]) ** 2))maxwidth = max(int(widthA),int(widthB))heightA = np.sqrt(((tr[0] - br[0]) ** 2) + ((tr[1] - br[1]) ** 2))heightB = np.sqrt(((tl[0] - bl[0]) ** 2) + ((tl[1] - bl[1]) ** 2))maxheight = max(int(heightA), int(heightB))# 变换后对应坐标位置dst = np.array([[0,0],[maxwidth - 1,0],[maxwidth - 1,maxheight - 1],[0,maxheight - 1]],dtype="float32")M = cv2.getPerspectiveTransform(rect,dst)warped = cv2.warpPerspective(image,M,(maxwidth,maxheight))# 返回变化后结果return warped

"""-----执行透视变换-----"""
warped_t = four_point_transform(image,docCnt.reshape(4,2))
warped_new = warped_t.copy()
cv_show('warped',warped_t)
warped = cv2.cvtColor(warped_t,cv2.COLOR_BGR2GRAY)

在这里插入图片描述

这样就将答题卡完整的取出来了。

5. 阈值处理

非黑即白，使得到的答题卡更清晰。

"""-----阈值处理-----"""
thresh = cv2.threshold(warped,0,255,cv2.THRESH_BINARY_INV | cv2.THRESH_OTSU)[1]
cv_show('thresh',thresh)
thresh_Contours = thresh.copy()

在这里插入图片描述

6. 找每一个圆圈轮廓

通过cv2.findContours()函数，查找轮廓，并将其绘制出来。
遍历每一个轮廓，将符合条件的圆圈轮廓存放进questionCnts列表中。

"""-----找到每一个圆圈轮廓-----"""
cnts = cv2.findContours(thresh,cv2.RETR_EXTERNAL,cv2.CHAIN_APPROX_SIMPLE)[1]
warped_Contours = cv2.drawContours(warped_t,cnts,-1,(0,255,0),1)
cv_show('warped_Contours',warped_Contours)
questionCnts = [] # 将圆圈轮廓存放此处for c in cnts:# 遍历轮廓并计算比例和大小(x,y,w,h) = cv2.boundingRect(c)ar = w/float(h)# 根据实际情况指定标准if w >= 20 and h >= 20 and ar >= 0.9 and ar <= 1.1:questionCnts.append(c)

在这里插入图片描述

7. 将每一个圆圈轮廓排序

定义了一个名为 sort_contours的函数，用于根据指定的方法对轮廓（contours）进行排序：

功能：这个函数可以用于在图像处理中，根据对象的水平或垂直位置对检测到的对象进行排序，这在处理图像中的多个对象时非常有用。

def sort_contours(cnts ,method='left-to-right'):reverse=Falsei=0if method=='right-to-left' or method=='bottom-to-top':reverse=Trueif method=='top-to-bottom' or method=='bottom-to-top':i=1boundingBoxes=[cv2.boundingRect(c) for c in cnts](cnts,boundingBoxes)=zip(*sorted(zip(cnts,boundingBoxes),key=lambda b:b[1][i],reverse=reverse))#zip(*...)使用星号操作符解包排序后的元组列表，并将其重新组合成两个列表:一个包含所有轮廓，另一个包含所有边界框。return cnts,boundingBoxes

questionCnts = sort_contours(questionCnts,method = "top-to-bottom")[0]

8. 找寻所填答案，比对正确答案

8.1 思路

思路：我们发现，答题卡中，每一行共五个圆圈代表一道题的答案，我们要找到填涂的圆圈，然后再找到正确答案的圆圈，比对二者是不是同一个。

所以我们要从左到右每五个圆圈轮廓寻找一次填涂答案的位置，然后比较一次。那么，我们怎么从五个轮廓中找到填涂的那个呢？

通过cv2.countNonZero()函数方法，作用是计算数组（通常是图像或图像的一部分）中非零元素（像素点）的数量。填涂后的轮廓位置轮廓内都是有颜色的，通过掩膜（对每一个轮廓进行掩膜）方法与每个轮廓做”与“运算，然后计算非零元素的数量，五个中，谁最多，谁就是填涂的。

接着通过它在五个中的位置，与正确答案的位置作比较，看看一不一致，判断对错。

8.2 图解

图解：

第一个轮廓的掩膜”与“运算：

在这里插入图片描述

得到一个清晰的轮廓，计算它的非零像素点的数量。

填涂点的掩膜”与”运算：

在这里插入图片描述

对比上下两个轮廓的非零像素点的数量就可以明显锁定填涂位置。

8.3 代码体现

"""-----比对答案-----"""
ANSWER_KEY = {0:1,1:4,2:0,3:3,4:1} # 正确答案
correct = 0
# 每持有5个选项
for (q,i) in enumerate(np.arange(0,len(questionCnts),5)):cnts = sort_contours(questionCnts[i:i + 5])[0]bubbled = None# 遍历每一个结果for (j,c) in enumerate(cnts):# 使用mask来判断结果mask = np.zeros(thresh.shape,dtype="uint8")cv2.drawContours(mask,[c],-1,255,-1)cv_show('mask',mask)# 通过计算非零点数量来算是否选择这个答案# 利用掩膜进行‘与’操作，只保留mask位置中的内容thresh_mask_and = cv2.bitwise_and(thresh,thresh,mask=mask)cv_show('thresh_mask_and',thresh_mask_and)total = cv2.countNonZero(thresh_mask_and)if bubbled is None or total > bubbled[0]:bubbled = (total,j)# 对比正确答案color = (0,0,255)k = ANSWER_KEY[q]if k == bubbled[1]: # 判断正确color = (0,255,0)correct += 1cv2.drawContours(warped_new,[cnts[k]],-1,color,3)cv_show("warpeding",warped_new)

判断结果：

在这里插入图片描述

9. 计算正确率

"""-----计算分数-----"""
score = (correct / 5.0) * 100
print("[INFO] score:{:.2f}%".format(score))
cv2.putText(warped_new,"{:.2f}%".format(score),(10,30),cv2.FONT_HERSHEY_SIMPLEX,0.9,(0,0,255),2)
cv2.imshow("origimal",image)
cv2.imshow('Exam',warped_new)
cv2.waitKey(0)
----------------
[INFO] score:80.00%

在这里插入图片描述

总结

本篇介绍了：如何对答题卡进行识别并计算准确率。

要点知识：边缘检测、轮廓近似、透视变换以及掩膜。

过程：1. 图片预处理 -----> 2. 描绘轮廓 -----> 3. 轮廓近似 -----> 4. 透视变换 -----> 5. 阈值处理 -----> 6. 找每一个圆圈轮廓 -----> 7. 将每一个圆圈轮廓排序 -----> 8. 比对正确答案 -----> 9. 计算正确率.

【进阶OpenCV】（9）--摄像头操作---＞答题卡识别改分项目

文章目录项目：答题卡识别改分1. 图片预处理2. 描绘轮廓3. 轮廓近似4. 透视变换5. 阈值处理6. 找每一个圆圈轮廓7. 将每一个圆圈轮廓排序8. 找寻所填答案，比对正确答案8.1 思路8.2 图解8.3 代码体现 9. 计算正确率总结项目：答题卡识别改分 …...

编程日记 2024/10/13 4:53:51

实时从TDengine数据库采集数据到Kafka Topic

实时从TDengine数据库采集数据到Kafka Topic 一、认识TDengine二、TDengine Kafka Connector三、什么是 Kafka Connect？四、前置条件五、安装 TDengine Connector 插件六、启动 Kafka七、验证 kafka Connect 是否启动成功八、TDengine Source Connector 的使用九、添…...

编程日记 2024/10/13 4:52:50

Linux -- 初识动静态库

目录为什么要有库？ 静态库什么是静态库？ 特点优点缺点动态库什么是动态库？ 优点缺点编译器会选择哪个库？ 为什么要有库？ 库的存在是为了提高软件开发的效率、促进代码复用以及简化维护工作。通过使用…...

编程日记 2024/10/13 4:51:49

vite 打包前请求接口和打包后的不一致

在使用 Vite 进行项目打包时，如果发现打包前请求接口和打包后的行为不一致，这可能是由于多种原因导致的。以下是一些可能的原因和相应的解决方案： 1. 代理配置问题开发环境：在开发环境中，Vite 通常使用 vite.config…...

编程日记 2024/10/13 4:50:48

背景： Collecting fairseq Using cached https://pypi.tuna.tsinghua.edu.cn/packages/d7/0f/b7043b451a97eb9b4cfb1b1e23e567b947d9d7bca542403228bd53b435fe/fairseq-0.12.1.tar.gz (9.6 MB) Installing build dependencies ... done Getting requirements…...

编程日记 2024/10/13 4:47:39

使用Mockaroo生成测试数据

使用Mockaroo生成测试数据最近在学习【Spring Boot & React】Spring Boot和React教程视频的P51.Generating 1000 students一课中，看到了https://www.mockaroo.com/网站可以用来模拟生成测试数据，觉得还不错，特此记录一下。感觉每次看老…...

编程日记 2024/10/13 4:46:38

使用频率最高的 opencv 基础绘图操作 - python 实现

以下是 opencv-python 基本操作绘制示例，绘制： 1）圆，2）矩形，3）线段，4）文本。安装 opencv-python pip install opencv-python 在图上绘制圆的操作，示例如…...

编程日记 2024/10/13 4:45:37

Python 在Excel中添加数据条

在Excel中添加数据条是一种数据可视化技巧，它通过条形图的形式在单元格内直观展示数值的大小，尤其适合比较同一列或行中各个单元格的数值。这种表示方式可以让大量的数字信息一目了然。本文将介绍如何使用Python在Excel中的指定单元格区域添加数据条。 …...

编程日记 2024/10/13 4:44:35

Unity中搜索不到XR Interaction Toolkit包解决方法

问题： 针对Unity版本2020.3在中PackageManager可能搜素不到XR Interaction Toolkit包在Package Manager中未显示XR Interaction Toolkit包解决方法： Package manager左上角，点加号，选择 Add package from git URL..，…...

编程日记 2024/10/13 4:43:34

【前端】JQ验证每个单选按钮是否已经选择

验证每个单选题是否都已经选择，其中每个input中不带name值，直接遍历input[type"radio"]验证 <!DOCTYPE html> <html lang"en"> <head> <meta charset"UTF-8"> <meta name"viewpor…...

编程日记 2024/10/13 4:42:32

【无人机设计与控制】滑模控制、反步控制、传统PID四旋翼无人机轨迹跟踪控制仿真

摘要本文基于滑模控制、反步控制和传统PID控制，设计了针对四旋翼无人机的轨迹跟踪控制系统。通过对比这三种控制策略在四旋翼无人机轨迹跟踪中的表现，分析了各自的优缺点和适用场景。仿真结果表明，滑模控制具有更强的鲁棒性，反步…...

编程日记 2024/10/13 4:40:26

MongoDB 介绍

一、MongoDB 介绍 MongoDB 是一个开源的、面向文档的数据库管理系统。它采用了灵活的数据模型，以类似 JSON 的文档形式存储数据，具有高可扩展性、高性能和丰富的功能。主要特点包括： 灵活的数据模型：文档型数据库允许存储不同…...

编程日记 2024/10/13 4:39:25

计算机网络：物理层 —— 物理层概述

文章目录物理层功能物理层接口特性常见特性相关概念物理层（Physical Layer）是OSI（Open Systems Interconnection）模型的第一层，负责提供原始比特流传输的服务。它定义了硬件接口的电气、机械、功能和过程特性&#…...

编程日记 2024/10/13 4:35:21

HTTP的工作原理

HTTP（Hypertext Transfer Protocol）是一种用于在计算机网络上传输超文本数据的应用层协议。它是构成万维网的基础之一，被广泛用于万维网上的数据通信。（超文本(Hypertext)是用超链接的方法，将各种不同空间的文字信息组…...

编程日记 2024/10/13 4:32:16

缓存数据减轻服务器压力

问题：不是所有的数据都需要请求后端的不是所有的数据都需要请求后端的，有些数据是重复的、可以复用的解决方案：缓存实现思路：每一个分类为一个key，一个可以下面可以有很多菜品前端是按照分类查询的，所以我们需要通过分类来缓存缓存代码 /*** 根据分类id查询菜品** @pa…...

编程日记 2024/10/13 4:30:14

【自动驾驶】控制算法（十二）横纵向综合控制 | 从理论到实战全面解析

写在前面： 🌟 欢迎光临清流君的博客小天地，这里是我分享技术与心得的温馨角落。📝 个人主页：清流君_CSDN博客，期待与您一同探索移动机器人领域的无限可能。 🔍 本文系清流君原创之作&…...

编程日记 2024/10/13 4:29:13

Python基础之List列表用法

1、创建列表 names ["张三","李四","王五","Mary"] 2、列表分片 names[1]：获取数组的第2个元素。 names[1:3]：获取数组的第2、第3个元素。包含左侧，不包含右侧。 names[:3]等同于names[0:3]&…...

编程日记 2024/10/13 4:28:12

视觉检测开源库-功能包框架搭建

chapt9/chapt9_ws/src，接着在目录下新建 yolov5_ros2 功能包，并添加相关依赖，完整命令如下： ros2 pkg create yolov5_ros2 --build-type ament_python --dependencies rclpy yolov5 cv_bridge sensor_msgs vision_msgs cv2 --lic…...

编程日记 2024/10/13 4:26:09

pytest的基础入门

pytest判断用例的成功或者失败 pytest识别用例失败时会报AssertionError或者xxxError错误，当捕获异常时pytest无法识别到失败的用例 pytest的fixture夹具 pytest的参数化 #coding:utf-8 import pytestfrom PythonProject.pytest_test.funcs.guess_point import ge…...

编程日记 2024/10/13 4:18:01

（31）非零均值信号的时域分析：均值、方差、与功率

文章目录前言一、使用MATLAB生成余弦波并画图二、计算信号的均值、方差、与功率三、结果分析前言本文对叠加了直流分量的一段整周期余弦信号进行时域分析，使用MATLAB进行信号生成，并计算其均值、方差、与功率。最后给出对计算结果的分析，…...

编程日记 2024/10/13 4:14:58

多模态大语言模型arxiv论文略读（108）

CROME: Cross-Modal Adapters for Efficient Multimodal LLM ➡️ 论文标题：CROME: Cross-Modal Adapters for Efficient Multimodal LLM ➡️ 论文作者：Sayna Ebrahimi, Sercan O. Arik, Tejas Nama, Tomas Pfister ➡️ 研究机构: Google Cloud AI Re…...

编程新知 2025/7/5 8:54:59

css3笔记（1）自用

outline: none 用于移除元素获得焦点时默认的轮廓线 broder:0 用于移除边框 font-size：0 用于设置字体不显示 list-style: none 消除<li> 标签默认样式 margin: xx auto 版心居中 width:100% 通栏 vertical-align 作用于行内元素 / 表格单元格&#xff…...

编程新知 2025/6/21 18:22:13

Java + Spring Boot + Mybatis 实现批量插入

在 Java 中使用 Spring Boot 和 MyBatis 实现批量插入可以通过以下步骤完成。这里提供两种常用方法：使用 MyBatis 的 <foreach> 标签和批处理模式（ExecutorType.BATCH）。方法一：使用 XML 的 <foreach> 标签&#xff…...

编程新知 2025/6/11 2:44:05

VM虚拟机网络配置（ubuntu24桥接模式）：配置静态IP

编辑-虚拟网络编辑器-更改设置选择桥接模式，然后找到相应的网卡（可以查看自己本机的网络连接） windows连接的网络点击查看属性编辑虚拟机设置更改网络配置，选择刚才配置的桥接模式静态ip设置： 我用的ubuntu24桌…...

编程新知 2025/7/5 13:50:27

Java求职者面试指南：计算机基础与源码原理深度解析

Java求职者面试指南：计算机基础与源码原理深度解析第一轮提问：基础概念问题 1. 请解释什么是进程和线程的区别？ 面试官：进程是程序的一次执行过程，是系统进行资源分配和调度的基本单位；而线程是进程中的…...

编程新知 2025/7/5 14:21:47

华为OD机试-最短木板长度-二分法(A卷,100分)

此题是一个最大化最小值的典型例题， 因为搜索范围是有界的，上界最大木板长度补充的全部木料长度，下界最小木板长度； 即left0,right10^6; 我们可以设置一个候选值x(mid)，将木板的长度全部都补充到x，如果成功…...

编程新知 2025/7/4 22:31:47

小木的算法日记-多叉树的递归/层序遍历

🌲 从二叉树到森林：一文彻底搞懂多叉树遍历的艺术 🚀 引言你好，未来的算法大神！ 在数据结构的世界里，“树”无疑是最核心、最迷人的概念之一。我们中的大多数人都是从二叉树开始入门的，它…...

编程新知 2025/7/6 4:23:14

云安全与网络安全：核心区别与协同作用解析

在数字化转型的浪潮中，云安全与网络安全作为信息安全的两大支柱，常被混淆但本质不同。本文将从概念、责任分工、技术手段、威胁类型等维度深入解析两者的差异，并探讨它们的协同作用。一、核心区别定义与范围网络安全：聚焦于保…...

编程新知 2025/7/7 0:12:19

命令行关闭Windows防火墙

命令行关闭Windows防火墙引言一、防火墙：被低估的"智能安检员"二、优先尝试！90%问题无需关闭防火墙方案1：程序白名单（解决软件误拦截）方案2：开放特定端口（解决网游/开发端口不通）三、命令行极速关闭方案方法一：PowerShell（推荐Win10/11）方法二：CMD命令…...

编程新知 2025/7/6 22:58:12

ArcPy扩展模块的使用(3)

管理工程项目 arcpy.mp模块允许用户管理布局、地图、报表、文件夹连接、视图等工程项目。例如，可以更新、修复或替换图层数据源，修改图层的符号系统，甚至自动在线执行共享要托管在组织中的工程项。以下代码展示了如何更新图层的数据源&…...

编程新知 2025/7/5 22:22:08

文章目录

项目：答题卡识别改分

1. 图片预处理

2. 描绘轮廓

3. 轮廓近似

4. 透视变换

5. 阈值处理

6. 找每一个圆圈轮廓

7. 将每一个圆圈轮廓排序

8. 找寻所填答案，比对正确答案

8.1 思路

8.2 图解

8.3 代码体现

9. 计算正确率

总结

相关文章：