当前位置：首页 > news >正文

基于计算机视觉的坑洼道路检测和识别-MathorCup A（深度学习版本）

news 2026/2/9 15:17:09

1 2023 年 MathorCup 高校数学建模挑战赛——大数据竞赛

赛道 A：基于计算机视觉的坑洼道路检测和识别
使用深度学习模型，pytorch版本进行图像训练和预测，使用ResNet50模型

2 文件夹预处理

因为给定的是所有图片都在一个文件夹里面，所以需要先进行处理，核心代码：

for file_name in file_names:source_path = os.path.join(source_folder, file_name)# 判断文件名中是否包含'a'字符if "normal" in file_name:# 如果包含'a'字符，将文件移动到文件夹Adestination_path = os.path.join(folder_normal, file_name)shutil.copy(source_path, destination_path)elif "potholes" in file_name:# 如果包含'bb'字符，将文件移动到文件夹BBdestination_path = os.path.join(folder_potholes, file_name)shutil.copy(source_path, destination_path)

移动后的图片所在文件夹显示
在这里插入图片描述
每个文件夹里面包含属于这一类的图片

在这里插入图片描述

3 使用ResNet50模型进行建模

3.1 ResNet50核心原理

输入层: 接收输入图像卷积层1:对输入图像进行卷积操作，得到64个特征图批量标准化层1:对卷积层的输出进行批量标准化
ReLU激活函数1:对批量标准化后的特征图进行非线性激活
残差块1:包含两个残差块，每个残差块由两个卷积层和一个批量标准化层组成ReLU激活函数2:对残差块1的输出进行非线性激活
批量标准化层2:对ReLU激活函数2的输出进行批量标准化。
卷积层2:对批量标准化后的特征图进行卷积操作，得到128个特征图残差块2:包含两个残差块，每个残差块由两个卷积层和一个批量标准化层组成ReLU激活函数3:对残差块2的输出进行非线性激活批量标准化层3:对ReLU激活函数3的输出进行批量标准化。卷积层3:对批量标准化后的特征图进行卷积操作，得到256个特征图

在这里插入图片描述

3.2 核心代码

3.2.1 数据预处理

数据预处理，归一化

transform = T.Compose([T.Resize(256),T.CenterCrop(224),T.ToTensor(),T.Normalize(mean=[0.485, 0.456, 0.406], std=[0.229, 0.224, 0.225]),])

3.2.2 训练集和测试集划分

# 划分数据集为训练集和测试集
validation_split = 0.2
dataset_size = len(custom_dataset)
split = int(validation_split * dataset_size)
indices = list(range(dataset_size))
np.random.shuffle(indices)
train_indices, test_indices = indices[split:], indices[:split]train_sampler = SubsetRandomSampler(train_indices)
test_sampler = SubsetRandomSampler(test_indices)# 创建数据加载器
batch_size= 128
train_loader = DataLoader(custom_dataset, batch_size=batch_size, sampler=train_sampler)
test_loader = DataLoader(custom_dataset, batch_size=batch_size, sampler=test_sampler)

3.2.3 加载模型

from torchvision import models
model = models.resnet50(pretrained=True) # 导入resnet50网络# 修改最后一层，最后一层的神经元数目=类别数目，所以设置为100个
model.fc = torch.nn.Linear(in_features=2048, out_features=2)

3.2.4 训练

        train = Variable(images).cuda()labels = Variable(labels).cuda()# 梯度清零optimizer.zero_grad()# 前向计算outputs = model(train)predicted = torch.max(outputs.data, 1)[1]  # 预测标签acc = (predicted == labels).sum() / float(len(labels))  # 计算精度loss = error(outputs, labels)  # 计算损失函数# 计算梯度loss.backward()# 更新梯度optimizer.step()train_loss_list.append(loss.data.cpu().item())train_acc_list.append(acc.cpu().item())

3.2.5 模型预测

遍历测试数据集

 with torch.no_grad():for inputs, labels in test_loader:inputs = Variable(inputs).cuda()labels = Variable(labels).cuda()outputs = model(inputs)_, predicted = torch.max(outputs, 1)  # 获取预测标签true_labels.extend(labels.cpu().numpy())  # 将真实标签添加到列表predicted_labels.extend(predicted.cpu().numpy())  # 将预测标签添加到列表

4 结果显示

要输出精度、F1 分数和分类报告等多种指标，你可以在训练模型之后使用Scikit-Learn的工具来进行评估和计算这些指标。

train data: 0  Loss: 0.1588  Accuracy: 0.9143
Accuracy: 0.9833333333333333
Precision: 0.9857142857142857
Recall: 0.9833333333333333
F1 Score: 0.9838964773544213
Classification Report:precision    recall  f1-score   support0       1.00      0.98      0.99        541       0.86      1.00      0.92         6accuracy                           0.98        60macro avg       0.93      0.99      0.96        60
weighted avg       0.99      0.98      0.98        60

完整代码：https://docs.qq.com/doc/DWEtRempVZ1NSZHdQ

基于计算机视觉的坑洼道路检测和识别-MathorCup A（深度学习版本）

1 2023 年 MathorCup 高校数学建模挑战赛——大数据竞赛赛道 A：基于计算机视觉的坑洼道路检测和识别使用深度学习模型，pytorch版本进行图像训练和预测，使用ResNet50模型 2 文件夹预处理因为给定的是所有图片都在一个文件夹里面&#xf…...

编程日记 2023/10/30 18:22:40

【考研数学】概率论与数理统计 —— 第七章 | 参数估计（1，基本概念及点估计法）

文章目录引言一、参数估计的概念二、参数的点估计2.1 矩估计法2.2 最大似然估计法写在最后引言我们之前学了那么多分布，如正态分布 N ( μ , σ 2 ) N(\mu,\sigma^2) N(μ,σ2)，泊松分布 P ( λ ) P(\lambda) P(λ) 等等，都是在已知 …...

编程日记 2023/10/30 18:21:37

获取文本长度

使用TextView的getLineCount方法，它可以返回TextView当前显示的行数。但是，这个方法只有在TextView绘制完成后才能返回正确的值，否则可能返回0。因此，需要在TextView的post方法中调用，或者在onWindowFocusChanged方法中…...

编程日记 2023/10/30 18:18:35

python html(文件/url/html字符串)转pdf

安装库 pip install pdfkit第二步下载程序wkhtmltopdf https://wkhtmltopdf.org/downloads.html 下载7z压缩包解压即可, 无需安装解压后结构应该是这样, 我喜欢放在项目里, 相对路径引用(也可以使用绝对路径, 放其他地方) import pdfkit# 将 wkhtmltopdf.exe程序路径 p…...

编程日记 2023/10/30 18:16:33

Spring概述

Spring概述 Spring 是最受欢迎的企业级 Java 应用程序开发框架，数以百万的来自世界各地的开发人员使用 Spring 框架来创建性能好、易于测试、可重用的代码。 Spring 框架是一个开源的 Java 平台，它最初是由 Rod Johnson 编写的，并且于 2003 …...

编程日记 2023/10/30 18:15:32

Linux网卡

网卡网卡（Network Interface Card，NIC）是一种计算机硬件设备，也称为网络适配器或网络接口控制器。一个网卡就是一个接口网卡组成和工作原理参考https://blog.csdn.net/tao546377318/article/details/51602298 每个网卡都拥有唯…...

编程日记 2023/10/30 18:14:31

【Python机器学习】零基础掌握ElasticNet变量选择回归器

如何优雅地解决房价预测问题？房价预测一直是一个热门而复杂的话题。假设一个地产商希望准确地预测不同城市区域的房价，以便更有效地进行房地产投资。问题在于，房价是由多种因素共同决定的，例如地段、房屋面积、交通便利程度等。为了解决这个问题，一个可行的思路是使用…...

编程日记 2023/10/30 18:13:28

namespace my_vector {template <class T>class vector{public:typedef T* iterator;typedef const T* const_iterator;//常量指针，指针指向的值不可以变；//构造函数vector():start(nullptr),finish(nullptr),end_of_storage(nullptr){}//析构函数…...

编程日记 2023/10/30 18:09:23

Qt开发: 利用Qt的charts模块绘制曲线、饼图、柱状图、折线图等各种图表

一、前言 Qt Charts模块是Qt提供的一个用于创建各种类型图表的功能模块。为开发人员提供了一种简单而强大的方式来可视化数据。Qt Charts模块基于Qt GUI框架构建，可以与其他Qt模块无缝集成，例如Qt Widgets、Qt Quick和Qt OpenGL。 Qt Charts模块包含了几个核心类：（1）Q…...

编程日记 2023/10/30 18:08:22

Redis：加速你的应用响应时间，提升用户体验

绝大部分写业务的程序员，在实际开发中使用 Redis 的时候，只会 Set Value 和 Get Value 两个操作，对 Redis 整体缺乏一个认知。这里对 Redis 常见问题做一个总结，解决大家的知识盲点。 1、为什么使用 Redis 在项目中使用 Redis&am…...

编程日记 2023/10/30 18:07:21

乐鑫 SoC 内存映射入门

微控制器 (MCU) 的性能和内存能力逐步提升，其复杂度也随之加大。特别是当用户需要配置内存管理单元来映射外部存储器芯片 (Flash/SPIRAM) 时，这种现象尤其明显。开始在乐鑫 SoC 上运行 Zephyr RTOS 时，会发现这些 SoC 与 ARM 架构的 MCU 相…...

编程日记 2023/10/30 18:06:19

蓝凌EIS智慧协同平台saveImg接口存在任意文件上传漏洞

蓝凌EIS智慧协同平台saveImg接口存在任意文件上传漏洞一、蓝凌EIS简介二、漏洞描述三、影响版本四、fofa查询语句五、漏洞复现六、深度复现1、发送如花2、哥斯拉直连免责声明：请勿利用文章内的相关技术从事非法测试，由于传播、利用此文所提供的信息或者…...

编程日记 2023/10/30 18:05:19

【SEC 学习】美化 Linux 终端

一、步骤 1. 进入 /etc/bash.bashrc vim /etc/bash.bashrc2. 重新加载 bash.bashrc source /etc/bash.bashrc二、各参数指标符号含义\u当前用户的账号名称\h仅取主机的第一个名字，如上例，则为fc4，.linux则被省略\H完整的主机名称。例如&…...

编程日记 2023/10/30 18:04:18

【Unity小技巧】可靠的相机抖动及如何同时处理多个震动（附项目源码）

文章目录每篇一句前言安装虚拟相机虚拟相机震动测试代码控制震动清除震动控制震动的幅度和时间两个不同的强弱震动同时发生源码完结每篇一句围在城里的人想逃出来，站在城外的人想冲进去，婚姻也罢，事业也罢，人生的欲望大都如此…...

编程日记 2023/10/30 18:02:16

【51单片机】51单片机概述（学习笔记）

一、课程简介 1、硬件设备 51单片机开发板 Win电脑 2、软件设备 Keil5：编写程序代码 STC-ISP：下载程序有道词典福昕阅读器二、开发工具介绍 1、Keil5 keil.com > 下载C51版本 > 使用破解程序 2、STC-ISP 绿色版：直接运…...

编程日记 2023/10/30 18:01:14

make和new的区别

make和new都是golang用来分配内存（理论上都是在堆上分配），不同的是 new分配空间只是将内存清零，并没有初始化；而make分配之后只初始化内存new为每个类型都分配，而make专用于slice、map、channew返回类型指…...

编程日记 2023/10/30 17:58:10

vue3获取页面路径

import { useRouter, useRoute } from vue-routerconst router useRouter()router.currentRoute.value.path // 页面路径...

编程日记 2023/10/30 17:56:08

基于STM32闭环步进电机控制系统设计

**单片机设计介绍，1654基于STM32闭环步进电机控制系统设计（仿真，程序，说明） 文章目录一概要二、功能设计设计思路三、软件设计原理图五、程序文档六、文章目录一概要基于STM32的闭环步进电机控制系统设计是…...

编程日记 2023/10/30 17:55:07

Java中的队列：各种类型及使用场景

在Java中，队列是一种重要的数据结构，用于存储按特定顺序排列的元素。队列在多线程环境中特别有用，因为它们可以用来解决并发问题。在Java中，队列主要分为以下几种类型： 接口： Queue: 这是Java Queue接口&…...

编程日记 2023/10/30 17:54:06

MappingMongoConverter原生mongo 枚举类ENUM映射使用的是name

j.l.IllegalArgumentException: No enum constant com.xxx.valobj.TypeEnum.stringat java.lang.Enum.valueOf...

编程日记 2023/10/30 17:52:03

业务系统对接大模型的基础方案：架构设计与关键步骤

业务系统对接大模型：架构设计与关键步骤在当今数字化转型的浪潮中，大语言模型（LLM）已成为企业提升业务效率和创新能力的关键技术之一。将大模型集成到业务系统中，不仅可以优化用户体验，还能为业务决策提供…...

编程新知 2026/2/8 4:53:03

golang循环变量捕获问题

在 Go 语言中，当在循环中启动协程（goroutine）时，如果在协程闭包中直接引用循环变量，可能会遇到一个常见的陷阱 - 循环变量捕获问题。让我详细解释一下： 问题背景看这个代码片段： fo…...

编程新知 2026/1/21 14:29:57

Leetcode 3577. Count the Number of Computer Unlocking Permutations

Leetcode 3577. Count the Number of Computer Unlocking Permutations 1. 解题思路2. 代码实现题目链接：3577. Count the Number of Computer Unlocking Permutations 1. 解题思路这一题其实就是一个脑筋急转弯，要想要能够将所有的电脑解锁&#x…...

编程新知 2026/1/4 2:33:39

五年级数学知识边界总结思考-下册

目录一、背景二、过程1.观察物体小学五年级下册“观察物体”知识点详解：由来、作用与意义**一、知识点核心内容****二、知识点的由来：从生活实践到数学抽象****三、知识的作用：解决实际问题的工具****四、学习的意义：培养核心素养…...

编程新知 2025/10/7 4:57:55

return this；返回的是谁

一个审批系统的示例来演示责任链模式的实现。假设公司需要处理不同金额的采购申请，不同级别的经理有不同的审批权限： // 抽象处理者：审批者 abstract class Approver {protected Approver successor; // 下一个处理者// 设置下一个处理者pub…...

编程新知 2026/1/28 21:45:43

群晖NAS如何在虚拟机创建飞牛NAS

套件中心下载安装Virtual Machine Manager 创建虚拟机配置虚拟机飞牛官网下载 https://iso.liveupdate.fnnas.com/x86_64/trim/fnos-0.9.2-863.iso 群晖NAS如何在虚拟机创建飞牛NAS - 个人信息分享...

编程新知 2026/1/30 6:19:54

PostgreSQL——环境搭建

一、Linux # 安装 PostgreSQL 15 仓库 sudo dnf install -y https://download.postgresql.org/pub/repos/yum/reporpms/EL-$(rpm -E %{rhel})-x86_64/pgdg-redhat-repo-latest.noarch.rpm# 安装之前先确认是否已经存在PostgreSQL rpm -qa | grep postgres# 如果存在&#xff0…...

编程新知 2025/11/26 20:46:42