当前位置：首页 > news >正文

【卷积神经网络】MNIST 手写体识别

news 2026/2/8 17:25:15

LeNet-5 是经典卷积神经网络之一，1998 年由 Yann LeCun 等人在论文《Gradient-Based Learning Applied to Document Recognition》中提出。LeNet-5 网络使用了卷积层、池化层和全连接层，实现可以应用于手写体识别的卷积神经网络。TensorFlow 内置了 MNIST 手写体数据集，可以很方便地读取数据集，并应用于后续的模型训练过程中。本文主要记录了如何使用 TensorFlow 2.0 实现 MNIST 手写体识别模型。

1 数据集准备

2 模型建立

3 模型训练

1 数据集准备

TensorFlow 内置了 MNIST 手写体数据集，安装 TensorFlow 之后，使用如下代码就可以加载 MNIST 数据集：

import tensorflow as tfmnist = tf.keras.datasets.mnist
(train_x, train_y), (test_x, test_y) = mnist.load_data()

使用 Matplotlib 查看前 25 张图片，并打印对应的标签。

from matplotlib import pyplot as plt# 查看训练集
plt.figure(figsize=(3,3))
for i in range(25):plt.subplot(5,5,i+1)plt.imshow(train_x[i], cmap=plt.cm.binary)plt.xticks([])plt.yticks([])
plt.show()

接着，使用 tf.one_hot() 函数，对图像的标签进行独热码编码。

# 预处理
train_y = tf.one_hot(train_y, depth=10)
test_y = tf.one_hot(test_y, depth=10)

2 模型建立

MNIST 手写体数据集中，每张图像的大小是 28 × 28 × 1，按照 LeNet-5 模型的思路，构建卷积神经网络模型。选择 5 × 5 的卷积核，卷积层之后是 2 × 2 的平均池化，激活函数选择 sigmoid（除了最后一层）。

# the first layer can receive an 'input_shape' argument
model = tf.keras.models.Sequential([tf.keras.layers.Conv2D(filters=6,kernel_size=5,padding='valid',activation='sigmoid',input_shape=(28,28,1)),tf.keras.layers.AveragePooling2D(pool_size=(2,2),strides=2,padding='valid'),tf.keras.layers.Conv2D(filters=16,kernel_size=5,padding='valid',activation='sigmoid'),tf.keras.layers.AveragePooling2D(pool_size=(2,2),strides=2,padding='valid'),tf.keras.layers.Flatten(),tf.keras.layers.Dense(120,activation='sigmoid'),tf.keras.layers.Dense(84,activation='sigmoid'),tf.keras.layers.Dense(10,activation='softmax')
])

使用 model.summary() 查看模型信息。

model.summary()

Model: "sequential"
_________________________________________________________________
Layer (type) Output Shape Param #
=================================================================
conv2d (Conv2D) (None, 24, 24, 6) 156

average_pooling2d (AverageP (None, 12, 12, 6) 0
ooling2D)

conv2d_1 (Conv2D) (None, 8, 8, 16) 2416

average_pooling2d_1 (Averag (None, 4, 4, 16) 0
ePooling2D)

flatten (Flatten) (None, 256) 0

dense (Dense) (None, 120) 30840

dense_1 (Dense) (None, 84) 10164

dense_2 (Dense) (None, 10) 850

=================================================================
Total params: 44,426
Trainable params: 44,426
Non-trainable params: 0
_________________________________________________________________

3 模型训练

使用 compile() 函数配置模型，优化算法为 Adam 算法，学习率为 0.001，损失函数为交叉熵损失函数。

# 模型配置
model.compile(optimizer=tf.keras.optimizer.Adam(learning_rate=1e-3),loss=tf.keras.losses.CategoricalCrossentropy(),metrics=['accuracy']
)# 模型训练
model.fit(x=train_x,y=train_y,validation_split=0.0,epochs=10
)

Epoch 1/10
1875/1875 [==============================] - 72s 38ms/step - loss: 0.5806 - accuracy: 0.8206
Epoch 2/10
1875/1875 [==============================] - 70s 37ms/step - loss: 0.1254 - accuracy: 0.9620
Epoch 3/10
1875/1875 [==============================] - 75s 40ms/step - loss: 0.0870 - accuracy: 0.9735
Epoch 4/10
1875/1875 [==============================] - 82s 43ms/step - loss: 0.0699 - accuracy: 0.9785
Epoch 5/10
1875/1875 [==============================] - 69s 37ms/step - loss: 0.0604 - accuracy: 0.9809
Epoch 6/10
1875/1875 [==============================] - 68s 36ms/step - loss: 0.0530 - accuracy: 0.9833
Epoch 7/10
1875/1875 [==============================] - 72s 38ms/step - loss: 0.0477 - accuracy: 0.9854
Epoch 8/10
1875/1875 [==============================] - 70s 38ms/step - loss: 0.0436 - accuracy: 0.9863
Epoch 9/10
1875/1875 [==============================] - 70s 37ms/step - loss: 0.0399 - accuracy: 0.9873
Epoch 10/10
1875/1875 [==============================] - 68s 36ms/step - loss: 0.0357 - accuracy: 0.9883
<keras.callbacks.History at 0x20a56b65660>

【卷积神经网络】MNIST 手写体识别

1 数据集准备

2 模型建立

3 模型训练

相关文章：

【卷积神经网络】MNIST 手写体识别

Ansible学习笔记2

80. 删除有序数组中的重复项 II

CVE-2023-36874 Windows错误报告服务本地权限提升漏洞分析

IDEA遇到 git pull 冲突的几种解决方法

[Unity]UI和美术出图效果不一致

SpringBoot整合JPA和Hibernate框架

Java中文件的创建(三种方式)，文件常用的方法

Spring boot中调用C/C++（dll）

【Apollo学习笔记】——规划模块TASK之PATH_DECIDER

Lua学习（二）

制作鲜花商城小程序的详细步骤

Ubuntu20以上高版本如何安装低版本GCC

context.WithCancel()的使用

vue3中引入百度地图

【Linux-Day8- 进程替换和信号】

日志文件之间关系和介绍及应用

mac电脑屏幕录制Berrycast Mac屏幕录制软件

机器学习笔记之最优化理论与方法(一)最优化问题概述

【ES5新特性一】严格模式语法变化、全局的JSON对象、编码和解码的方法

UE5 学习系列（二）用户操作界面及介绍

XML Group端口详解

在软件开发中正确使用MySQL日期时间类型的深度解析

React Native 导航系统实战（React Navigation）

相机Camera日志实例分析之二：相机Camx【专业模式开启直方图拍照】单帧流程日志详解

macOS多出来了：Google云端硬盘、YouTube、表格、幻灯片、Gmail、Google文档等应用

解决本地部署 SmolVLM2 大语言模型运行 flash-attn 报错

安宝特方案丨船舶智造的“AR+AI+作业标准化管理解决方案”（装配）

排序算法总结（C++）

在鸿蒙HarmonyOS 5中使用DevEco Studio实现企业微信功能