当前位置: 开发笔记 > 编程语言 > 正文

matlab手写数字识别_TensorFlow下利用MNIST训练模型识别手写数字

作者：果子露强逼_604 | 来源：互联网 | 2023-10-11 08:37

训练MNIST数据集，并保存训练模型#Python3#使用LeNet5的七层卷积神经网络用于MNIST手写数字识别importtensorflowastffromte

训练MNIST数据集&＃xff0c;并保存训练模型

# Python3

# 使用LeNet5的七层卷积神经网络用于MNIST手写数字识别

import tensorflow as tf

from tensorflow.examples.tutorials.mnist import input_data

mnist &＃61; input_data.read_data_sets("MNIST_data", one_hot&＃61;True)

# 为输入图像和目标输出类别创建节点

x &＃61; tf.placeholder(tf.float32, shape&＃61;[None, 784]) # 训练所需数据占位符

y_ &＃61; tf.placeholder(tf.float32, shape&＃61;[None, 10]) # 训练所需标签数据占位符

# *************** 构建多层卷积网络 *************** #

# 权重、偏置、卷积及池化操作初始化,以避免在建立模型的时候反复做初始化操作

def weight_variable(shape):

initial &＃61; tf.truncated_normal(shape, stddev&＃61;0.1) # 取随机值&＃xff0c;符合均值为0&＃xff0c;标准差stddev为0.1

return tf.Variable(initial)

def bias_variable(shape):

initial &＃61; tf.constant(0.1, shape&＃61;shape)

return tf.Variable(initial)

# x 的第一个参数为图片的数量&＃xff0c;第二、三个参数分别为图片高度和宽度&＃xff0c;第四个参数为图片通道数。

# W 的前两个参数为卷积核尺寸&＃xff0c;第三个参数为图像通道数&＃xff0c;第四个参数为卷积核数量

# strides为卷积步长&＃xff0c;其第一、四个参数必须为1&＃xff0c;因为卷积层的步长只对矩阵的长和宽有效

# padding表示卷积的形式&＃xff0c;即是否考虑边界。"SAME"是考虑边界&＃xff0c;不足的时候用0去填充周围&＃xff0c;"VALID"则不考虑

def conv2d(x, W):

return tf.nn.conv2d(x, W, strides&＃61;[1, 1, 1, 1], padding&＃61;&＃39;SAME&＃39;)

# x 参数的格式同tf.nn.conv2d中的x&＃xff0c;ksize为池化层过滤器的尺度&＃xff0c;strides为过滤器步长

def max_pool_2x2(x):

return tf.nn.max_pool(x, ksize&＃61;[1, 2, 2, 1], strides&＃61;[1, 2, 2, 1], padding&＃61;&＃39;SAME&＃39;)

#把x更改为4维张量&＃xff0c;第1维代表样本数量&＃xff0c;第2维和第3维代表图像长宽&＃xff0c; 第4维代表图像通道数

x_image &＃61; tf.reshape(x, [-1,28,28,1]) # -1表示任意数量的样本数,大小为28x28&＃xff0c;深度为1的张量

# 第一层&＃xff1a;卷积

W_conv1 &＃61; weight_variable([5, 5, 1, 32]) # 卷积在每个5x5的patch中算出32个特征。

b_conv1 &＃61; bias_variable([32])

h_conv1 &＃61; tf.nn.relu(conv2d(x_image, W_conv1) &＃43; b_conv1)

# 第二层&＃xff1a;池化

h_pool1 &＃61; max_pool_2x2(h_conv1)

# 第三层&＃xff1a;卷积

W_conv2 &＃61; weight_variable([5, 5, 32, 64])

b_conv2 &＃61; bias_variable([64])

h_conv2 &＃61; tf.nn.relu(conv2d(h_pool1, W_conv2) &＃43; b_conv2)

# 第四层&＃xff1a;池化

h_pool2 &＃61; max_pool_2x2(h_conv2)

# 第五层&＃xff1a;全连接层

W_fc1 &＃61; weight_variable([7 * 7 * 64, 1024])

b_fc1 &＃61; bias_variable([1024])

h_pool2_flat &＃61; tf.reshape(h_pool2, [-1, 7*7*64])

h_fc1 &＃61; tf.nn.relu(tf.matmul(h_pool2_flat, W_fc1) &＃43; b_fc1)

# 在输出层之前加入dropout以减少过拟合

keep_prob &＃61; tf.placeholder("float")

h_fc1_drop &＃61; tf.nn.dropout(h_fc1, keep_prob)

# 第六层&＃xff1a;全连接层

W_fc2 &＃61; weight_variable([1024, 10])

b_fc2 &＃61; bias_variable([10])

# 第七层&＃xff1a;输出层

y_conv&＃61;tf.nn.softmax(tf.matmul(h_fc1_drop, W_fc2) &＃43; b_fc2)

# *************** 训练和评估模型 *************** #

# 为训练过程指定最小化误差用的损失函数&＃xff0c;即目标类别和预测类别之间的交叉熵

cross_entropy &＃61; -tf.reduce_sum(y_*tf.log(y_conv))

# 使用反向传播&＃xff0c;利用优化器使损失函数最小化

train_step &＃61; tf.train.AdamOptimizer(1e-4).minimize(cross_entropy)

# 检测我们的预测是否真实标签匹配(索引位置一样表示匹配)

# tf.argmax(y_conv,dimension), 返回最大数值的下标通常和tf.equal()一起使用&＃xff0c;计算模型准确度

# dimension&＃61;0 按列找 dimension&＃61;1 按行找

correct_prediction &＃61; tf.equal(tf.argmax(y_conv,1), tf.argmax(y_,1))

# 统计测试准确率&＃xff0c; 将correct_prediction的布尔值转换为浮点数来代表对、错&＃xff0c;并取平均值。

accuracy &＃61; tf.reduce_mean(tf.cast(correct_prediction, "float"))

saver &＃61; tf.train.Saver() # 定义saver

# *************** 开始训练模型 *************** #

with tf.Session() as sess:

sess.run(tf.global_variables_initializer())

for i in range(1000):

batch &＃61; mnist.train.next_batch(50)

if i%100 &＃61;&＃61; 0:

# 评估模型准确度&＃xff0c;此阶段不使用Dropout

train_accuracy &＃61; accuracy.eval(feed_dict&＃61;{x:batch[0], y_: batch[1], keep_prob: 1.0})

print("step %d, training accuracy %g"%(i, train_accuracy))

# 训练模型&＃xff0c;此阶段使用50%的Dropout

train_step.run(feed_dict&＃61;{x: batch[0], y_: batch[1], keep_prob: 0.5})

saver.save(sess, &＃39;./save/model.ckpt&＃39;) #模型储存位置

print("test accuracy %g"%accuracy.eval(feed_dict&＃61;{x: mnist.test.images [0:2000], y_: mnist.test.labels [0:2000], keep_prob: 1.0}))

手写数字图像预处理

然后自己手写数字

利用Python和OpenCV进行图像预处理

需要安装Python的OpenCV接口(安装命令&＃xff1a;pip install opencv-python)
MNIST要求数据为28*28像素&＃xff0c;单通道&＃xff0c;且需要二值化。

import cv2

global img

global point1, point2

def on_mouse(event, x, y, flags, param):

global img, point1, point2

img2 &＃61; img.copy()

if event &＃61;&＃61; cv2.EVENT_LBUTTONDOWN: #左键点击

point1 &＃61; (x,y)

cv2.circle(img2, point1, 10, (0,255,0), 5)

cv2.imshow(&＃39;image&＃39;, img2)

elif event &＃61;&＃61; cv2.EVENT_MOUSEMOVE and (flags & cv2.EVENT_FLAG_LBUTTON): #按住左键拖曳

cv2.rectangle(img2, point1, (x,y), (255,0,0), 5) # 图像&＃xff0c;矩形顶点&＃xff0c;相对顶点&＃xff0c;颜色&＃xff0c;粗细

cv2.imshow(&＃39;image&＃39;, img2)

elif event &＃61;&＃61; cv2.EVENT_LBUTTONUP: #左键释放

point2 &＃61; (x,y)

cv2.rectangle(img2, point1, point2, (0,0,255), 5)

cv2.imshow(&＃39;image&＃39;, img2)

min_x &＃61; min(point1[0], point2[0])

min_y &＃61; min(point1[1], point2[1])

width &＃61; abs(point1[0] - point2[0])

height &＃61; abs(point1[1] -point2[1])

cut_img &＃61; img[min_y:min_y&＃43;height, min_x:min_x&＃43;width]

resize_img &＃61; cv2.resize(cut_img, (28,28)) # 调整图像尺寸为28*28

ret, thresh_img &＃61; cv2.threshold(resize_img,127,255,cv2.THRESH_BINARY) # 二值化

cv2.imshow(&＃39;result&＃39;, thresh_img)

cv2.imwrite(&＃39;./images/text.png&＃39;, thresh_img) # 预处理后图像保存位置

def main():

global img

img &＃61; cv2.imread(&＃39;./images/src.jpg&＃39;) # 手写数字图像所在位置

img &＃61; cv2.cvtColor(img, cv2.COLOR_BGR2GRAY) # 转换图像为单通道(灰度图)

cv2.namedWindow(&＃39;image&＃39;)

cv2.setMouseCallback(&＃39;image&＃39;, on_mouse) # 调用回调函数

cv2.imshow(&＃39;image&＃39;, img)

cv2.waitKey(0)

if __name__ &＃61;&＃61; &＃39;__main__&＃39;:

main()

运行上方代码&＃xff0c;利用鼠标框选自己手写数字区域&＃xff0c;完成图像预处理&＃xff0c;可得到如下图像

手写数字识别

完成图像预处理后&＃xff0c;即可将图片输入到网络中进行识别

from PIL import Image

import tensorflow as tf

import numpy as np

im &＃61; Image.open(&＃39;./images/text.png&＃39;)

data &＃61; list(im.getdata())

result &＃61; [(255-x)*1.0/255.0 for x in data]

print(result)

# 为输入图像和目标输出类别创建节点

x &＃61; tf.placeholder("float", shape&＃61;[None, 784]) # 训练所需数据占位符

# *************** 构建多层卷积网络 *************** #

def weight_variable(shape):

initial &＃61; tf.truncated_normal(shape, stddev&＃61;0.1) # 取随机值&＃xff0c;符合均值为0&＃xff0c;标准差stddev为0.1

return tf.Variable(initial)

def bias_variable(shape):

initial &＃61; tf.constant(0.1, shape&＃61;shape)

return tf.Variable(initial)

def conv2d(x, W):

return tf.nn.conv2d(x, W, strides&＃61;[1, 1, 1, 1], padding&＃61;&＃39;SAME&＃39;)

def max_pool_2x2(x):

return tf.nn.max_pool(x, ksize&＃61;[1, 2, 2, 1], strides&＃61;[1, 2, 2, 1], padding&＃61;&＃39;SAME&＃39;)

x_image &＃61; tf.reshape(x, [-1,28,28,1]) # -1表示任意数量的样本数,大小为28x28&＃xff0c;深度为1的张量

W_conv1 &＃61; weight_variable([5, 5, 1, 32]) # 卷积在每个5x5的patch中算出32个特征。

b_conv1 &＃61; bias_variable([32])

h_conv1 &＃61; tf.nn.relu(conv2d(x_image, W_conv1) &＃43; b_conv1)

h_pool1 &＃61; max_pool_2x2(h_conv1)

W_conv2 &＃61; weight_variable([5, 5, 32, 64])

b_conv2 &＃61; bias_variable([64])

h_conv2 &＃61; tf.nn.relu(conv2d(h_pool1, W_conv2) &＃43; b_conv2)

h_pool2 &＃61; max_pool_2x2(h_conv2)

W_fc1 &＃61; weight_variable([7 * 7 * 64, 1024])

b_fc1 &＃61; bias_variable([1024])

h_pool2_flat &＃61; tf.reshape(h_pool2, [-1, 7*7*64])

h_fc1 &＃61; tf.nn.relu(tf.matmul(h_pool2_flat, W_fc1) &＃43; b_fc1)

# 在输出层之前加入dropout以减少过拟合

keep_prob &＃61; tf.placeholder("float")

h_fc1_drop &＃61; tf.nn.dropout(h_fc1, keep_prob)

# 全连接层

W_fc2 &＃61; weight_variable([1024, 10])

b_fc2 &＃61; bias_variable([10])

# 输出层

# tf.nn.softmax()将神经网络的输层变成一个概率分布

y_conv&＃61;tf.nn.softmax(tf.matmul(h_fc1_drop, W_fc2) &＃43; b_fc2)

saver &＃61; tf.train.Saver() # 定义saver

# *************** 开始识别 *************** #

with tf.Session() as sess:

sess.run(tf.global_variables_initializer())

saver.restore(sess, "./save/model.ckpt")#这里使用了之前保存的模型参数

prediction &＃61; tf.argmax(y_conv,1)

predint &＃61; prediction.eval(feed_dict&＃61;{x: [result],keep_prob: 1.0}, session&＃61;sess)

print("recognize result: %d" %predint[0])

推荐阅读

get
开源Keras Faster RCNN模型介绍及代码结构解析

本文介绍了开源Keras Faster RCNN模型的环境需求和代码结构，包括FasterRCNN源码解析、RPN与classifier定义、data_generators.py文件的功能以及损失计算。同时提供了该模型的开源地址和安装所需的库。 ... [详细]

蜡笔小新 2023-12-10 17:44:07
get
Python正则表达式学习记录及常用方法

本文记录了学习Python正则表达式的过程，介绍了re模块的常用方法re.search，并解释了rawstring的作用。正则表达式是一种方便检查字符串匹配模式的工具，通过本文的学习可以掌握Python中使用正则表达式的基本方法。 ... [详细]

蜡笔小新 2023-12-13 16:37:19
import
基于dlib的人脸68特征点提取(眨眼张嘴检测)python版本

文章目录引言开发环境和库流程设计张嘴和闭眼的检测引言(1)利用Dlib官方训练好的模型“shape_predictor_68_face_landmarks.dat”进行68个点标定 ... [详细]

蜡笔小新 2023-12-12 13:27:42
web
python打卡记录去重_Python零基础学习笔记与记录之一（了解Python这个小伙伴）

本人学习笔记，知识点均摘自于网络，用于学习和交流(如未注明出处，请提醒，将及时更正，谢谢)OS:我学习是为了上 ... [详细]

蜡笔小新 2023-10-17 16:05:58
list
微软头条实习生分享深度学习自学指南

本文介绍了一位微软头条实习生自学深度学习的经验分享，包括学习资源推荐、重要基础知识的学习要点等。作者强调了学好Python和数学基础的重要性，并提供了一些建议。 ... [详细]

蜡笔小新 2023-12-14 20:58:32
get
向QTextEdit拖放文件的方法及实现步骤

本文介绍了在使用QTextEdit时如何实现拖放文件的功能，包括相关的方法和实现步骤。通过重写dragEnterEvent和dropEvent函数，并结合QMimeData和QUrl等类，可以轻松实现向QTextEdit拖放文件的功能。详细的代码实现和说明可以参考本文提供的示例代码。 ... [详细]

蜡笔小新 2023-12-14 16:06:38
int
Python异常的捕获、传递与抛出操作示例

本文介绍了Python异常的捕获、传递与抛出操作，并提供了相关的操作示例。通过异常的捕获和传递，可以有效处理程序中的错误情况。同时，还介绍了如何主动抛出异常。通过本文的学习，读者可以掌握Python中异常处理的基本方法和技巧。 ... [详细]

蜡笔小新 2023-12-14 16:04:01
int
UVALive6575 Odd and Even Zeroes 数位dp+找规律

本文介绍了UVALive6575题目Odd and Even Zeroes的解法，使用了数位dp和找规律的方法。阶乘的定义和性质被介绍，并给出了一些例子。其中，部分阶乘的尾零个数为奇数，部分为偶数。 ... [详细]

蜡笔小新 2023-12-13 14:19:28
byte
CF：3D City Model（小思维）问题解析和代码实现

本文通过解析CF：3D City Model问题，介绍了问题的背景和要求，并给出了相应的代码实现。该问题涉及到在一个矩形的网格上建造城市的情景，每个网格单元可以作为建筑的基础，建筑由多个立方体叠加而成。文章详细讲解了问题的解决思路，并给出了相应的代码实现供读者参考。 ... [详细]

蜡笔小新 2023-12-13 14:17:11
eval
也就是|小窗_卷积的特征提取与参数计算

篇首语：本文由编程笔记#小编为大家整理，主要介绍了卷积的特征提取与参数计算相关的知识，希望对你有一定的参考价值。Dense和Conv2D根本区别在于，Den ... [详细]

蜡笔小新 2023-12-13 12:59:48
import
[大整数乘法] java代码实现

本文介绍了使用java代码实现大整数乘法的过程，同时也涉及到大整数加法和大整数减法的计算方法。通过分治算法来提高计算效率，并对算法的时间复杂度进行了研究。详细代码实现请参考文章链接。 ... [详细]

蜡笔小新 2023-12-13 11:21:32
get
通过Go SDK（Amazon S3）从Bucket生成Torrent - Generate Torrent from Bucket via Go SDK (Amazon S3)

Imtryingtofigureoutawaytogeneratetorrentfilesfromabucket,usingtheAWSSDKforGo.我正 ... [详细]

蜡笔小新 2023-12-12 14:13:01
import
学习Java异常处理之throws之抛出并捕获异常（9）

任务描述本关任务：在main方法之外创建任意一个方法接收给定的两个字符串，把第二个字符串的长度减1生成一个整数值，输出第一个字符串长度是 ... [详细]

蜡笔小新 2023-12-12 10:14:42
import
Python操作MySQL（pymysql模块）详解及示例代码

本文介绍了使用Python操作MySQL数据库的方法，详细讲解了pymysql模块的安装和连接MySQL数据库的步骤，并提供了示例代码。内容涵盖了创建表、插入数据、查询数据等操作，帮助读者快速掌握Python操作MySQL的技巧。 ... [详细]

蜡笔小新 2023-12-10 17:50:06
import
通过Anaconda安装tensorflow，并安装运行spyder编译器的完整教程

本文提供了一个完整的教程，介绍了如何通过Anaconda安装tensorflow，并安装运行spyder编译器。文章详细介绍了安装Anaconda、创建tensorflow环境、安装GPU版本tensorflow、安装和运行Spyder编译器以及安装OpenCV等步骤。该教程适用于Windows 8操作系统，并提供了相关的网址供参考。通过本教程，读者可以轻松地安装和配置tensorflow环境，以及运行spyder编译器进行开发。 ... [详细]

蜡笔小新 2023-12-09 09:46:32

果子露强逼_604

这个家伙很懒，什么也没留下！

Tags | 热门标签

RankList | 热门文章