首先导入官网模块与数据集:
from tensorflow.examples.tutrials.mnist import input_data
mnist = input_data.read_data_sets('MNIST_data',one_hot=True)
# 若文件不存在时 , 会自动执行下载
# 打印出第0幅图片的向量表示
print(mnist.train.images[0, :])
# 打印出第0幅图片的标签
print(mnist.train.labels[0, :])
将保存的数据进行图片化观察:
import scipy.misc
import os
import cv2
#将生成的图片保存在raw文件夹下,输出前5张图片为例
save_dir = 'MNIST_data/raw/'
if os.path.exists(save_dir) is False:
os.makedirs(save_dir)
for i in range(5):
# mnist.train.images[i, :]就表示第i张图片(序号从0开始)
image_array = mnist.train.images[i, :]
# TensorFlow中的MNIST图片是一个784维的向量,我们重新把它还原为28x28维的图像。
image_array = image_array.reshape(28, 28)
# 保存文件的格式为 mnist_train_0.jpg, mnist_train_1.jpg, ... ,mnist_train_19.jpg
filename = save_dir + 'mnist_train_%d.jpg' % i
# 将image_array保存为图片
# 先用scipy.misc.toimage转换为图像,再调用save直接保存。
# scipy.misc.toimage(image_array, cmin=0.0, cmax=1.0).save(filename) 由于函数已经被删除 用新的函数 *255是将标准化的全黑的图像化为原来的图像
cv2.imwrite(filename, image_array*255)

下一步,查看数据的标签:
for i in range(5):
# 得到one-hot表示,形如(0, 1, 0, 0, 0, 0, 0, 0, 0, 0)
one_hot_label = mnist.train.labels[i, :]
# 通过np.argmax我们可以直接获得原始的label
# 因为只有1位为1,其他都是0
label = np.argmax(one_hot_label)
print('mnist_train_%d.jpg label: %d' % (i, label))

下一篇文章我会写一下用CNN进行识别,如果你出现了某些属性不存在的问题,也可以选择降低版本之类的方法.
本文档展示了如何使用TensorFlow加载MNIST数据集,并将数据集中的图片向量还原为28x28的图像进行可视化。同时,还解释了如何获取和理解数据集中的标签。最后,文章预告将利用CNN对MNIST数据集进行识别。

2万+

被折叠的 条评论
为什么被折叠?



