1.mnist数集介绍
MNIST数据集官网: Yann LeCun's website
6w行训练数据集,1w行测试训练集
训练集:训练集数据(t10k-images.idx3-ubyte)和训练集标签(t10k-labels.idx1-ubyte)
每张图片28*28=784,因此训练集mnist.train.images是一个形状为【60000,784】的张量第一个维度数字 用来索引图片,第二个维度的数字用来索引每一张图片中的像素点,像素强度介于0-1之间
数据集的标签是介于0-9的数字,要把标签转化为“one-hot vectors",数据集mnist.train.labels是 一个【60000,10】的数字矩阵
2.softmax函数
用来分类,得到的结果转化为概率。
3.代码部分
import tensorflow as tf
from tensorflow.examples.tutorials.mnist import input_data
#载入数据集
mnist = input_data.read_data_sets("MNIST_data",one_hot=True)
#每个批次的大小
batch_size = 100
#计算一共有多少个批次
n_batch = mnist.train.num_examples//batch_size
#定义两个placeholder
x = tf.placeholder(tf.float32,[None,784])#一张图片784
y = tf.placeholder(tf.float32,[None,10])
#创建简单神经网络,输入层784个神经元,输出层10个神经元
W = tf.Variable(tf.zeros([784,10]))
b = tf.Variable(tf.zeros([10]))
prediction = tf.nn.softmax(tf.matmul(x,W)+b)
#二次代价函数
# loss = tf.reduce_mean(tf.square(y-prediction))
#使用梯度下降法
train_step = tf.train.GradientDescentOptimizer(0.2).minimize(loss)
#初始化变量
init = tf.global_variables_initializer()
#返回prediction中概率最大的标签(总共10个),再equal比较
#如果位置相同,结果为1,否则0,结果存放在一个布尔型列表中
correct_prediction = tf.equal(tf.argmax(y,1),tf.argmax(prediction,1))#argmax返回一维张量中最大的值所在的位置
#求准确率
#cast为转换类型,再求平均值,平均值就是准确率,因为只有0.1,理解一下!
accuracy = tf.reduce_mean(tf.cast(correct_prediction,tf.float32))
with tf.Session() as sess:
sess.run(init)
#所有数据迭代21次
for epoch in range(21):
#每一次迭代的批次
for batch in range(n_batch):
#用next那个函数,xs为图片,ys为标签
batch_xs,batch_ys = mnist.train.next_batch(batch_size)
sess.run(train_step,feed_dict={x:batch_xs,y:batch_ys})
acc = sess.run(accuracy,feed_dict={x:mnist.test.images,y:mnist.test.labels})
print("Iter"+str(epoch)+"Testing Accuracy"+str(acc))