LSTM简单实例

个人笔记 感谢指正

LSTM_tensorflow

1.导入包
import tensorflow as tf
from tensorflow.examples.tutorials.mnist import input_data
2.导入mnist手写数据集
mnist = input_data.read_data_sets('MNIST_data/',one_hot=True)
3.设置相应的参数
n_inputs = 28  #单个LSTM神经元接受的向量维度
max_time = 28  #一次输入的时间跨度
lstm_size = 100 #隐藏层数
n_classes = 10  #输出种类数
batch_size = 50  #批次的大小
n_batch = mnist.train.num_examples // batch_size  #计算批次数
4.定义占位变量
#None表示这一个维度值可以为任意值
x = tf.placeholder(tf.float32,[None,784])
y = tf.placeholder(tf.float32,[None,10])
5.初始化权重与偏置
#初始化权重
weights = tf.Variable(tf.truncated_normal([lstm_size,n_classes],stddev=0.1)) 
#初始化偏置
biases = tf.Variable(tf.constant(0.1,shape=[n_classes]))

#注意:单个LSTM神经元输出的都是标量,只有多个LSTM神经元组成的LSTMCell输出的才是标量,而且这里的weights是LSTMCell与最后全连接层之间的参数,LSTMCell中的参数不需要我们去设置

6.定义RNN网络(包括最后的全连接层)
def RNN(X,weights,biases):
    inputs = tf.reshape(X,[-1,max_time,n_inputs])
    lstm_cell = tf.contrib.rnn.BasicLSTMCell(lstm_size)
    outputs, final_state = tf.nn.dynamic_rnn(lstm_cell,inputs,dtype=tf.float32) 
    results = tf.nn.softmax(tf.matmul(final_state[1],weights) + biases)
    return results

#tf.contrib.rnn.BasicLSTMCell(hidden_units)函数:其实就是定义一个LSTM神经元组成的一层,但是我们只需要传入该层的units的大小,至于该层的权重与偏置并不需要我们去设置

#tf.nn.dynamic_rnn(lstm_cell,inputs,dtype=tf.float32): Creates a recurrent neural network specified by RNNCell cell

7.代价函数与优化器设置
prediction = RNN(x,weights,biases)

cross_entropy = tf.reduce_mean(tf.nn.softmax_cross_entropy_with_logits(labels=y,logits=prediction))

train_step = tf.train.AdamOptimizer(1e-4).minimize(cross_entropy)

correct_prediction = tf.equal(tf.argmax(prediction,1),tf.argmax(y,1))

accuracy = tf.reduce_mean(tf.cast(correct_prediction,tf.float32))

init = tf.global_variables_initializer()  #return An Op that initializes global variables in the graph.
8.会话编写
with tf.Session() as sess:
    sess.run(init)
    for epoch in range(6):
        for batch in range(n_batch):
            batch_xs, batch_ys = mnist.train.next_batch(batch_size)
            sess.run(train_step,feed_dict={x:batch_xs,y:batch_ys})

        acc = sess.run(accuracy,feed_dict={x:mnist.test.images,y:mnist.test.labels})
        print('Iter' + str(epoch) + ',Testing Accuracy' + str(acc))
9.LSTM原理分析

参考来源:https://blog.csdn.net/mch2869253130/article/details/89150043
注意:下述公式中的乘法都是元素乘法不是矩阵乘法
在这里插入图片描述

1.忘记门

在这里插入图片描述
第一步是决定从细胞状态里扔掉什么信息(也就是保留多少信息)。将上一步细胞状态中的信息选择性的遗忘 。
实现方式:通过sigmoid层实现的“忘记门”。以上一步的 h t − 1 h_{t-1} ht1和本次的输 入 x t 入x_{t} xt,然后为 C t − 1 C_{t-1} Ct1的每一个数字输出一个0-1的值,记为 f t f_{t} ft

2.输入层门

在这里插入图片描述
第二步是决定在细胞状态里存什么。将新的信息选择性的记录到细胞状态中。
实现方式:
sigmoid层(输入门层)决定我们要更新什么值,这个概率表示为 i t i_{t} it
tanh层创建一个候选值向量 C ~ \widetilde{C} C 将会被增加到细胞状态中。 我们将会在下一步把这两个结合起来更新细胞状态。

3.更新细胞状态(细胞状态)

在这里插入图片描述
更新旧的细胞状态实现方式: f t f_{t} ft表示忘记上一次信息 C t − 1 C_{t-1} Ct

  • 0
    点赞
  • 17
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
这是一个简单的 MATLAB 代码示例,演示如何使用 LSTM(长短时记忆)神经网络来进行分类。 首先,我们需要准备一些训练数据和测试数据。在这个例子中,我们将使用一个人工制造的数据集,其中包含两个类别的数据点。 ``` % 生成一些训练数据和测试数据 train_data = [randn(100,2)+2; randn(100,2)-2]; train_labels = [ones(100,1); zeros(100,1)]; test_data = [randn(50,2)+2; randn(50,2)-2]; test_labels = [ones(50,1); zeros(50,1)]; ``` 接下来,我们将定义 LSTM 神经网络模型。在这个例子中,我们将使用 2 个 LSTM 层和一个全连接层来进行分类。我们还需要定义一些超参数,例如网络的隐藏单元数量、学习率、训练次数等。 ``` % 定义 LSTM 神经网络模型 num_hidden_units = 10; learning_rate = 0.01; num_epochs = 100; layers = [ sequenceInputLayer(2) lstmLayer(num_hidden_units,'OutputMode','last') lstmLayer(num_hidden_units,'OutputMode','last') fullyConnectedLayer(1) sigmoidActivationLayer regressionLayer]; options = trainingOptions('adam', ... 'MaxEpochs', num_epochs, ... 'MiniBatchSize', 32, ... 'InitialLearnRate', learning_rate, ... 'GradientThreshold', 1, ... 'Shuffle', 'every-epoch', ... 'Plots','training-progress'); ``` 现在,我们可以使用 `trainNetwork` 函数来训练模型。训练过程中,我们将使用训练数据来更新模型的参数。 ``` % 训练 LSTM 神经网络模型 net = trainNetwork(train_data', train_labels', layers, options); ``` 训练完成后,我们可以使用 `classify` 函数来对测试数据进行分类,并计算分类准确率。 ``` % 对测试数据进行分类并计算准确率 test_predictions = classify(net, test_data'); accuracy = sum(test_predictions == test_labels') / numel(test_labels); fprintf('测试准确率:%.2f%%\n', accuracy * 100); ``` 完整代码如下: ``` % 生成一些训练数据和测试数据 train_data = [randn(100,2)+2; randn(100,2)-2]; train_labels = [ones(100,1); zeros(100,1)]; test_data = [randn(50,2)+2; randn(50,2)-2]; test_labels = [ones(50,1); zeros(50,1)]; % 定义 LSTM 神经网络模型 num_hidden_units = 10; learning_rate = 0.01; num_epochs = 100; layers = [ sequenceInputLayer(2) lstmLayer(num_hidden_units,'OutputMode','last') lstmLayer(num_hidden_units,'OutputMode','last') fullyConnectedLayer(1) sigmoidActivationLayer regressionLayer]; options = trainingOptions('adam', ... 'MaxEpochs', num_epochs, ... 'MiniBatchSize', 32, ... 'InitialLearnRate', learning_rate, ... 'GradientThreshold', 1, ... 'Shuffle', 'every-epoch', ... 'Plots','training-progress'); % 训练 LSTM 神经网络模型 net = trainNetwork(train_data', train_labels', layers, options); % 对测试数据进行分类并计算准确率 test_predictions = classify(net, test_data'); accuracy = sum(test_predictions == test_labels') / numel(test_labels); fprintf('测试准确率:%.2f%%\n', accuracy * 100); ```

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值