聊聊RNN&LSTM

时间：2023-12-15

导读：RNN.用于解决输入数据为，序列到序列(时间序列)数据，不能在传统的前馈神经网络(FNN)很好应用的问题。时间序列数据是指在不同时间点上收集到的数据，这类数据反映了某一事物、现象等随时间的变化状态或程度，即输入内容的上下文关联性强。.整体结构.x、o为向量，分别表示输入层、输出层

RNN

用于解决输入数据为，序列到序列(时间序列)数据，不能在传统的前馈神经网络(FNN)很好应用的问题。时间序列数据是指在不同时间点上收集到的数据，这类数据反映了某一事物、现象等随时间的变化状态或程度，即输入内容的上下文关联性强。

整体结构

x、o为向量，分别表示输入层、输出层的值；U、V为权重矩阵，U是输入层到隐藏层的权重矩阵，V是隐藏层到输出层的权重矩阵，W 是上一次的值 S(t-1) 作为这一次的输入的权重矩阵，S(t)是当前的隐藏层矩阵。

RNN层结构与计算公式

RNN层计算公式

RNN层正向传播

MatMul表示矩阵乘积。

这里的h也就是s，都是RNN层函数的输出结果。RNN层的处理函数是tanh，输出结果是h，因此RNN层具有”状态”，这也是其具有记忆性的原因。

RNN隐藏层的输出结果，也被称为隐藏状态或是隐藏状态向量，一般用h或s表示。

RNN层反向传播

蓝线表示反向传播的线路图

带来的问题

由于激活函数Tanh其反向传播时，会导致梯度为0或趋于很大的数值，导致梯度消失或爆炸。

LSTM

通过引入输入门、遗忘门和输出门，解决RNN模型下带来的梯度消失的问题。

整体结构

输出门的结果用o来表示，其计算公式如下：

遗忘门的结果用f表示，其计算公式如下：

输入门的结果用i表示，其计算公式如下：

遗忘门从上一时刻的记忆单元中删除了应该忘记的东西，但需要添加一些应当记住的新信息，新的记忆单元g，其计算公式如下：

要注意的是，不同的门输出所代表的意义不一样，因为其最后流向的地方不一样，分别是转换为了新的记忆单元c，新的隐藏状态h。
最终汇总后的整体结构如下

反向传播

蓝线代表反向传播路径，记忆单元的反向传播仅流过“+”和“×”节点。“+”节点将上游传来的梯度原样流出，所以梯度没有变化（退化）。

优化

LSTM的优化可以从三个方面

LSTM层的多层化
1. 在使用RNN创建高精度模型时，加深LSTM层（叠加多个LSTM层）的方法往往很有效。之前我们只用了一个LSTM层，通过叠加多个层，可以提高语言模型的精度。
基于Dropout抑制过拟合
1. 通过叠加LSTM层，可以期待能够学习到时序数据的复杂依赖关系。换句话说，通过加深层，可以创建表现力更强的模型，但是这样的模型往往会发生过拟合（overfitting）。
2. Dropout随机选择一部分神经元，然后忽略它们，停止向前传递信号。这种“随机忽视”是一种制约，可以提高神经网络的泛化能力。
权重共享
1. 共享权重可以减少需要学习的参数数量，从而促进学习。另外，参数数量减少，还能收获抑制过拟合的好处。
2. 绑定（共享）Embedding层和Affine层的权重的技巧在于权重共享。通过在这两个层之间共享权重，可以大大减少学习的参数数量。

上一篇：软件工程快速入门(下）

下一篇：质量保障体系建设演进案例

阅读

内容

Unity 中的存档系统（本地存
2023-12-09

思想.在游戏过程中，玩家的背包、登录、人物系统都与数据息息相关，无论是一开始就设定好的默认数据，还是可以动态存取的数据，
Cocos Creator 打包
2023-12-09

大家好，我是晓衡！.记得前段时间，在一些群里看到有小伙伴说 Cocos Creator 打包 Android 原生 AP
unity 实现自定义class
2023-12-09

气死我了，搜半天没有，全让序列化再反序列化，又不方便又不美观。结果自己试着一写就通，两行完事。.首先先安装Newtons
Mybatis的工作原理
2023-12-05

mybatis的工作原理.mybatis基本工作原理.封装sql ->调用JDBC操作数据库 -> 返回数据封装.JDB
数据分析师如何用SQL解决业务问
2023-12-03

本文来自问答。.提问：数据分析人员需要掌握sql到什么程度？.请问做一名数据分析人员，在sql方面需要掌握到什么程度呢？
缓存面试解析：穿透、击穿、雪崩，
2023-12-03

为什么使用缓存.在程序内部使用缓存，比如使用map等数据结构作为内部缓存，可以快速获取对象。通过将经常使用的数据存储在缓
Unity学习笔记--数据持久化
2023-12-02

JSON相关.json是国际通用语言，可以跨平台（游戏，软件，网页，不同OS）使用，.json语法较为简单，使用更广泛。
智能车载设备
2023-10-02

智能车载设备.我们的智能车载设备是一款结合了最新科技和创新设计的汽车配件，旨在提升驾驶体验、提高安全性和为用户带来智能化
智能医疗设备
2023-10-02

智能医疗设备产品介绍.智能医疗设备是一款集成了先进技术的高科技产品，旨在提高医疗保健的效率和质量。该设备主要应用于医院、
互联网金融服务平台
2023-10-01

互联网金融服务平台.产品功能.个人理财：用户可以通过平台进行投资理财，选择适合自己的理财产品，实现资金增值。.贷款服务：
电子元件电感
2023-10-02

电子元件电感.产品功能.电感是一种重要的电子元件，用于储存和释放电能，调节电路中的电流和电压。它在电子设备和通讯设备中起
智能智能家居设备
2023-10-05

智能家居设备介绍.产品概述.我们当前运营的产品是智能家居设备，它是一款智能化的家居控制系*，旨在为用户提供更便捷、舒适的
智能可穿戴设备
2023-10-03

产品功能介绍.我们的智能可穿戴设备是一款集健康监测、运动追踪、通讯互动等多种功能于一体的产品。它采用先进的传感技术，可实
智能手机
2023-10-01

产品功能介绍：智能手机.智能手机是一款集通讯、娱乐、办公等功能于一体的移动智能设备。首先，智能手机具有强大的通讯功能，支
智能智能物流设备
2023-10-04

智能物流设备.1. 产品描述.智能物流设备是一款基于物联网技术的智能设备，主要用于运输、储存和**物流货物。其核心功能是
智能智能娱乐设备
2023-10-04

产品功能介绍.1. 智能娱乐设备.我们的智能娱乐设备是一款结合了智能技术和娱乐功能的产品。它拥有丰富的娱乐资源，包括音乐
智能电视
2023-10-01

产品功能介绍.智能电视是一款结合了传统电视和智能硬件的产品。它内置了智能操作系*，能够连接互联网并运行各种应用程序。智能