如何计算LSTM层中的参数数量

长短期记忆网络（通常称为“ LSTM”）是一种特殊的RNN，经过精心设计LSTM能够学习长期的依赖。正如他的名字，它可以学习长期和短期的依赖。

每个LSTM层都有四个门：

下面计算一个LSTM单元的参数：

每一个lstm的操作都是线性操作，所以只要计算一个然后乘以4就可以了，下面以Forget gate为例：

因为已经知道h(t-1)和X(t) W_f和b_f是未知项。这里我们使用LSTM来寻找最终的w_f是[h(t-1)， x(t)]的拼接。

所以来计算参数公式:

在整个LSTM层中有四个门，所以最后的方程如下。

在实际应用时，我们不只是处理单个LSTM cell。如何计算多个cell的参数?

num_units =来自以前的时间戳隐藏的层单元= output_dim

我们实际计算一个lstm的参数数量

keras的计算结果为：

完整文章：

posted @ 2022-06-08 10:45 deephub 阅读(104) 评论(0) 编辑收藏举报

刷新页面返回顶部

deephub