在分类任务中,使用LSTM模型的输入数据通常是时间序列或序列数据,每个输入样本包含若干个时间步长(time steps),每个时间步长有多个特征(features)。典型的输入数据维度为 (batch_size, sequence_length, num_features)。
典型例子:
假设我们要进行一个文本分类任务,LSTM模型的输入是一个句子,目标是对该句子进行分类,比如情感分析(正面/负面)。假设我们有如下数据:
- 输入数据:一组句子,每个句子被表示为一个词向量序列,每个词向量有100个维度。
- 数据集:包含32个句子,每个句子最长包含50个单词。
那么,LSTM的输入数据可以表示为一个三维张量,维度为 (32, 50, 100)。
各个维度的含义:
-
batch_size (32):
- 批量大小,表示一次输入LSTM模型的数据样本数量。在这个例子中,
32表示一次输入32个句子。
- 批量大小,表示一次输入LSTM模型的数据样本数量。在这个例子中,
-
sequence_length (50):
- 序列长度,表示每个输入样本的时间步长数量。在这个例子中,
50表示每个句子最多有50个单词。如果一个句子少于50个单词,可以用特殊的填充符号(如
- 序列长度,表示每个输入样本的时间步长数量。在这个例子中,
订阅专栏 解锁全文

4215

被折叠的 条评论
为什么被折叠?



