【发布时间】:2017-10-25 10:45:15
【问题描述】:
我有以下代码来计算张量流中 LSTM 的成本。当我执行代码时,优化器步骤需要很长时间才能完成,大约 25 分钟。
cost = tf.reduce_mean(tf.nn.softmax_cross_entropy_with_logits(logits=pred, labels=y_class))
optimizer = tf.train.RMSPropOptimizer(learning_rate=lr).minimize(cost)
为什么会这样?这是否取决于我的权重大小、偏差、LSTM 中隐藏层的数量? 我正在 GTX 840M 上训练网络
【问题讨论】:
-
你的学习率和初始化权重和偏差的模式以及激活函数的类型是多少?
-
我使用
truncated_normal_initializer表示权重,constant_initializer表示偏差。学习率为 0.001
标签: tensorflow lstm tensorflow-gpu