【发布时间】:2018-08-02 13:32:31
【问题描述】:
我已经按照以下说明训练了一个模型: https://www.tensorflow.org/tutorials/sequences/audio_recognition#training
我有一个 ckpt 文件,但无法使用 tensorflow 的官方说明将其冻结并生成 PB。
为了创建 PB 文件,我使用以下转换器转换了 pbtxt: https://github.com/irfansharif/tensorflow/blob/master/converter.py
现在在运行 Tensorflow 官方“label_wav_file”时出现以下错误:
2018-08-02 10:15:12.263821: 我 tensorflow/core/platform/cpu_feature_guard.cc:140] 你的 CPU 支持 此 TensorFlow 二进制文件未编译使用的指令:AVX2 FMA Traceback(最近一次调用最后一次):文件“label_wav.py”,行 134,在 tf.app.run(main=main, argv=[sys.argv[0]] + unparsed) 文件“/usr/local/lib/python3.5/dist-packages/tensorflow/python/platform/app.py” , 第 126 行,运行中 _sys.exit(main(argv)) 文件“label_wav.py”,第 106 行,在 main FLAGS.output_name, FLAGS.how_many_labels) 文件“label_wav.py”,第 100 行,在 label_wav run_graph(wav_data,labels_list,input_name,output_name,how_many_labels)文件“label_wav.py”,第 68 行,在 run_graph 预测,= sess.run(softmax_tensor, {input_layer_name: wav_data}) 文件 "/usr/local/lib/python3.5/dist-packages/tensorflow/python/client/session.py", 第 900 行,运行中 run_metadata_ptr)文件“/usr/local/lib/python3.5/dist-packages/tensorflow/python/client/session.py”, 第 1104 行,在 _run np_val = np.asarray(subfeed_val, dtype=subfeed_dtype) 文件 "/home/user/.local/lib/python3.5/site-packages/numpy/core/numeric.py", 第 531 行,在数组中 return array(a, dtype, copy=False, order=order) ValueError: could not convert string to float: b'RIFF$}\x00\x00WAVEfmt \x10\x00\x00\x00\x01\x00\x01\x00
我想确定我想用作输入和输出层的层(我怀疑这是问题的根源)
输入层:data/Mul:0 输出层:ArgMax:0
(我选择了以下作为输出层,因为它是在 pbtxt 文件中设置的)
任何想法什么是正确的层或我做错了什么?
【问题讨论】:
标签: python tensorflow speech-recognition