【问题标题】:Unable to run tensorflow examples. CUBLAS error无法运行张量流示例。 CUBLAS 错误
【发布时间】:2018-05-04 04:33:26
【问题描述】:

大约一个月前我已经完成了这一切,并且正在尝试再次运行所有内容。我升级了所有活动部件,并且正试图运行此处找到的 tensorflow 示例:tensorflow git models

设置:

  • Ubuntu 16.04
  • CUDA 版本:发布 8.0、V8.0.61(能够运行 deviceQuery 等)
  • CUDNN_MAJOR 5(不管是 5.1 还是 6)
  • Tensorflow 后端版本:1.4.0(无法运行示例)
  • keras 版本:2.1.1

这是我得到的错误:

2017-11-20 15:18:00.209182: 我 tensorflow/core/common_runtime/gpu/gpu_device.cc:1120] 创建 TensorFlow 设备 (/device:GPU:0) -> (设备: 0, 名称: GeForce GTX 1070, pci bus id: 0000:01:00.0, 计算能力: 6.1) 2017-11-20 15:18:07.457924: E tensorflow/stream_executor/cuda/cuda_blas.cc:366] 未能创建 cublas 句柄:CUBLAS_STATUS_NOT_INITIALIZED 2017-11-20 15:18:07.474515: E tensorflow/stream_executor/cuda/cuda_blas.cc:366] 未能创建 cublas 句柄:CUBLAS_STATUS_NOT_INITIALIZED 2017-11-20 15:18:07.558178: E tensorflow/stream_executor/cuda/cuda_blas.cc:366] 未能创建 cublas 句柄:CUBLAS_STATUS_NOT_INITIALIZED 2017-11-20 15:18:07.575864: E tensorflow/stream_executor/cuda/cuda_blas.cc:366] 未能创建 cublas 句柄:CUBLAS_STATUS_NOT_INITIALIZED 2017-11-20 15:18:07.593372: E tensorflow/stream_executor/cuda/cuda_blas.cc:366] 未能创建 cublas 句柄:CUBLAS_STATUS_NOT_INITIALIZED 2017-11-20 15:18:07.610621: E tensorflow/stream_executor/cuda/cuda_blas.cc:366] 未能创建 cublas 句柄:CUBLAS_STATUS_NOT_INITIALIZED 2017-11-20 15:18:08.431784: E tensorflow/stream_executor/cuda/cuda_dnn.cc:385] 无法创建 cudnn 句柄:CUDNN_STATUS_INTERNAL_ERROR 2017-11-20 15:18:08.431816: E tensorflow/stream_executor/cuda/cuda_dnn.cc:352] 无法破坏 cudnn 句柄:CUDNN_STATUS_BAD_PARAM 2017-11-20 15:18:08.431838: F tensorflow/core/kernels/conv_ops.cc:667] 检查 失败:流->父()->GetConvolveAlgorithms( conv_parameters.ShouldIncludeWinogradNonfusedAlgo(), &algorithms) 中止(核心转储)

任何建议将不胜感激。

编辑:这个问题:tensorflow running error with cublas 类似 - 但答案对我不起作用。

【问题讨论】:

  • 请帮我理解为什么要关闭投票?只要让我知道我是否可以做任何事情来改善问题,而不仅仅是关闭它。请。
  • 在哪个型号上失败了?请提供更多信息,以便其他人可以重现问题、隔离问题或减少问题。我遇到了类似的错误:E tensorflow/stream_executor/cuda/cuda_blas.cc:366] failed to create cublas handle: CUBLAS_STATUS_NOT_INITIALIZED
  • 我提出了一个问题:github.com/tensorflow/models/issues/2857。目前它只是让任何模型从github.com/tensorflow/models 运行
  • models/tutorials/image/imagenet/classify_image.py
  • 我试过:'python分类图像.py'它按预期工作,没有错误。它可能与某些环境变化有关。安装完 Tensorflow 后,有一些简单的测试程序来验证安装。你试过吗?感谢您分享您的案例。

标签: python-2.7 tensorflow ubuntu-16.04


【解决方案1】:

这不是一个很好的解决方案 - 但它是唯一有效的解决方案:

CUDNN 6 不能很好地与 TF 配合使用。因此,如果您在任何地方都有库,它就会崩溃。基本上它是版本控制而不是内存或路径。必须确保找不到 CUDNN v6 并且 TF 是 1.2 版而不是 1.4 版。

最终设置:Ubuntu 16.04。 CUDA 8、CUDNN 5.1、TF 1.2。

可以通过以下方式安装 tf 版本:

$ sudo apt install tensorflow-gpu==1.2 

这帮助我度过了黑暗时期:TensorFlow Framework 并在此过程中列出了一些测试以进行健全性检查。

【讨论】:

  • 只是一个小修正。它的 sudo pip install tensorflow-gpu==1.2
猜你喜欢
  • 1970-01-01
  • 2016-06-27
  • 2019-01-30
  • 1970-01-01
  • 2016-11-13
  • 1970-01-01
  • 2017-02-03
  • 2018-06-21
  • 1970-01-01
相关资源
最近更新 更多