【发布时间】:2017-08-08 06:34:00
【问题描述】:
除了设置“zeppelin.pyspark.python”以使 Zeppelin 解释器成为特定的 Python 可执行文件之外,我还需要做什么?
背景:
我正在使用连接到 Spark+Mesos 集群的 Apache Zeppelin。该集群已经运行了好几年。 Zeppelin 是新的,总体上运行良好。
但我无法在 pyspark 中应用于 RDD 的函数中导入 numpy。当我使用 Python 子进程定位 Python 可执行文件时,它显示代码正在系统的 Python 中运行,而不是在它需要所在的 virutalenv 中。
所以我看到了一些关于这个问题的问题,这些问题说解决方法是将“zeppelin.pyspark.python”设置为指向正确的 python。我已经这样做了,并重新启动了几次解释器。但它仍然使用系统Python。
还有什么我需要做的吗?这是使用 Zeppelin 0.7。
【问题讨论】: