【发布时间】:2017-06-01 15:53:46
【问题描述】:
在我的应用程序中,我使用 stanford NLP 运行 nlp 作业。 stanford parse 模型被打包在一个 jar 中,并作为 UDF 安装,我使用 sqlContext.sql 来使用它。但我觉得它运行得很慢。谁能帮我加快速度?
代码如下:
sqlContext.sql("CREATE TEMPORARY FUNCTION segmenter AS 'cn.com.datamesh.stanford.nlp.StanfordNlp'").collect()
sqlContext.sql("SELECT segmenter(text) FROM twitter_data")
【问题讨论】:
-
您是否成功地以某种方式提高了速度?
标签: apache-spark pyspark