【发布时间】:2016-07-07 21:55:39
【问题描述】:
在流式 pyspark 应用程序中使用连接池的正确方法是什么?
我通读了https://forums.databricks.com/questions/3057/how-to-reuse-database-session-object-created-in-fo.html 并了解正确的方法是对 scala/java 使用单例。这在 python 中可能吗?一个小的代码示例将不胜感激。我相信为流式应用程序创建每个分区的连接将非常低效。
【问题讨论】:
标签: python apache-spark pyspark connection-pooling spark-streaming