【发布时间】:2017-07-06 16:43:23
【问题描述】:
我正在使用 Pentaho Data Integration 7.1 将一些本地文件复制到 Hadoop 2.8.0 集群。我在 Pentaho 上创建了一个 Hadoop 集群连接,并且正在使用 Hadoop Copy Files 步骤。当我从 GUI (spoon.sh) 执行作业时,我可以成功上传文件,我可以在日志中看到以下行:
Hadoop Copy Files - Processing row source File/folder source : [file:///home/etl/Desktop/users_full_20170620.csv] ... destination file/folder : [hdfs://hadoop:***@spark-master.cu:9000/value_iq]... wildcard : [null]
但是当我尝试使用 kitchen.sh 运行相同的转换失败时,我收到以下错误:
Hadoop Copy Files - ERROR (version 7.1.0.0-12, build 1 from 2017-05-16 17.18.02 by buildguy) : Folder file:///value_iq/bin/kettle/data-integration_7.1/hdfs:/hadoop:hadoop@spark-master.cu:9000/value_iq does not exist!
假设目的地环境是本地的,它以某种方式在 hdfs url 前面添加了 kitchen.sh 所在的路径。
这是我的 Hadoop 复制文件步骤的屏幕截图
已创建此错误的 JIRA 报告:http://jira.pentaho.com/browse/PDI-16443
【问题讨论】:
标签: hadoop hdfs pentaho-data-integration