【发布时间】:2020-03-04 00:51:29
【问题描述】:
我正在尝试在托管 DataProc 集群上运行猪作业。我有几个并行运行的独立猪作业。我已将每个作业的 continueOnFailure 设置为 true。现在,如果其中一项作业失败,则所有其他作业都将停止并终止集群。我不希望这样,我希望终止失败的作业并让其他作业按预期运行。
我实例化的yaml文件如下:
jobs:
- pigJob:
continueOnFailure: true
queryList:
queries:
- sh pqr.sh
stepId: run-pig-pqr
- pigJob:
continueOnFailure: true
queryList:
queries:
- sh abc.sh
stepId: run-pig-abc
placement:
managedCluster:
clusterName: batch-job
config:
gceClusterConfig:
zoneUri: asia-south1-a
masterConfig:
machineTypeUri: n1-standard-8
diskConfig:
bootDiskSizeGb: 50
workerConfig:
machineTypeUri: n2-highcpu-64
numInstances: 2
diskConfig:
bootDiskSizeGb: 50
softwareConfig:
imageVersion: 1.4-ubuntu18
我正在使用命令创建集群
gcloud dataproc workflow-templates instantiate-from-file --file $file-name.yaml
我在我的 yaml 中提供了任何错误的配置?
【问题讨论】: