【问题标题】:Turtle files data processing from s3 to Neptune从 s3 到 Neptune 的 Turtle 文件数据处理
【发布时间】:2018-08-16 07:53:22
【问题描述】:

我已按照 AWS 文档中的建议通过 curl post 方法命令将海龟文件从 s3 复制到 Neptune。 curl 命令已执行,作业已成功完成。发布作业执行,我检查了作业 id 状态以了解负载状态的详细信息;我的工作显示整体状态已完成,但记录数为零。我在 S3 中的海龟文件有很多记录。为什么我的 curl post 方法没有将一条记录从 S3 传输到 Neptune?如果您已成功将海龟文件从 S3 移动到 Neptune,请有人帮忙。

【问题讨论】:

  • 嗨。您能否发布状态 API 对此加载请求的完整响应?您还可以使用 details 标志显示有关已处理文件等的更多详细信息,docs.aws.amazon.com/neptune/latest/userguide/…
  • 从文档中,我检查了加载器状态,作业 ID 和结果显示为 load_completed 和记录数 =0 ,重复记录 =0 ,总时间 =0
  • @Srinivas 您在这个问题上还需要其他帮助吗?

标签: sparql amazon-neptune


【解决方案1】:

这看起来非常特定于您正在加载的数据类型。使用 Amazon Neptune 打开支持案例或在 AWS 论坛上发布更多详细信息(示例请求和响应)可能是更好的选择。

有几种可能:

  1. 您的海龟数据集存在一些问题。 load status API 应该能够帮助您解决这个问题。
  2. 这是一个重复的加载请求,所有记录最终都被标记为重复。

【讨论】:

  • 以下是我从加载程序 API 得到的响应:状态:200 ok,有效负载:{ feedcount:[{ LOAD_COMPLETED}],总体状态:{ fulluri:mybucket 路径,状态:load_completed,totalrecords = 0 , totalduplicates = 0 , totaltimespend =0 , runnumber = 3 , retrynumber = 1 , 插入错误 =0 , parsingerrors =0 } , ....}
  • 我最好的猜测是指定给加载器的文件路径不正确,因此它在指定位置找不到任何文件。如果不是这样,请使用 Neptune 开一个支持案例。
猜你喜欢
  • 2022-08-08
  • 1970-01-01
  • 1970-01-01
  • 2021-10-02
  • 2017-10-17
  • 2018-01-12
  • 1970-01-01
  • 1970-01-01
  • 2010-10-02
相关资源
最近更新 更多