【问题标题】:IBM Watson, how to input data of entire booksIBM Watson,如何输入整本书的数据
【发布时间】:2017-04-21 22:20:16
【问题描述】:

我正在使用 IBM Watson 分析试用版,它说它只接受 CSV、Excel 和其他一些格式的数据。如何将书籍或正文转换为可接受的格式?谢谢

【问题讨论】:

    标签: ibm-watson watson


    【解决方案1】:

    WCA(Watson Context Analytics)的架构似乎不支持 PDF 本身。请参考以下图片来自 IBM Link

    我认为最好使用转换器将 pdf 转换为文本,例如 CONVERTER 并将其推送到数据库或其他中。 然后,您可以从中抓取文本数据。

    仅供参考,文档必须有一个 KEY 列(即书名)。

    【讨论】:

      【解决方案2】:

      即使您确实将图书转换为可接受的文本格式(.csv..xls,.xlsx..sav),Watson Analytics 也没有针对文本分析进行优化。听起来Watson Explorer 是最适合您需求的产品。

      希望这会有所帮助。

      【讨论】:

        【解决方案3】:

        即使 CSV 或 XLS 是可接受的文件格式,数据集也需要采用特定结构。您需要它后面的所有表和数据的标题。我不确定这本书的数据如何适合这种格式。

        我最近在how to structure and refine data before importing into Watson Analytics 上发布了这篇博文,以获得最佳效果。

        对于您的具体要求,您可以按照上面 Brennan 的建议查看 Watson Explorer,或者更好的是您可以学习使用IBM Content Analytics here.

        【讨论】:

          猜你喜欢
          • 2018-12-23
          • 1970-01-01
          • 2016-06-26
          • 2020-08-16
          • 1970-01-01
          • 1970-01-01
          • 2014-01-28
          • 1970-01-01
          • 1970-01-01
          相关资源
          最近更新 更多