【问题标题】:Data scraping: How to read all table content from multiple pages (using next page)?数据抓取:如何从多个页面读取所有表格内容(使用下一页)?
【发布时间】:2019-08-21 10:46:54
【问题描述】:

我正在尝试使用 (UiPath) 数据抓取向导从网页抓取数据。 该表结构良好,第一次单击建议阅读整个表。

我想要所有数据,所以我将 MaxNumberOfResults 设置为 0。

ExtractData setup

下一页按钮已正确标记,除了最后一页外,它确实有效。 问题是程序由于寻找下一个按钮而崩溃,因为它存在于页面上,但无法推送它,所以它期望有更多的页面。

我用“元素存在”测试了“下一步”按钮,即使在最后一页上它也一直是 True。

Element exist

最后一页按钮看起来像这样last page buttons

有什么建议或类似经验吗?

【问题讨论】:

    标签: rpa uipath uipath-studio


    【解决方案1】:

    尝试使用 UiExplorer,一些按钮有额外的字段,这些字段并不总是在选择器中使用,可能还有其他字段可用于区分工作的“下一步”按钮和灰显的“下一步”按钮。

    或者,如果“下一步”按钮具有诸如 enabled 之类的字段,则您可以使用 Get Attribute 活动,该字段可以根据是否有另一个页面返回真或假。

    【讨论】:

    • 好主意康纳,谢谢。我检查了 HTML 代码,并且 aria-disabled="true" ("false") 有所不同。不幸的是,Get Attribute 不返回任何内容,并且 UiExplorer 看不到该属性。
    • 按下 Next 时 URL 是否会发生变化,您能否在每次按 Next 时读取 URL,如果没有变化,则说明您已经到达终点。
    • 哦,我错过了带获取属性的上下文。 aria-disabled 是要获取的值。现在它起作用了! (我的意思是获取属性,而不是整个过程:))
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2021-07-12
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多