【问题标题】:How to extract all text's link and other properties form html?如何从 html 中提取所有文本的链接和其他属性?
【发布时间】:2022-12-04 01:16:03
【问题描述】:

请注意,如果它是单个元素,我可以提取但我需要将它们全部提取在一起。

您好我正在尝试使用 Selenium 和 Java 从页面的项目列表中提取文本和链接。我能够提取所有链接文本,但面临找出链接文本的问题。 html 代码如下所示:

<div class="col-12">
        <a href="/category/agricultural-products-service">
                <img src="/assets/images/icon/1.jpg" alt="icon" class="img-fluid category_icon">
                    <h5 class="category_title">Agricultural </h5>
        </a>
 </div>
<div class="col-12">
        <a href="/category/products-service">
                <img src="/assets/images/icon/7.jpg" alt="icon" class="img-fluid category_icon">
                    <h5 class="category_title">Products</h5>
        </a>
 </div>

使用 h5 我可以提取所有元素,但我需要提取这些元素的所有 href

【问题讨论】:

  • 您是否尝试过通过 xPath 搜索将所有 div 与类一起收集?

标签: java list selenium selenium-webdriver


【解决方案1】:

要从多个 Web 元素中提取文本或链接或任何其他属性值,您需要将所有这些元素收集在一个列表中,然后遍历该列表,从每个 Web 元素对象中提取所需的值。
如下:

List<WebElement> elements = driver.findElements(By.tagName("h5"));
for(WebElement element : elements){
    String value = element.getText();
    System.out.println(value);
}

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2011-02-10
    • 2010-09-20
    • 2011-06-05
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2018-11-19
    • 2019-04-03
    相关资源
    最近更新 更多