【问题标题】:Splinter- Web Scraping href by find_partial_textSplinter- Web Scraping href by find_partial_text
【发布时间】:2020-11-18 16:02:37
【问题描述】:

我是网络抓取的新手,我正在尝试使用 Splinter 和 Beautiful Soup 从 HTML 页面中检索 href。这是我的代码

# hem1
url="https://astrogeology.usgs.gov/search/map/Mars/Viking/cerberus_enhanced"
browser.visit(url)
hem1=browser.find_link_by_partial_text('Sample').get("href")

这会收到错误

AttributeError: 'ElementList' 对象没有属性 'get'

非常感谢任何帮助。

【问题讨论】:

    标签: web-scraping beautifulsoup splinter


    【解决方案1】:

    您收到此错误是因为 browser.find_link_by_partial_text('Sample') 返回一个 ElementList。要从中取出元素,您需要使用索引。

    例子:

    hem1=browser.find_link_by_partial_text('Sample')
    first_element = hem1[0]
    

    要获取href,您可以使用以下行:

    hem1[0]['href']
    

    关于find_link_by_partial_text()的更多信息:https://splinter.readthedocs.io/en/latest/api/driver-and-element-api.html#splinter.driver.DriverAPI.find_link_by_partial_text

    【讨论】:

    • 这将返回一个分裂元素,该元素转换回“样本”,即部分文本,而不是伴随它的 href。有什么方法可以“获取”关联的 href?
    • 如果对您有帮助,请批准答案:)
    • 我如何批准?我投了赞成票,但由于我没有回答任何问题,堆栈溢出没有显示它
    • 你可以点击答案左侧的勾
    猜你喜欢
    • 2021-09-03
    • 1970-01-01
    • 2014-03-16
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2018-08-24
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多