【问题标题】:Scrape tag value刮标签值
【发布时间】:2018-05-31 17:08:52
【问题描述】:

我想问一下,我可以用beautifulsoup 刮掉标签的价值吗: 我想得到一个img src:

<img class="product-pic" src="//cdn.shopify.com/s/files/1/1385/4109/products/Beef_Patties_grande_41a52a6f-1d85-499c-be1d-06ecb318c2ad_large.jpg?v=1469212539" alt="Beef Burgers">

我想抓取 src 的值。即

//cdn.shopify.com/s/files/1/1385/4109/products/Beef_Patties_grande_41a52a6f-1d85-499c-be1d-06ecb318c2ad_large.jpg?v=1469212539

我正在做的是:

containers[0].find("img").next_element.next_element.next_element.next_element.next_element.next_element

但我没有得到预期的输出,我得到的是:

<a href="/collections/beef/products/beef-burgers">Beef Burgers</a>

任何帮助将不胜感激,谢谢

【问题讨论】:

  • 如果你像soup.select_one("img[class='product-pic']")['src']一样尝试会得到什么?
  • @SIM 感谢您的回复,我得到了答案,我已将其发布在下面

标签: python-3.x web-scraping beautifulsoup


【解决方案1】:

我的问题得到了答案,我所要做的很简单:

img = containers[0].find("img",{"class":"product-pic"})
src = img["src"]

输出:

'//cdn.shopify.com/s/files/1/1385/4109/products/Beef_Patties_grande_41a52a6f-1d85-499c-be1d-06ecb318c2ad_large.jpg?v=1469212539'

【讨论】:

    猜你喜欢
    • 2020-04-21
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2020-05-13
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多