【发布时间】:2015-03-14 16:41:09
【问题描述】:
我正在使用 beautifulsoup 来抓取此网页中每个产品的 href:http://www.amazon.com/s/ref=nb_sb_noss_1?url=search-alias%3Daps&field-keywords=digital+camera。这些 href 以“keywords=digital+camera”结尾 这是我的代码:
from bs4 import BeautifulSoup
import requests
url = "http://www.amazon.com/s/ref=nb_sb_noss_1?url=search-alias%3Daps&field-keywords=digital+camera"
keyword = "keywords=digital+camera"
r = requests.get(url)
data = r.text
soup = BeautifulSoup(data)
for link in soup.find_all('a'):
href = link.get('href')
if href is None:
continue
elif keyword in href:
print href
我没有从上面的脚本中得到任何反馈,有什么可以解决的吗? 谢谢
【问题讨论】:
-
您是否尝试过打印所有的 href 和“ctrl+f”来查看您实际上得到了您认为得到的结果?我刚刚打印了
[x.get("href") for x in soup.find_all('a')]并没有得到任何包含字符串"keywords=digital+camera"的内容 -
@TehTris 是的,我试过了。我没有得到任何关键字 in。
标签: python web-scraping beautifulsoup