【发布时间】:2019-07-18 11:16:37
【问题描述】:
一段时间以来一直在尝试制作一个可以从网站拆分数据的python程序。我遇到了bs4 python 库,并决定将它用于该工作。
问题是我总是得到 None 的结果,这是我无法理解的
我只想得到一个位于a@href 中的单词,它位于一个 div 类中,为此,我编写了一个类似的函数:
def run(self):
response = requests.get(self.url)
soup = BeautifulSoup(response.text, 'html.parser')
finalW = soup.find('a', attrs={'class': 'target'})
print(finalW)
使用这段代码,我希望得到一个字,但它只返回None。
我也很有可能在这个目录的路径上犯了一个错误,所以我发布了一张我想从 HTML 中提取的东西的图片:
【问题讨论】:
-
您应该添加原始数据,而不是图像链接或屏幕截图。
-
可以分享网址吗?
-
您是否检查过此 html 元素是否存在于源代码中,或者是否稍后通过某些 javascript/ajax 调用添加了该元素,该调用会修改 DOM 对象。 requests 只会获得原始来源。您不会得到任何添加或修改原始源元素的更新或修改。
-
已经检查过了,Chris Doyle。当我使用 finde_all 命令时,我清楚地看到了该 HTML 文件中的所有 A href,包括我正在寻找的东西
标签: python beautifulsoup