【发布时间】:2022-01-20 08:26:33
【问题描述】:
我正在尝试使用 BeautifulSoup 删除 HTML 文档中的所有 URL 链接,只留下相对链接(而不是绝对链接)。 例如,我正在尝试构建代码来转换这个 HTML 标记:
<a href="https://www.mertens-stahl.de/berlin/unternehmen.php">
进入这个:
<a href="/berlin/unternehmen.php">
我还没有遇到可行的解决方案,所以到目前为止我的代码示例如下所示:
url = https://www.mertens-stahl.de
html = requests.get("https://www.mertens-stahl.de/berlin/downloads.php").text
soup = BeautifulSoup(html, "html.parser")
soup.find(url).replace_with("")
这会产生错误AttributeError: 'NoneType' object has no attribute 'replace_with',所以我正在寻找解决此问题的正确方法。谢谢!
【问题讨论】:
标签: python html beautifulsoup