【发布时间】:2021-07-01 07:09:08
【问题描述】:
如何从该特定链接获取所有 URL:https://www.oddsportal.com/results/#soccer
对于此页面上的每个 URL,都有多个页面,例如页面第一个链接:
https://www.oddsportal.com/soccer/africa/
以以下页面为例:
https://www.oddsportal.com/soccer/africa/africa-cup-of-nations/results/
->https://www.oddsportal.com/soccer/africa/africa-cup-of-nations/results/#/page/2/...
https://www.oddsportal.com/soccer/africa/africa-cup-of-nations-2019/results/
->https://www.oddsportal.com/soccer/africa/africa-cup-of-nations-2019/results/#/page/2/...
理想情况下,我想用 python 编写代码,因为我对它很熟悉(比其他语言更不接近我可以称之为舒适的语言) 和
点击链接后:
当我去检查元素时,我可以看到链接可以被刮掉,但是我对它很陌生。
请帮忙
【问题讨论】:
-
请发布您的代码。你尝试了什么,你在哪里卡住了?
-
现在,我正在手动复制页面上的每个 URL 并创建一个列表。因此,我不确定我可以在这里发布什么代码
-
你是网络抓取的新手吗?
-
@Ram 是的。很新。我创建了一个代码,可以“在 URL 中”抓取所有数据。但是,要获得我需要帮助的所有 URL。由于 For 循环和所有属性,我无法理解它。
-
@Ram 如果我可以在此处发布现有代码以从 URL 中抓取数据,会有帮助吗?
标签: python web-scraping