【发布时间】:2018-08-17 12:33:13
【问题描述】:
我有以下页面:
http://greyhoundbet.racingpost.com/#card/race_id=1632746&r_date=2018-08-17&tab=form
它包含一系列以“表格”形式组织的信息。我需要“提取”该信息(行和列)以稍后处理信息。
知道我是新手,我尝试用 bs4 和 python 来做,但没有成功。你会推荐什么?
1) 我是否应该使用一种程序语言来读取页面上的文本(我应该使用哪个?我要寻找什么?)然后对其进行操作?
2)我可以手动获取文本(ctrl+c)并以某种方式将其发送到 python 吗?
您将如何以最简单的方式从页面获取信息,以便以后使用数据?
谢谢大家,如果这是一个愚蠢的问题,我很抱歉。过去一周我一直在为此苦苦挣扎。
问候, P.
编辑: 我正在考虑使用面向对象的方法来分离每只灰狗并研究每个数字。用 C# 做可能更好?
【问题讨论】:
-
为了解析,你必须使用 selenium,因为所有数据都是从 javascript 加载的
-
谢谢,utks009。我去看看。
标签: python parsing web-scraping beautifulsoup text-parsing