【发布时间】:2017-01-11 02:09:17
【问题描述】:
我正在尝试从 HTML 表格中抓取信息,该表格具有筛选不同时间段的交互能力。示例表位于此 URL:http://quotes.freerealtime.com/dl/frt/M?IM=quotes&type=Time%26Sales&SA=quotes&symbol=IBM&qm_page=45750。
我想在 9:30 开始,然后向前跳 1 分钟与桌子互动。我想将所有数据导出到 DataFrame。 我尝试过使用 pandas.read_html() 并尝试过使用 BeautifulSoup。尽管我对 BeautifulSoup 没有经验,但这些都不适合我。我的请求是否可行,或者网站是否保护了这些信息不被网络抓取?任何帮助将不胜感激!
【问题讨论】:
-
您对特定于硒的方法感兴趣吗?
-
是的!
标签: python html pandas beautifulsoup