【发布时间】:2014-06-06 16:11:35
【问题描述】:
我正在尝试在页面源中检索一些看起来像这样的数据: “日期”:“2011-04-03T00:00:00.000Z”, “排名”:55182 }, { “日期”:“2011-04-10T00:00:00.000Z”, “排名”:23649 }, { “日期”:“2011-04-17T00:00:00.000Z”, “排名”:26064 }, { “日期”:“2011-04-24T00:00:00.000Z”, “排名”:18373 }, { “日期”:“2011-05-01T00:00:00.000Z”, “排名”:18073 }, { “日期”:“2011-05-08T00:00:00.000Z”, “排名”:15539 }, { “日期”:“2011-05-15T00:00:00.000Z”, “排名”:14562 }, { “日期”:“2011-05-22T00:00:00.000Z”, “排名”:18921 }, { “日期”:“2011-05-29T00:00:00.000Z”, “排名”:10849 }, { “日期”:“2011-06-05T00:00:00.000Z”, “排名”:5871 }, { “日期”:“2011-06-12T00:00:00.000Z”, “排名”:3804 }, { “日期”:“2011-06-19T00:00:00.000Z”, “排名”:8243 }, { “日期”:“2011-06-26T00:00:00.000Z”, “排名”:9688 }, { “日期”:“2011-07-03T00:00:00.000Z”, “排名”:11592 }, { “日期”:“2011-07-10T00:00:00.000Z”, “排名”:11508 }, { “日期”:“2011-07-17T00:00:00.000Z”, “排名”:10405 }, { “日期”:“2011-07-24T00:00:00.000Z”, “排名”:10080 }, { “日期”:“2011-07-31T00:00:00.000Z”, “排名”:10392 }
我想使用 Python 爬虫从网站检索这些数据,我需要将数据存储在 MYSql 数据库中。
我该怎么做呢? 我需要根据数据库中的日期值存储 52 周。 该网站目前还安装了验证码。
我将如何绕过验证码,我应该制作 52 列数据来存储它吗?
【问题讨论】:
标签: python mysql sql date web-crawler