【发布时间】:2011-03-13 16:57:49
【问题描述】:
我有以下链接:
url的引用部分有如下信息:
A7 == 议会(当前为第七届议会,前者为A6,以此类推)
2010 == 年
0001 == 文件编号
对于每年和议会,我想确定网站上的文件数量。任务很复杂,例如,对于 2010 年,数字 186、195,196 有空页,而最大数字是 214。理想情况下,输出应该是一个包含所有文档编号的向量,不包括丢失的文档编号。
谁能告诉我这在 python 中是否可行?
最好的,托马斯
【问题讨论】:
标签: python url web-scraping