【发布时间】:2013-07-02 17:21:06
【问题描述】:
有一张桌子需要用scrapy刮。数据格式如下:
<table>
<tr class="colhead">
<td width="170">MON, NOV 11</td>
<td width="80">Item</td>
<td width="60" align="center"></td>
<td width="210">Item</td>
<td width="220">Item</td>
</tr>
<tr class="oddrow">
<td> Item </a></td>
<td> Item </td>
<td align="center"> Item </td>
<td></td>
<td> Item </td>
</tr>
<tr class="evenrow">
<td> Item </a></td>
<td> Item </td>
<td align="center"> Item </td>
<td></td>
<td> Item </td>
</tr>
</table>
我确实得到了完整的项目列表
items = hxs.select('//table[@class="tablehd"]//td//text()').extract()
如何将它们拆分为每个项目,然后分配数据 td1 - td5
【问题讨论】:
标签: python web-scraping scrapy