【发布时间】:2016-12-19 08:26:07
【问题描述】:
我想废弃一个包含多页的网站并提取特定的 div,然后再将其导出到仅以 div 作为内容的 html 页面。
我可以通过以下命令使用 Xidel 从内容中提取数据
xidel http://someURl/ --extract //div[2]/div[2]/div -f "//a" -e //div[2]/div[2]/div
是否可以将提取的数据下载到 html 文件中?
【问题讨论】:
我想废弃一个包含多页的网站并提取特定的 div,然后再将其导出到仅以 div 作为内容的 html 页面。
我可以通过以下命令使用 Xidel 从内容中提取数据
xidel http://someURl/ --extract //div[2]/div[2]/div -f "//a" -e //div[2]/div[2]/div
是否可以将提取的数据下载到 html 文件中?
【问题讨论】:
添加一个参数:--output-format=html
【讨论】:
<!DOCTYPE html><div>[content-if-extraction]</div>,正如作者所要求的那样。