【发布时间】:2010-12-25 06:31:57
【问题描述】:
我想从 html 文件的锚标记中提取 URL。 这需要使用 SED/AWK 在 BASH 中完成。请不要使用 perl。
最简单的方法是什么?
【问题讨论】:
-
阅读本文并获得启发:stackoverflow.com/questions/1732348/…
-
如果您不介意:无法保证您找到所有 url。 或 无法保证所有您找到的网址是有效的。 使用以下示例之一。如果你介意使用合适的工具来完成这项工作(perl、python、ruby)
-
我之前的评论当然是针对您可能尝试的任何 easy 解决方案。 awk 足够强大,可以完成这项工作,理论上你可以在 awk 中实现 perl ...
-
这是否像那些幸存者挑战之一,你必须活三天只吃白蚁?如果不是,严重的是,为什么要限制?每个现代系统都至少可以安装 Perl,然后你就拥有了整个网络