【发布时间】:2023-04-05 05:17:02
【问题描述】:
我想编写一个 shell 脚本来从 rss 提要中获取图像。 现在我有:
curl http://foo.com/rss.xml | grep -E '<img src="http://www.foo.com/full/' | head -1 | sed -e 's/<img src="//' -e 's/" alt=""//' -e 's/width="400"//' -e 's/ height="400" \/>//' | sed 's/ //g'
我用它来抓取文件中第一次出现的图像 URL。 现在我想把这个 URL 放在一个变量中,以便再次使用 cURL 来下载图像。 任何帮助表示赞赏! (您也可以提供有关如何更好地从带有 URL 的行中删除所有内容的提示。这是行:
<img src="http://www.nichtlustig.de/comics/full/100802.jpg" alt="" width="400" height="400" />
可能有比我的解决方案更好的正则表达式来删除除 URL 之外的所有内容。) 提前致谢!
【问题讨论】: