【发布时间】:2013-11-20 15:39:03
【问题描述】:
我试图在网页的项目内容部门中获取信息,我希望我的脚本等待并阅读网页中出现的任何新项目内容部门。有什么建议吗?
use WWW::Mechanize::Firefox;
my $mech = WWW::Mechanize::Firefox->new();
$mech->get('https://openbook.etoro.com/Dellos/overview/');
my @text = $mech->selector('.item-content');
for my $p (0..$#text) {
my $normal=$text[$p]->{innerHTML};
print $normal;
}
exit;
【问题讨论】:
-
获取页面后,获取新内容的唯一方法是再次获取它(假设没有 JavaScript 在起作用)。您可以轮询页面,直到
Last-Modified标头更改,但您应该先查看网站的使用条款。
标签: perl screen-scraping www-mechanize-firefox