【发布时间】:2011-08-25 12:13:54
【问题描述】:
我目前正在研究一种方法来解析包含欧洲基金会数据的网站。
http://www.foundationfinder.ch/ 拥有 790 个基础的数据集。所有数据均可免费使用 - 不受版权限制。
目标是什么:我想解析数据并将其保存在本地:为了更好的检索和更方便的使用方式:也许可以将其存储到 Calc / 甚至更好的 MySQL-Database。
问题:用 Perl 解析 HTML 的最简单方法是什么 我应该使用 LWP 还是 Mechanize:哪种方法更简单!?
有朋友让我试试Python!?美丽的汤。我想到了一种使用 Perl LWP 或 Python Beautiful Soup 的方法。其他方法来解析这样一个我看不到的网站。好的,有一种方法 - 使用 PHP。当然,我们可以通过某种方式使用 PHP(和 Curl)
哪种方法最好。 Perl 与 LWP 还是机械化?还是 Python 的……?
除了语言问题:任何人都可以帮助我迈出第一步。 - 帮助我走上正轨!?我期待收到您的来信
问候 零
【问题讨论】:
-
以下哪种语言您最流利?就绝对而言,可能是 Perl 最适合这项任务,但如果您最熟悉 PHP,那么这最终会更重要。
-
如果您擅长 PHP,我建议您使用 PHP 的 DOM 类和 XPath。这很容易。
-
嗨 Schwartzie,你好泰国 - 非常感谢您的快速回答。我对 PHP 有点熟悉 - 所以我想我必须走 PHP 的路。这些想法很棒,但我不知道我可以自己完成所有工作。泰语 - 您是否可以支持一些 sn-ps 来简要了解如何使用 PHP 加快速度!?我喜欢收到你的来信
标签: php python perl parsing lwp