【发布时间】:2013-01-31 16:59:49
【问题描述】:
是否有规则、框架或工具集用于使用来自 html 页面的信息作为输入数据的一部分进行编程?类似于元搜索引擎的东西。你是怎么解析网页的?
我更喜欢 java 或 flex/flash,或者一些阅读的指针。
谢谢!
2013 年 2 月 7 日更新
感谢您的回答!网络抓取是我一直在寻找的术语!
从这篇帖子Web scraping with Java 中找到了这个很棒的java 库:http://jsoup.org/。
正在寻找 flex 的,我会在找到后立即更新。
【问题讨论】:
-
我想这就是你想要的:en.wikipedia.org/wiki/Web_scraping(顺便说一句,这个问题对于这个网站来说有点太笼统了)
-
你能告诉我们你到底想做什么吗?
标签: java apache-flex web-scraping