【问题标题】:Extract data with HTMLAgilityPack – simple example使用 HTMLAgilityPack 提取数据 - 简单示例
【发布时间】:2014-05-26 11:26:52
【问题描述】:

我在网上搜索过,找不到简单的 HTMLAgilityPack 示例来从网页中提取 1 条信息。大多数示例都在 C# 中,并且代码转换器无法正常工作。开发者论坛也没有帮助。

无论如何,我试图从这个 URL “http://quotes.morningstar.com/stock/c-company-profile?t=dltr”和这个文本“Dollar Tree Stores, Inc.,在美国和加拿大经营折扣杂货店”中提取“Consumer Defensive”字符串。其商店以 1.00 美元和 1.25 加元的固定价格提供商品。该公司在同一网页上以 Dollar Tree、Deal$、Dollar Tree Canada 等名称经营商店。

此链接上的尝试代码:https://stackoverflow.com/questions/13147749/html-agility-pack-with-vb-net-parsing 但未声明 GetPageHTML。 这个是 C# HTML Agility pack - parsing tables 等等。

谢谢。

【问题讨论】:

  • 投反对票:如果您不喜欢我的问题并且不愿意提供帮助,请至少发表评论!

标签: vb.net html-agility-pack


【解决方案1】:

从该 URL 返回的 HTML 被转换为具有 2 个根节点的 XML,因此不能直接转换为 XML 文档。

对于您希望检索的值,只需检索 HTML 文档并搜索您希望提取的字符串的开始和结束标记可能会更容易。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2015-11-15
    • 2012-07-20
    • 2011-08-17
    • 1970-01-01
    相关资源
    最近更新 更多