【问题标题】:Parse html page source with libcurl and C使用 libcurl 和 C 解析 html 页面源代码
【发布时间】:2010-01-29 13:32:10
【问题描述】:

如何打印在 curl_easy_setopt 中指定的网页源代码,而无需 html 标记?那么,只打印源中的文本?

【问题讨论】:

  • curl 是一个 HTTP 交互库。我认为这与解析 HTML 无关。

标签: c parsing function libcurl


【解决方案1】:

Curl/libcurl 仅用于获取 HTML 页面。要从中提取信息,您需要其他工具。

最通用的解决方案是使用 HTML 解析器。 C 语言中的一个好的是HTMLparser from libxml

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2012-04-30
    • 2010-10-09
    • 2011-01-16
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2019-05-19
    • 2015-01-22
    相关资源
    最近更新 更多