【问题标题】:Grabbing data from sperate links of the same website从同一网站的不同链接中获取数据
【发布时间】:2019-06-27 05:06:05
【问题描述】:

感谢您抽出时间阅读本文 我想知道是否有任何方法可以从不同的链接获取特定代码,但它们都是同一个域

【问题讨论】:

  • 你能提供一些例子吗,看起来你想要一个域的子域。
  • 好的,这个链接中的例子facebook.com/zuck 如果你打开它,你会看到Mark Zuckerberg 这个名字,如果你打开这个facebook.com/moskov 你会看到Dustin Moskovitz 这个名字我想要的只是编程它从这样的链接列表中获取名称
  • 如果您想从用户链接中获取真实姓名,请考虑使用 Facebook API。
  • 不不,域名不是 facebook,这只是一个例子,我想要的只是从不同的链接中获取特定的 HTML 行并将每个链接放在一行上

标签: python vb.net


【解决方案1】:

我想如果我理解你需要用户名形成链接。

facebook.com/zuck

acebook.com/moskov

您可以跟踪并提取页面标题,这可能并不总是准确的。

>   <title id="pageTitle">Mark Zuckerberg</title>  
>   <title id="pageTitle">Dustin Moskovitz</title>

html2text 是一个 Python 脚本,可将 HTML 页面转换为干净、易于阅读的纯 ASCII 文本。更好的是,ASCII 也恰好是有效的 Markdown(文本到 HTML 格式)。 https://github.com/Alir3z4/html2text

如果您想从 url 中阅读,请查看以下说明 How to read html from a url in python 3

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2017-07-15
    • 1970-01-01
    • 1970-01-01
    • 2016-11-28
    • 2011-07-19
    • 2019-03-18
    • 2011-11-02
    • 1970-01-01
    相关资源
    最近更新 更多