【问题标题】:I want HTML content from the script. using requests and Bs4 library我想要脚本中的 HTML 内容。使用请求和 Bs4 库
【发布时间】:2021-09-10 18:46:52
【问题描述】:

我正在尝试从 Twitter 上抓取一些数据,但是我正在以脚本的形式获取数据,请帮我解决这个问题,我想要脚本中的 HTML 内容

from bs4 import BeautifulSoup as bs4
from requests import get

def data(i):
    page='https://twitter.com/search?q=%23{}&src=typeahead_click'
    page1=page.format(i)
    #print(page)
    load=get(page1)
    data=bs4(load.text,'html.parser')
    print(data)

    
i='JobseekersSA'
data(i)

我得到的结果在脚本中,请帮我获取html的内容。

【问题讨论】:

    标签: json web-scraping beautifulsoup


    【解决方案1】:

    不幸的是,Twitter 现在需要 JavaScript。虽然可能有一种方法可以将数据作为 JSON 获取,但如果没有 JavaScript 或其他一些脚本将该数据转换为 HTML,则无法将其作为 HTML 获取。您抓取的数据可能是 JSON。我会使用现代浏览器的检查器和其他网络工具来查看正在获取的所有内容、查找数据文件以及它们与原始页面的关系。

    【讨论】:

      猜你喜欢
      • 2018-08-26
      • 1970-01-01
      • 1970-01-01
      • 2021-11-14
      • 2017-04-20
      • 2019-10-29
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多