【问题标题】:I'm trying to get the title for this website using BeautifulSoup but I keep getting a TypeError, how do I fix this?我正在尝试使用 BeautifulSoup 获取该网站的标题,但我不断收到 TypeError,我该如何解决这个问题?
【发布时间】:2020-02-23 00:44:08
【问题描述】:
import requests
import bs4 as BeautifulSoup

page = requests.get('https://www.basketball-reference.com/friv/dailyleaders.fcgi')
soup = BeautifulSoup( page.content, 'html-parser')

print (soup.title)

我已经为课堂编写了与此类似的代码,但是我尝试制作自己的网络爬虫来获取网站的名称和 NBA 每天的领先得分手。但我坚持的第一个问题是获取页面的标题。

【问题讨论】:

  • 请检查答案,如果有帮助,请给它一个正确的勾号,因为它将作为其他人的参考,谢谢

标签: python beautifulsoup


【解决方案1】:

您可以使用下面的代码来获取网页的标题。

import requests
from bs4 import BeautifulSoup

url_req = requests.get('https://www.basketball-reference.com/friv/dailyleaders.fcgi')
soup = BeautifulSoup(url_req.content, 'lxml')
print(soup.select_one('title').text)

除了bs4,还可以使用lxml的tree.xpath来获取title。希望这可以帮助。谢谢

【讨论】:

    猜你喜欢
    • 2017-05-30
    • 1970-01-01
    • 1970-01-01
    • 2019-01-22
    • 2023-01-07
    • 2020-03-25
    • 2020-02-14
    相关资源
    最近更新 更多