【问题标题】:How can I parse a link within locally stored html using python?如何使用 python 解析本地存储的 html 中的链接?
【发布时间】:2021-02-22 22:05:03
【问题描述】:

我正在尝试从本地存储的 html 文件中的链接中提取文本。链接如下:

file:///Users/my_name/Dropbox/folder_name/wisenews/18Jan2021%20(1).html#body.202003310521728.1

我似乎无法使用open() 访问此链接。我尝试了以下但不起作用。

open(file:///Users/my_name/Dropbox/folder_name/wisenews/18Jan2021%20(1).html#body.202003310521728.1)

如何访问此链接?

我添加了 jupyter notebook 的截图以便更详细地说明

【问题讨论】:

  • file:// 不是文件路径的一部分。你试过省略它吗?
  • @mkrieger1 是的,Users/.. 也不行
  • 有什么问题?
  • @mkrieger1 我使用 open() 并收到找不到文件的错误消息
  • 您是否检查过该文件是否存在并且其路径与您传递给open() 的路径相同?

标签: html python-3.x web-scraping


【解决方案1】:

您必须将实际文件路径传递给函数

应该是这样的:

open("C:/Users/Users/my_name/Dropbox/folder_name/wisenews/18Jan2021%20(1).html")

【讨论】:

  • 我正在尝试访问 html 中的链接,Users/my_name/Dropbox/folder_name/wisenews/18Jan2021%20(1).html#body.202003310521728.1
  • 是的,我添加了一个屏幕截图以便更详细地说明
  • 如果笔记本与此文件位于同一文件夹中,请尝试在路径前添加 ./
猜你喜欢
  • 2021-10-31
  • 1970-01-01
  • 1970-01-01
  • 2016-02-12
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多