【问题标题】:How to get xpath value using python of the current instance? [closed]如何使用当前实例的 python 获取 xpath 值? [关闭]
【发布时间】:2014-02-04 01:14:21
【问题描述】:

我不知道这是否可能......我想要做的是在调用时从 FIREFOX 返回 xpath 值......使用 python。我可以在不指定 URL 的情况下执行此操作吗?

抱歉,我没有更多详细信息,感谢您提供的任何答案

【问题讨论】:

  • 我认为你不明白 xpath 是什么。
  • 你是对的,我不确定它是什么。弄乱 chrome 我注意到每个元素都有一个 xpath,我认为这是我可以访问该值的一种方式
  • Xpath 是一种访问 XML/HTML 树中元素的方法。我仍然不知道你在问什么。提供示例场景和期望的行为会有所帮助。
  • 有一个网站(需要登录和静态 URL),其中包含我希望能够通过 python 访问并用于程序的元素(程序的功能是否相关?)跨度>
  • 啊!这更有意义!总的 XY 问题。我会发布一个答案。

标签: python html xpath


【解决方案1】:

听起来你只是想用一些web scraping 弄湿你的脚。基本上,网络抓取的想法是获取网站返回的 html,并通过它解析相关信息。

这个主题实际上相当广泛,整个描述都超出了范围,但scrapy 是一个 python 包,可以让这相对简单。

这里有教程:scrapy tutorial

您可能还想查看Casperjs 以更丰富的方式与网页交互。

【讨论】:

  • 我不完全确定这就是我要找的。使用这种方法,python 模块直接访问/打开网站进行抓取,这在我的情况下不起作用(URL 是登录页面)。你能指出我正确的方向吗?
  • @user21267 如果您想以编程方式与网页交互、登录等等,那么您不再需要处理静态页面。这意味着您需要以更丰富的方式与网页交互,然后我会考虑使用 Casperjs。值得注意的是,您可能需要更深入地了解网页的工作原理,特别是 GET 和 POST 请求在登录中的作用。但 Casperjs 是正确的开始。
猜你喜欢
  • 2012-02-07
  • 1970-01-01
  • 2014-06-22
  • 1970-01-01
  • 2011-12-22
  • 1970-01-01
  • 2014-06-28
  • 2019-08-27
  • 2014-10-24
相关资源
最近更新 更多