【发布时间】:2020-03-06 13:35:21
【问题描述】:
你好,世界,
Python 中的新手,我正在尝试抓取一个 javascript 页面:https://search.gleif.org/#/search/
请在下面从我的代码中找到结果(使用请求)
<!DOCTYPE html>
<html>
<head><meta charset="utf-8"/>
<meta content="width=device-width,initial-scale=1" name="viewport"/>
<title>LEI Search 2.0</title>
<link href="/static/icons/favicon.ico" rel="shortcut icon" type="image/x-icon"/>
<link href="https://fonts.googleapis.com/css?family=Open+Sans:200,300,400,600,700,900&subset=cyrillic,cyrillic-ext,greek,greek-ext,latin-ext,vietnamese" rel="stylesheet"/>
<link href="/static/css/main.045139db483277222eb714c1ff8c54f2.css" rel="stylesheet"/></head>
<body>
<div id="app"></div>
<script src="/static/js/manifest.2ae2e69a05c33dfc65f8.js" type="text/javascript"></script>
<script src="/static/js/vendor.6bd9028998d5ca3bb72f.js" type="text/javascript"></script>
<script src="/static/js/main.5da23c5198041f0ec5af.js" type="text/javascript"></script>
</body>
</html>
问题:
而不是检索上述脚本:
"src="/static/js/manifest.2ae2e69a05c33dfc65f8.js" type="text/javascript""
我想要表格的内容以便存储它。
【问题讨论】:
-
你到底想找到什么?
-
那么问题是如何在 selenium 中设置代理身份验证?您可以通过谷歌搜索并找到一些解决硒限制的方法。
-
@pguardiario 问题是如何获取表格内容而不是 js.script。如果您有任何提示?
-
@SuperStormer,我想刮桌子,但我没有得到脚本 js。你知道如何处理它吗?
-
你会为此使用硒。
标签: javascript python selenium beautifulsoup request