【发布时间】:2019-06-07 05:56:00
【问题描述】:
我正在尝试访问
中的元素<script type="text/javascript">ReportPopper("http://asd.asd.asd/ReportOutput/asd-asd-41cc-asd-asd.xls");<script>
使用beautifulsoup,不幸的是我不确定如何访问 ReportPopper 部分并使用Python 将其分配给变量
对不起,如果这已经回答。 我尝试在 find('ReportPopper') 中添加 ReportPopper 并给我一个 none 元素。
import requests
import io
import os
from bs4 import BeautifulSoup
participation = requests.post(url=report_post_url,data=request_post_report_form,headers=report_post_headers,stream=True)
print(participation)
soup = BeautifulSoup(participation.text, 'html.parser')
for n in soup.find_all('script'):
javascript = n['ReportPopper']
print(javascript)
我想得到我的最终结果:
javascript = "http://asd.asd.asd/ReportOutput/asd-asd-41cc-asd-asd.xls"
作为我的输出:
Traceback (most recent call last):
File "c:\Users\John asd\Documents\GitHub\asd.net\testing.py", line 184, in <module>
javascript = n['ReportPopper']
File "C:\Users\John asd\asd\Local\Programs\Python\Python37\lib\site-packages\bs4\element.py", line 1016, in __getitem__
return self.attrs[key]
KeyError: 'ReportPopper'
【问题讨论】:
-
report_post_url的值是多少? -
请检查您发布的元素是否正确。我的意思是:
<script type="text/javascript">ReportPopper("http://asd.asd.asd/ReportOutput/asd-asd-41cc-asd-asd.xls");<script>
标签: javascript python html web-scraping beautifulsoup