【发布时间】:2019-08-15 04:53:22
【问题描述】:
实际上,我是使用 Python Beautifulsoup4 进行解析的新手。我在刮this website。我需要首页上的当前每英里价格。
我已经用了 3 个小时。在互联网上寻找解决方案时。我知道有一个库 PyQT4 可以像网络浏览器一样模仿并加载内容,然后一旦完成加载,您就可以提取所需的数据。但是我崩溃了。
使用这种方法以原始文本格式收集数据。我也尝试了其他方法。
def parseMe(url):
soup = getContent(url)
source_code = requests.get(url)
plaint_text = source_code.text
soup = BeautifulSoup(plaint_text, 'html.parser')
osrs_text = soup.find('div', class_='col-md-12 text-center')
print(osrs_text.encode('utf-8'))
Please have a look on this image。我认为问题在于 ::before 和 ::after 标签。它们会在页面加载后出现。
我们将不胜感激。
【问题讨论】:
标签: python python-3.x web-scraping beautifulsoup python-requests