【发布时间】:2020-01-11 00:24:24
【问题描述】:
我正在尝试制作一个自动化系统,该系统将建立一个来自 hellopeter 的公司的评论数据库。
我想在这个数据集上应用情感分析,我尝试过使用美丽的汤,但我无法挖掘到重要信息
page = requests.get('https://www.hellopeter.com/telkom/reviews/appalling-service-cdc4559e8084e0db01dd6d7e807875460607ac77-2851593')
soup = BeautifulSoup(page.content, 'html.parser')
print(soup.prettify())
我期望的输出是能够深入到实际审查数据所在的类。我实际上得到的是
下面大概有10层
<div id="app">
</div>
它输出,我不知道如何进行实际审查
更具体地说,我想要
<p data-v-403b1c0a="" itemprop="reviewRating" itemscope="itemscope" itemtype="http://schema.org/Rating">
1
<p data-v-403b1c0a="" itemprop="reviewBody" class="full-content">
<p data-v-403b1c0a="" itemprop="name" class="is-detail-card">APPALLING SERVICE</p>
元素 任何建议
【问题讨论】:
-
您希望具体提取哪些内容?
标签: python-3.x selenium xpath beautifulsoup webdriverwait