【发布时间】:2018-05-24 16:45:50
【问题描述】:
我可以在inspect 期间看到内容位于article-wrap 类中,如屏幕截图中突出显示的那样:
但是当我尝试抓取其中的文本内容时,我什么也得不到:
这是为什么呢?我是否错误地指定了班级?如果是这样,我需要指定哪个类?知道我应该指定哪个类(或标签,或 div 等)的最简单方法是什么?
这是代码:
import requests
links = open("article links.txt", "r")
for a in links:
page = requests.get(a)
soup = BeautifulSoup(page.text, 'lxml')
html = soup.find(class_="article-wrap")
print(html)
【问题讨论】:
-
我测试了您的代码并且它正在工作。您能否打印出循环中的链接以实际检查链接是否有效并指向具有实际
article-wrapdiv 的页面?我刚刚使用了一篇文章的单个链接。 -
可以给个网址吗?
-
@Kristada673 在你给我的例子中,类是:“mag-article-wrap”
-
@Kristada673 超级,考虑自己写下答案并接受它:)
-
@Kristada673,很高兴听到它对你有用 :)
标签: python html web-scraping beautifulsoup scrapy