【发布时间】:2019-12-10 14:21:22
【问题描述】:
我正在尝试从 twitter 上抓取推文以进行一个辅助项目。
输出有困难。
使用最新版本的 pycharm。
import urllib
import urllib.request
from bs4 import BeautifulSoup
theurl = "https://twitter.com/search?q=ghana%20and%20jollof&src=typed_query"
thepage = urllib.request.urlopen(theurl)
soup = BeautifulSoup(thepage, "html.parser")
i = 1
for tweets in soup.findAll('div', {
"class": "css-901oao css-16my406 r-1qd0xha r-ad9z0x r-bcqeeo r-qvutc0"
}):
print (i)
print (tweets.find('span').text)
i = i+1
print(tweets)
我没有收到任何错误,但推文没有输出。
【问题讨论】:
-
我相信,但我不完全确定,推文是通过 javascript 在浏览器中动态加载的。所以你不能动态加载推文。我想有一些 python 模块可以完成这项工作,比如tweepy
标签: python web-scraping twitter sentiment-analysis