【发布时间】:2021-01-22 07:11:05
【问题描述】:
我将提取所有推文和回复。我使用了以下代码,但它只提取了大约 3200 条推文。
import pandas as pd
import numpy as np
import tweepy
consumer_key = "*"
consumer_secret = "*"
access_token = "*"
access_token_secret = "*"
auth = tweepy.OAuthHandler(consumer_key, consumer_secret)
auth.set_access_token(access_token, access_token_secret)
api = tweepy.API(auth,wait_on_rate_limit=True)
username = 'ASPCA'
tweets = tweepy.Cursor(api.user_timeline, screen_name=username).items()
tweets_list = [[tweet.created_at, tweet.id, tweet.text, tweet.in_reply_to_status_id_str, tweet.in_reply_to_screen_name, tweet.in_reply_to_user_id_str, tweet.user.id] for tweet in tweets]
该页面有近 34K 条推文。
感谢任何人的帮助
【问题讨论】:
标签: python web-scraping twitter web-crawler tweepy