【问题标题】:Writing url extracted from tweets in a csv file在 csv 文件中写入从推文中提取的 url
【发布时间】:2021-07-25 01:36:24
【问题描述】:

我正在尝试使用此代码从推文中提取网址。它完美地工作,并将完整的网址作为输出提供给我。我想将所有这些 url 写在一个 csv 文件中,我不在乎它是否与推文相同(它会更好)或另一个。我尝试了不同的东西,比如“.to_csv”或 writerow 函数,但它们没有用,可能是因为我把它们放在了错误的地方。任何帮助表示赞赏!

def get_tweets(handle):
      try:
        auth = tweepy.OAuthHandler(consumer_key, consumer_secret)
        auth.set_access_token(access_token, access_token_secret)
        api = tweepy.API(auth)

    
        number_of_tweets = 200

        tweets = api.user_timeline(screen_name = handle,count = number_of_tweets)

        print(handle, "Number of tweets extracted: {}\n".format(len(tweets)))
        df = pd.DataFrame(data=[tweet.user.screen_name for tweet in tweets], columns=['ScreenName'])

        for tweet in tweets:
            urls = re.findall("http[s]?://(?:[a-zA-Z]|[0-9]|[$-_@.&+]|[!*\(\),]|(?:%[0-9a-fA-F][0-9a-fA-F]))+", tweet.text)
            for url in urls:
                try:
                    opener = urllib.request.build_opener()
                    request = urllib.request.Request(url)
                    response = opener.open(request)
                    actual_url = response.geturl()
                    print (actual_url)
                except:
                    print(url)
      except:
        pass
      return df



handles = ["name of the user"]
           
         
for handle in handles:
    df_new = get_tweets(handle)

【问题讨论】:

    标签: python pandas url twitter extract


    【解决方案1】:

    你可以试试这个:

    handles = ["name of the user"]
    
    for handle in handles:
        df_new = get_tweets(handle)
        df_new.to_csv(path_or_buf=f"{handle}_tweets.csv", index=False)
    

    【讨论】:

    • 谢谢!但是这样我就无法打印出网址
    猜你喜欢
    • 2018-07-21
    • 1970-01-01
    • 2014-01-14
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多