【问题标题】:How does FeedJack fetches historical feedsFeedJack 如何获取历史提要
【发布时间】:2010-07-10 02:43:04
【问题描述】:

我正在构建一个新闻聚合网站,并且正在寻找一种将(任何特定网站的)旧提要获取到系统中的方法。在这门课程中,我偶然发现了Feedjack。据说它可以处理我需要的东西。所以我开始深入研究源代码。 (我不想直接在我的 django 项目中插入。)我看到的只是这一行:

self.fpf = parse_feed(self.feed.feed_url, agent=USER_AGENT, etag=self.feed.etag) # in bin/feedjack_update.py

我不确定这如何处理历史提要解析。我可以知道我错过了什么。我还有一个问题是,更不用说 feedjack,我如何访问任何网站的历史提要?

【问题讨论】:

    标签: django feed feedparser


    【解决方案1】:

    网站不提供历史供稿。不幸的是,“访问”它的唯一方法是将它自己存储在数据库中。对于常见的提要,您可以从另一个聚合器获取它。否则,您会从首次添加提要开始构建历史记录。

    【讨论】:

      【解决方案2】:

      我能看到的唯一选项是使用 Google Reader。有一个blogpost about constructing feed history of any feed。我不想仅仅为了获取历史信息而坚持服务。无论如何,如果没有更好的选择,我会去的。

      【讨论】:

      • 我阅读了上述谷歌阅读器博客文章中的 cmets 并尝试了 NewsBlur.com。两者似乎在同一件事上都失败了,除非有人至少订阅了该网站一次,否则您不能保证旧的提要条目。所以谷歌阅读器只是获取已经缓存的条目。如果没有人订阅该网站,则缓存中不会有任何内容,并且您无法从该 Google 阅读器平台检索它。游戏结束!
      猜你喜欢
      • 2016-08-05
      • 2013-06-03
      • 2019-07-26
      • 1970-01-01
      • 2014-11-01
      • 1970-01-01
      • 2013-08-02
      • 1970-01-01
      • 2021-01-17
      相关资源
      最近更新 更多