代码之家  ›  专栏  ›  技术社区  ›  shacker kravietz

使用通用提要分析器聚合多个提要

  •  0
  • shacker kravietz  · 技术社区  · 16 年前

    在通用提要解析器中使用单源提要解析非常幸运,但是现在我需要通过它运行多个提要并生成按时间顺序交错的输出(而不是RSS)。似乎我需要遍历URL,并将每个条目填入字典列表中,然后按条目时间戳对其进行排序,并从顶部切掉一块。这看起来是可行的,但在资源方面相当昂贵(为此,我将积极缓存它)。

    只是想知道是否有一种更简单的方法——例如,使用FeedParser进行简单聚合的现有库。样本代码?明白还是警告?谢谢。

    2 回复  |  直到 16 年前
        1
  •  2
  •   John Paulett    16 年前

    您可以将提要放入数据库,然后从此数据库生成新的提要。

    考虑研究两个基于FeedParser的RSS聚合器: Planet Feed Aggregator FeedJack (基于Django),或者至少他们是如何解决这个问题的。

        2
  •  1
  •   Denis Otkidach    16 年前

    这里已经有了在数据库中存储数据的建议,例如 bsddb.btopen() 或任何RDBMS。

    看一看 heapq.merge() bisect.insort() 或者,如果您想合并内存中的数据,可以使用其中一个B树实现。