代码之家  ›  专栏  ›  技术社区  ›  Zinngg

如何从中提取元素(标题名称、投票、视图、每个标题的答案)https://stackoverflow.com/?tab=month?

  •  2
  • Zinngg  · 技术社区  · 8 年前

    urllib2 )但不是元素的提取( votes , title ,...). 页面为 https://stackoverflow.com/?tab=month

    我如何编写python脚本来获取网页,然后提取每个问题的所有标题、视图数、投票数和答案?

    1 回复  |  直到 8 年前
        1
  •  3
  •   razieh babaee    8 年前

    如果要对页面进行爬网,可以使用以下库: scrapy ,但stackoverflow具有非常好且易于使用的REST API和排序功能,您可以在此处访问和阅读这些功能: https://api.stackexchange.com/docs/ 例如,有关检索问题的信息,请参阅本页: https://api.stackexchange.com/docs/questions