代码之家  ›  专栏  ›  技术社区  ›  John

如何在浏览器中加载但不在BeautifulSoup中加载的python中解析web表?

  •  0
  • John  · 技术社区  · 3 年前

    我想从这个网站上获取表格的数据框架(网球预订- https://clubspark.lta.org.uk/StJohnsParkLondon/Booking/BookByDate ),但是pd.read_html没有找到任何表,BeautifulSoup也没有加载(div class=“booking sheet clearfix”)所有数据所在的位置。

    我试过使用硒,并提出了要求,但得到了同样的结果,如有任何帮助,我们将不胜感激。

    1 回复  |  直到 3 年前
        1
  •  0
  •   Tim Roberts    3 年前

    这些数据是通过Javascript动态生成的。您不能使用 requests 和 BeautifulSoup 为此,也不能使用你 pandas.read_html 。您需要使用 Selenium 要获取它,您需要使用 硒 API来遍历DOM中的对象以提取数据。