我想在这个网站上刮桌子: http://fluxnet.fluxdata.org/sites/site-list-and-pages/?view=table ,使用以下代码:
library(rvest) url <- "http://fluxnet.fluxdata.org/sites/site-list-and-pages/?view=table" tbl <- url %>% read_html() %>% html_nodes(xpath='//*[@id="siteTable"]') %>% html_table()
但是,返回的表只有头,但根本没有数据。
我错过了什么?
如果只是针对单个页面,最简单的解决方案是在浏览器中打开页面,并将其保存为本地硬盘上的HTML文件。
然后,您可以运行上述代码行,指向硬盘上文件的位置,而不是远程url。它应该有用。