在R中,我创建了两个数据集,并将其保存为csv文件
liste <-write.csv(liste, file="/home/.../liste.csv", row.names=FALSE)
data <- write.csv(data, file="/home/.../data.csv", row.names=FALSE)
我现在想在SparkR中打开这些csv文件。所以我键入
liste <- read.df(sqlContext, "/home/.../liste.csv", "com.databricks.spark.csv", header="true", delimiter= "\t")
data <- read.df(sqlContext, "/home/.../data.csv", "com.databricks.spark.csv", header="true", delimiter= "\t")
事实证明,在SparkR中成功加载了一个数据集“liste”,但由于某些奇怪的原因,无法加载“data”。
“liste”只是R中数字的向量,而“data”是数据。帧我已加载到R中,并删除了data.frame的一些部分。SparkR给我这个错误消息:
错误:returnStatus==0不是TRUE