我有一个
DataFrame
10行2列:
ID
具有随机标识符值的列和
VAL
列填充
None
.
vals = [
Row(ID=1,VAL=None),
Row(ID=2,VAL=None),
Row(ID=3,VAL=None),
Row(ID=4,VAL=None),
Row(ID=5,VAL=None),
Row(ID=6,VAL=None),
Row(ID=7,VAL=None),
Row(ID=8,VAL=None),
Row(ID=9,VAL=None),
Row(ID=10,VAL=None)
]
df = spark.createDataFrame(vals)
现在假设我想更新
瓦尔
值为“的3行的列”
让
“,3行带值”
水桶
“和4行数值”
这
“。
在pyspark中有没有一种简单的方法可以做到这一点?
注:id值不一定连续,bucket分布不一定均匀