我试图弄清楚在什么地方需要使用lit值,它在文档中被定义为literal column。
以下面的udf为例,它返回一个SQL列数组的索引:
def find_index(column, index):
return column[index]如果我将一个整数传入其中,我会得到一个错误。我需要将udf值传递到lit(n)中,以获得正确的数组索引。
有没有什么地方可以让我更好地学习何时使用lit和col的硬性规则?
发布于 2019-08-07 18:08:04
导入库:
from pyspark.sql.functions import lit简单的例子可以是:
df.withColumn("columnName", lit(Column_Value ))例如:
df = df.withColumn("Today's Date", lit(datetime.now()))https://stackoverflow.com/questions/37715060
复制相似问题