vector_sum

Statistische functie: retourneert de som van floatvectoren in een groep. Alle vectoren moeten dezelfde dimensie hebben.

Zie statistische functie voor de bijbehorende Databricks SQL-functievector_sum.

Syntax

from pyspark.sql import functions as dbf

dbf.vector_sum(col=<col>)

Parameters

Parameter Type Beschrijving
col pyspark.sql.Column of kolomnaam Invoervectorkolom.

Returns

pyspark.sql.Column: De op elementen gerichte somvector als een matrix van floats.

Examples

from pyspark.sql import functions as dbf
from pyspark.sql.types import ArrayType, FloatType, StructType, StructField

schema = StructType([StructField('v', ArrayType(FloatType()))])
df = spark.createDataFrame([([1.0, 2.0],), ([3.0, 4.0],)], schema)
df.select(dbf.vector_sum('v')).first()[0]
# [4.0, 6.0]