Notitie
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen u aan te melden of de directory te wijzigen.
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen de mappen te wijzigen.
Statistische functie: retourneert de som van floatvectoren in een groep. Alle vectoren moeten dezelfde dimensie hebben.
Zie statistische functie voor de bijbehorende Databricks SQL-functievector_sum.
Syntax
from pyspark.sql import functions as dbf
dbf.vector_sum(col=<col>)
Parameters
| Parameter | Type | Beschrijving |
|---|---|---|
col |
pyspark.sql.Column of kolomnaam |
Invoervectorkolom. |
Returns
pyspark.sql.Column: De op elementen gerichte somvector als een matrix van floats.
Examples
from pyspark.sql import functions as dbf
from pyspark.sql.types import ArrayType, FloatType, StructType, StructField
schema = StructType([StructField('v', ArrayType(FloatType()))])
df = spark.createDataFrame([([1.0, 2.0],), ([3.0, 4.0],)], schema)
df.select(dbf.vector_sum('v')).first()[0]
# [4.0, 6.0]