vector_sum

집계 함수: 그룹에 있는 float 벡터의 요소 단위 합계를 반환합니다. 모든 벡터는 동일한 차원을 가져야 합니다.

해당 Databricks SQL 함수는 집계 함수를 참조 vector_sum 하세요.

Syntax

from pyspark.sql import functions as dbf

dbf.vector_sum(col=<col>)

Parameters

매개 변수 Type 설명
col pyspark.sql.Column 또는 열 이름 입력 벡터 열입니다.

Returns

pyspark.sql.Column: 부동 소수 자릿수 배열인 요소별 합계 벡터입니다.

예제

from pyspark.sql import functions as dbf
from pyspark.sql.types import ArrayType, FloatType, StructType, StructField

schema = StructType([StructField('v', ArrayType(FloatType()))])
df = spark.createDataFrame([([1.0, 2.0],), ([3.0, 4.0],)], schema)
df.select(dbf.vector_sum('v')).first()[0]
# [4.0, 6.0]