start (DataStreamWriter)

Передает содержимое кадра данных в источник данных и возвращает объект StreamingQuery.

Синтаксис

start(path=None, format=None, outputMode=None, partitionBy=None, queryName=None, **options)

Параметры

Параметр Тип Описание
path str, необязательный Путь в файловой системе, поддерживаемой Hadoop.
format str, необязательный Формат, используемый для сохранения.
outputMode str, необязательный Запись данных в приемник: appendили completeupdate.
partitionBy str или list, необязательный Имена столбцов секционирования.
queryName str, необязательный Уникальное имя запроса.
**options
Все остальные параметры строки. Предоставляется checkpointLocation для большинства потоков; не требуется для memory потока.

Возвраты

StreamingQuery

Примеры

df = spark.readStream.format("rate").load()

Базовый пример:

q = df.writeStream.format('memory').queryName('this_query').start()
q.isActive
# True
q.name
# 'this_query'
q.stop()
q.isActive
# False

С триггером и дополнительными параметрами:

q = df.writeStream.trigger(processingTime='5 seconds').start(
    queryName='that_query', outputMode="append", format='memory')
q.name
# 'that_query'
q.isActive
# True
q.stop()