toTable (DataStreamWriter)

Memulai eksekusi kueri streaming, terus menghasilkan hasil ke tabel yang diberikan saat data baru tiba. Mengembalikan objek StreamingQuery.

Sintaksis

toTable(tableName, format=None, outputMode=None, partitionBy=None, queryName=None, **options)

Parameter-parameternya

Parameter Tipe Deskripsi
tableName str Nama tabel tersebut.
format str, opsional Format yang digunakan untuk menyimpan.
outputMode str, opsional Bagaimana data ditulis ke sink: append, , completeatau update.
partitionBy str atau daftar, opsional Nama kolom partisi. Diabaikan untuk tabel v2 yang sudah ada.
queryName str, opsional Nama unik untuk kueri.
**options
Semua opsi string lainnya. Sediakan checkpointLocation untuk sebagian besar aliran.

Pengembalian Barang

StreamingQuery

Catatan

Untuk tabel v1, partitionBy kolom selalu dihormati. Untuk tabel v2, partitionBy hanya dihormati jika tabel belum ada.

Examples

Simpan aliran data ke tabel:

import tempfile
import time
_ = spark.sql("DROP TABLE IF EXISTS my_table2")
with tempfile.TemporaryDirectory(prefix="toTable") as d:
    q = spark.readStream.format("rate").option(
        "rowsPerSecond", 10).load().writeStream.toTable(
            "my_table2",
            queryName='that_query',
            outputMode="append",
            format='parquet',
            checkpointLocation=d)
    time.sleep(3)
    q.stop()
    spark.read.table("my_table2").show()
    _ = spark.sql("DROP TABLE my_table2")