orc (DataFrameWriter)

A megadott elérési útvonalon menti az DataFrame ORC formátumban lévő tartalmat.

Szemantika

orc(path, mode=None, partitionBy=None, compression=None)

Paraméterek

Paraméter Típus Leírás
path str Bármely Hadoop által támogatott fájlrendszer elérési útja.
mode str, nem kötelező A viselkedés, ha az adatok már léteznek. Az elfogadott értékek a következők'append': , 'overwrite', 'ignore'és 'error''errorifexists' (alapértelmezett).
partitionBy str vagy list, nem kötelező Particionálási oszlopok nevei.
compression str, nem kötelező A használni kívánt tömörítési kodek.

Visszatérítések

Nincs

Examples

Írjon egy DataFrame-et egy ORC-fájlba, és olvassa vissza.

import tempfile
with tempfile.TemporaryDirectory(prefix="orc") as d:
    spark.createDataFrame(
        [{"age": 100, "name": "Alice"}]
    ).write.orc(d, mode="overwrite")

    spark.read.format("orc").load(d).show()
    # +---+------------+
    # |age|        name|
    # +---+------------+
    # |100|Alice|
    # +---+------------+