to_char

Převede col na řetězec na základě znaku format. Vyvolá výjimku, pokud převod selže.

Formát se může skládat z následujících znaků bez rozlišování velkých a malých písmen:

  • 0 nebo 9: Určuje očekávanou číslici mezi 0 a 9. Sekvence 0 nebo 9 ve formátovacím řetězci odpovídá sekvenci číslic ve vstupní hodnotě a generuje výsledný řetězec stejné délky jako odpovídající sekvence v řetězci formátu. Výsledný řetězec je vlevo vycpaný nulami, pokud sekvence 0/9 obsahuje více číslic než odpovídající část desetinné čárky, začíná číslem 0 a je před desetinnou čárkou. V opačném případě je doplněna mezerami.

  • '.' nebo 'D': Určuje pozici desetinné čárky (volitelné, povoleno pouze jednou).

  • ',' nebo 'G': Určuje pozici oddělovače seskupení (tisíce) (,). Musí existovat 0 nebo 9 vlevo a vpravo od každého oddělovače seskupení.

  • $: Určuje umístění znaménka měny $. Tento znak lze zadat pouze jednou.

  • 'S' nebo 'MI': Určuje pozici znaménka -nebo +(volitelné, povoleno pouze jednou na začátku nebo na konci řetězce formátu). Všimněte si, že "S" vytiskne kladná hodnota +, ale "MI" vytiskne mezeru.

  • "PR": Povoleno pouze na konci řetězce formátu; určuje, že výsledný řetězec bude zabalen do úhlových závorek, pokud je vstupní hodnota záporná.

Pokud col je datetime, format musí být platným vzorem data a času.

Pokud col je binární, převede se na řetězec v jednom z formátů:

  • "base64": řetězec base 64.
  • "hex": řetězec v šestnáctkovém formátu.
  • 'utf-8': vstupní binární soubor je dekódován na řetězec UTF-8.

Odpovídající funkci SQL Databricks vizte funkceto_char.

Syntaxe

from pyspark.sql import functions as dbf

dbf.to_char(col=<col>, format=<format>)

Parametry

Parameter Typ Description
col pyspark.sql.Column nebo str Vstupní sloupec nebo řetězce
format pyspark.sql.Column nebo str, optional formát, který se má použít k převodu hodnot znaků.

Examples

df = spark.createDataFrame([(78.12,)], ["e"])
df.select(to_char(df.e, lit("$99.99")).alias('r')).collect()