Nota
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare ad accedere o modificare le directory.
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare a modificare le directory.
Restituisce un stimato conteggio di valori univoci in una colonna.
Importante
Il supporto per APPROXIMATEDISTINCTCOUNT nelle modalità di importazione e archiviazione Direct Lake è attualmente in anteprima.
Sintassi
APPROXIMATEDISTINCTCOUNT(<columnName>)
Parametri
| Termine | Descrizione |
|---|---|
column |
Colonna di input. |
L'argomento column non può essere un'espressione.
Valore restituito
Numero approssimativo di valori distinti in column.
Osservazioni
L'unico argomento di questa funzione è una colonna. Usare colonne contenenti qualsiasi tipo di dati. Quando la funzione non trova righe da contare, restituisce un
BLANKoggetto ; in caso contrario, restituisce il conteggio di valori distinti.In modalità importazione, Direct Lake in OneLake e Direct Lake in SQL senza fallback, la funzione usa un algoritmo HyperLogLog lato motore.
In modalità DirectQuery la funzione richiama un'operazione di aggregazione corrispondente nell'origine dati. Questo comportamento è supportato per Azure SQL, Azure Synapse pool SQL dedicato, BigQuery, Databricks e Snowflake. Direct Lake in SQL usa questo comportamento DirectQuery quando esegue il fallback alla modalità DirectQuery.
Usare questa funzione per le colonne a cardinalità elevata quando un risultato approssimativo è accettabile. Usare DISTINCTCOUNT quando è necessario un risultato esatto.
Per le colonne a cardinalità bassa,
APPROXIMATEDISTINCTCOUNTè possibile che le prestazioni vengano eseguite più lentamente rispetto aDISTINCTCOUNT. Può anche usare più memoria diDISTINCTCOUNT, soprattutto con modelli di grandi dimensioni, concorrenza elevata o molti gruppi per gruppo.Il conteggio stimato restituito da
APPROXIMATEDISTINCTCOUNTha una frequenza di errore di circa 1,6% per i modelli Import e Direct Lake.