APPROXIMATEDISTINCTCOUNT

Van toepassing op:berekende kolomberekende tabelMetingVisuele berekening

Retourneert een geschatte aantal unieke waarden in een kolom.

Important

Ondersteuning voor APPROXIMATEDISTINCTCOUNT import- en Direct Lake-opslagmodi is momenteel beschikbaar als preview-versie.

Syntaxis

APPROXIMATEDISTINCTCOUNT(<columnName>)

Parameters

Term Beschrijving
column Invoerkolom.

Het column argument kan geen expressie zijn.

Retourwaarde

Het geschatte aantal afzonderlijke waarden in column.

Opmerkingen

  • Het enige argument voor deze functie is een kolom. Gebruik kolommen met elk type gegevens. Wanneer de functie geen rijen vindt die moeten worden geteld, retourneert deze een BLANK; anders wordt het aantal afzonderlijke waarden geretourneerd.

  • In de importmodus, Direct Lake op OneLake en Direct Lake op SQL zonder terugval, maakt de functie gebruik van een HyperLogLog-algoritme aan de enginezijde.

  • In de DirectQuery-modus roept de functie een bijbehorende aggregatiebewerking aan in de gegevensbron. Dit gedrag wordt ondersteund voor Azure SQL, Azure Synapse toegewezen SQL-pool, BigQuery, Databricks en Snowflake. Direct Lake op SQL maakt gebruik van dit DirectQuery-gedrag wanneer deze terugvalt naar de DirectQuery-modus.

  • Gebruik deze functie voor kolommen met hoge kardinaliteit wanneer een geschat resultaat acceptabel is. Gebruik DISTINCTCOUNT dit wanneer u een exact resultaat nodig hebt.

  • Voor kolommen APPROXIMATEDISTINCTCOUNT met lage kardinaliteit kan dit langzamer presteren dan DISTINCTCOUNT. Het kan ook meer geheugen gebruiken dan DISTINCTCOUNT, met name bij grote modellen, hoge gelijktijdigheid of veel groepen per groep.

  • Het geschatte aantal geretourneerd door APPROXIMATEDISTINCTCOUNT heeft een foutpercentage van ongeveer 1,6% voor Import- en Direct Lake-modellen.