APPROXIMATEDISTINCTCOUNT

Ισχύει για:Υπολογιζόμενη στήληΥπολογιζόμενος πίνακαςΜέτρηση υπολογισμού απεικόνισης

Επιστρέφει μια εκτιμώμενο πλήθος μοναδικών τιμών σε μια στήλη.

Σημαντικό

Η υποστήριξη για APPROXIMATEDISTINCTCOUNT τις λειτουργίες εισαγωγής και Αποθήκευσης Direct Lake είναι προς το παρόν σε προεπισκόπηση.

Σύνταξη

APPROXIMATEDISTINCTCOUNT(<columnName>)

Παραμέτρους

Όρος Περιγραφή
column Στήλη εισόδου.

Το column όρισμα δεν μπορεί να είναι παράσταση.

Τιμή επιστροφής

Ο κατά προσέγγιση αριθμός διακριτών τιμών σε column.

Παρατηρήσεις

  • Το μοναδικό όρισμα σε αυτή τη συνάρτηση είναι μια στήλη. Χρησιμοποιήστε στήλες που περιέχουν οποιονδήποτε τύπο δεδομένων. Όταν η συνάρτηση δεν βρίσκει γραμμές για να μετρήσει, επιστρέφει ένα BLANK; διαφορετικά, επιστρέφει το πλήθος των διακριτών τιμών.

  • Στη λειτουργία εισαγωγής, το Direct Lake στο OneLake και το Direct Lake σε SQL χωρίς εναλλακτική λύση, η συνάρτηση χρησιμοποιεί έναν αλγόριθμο HyperLogLog από την πλευρά του μηχανισμού.

  • Σε λειτουργία DirectQuery, η συνάρτηση καλεί μια αντίστοιχη λειτουργία συνάθροισης στην προέλευση δεδομένων. Αυτή η συμπεριφορά υποστηρίζεται για Azure SQL, Azure Synapse αποκλειστική ομάδα SQL, BigQuery, Databricks και Snowflake. Το Direct Lake σε SQL χρησιμοποιεί αυτήν τη συμπεριφορά DirectQuery όταν επιστρέψει στη λειτουργία DirectQuery.

  • Χρησιμοποιήστε αυτήν τη συνάρτηση για στήλες υψηλής πληθικότητας όταν ένα κατά προσέγγιση αποτέλεσμα είναι αποδεκτό. Χρησιμοποιήστε DISTINCTCOUNT την όταν χρειάζεστε ένα ακριβές αποτέλεσμα.

  • Για στήλες χαμηλής πληθικότητας, APPROXIMATEDISTINCTCOUNT ενδέχεται να εκτελούνται πιο αργά από DISTINCTCOUNTτο . Μπορεί επίσης να χρησιμοποιήσει περισσότερη μνήμη από DISTINCTCOUNTτη , ιδιαίτερα με μεγάλα μοντέλα, υψηλή ταυτόχρονη εκτέλεση ή πολλές ομάδες ομαδοποίησης.

  • Το εκτιμώμενο πλήθος που επιστρέφεται από APPROXIMATEDISTINCTCOUNT έχει ποσοστό σφάλματος περίπου 1,6% για τα μοντέλα Εισαγωγή και Direct Lake.