Werken met dubbele waarden

U kunt met dubbele sets waarden werken via transformaties waarmee duplicaten uit uw gegevens kunnen worden verwijderd. Of u kunt uw gegevens filteren om alleen duplicaten weer te geven, zodat u zich erop kunt richten.

Waarschuwing

Power Query is hoofdlettergevoelig. Wanneer u met dubbele waarden werkt, wordt in Power Query rekening meegeslagen in het geval van de tekst, wat tot ongewenste resultaten kan leiden. Als tijdelijke oplossing kunt u een transformatie in hoofdletters of kleine letters toepassen voordat u duplicaten verwijdert.

Voor dit artikel gebruiken de voorbeelden de volgende tabel met de kolommen ID, Categorie en Totaal .

Schermopname van de eerste voorbeeldtabel met de kolommen ID, Categorie en Totaal.

Opmerking

Het toepassen van een stap voor het verwijderen van duplicaten kan het geheugenverbruik aanzienlijk verhogen als Power Query deze bewerking niet kan offloaden naar de back-endgegevensbron (ook wel 'folding' genoemd).

Dubbele rijen verwijderen in Power Query

Gebruik Dubbele waarden verwijderen om rijen te verwijderen waarin geselecteerde kolommen herhaalde waarden bevatten. Power Query is hoofdlettergevoelig bij het vergelijken van waarden, dus pas eerst een transformatie naar hoofdletters of kleine letters toe als het gebruik van hoofdletters en kleine letters geen invloed mag hebben op de vergelijking.

  1. Selecteer de kolommen die dubbele waarden bevatten.

  2. Ga naar het tabblad Start .

  3. Selecteer Rijen verwijderen in de groep Rijen verminderen.

  4. Selecteer duplicaten verwijderen in de vervolgkeuzelijst.

    Schermopname van de locatie van de optie Duplicaten verwijderen onder Rijen verwijderen.

Waarschuwing

Power Query garandeert niet dat het eerste exemplaar in een set duplicaten wordt opgeslagen wanneer duplicaten worden verwijderd. Zie Sortering behouden voor meer informatie over het behouden van sorteren.

Duplicaten uit meerdere kolommen verwijderen

Met behulp van de voorbeeldtabel met de kolommen ID, Categorie en Totaal worden in dit voorbeeld dubbele rijen verwijderd op basis van alle kolommen.

Schermopname van de eerste tabel met dubbele waarden in meerdere kolommen benadrukt.

U hebt vier rijen die duplicaten zijn. Het doel is om deze dubbele rijen te verwijderen, zodat er alleen unieke rijen in de tabel staan. Selecteer alle kolommen in de tabel en selecteer dubbele waarden verwijderen.

De uitvoertabel bevat alleen rijen met unieke combinaties in alle kolommen.

Schermopname van de uiteindelijke tabel met dubbele waarden verwijderd uit alle kolommen.

Opmerking

U kunt deze bewerking ook uitvoeren met een subset kolommen.

Duplicaten uit één kolom verwijderen

Met dezelfde voorbeeldtabel worden in dit voorbeeld dubbele rijen verwijderd op basis van alleen de kolom Categorie .

Schermopname van de eerste tabel die duplicaten identificeert in de kolom Categorie.

U wilt deze duplicaten verwijderen en alleen unieke waarden behouden. Als u duplicaten uit de kolom Categorie wilt verwijderen, selecteert u deze en selecteert u Dubbele waarden verwijderen.

De uitvoertabel behoudt alleen de eerste rij voor elke unieke categoriewaarde .

Schermopname van de uiteindelijke tabel met dubbele waarden verwijderd uit de kolom Categorie.

Dubbele rijen behouden in Power Query

Gebruik Duplicaten behouden om de tabel te filteren, zodat alleen rijen worden weergegeven met herhaalde waarden in de geselecteerde kolommen. Power Query is hoofdlettergevoelig bij het vergelijken van waarden.

  1. Selecteer de kolommen die dubbele waarden bevatten.

  2. Ga naar het tabblad Start .

  3. Selecteer Rijen behouden in de groep Rijen beperken.

  4. Selecteer duplicaten behouden in de vervolgkeuzelijst.

    Schermopname van de locatie van de optie Duplicaten behouden onder Rijen behouden.

Duplicaten van meerdere kolommen behouden

Met behulp van de voorbeeldtabel met de kolommen ID, Categorie en Totaal worden in dit voorbeeld alleen rijen bijgehouden die meerdere keren in alle kolommen worden weergegeven.

Schermopname van de eerste tabel voor het bewaren van duplicaten uit meerdere kolommen.

U hebt vier rijen die duplicaten zijn. Het doel in dit voorbeeld is om alleen de rijen te behouden die in de tabel worden gedupliceerd. Selecteer alle kolommen in de tabel en selecteer dubbele waarden behouden.

De uitvoertabel bevat alleen de rijen met overeenkomende waarden in een andere rij.

Schermopname van de uiteindelijke tabel met alleen gedupliceerde rijen uit meerdere kolommen.

Duplicaten van één kolom behouden

Met dezelfde voorbeeldtabel worden in dit voorbeeld alleen rijen bijgehouden waarin de waarde van de id-kolom meer dan één keer wordt weergegeven.

Initiële tabel voor het bewaren van duplicaten uit één kolom.

In dit voorbeeld hebt u meerdere duplicaten die u in de tabel wilt bewaren. Als u duplicaten uit de kolom ID wilt behouden, selecteert u de id-kolom en selecteert u Duplicaten behouden.

De uitvoertabel bevat alle rijen waarin de id-waarde meerdere keren werd weergegeven.

Uiteindelijke tabel met alleen gedupliceerde rijen uit één kolom.

Hulpprogramma's voor gegevensprofilering