Märkus.
Juurdepääs sellele lehele nõuab autoriseerimist. Võite proovida sisse logida või kausta vahetada.
Juurdepääs sellele lehele nõuab autoriseerimist. Võite proovida kausta vahetada.
Duduplikatsioon leiab ja eemaldab lähtetabelist kliendi duplikaatkirjed, nii et iga klienti tähistab igas tabelis üks rida. Iga tabel dubleeritakse eraldi, kasutades reegleid antud kliendi kirjete tuvastamiseks.
Iga dubleerimisreegel käivitatakse iga rea suhtes. Kui teie esimene reegel vastab ridadele 1 ja 2 ning reegel 2 vastab ridadele 2 ja 3, siis vastendatakse read 1, 2 ja 3. Kui leitakse vastendatud read, valitakse võitja rida, mis esindab seda klienti ühendamise eelistuste alusel (Enim täidetud, Viimane või Kõige hiljutisem). Kasutage suvandit Täpsemalt , et luua võitja rida, valides väljad erinevatelt vastendatud ridadelt, näiteks kõige uuem e-kiri, kuid enim täidetud aadress.
Customer Insights – andmed teostab automaatselt järgmised toimingud.
- Deduplikeerige sama primaarvõtme väärtusega kirjed, valides võitjaks andmekogumi esimese rea.
- Deduplikeerige kirjed, kasutades tabelite vaheliste ridade vastendamisel tabeli jaoks määratletud vastendusreegleid .
Dubleerimise reeglite määratlemine
Hea reegel tuvastab unikaalse kliendi. Mõelge oma andmetele. Võib piisata klientide tuvastamisest välja (nt e-post) alusel. Kui aga soovite eristada kliente, kes jagavad meilisõnumit, võite valida reegli, millel on kaks tingimust, mis vastavad meilile + eesnimi. Lisateabe saamiseks vaadake teemat Dubleerimise head tavad.
Valige lehel Dubleerimisreeglid tabel ja valige duplikatsioonireeglite määratlemiseks Lisa reegel .
Otsa
Kui rikastasite tabeleid andmeallika tasemel, et täiustada ühendamistulemusi, valige lehe ülaservas Kasuta rikastatud tabeleid . Lisateavet leiate teemast Andmeallikate rikastamine.
Sisestage paanil Reegli lisamine järgmine teave.
Vali väli: valige tabeli saadaolevate väljade loendist, mille duplikaate soovite kontrollida. Valige väljad, mis on tõenäoliselt iga kliendi jaoks ainulaadsed. Näiteks meiliaadress või nime, linna ja telefoninumbri kombinatsioon.
Normaliseeri: valige veeru normaliseerimissuvandid. Normaliseerimine mõjutab ainult sobitamise etappi ja ei muuda andmeid.
Normaliseerimiseks Näited Numbrid Teisendab paljud numbreid tähistavad Unicode'i sümbolid lihtsateks numbriteks.
Näited: ❽ ja VIII. on mõlemad normaliseeritud arvuks 8.
Märkus: Sümbolid peavad olema kodeeritud Unicode'i punktivormingus.Sümbolid Eemaldab sümbolid ja erimärgid.
Näited: !?" #$%&'( )+,.-/:;<=>@^~{}'[ ]Tekst väiketähtedeks Teisendab suurtähed väiketähtedeks.
Näide: "THIS Is aN EXamplE" teisendatakse "see on näide"Tüüp – telefon Teisendab erinevates vormingutes telefonid numbriteks ning võtab arvesse riigikoodide ja laienduste esitamise erinevusi. Sümboleid ja tühikuid ignoreeritakse. Riigikoodide algusnumbriid "0" ignoreeritakse, kuna need vastavad +1 ja +01. Tähega eesliitega tähistatud laiendusi ignoreeritakse (X 123). Normaliseeritud riigikood on oluline, nii et riigikoodiga telefon ei ühti ilma riigikoodita telefoniga.
Näide: +01 425.555.1212 vasteid 1 (425) 555-1212
+01 425.555.1212 ei sobi (425) 555-1212Tüüp - Nimi Teisendab üle 500 üldnime variatsiooni ja pealkirja.
Näited: "debby" -> "deborah" "prof" ja "professor" -> "prof".Tüüp - aadress Teisendab aadresside tavalised osad.
Näited: "tänav" -> "st" ja "loode" -> "nw"Tüüp - Organisatsioon Eemaldab umbes 50 ettevõtte nime "mürasõna", nagu "co", "corp", "corporation" ja "ltd". Unicode'ist ASCII-ks Teisendab Unicode'i märgid ASCII-tähe ekvivalentideks
Näide: märgid "à", "á", "â", "À", "Á", "Â", "Ã", "Ä", "(A)" ja "A" teisendatakse kõik täheks "a".Tühik Eemaldab kogu tühja ruumi Pseudonüümide kaardistamine Võimaldab teil üles laadida kohandatud stringipaaride loendi, mida saab seejärel kasutada stringide tähistamiseks, mida tuleks alati pidada täpseks vasteks.
Kasutage pseudonüümi vastendamist, kui teil on konkreetsed andmenäited, mis teie arvates peaksid ühtima, kuid neid ei vastendata mõne muu normaliseerimismustri abil.
Näide: Scott ja Scooter või MSFT ja Microsoft.Kohandatud möödasõit Võimaldab teil üles laadida kohandatud stringide loendi, mida saab seejärel kasutada stringide tähistamiseks, mida ei tohiks kunagi sobitada.
Kohandatud möödaviik on kasulik siis, kui teil on andmeid, millel on ühised väärtused, mida tuleks ignoreerida, näiteks näiv telefoninumber või näiv meiliaadress.
Example: Ärge kunagi sobitage telefoni 555-1212 või test@contoso.com
Täpsus: määrake täpsuse tase. Täpsust kasutatakse täpse vaste ja hägusa sobitamise jaoks ning see määrab, kui lähedased peavad kaks stringi olema, et neid vasteks pidada.
- Põhiline: valige Madal (30%), Keskmine (60%), Kõrge (80%) ja Täpne (100%). Valige Täpne, et vastendada ainult kirjeid, mis vastavad 100 protsendile.
- Kohandatud: määrake protsent, millele kirjed peavad vastama. Süsteem vastab ainult selle läve ületavatele kirjetele.
Nimi: reegli nimi.
Soovi korral valige Lisa>lisamise tingimus , et lisada reeglile rohkem tingimusi. Tingimused on seotud loogilise AND-operaatoriga ja seega täidetakse ainult siis, kui kõik tingimused on täidetud.
Soovi korral saate reeglile erandite lisamiseks> erandi. Erandeid kasutatakse haruldaste valepositiivsete ja valenegatiivsete juhtumite käsitlemiseks.
Reegli loomiseks valige Valmis .
Soovi korral saate lisada veel reegleid.
Ühendamise eelistuste valimine
Kui reeglid käivitatakse ja kliendi kohta tuvastatakse duplikaatkirjed, valitakse ühendamispoliitika põhjal "võitja rida". Võitja rida tähistab klienti järgmises ühendamisetapis, mis vastendab tabelite vahelised kirjed. Mittevõitjate ("alternatiivsete") ridade andmeid kasutatakse vastendusreeglite ühendamise etapis, et vastendada kirjeid teistest tabelitest võitja reaga. See lähenemisviis parandab vastendustulemusi, lubades teabel (nt varasematel telefoninumbritel) aidata tuvastada vastavaid kirjeid. Võitja rea saab konfigureerida nii, et see oleks leitud duplikaatkirjetest kõige täidetum, viimane või kõige värskem.
Valige tabel ja seejärel Redigeeri kooste-eelistusi. Kuvatakse paan Ühenda eelistused .
Valige üks kolmest suvandist, et määrata, millist kirjet duplikaadi leidmisel säilitada.
- Enim täidetud: tuvastab enim täidetud veergudega kirje võitjakirjena. See on vaikimisi ühendamise valik.
- Viimane: tuvastab võitja kirje kõige hiljutisema kogemuse põhjal. Hiljutisuse määratlemiseks on vaja kuupäeva või numbrivälja.
- Kõige hiljutisem: tuvastab võitja kirje vähima hiljutisuse põhjal. Hiljutisuse määratlemiseks on vaja kuupäeva või numbrivälja.
Võrdse tulemuse korral on võitja kirje see, mille primaarvõtme väärtus on MAX(PK) või suurem.
Soovi korral valige tabeli üksikute veergude ühendamiselistuste määratlemiseks paani allservas Täpsemalt . Näiteks saate valida, kas säilitada kõige uuem meiliaadress JA kõige täielikum aadress erinevatest kirjetest. Laiendage tabelit, et näha kõiki selle veerge ja määratleda, millist suvandit üksikute veergude jaoks kasutada. Kui valite hiljutisuspõhise suvandi, peate määrama ka kuupäeva/kellaaja välja, mis määratleb hiljutisuse.
Kooste-eelistuste rakendamiseks valige Valmis .
Pärast dubleerimisreeglite ja ühendamiseelistuste määratlemist valige Edasi.