Données & tracking Expert

Déduplication probabiliste

Aussi appelé : probabilistic deduplication, fuzzy matching doublons, dedoublonnage flou · En anglais : probabilistic deduplication

La déduplication probabiliste estime si plusieurs enregistrements représentent la même entité lorsque les clés exactes diffèrent ou manquent. Elle détecte fautes, variations et changements, mais doit contrôler les faux rapprochements qui fusionneraient des personnes distinctes.

Définition

Dans le vocabulaire de l'acquisition et des leads, la déduplication probabiliste estime si plusieurs enregistrements représentent la même entité lorsque les clés exactes diffèrent ou manquent. Cette définition fixe le périmètre exact du terme et évite de lui attribuer une promesse qu'il ne contient pas.

La mise en œuvre se juge sur des éléments observables. Normalisez, comparez plusieurs attributs pondérés, calibrez les seuils sur des paires étiquetées et soumettez la zone grise à validation.

La principale confusion concerne « Dédoublonnage ». Le dédoublonnage est la démarche générale ; sa version probabiliste utilise un score plutôt qu'une égalité exacte de clés.

Concrètement

« Dupont Jean » à Lyon avec deux e-mails proches reçoit un score de correspondance, sans fusion automatique si le téléphone diffère.

À ne pas confondre avec

Notion Ce qu'elle décrit Point de distinction
Déduplication probabiliste La déduplication probabiliste estime si plusieurs enregistrements représentent la même entité lorsque les clés exactes diffèrent ou manquent. Elle détecte fautes, variations et changements, mais doit contrôler les faux rapprochements qui fusionneraient des personnes distinctes.
Dédoublonnage Le dédoublonnage est la démarche générale ; sa version probabiliste utilise un score plutôt qu'une égalité exacte de clés. Ne doit pas être utilisé comme synonyme automatique de Déduplication probabiliste.
Questions fréquentes

Ce que l'on nous demande sur ce terme

Que signifie Déduplication probabiliste ?
La déduplication probabiliste estime si plusieurs enregistrements représentent la même entité lorsque les clés exactes diffèrent ou manquent. Elle détecte fautes, variations et changements, mais doit contrôler les faux rapprochements qui fusionneraient des personnes distinctes.
À quoi sert Déduplication probabiliste dans une stratégie de leads ?
Elle détecte fautes, variations et changements, mais doit contrôler les faux rapprochements qui fusionneraient des personnes distinctes.
Comment mettre en œuvre Déduplication probabiliste ?
Normalisez, comparez plusieurs attributs pondérés, calibrez les seuils sur des paires étiquetées et soumettez la zone grise à validation.
Quelle différence entre Déduplication probabiliste et Dédoublonnage ?
Le dédoublonnage est la démarche générale ; sa version probabiliste utilise un score plutôt qu'une égalité exacte de clés.

Appliqué à Prospect.fr

Prospect.fr utilise trois zones — distinct, probable, certain — et conserve la décision ainsi que les éléments comparés.

Rédigé par Rédaction Prospect.fr · Dernière revue le

Des leads conformes, avec la preuve livrée

Consentement horodaté, enregistrement de l'appel de qualification et source tracée sont rattachés à chaque lead livré sur Prospect.fr.