Famille de processus

Qualité des données et processus de données de référence : règles, défauts et…

Cinq modèles pour conserver les données partagées utilisables : les règles de qualité et le suivi, un défaut du rapport à la clôture, les fiches de la demande à la mise hors service, le glossaire métier et l'entrée de catalogue auxquels…

La qualité des données et les données de base sont les deux disciplines qui décident si un numéro peut être fiable et si deux enregistrements correspondent au même client. Cette famille regroupe les cinq modèles qui les exécutent : un processus de règles et de surveillance, un processus de défaut pour un problème, un processus de données de base pour les entités partagées, ainsi que le glossaire et le catalogue qui donnent à chaque règle et enregistrent une signification définie.

Les cinq dépendent les uns des autres dans un ordre fixe. Gestion de la qualité des données est le processus permanent : un consommateur fixe un objectif, le gestionnaire et le propriétaire conviennent des règles et des tolérances, l'ingénierie met en œuvre les contrôles et surveille les violations. Lorsqu'une violation est importante, elle sort de cette boucle et devient un cas dans gestion des problèmes de qualité des données : impact évalué, utilisation contenue, cause confirmée, correction acceptée par le propriétaire et le consommateur, et clôturée par un suivi préventif. Chaque règle nomme un champ dont la signification provient du terme du glossaire et de l'entrée de catalogue, c'est pourquoi les deux sont répertoriés ici.

Gestion des données de référence gère les enregistrements partagés par plusieurs systèmes : clients, fournisseurs, produits, sites. Sa décision centrale est le résultat du match. Chaque demande de création ou de modification est vérifiée par rapport aux enregistrements existants avant qu'un propriétaire de domaine ne l'approuve, les opérations MDM publient l'identifiant et réconcilient la distribution, et le retrait attend que rien en aval ne dépende encore de l'enregistrement. Un doublon principal est l'endroit où les deux modèles se rencontrent : un doublon trouvé lors d'un contrôle qualité est contenu dans le processus de problème et résolu par une modification des données principales, de sorte que la correction atterrit à la source plutôt que dans un seul rapport.

Les échecs typiques sont structurels. Les règles sont écrites sans tolérance, donc chaque score constitue une infraction et aucun n'est suivi ; un problème est corrigé dans le rapport mais pas à la source, donc il revient ; et un enregistrement principal est retiré pendant qu'une application le lit encore. Chaque modèle place une décision nommée devant cette étape, demandant si les tolérances ont été approuvées, si le propriétaire et le consommateur acceptent la correction, si l'enregistrement principal peut être retiré en toute sécurité. L'autorité sur laquelle reposent ces décisions est définie dans gouvernance des données, et les pipelines qui déplacent les données entre les systèmes se trouvent dans ingénierie et migration de données.

Modèles de cette famille

Utilisé dans ces secteurs

Fonctionnalités QueryChart pour Qualité des données et données de base

Familles de processus associées

Plus dans Familles de processus