Configuration des événements

Objective

After completing this lesson, you will be able to configurez l'application source pour accepter les événements envoyés à SAP Customer Data Platform pour l'ingestion.

Introduction

Les événements d'application sont utilisés pour configurer la manière dont SAP Customer Data Platform ingère les données client à partir de systèmes externes. Ces événements incluent les données fournies volontairement par un client, c'est-à-dire des données directes, et les données fournies par d'autres, qui peuvent être des données de tiers, de visiteur ou hors ligne.

Il peut s'agir, par exemple, de données de liste de souhaits, de données de commande ou de données de navigation produit d'un client, etc.

Dans l'image suivante, une page Options d'événement (étape 1) affiche des informations de base, telles que le nom, le type de données, la description, ainsi que d'autres informations, par exemple :

  • Objectifs de traitement requis : pour les cas de fusion de données client, les informations entrantes (données d'événement) devront être accordées pour tous les objectifs de traitement configurés dans cette option, sinon elles seront ignorées.
  • Objectifs de traitement accordés : lors de l'ingestion, le client se verra accorder les objectifs de traitement configurés dans cette zone.
  • Chemin d'accès de lecture : comme l'application source est un stockage Cloud, vous pouvez indiquer le dossier que SAP CDP doit rechercher pour que les données client soient ingérées.
  • Filename Regex : seuls les noms de fichiers correspondant à l'expression régulière configurée dans ce champ seront pris en compte pour l'ingestion.
  • Format de fichier à lire : vous définissez ici si le format des fichiers de saisie de texte à ingérer est JSON ou CSV.
  • Déplacer après l'insertion : voulez-vous que les fichiers d'entrée soient déplacés vers un autre dossier après l'ingestion de leur contenu ?
Configuration d'événement affichant le nom, le type de données, les objectifs de traitement requis et accordés, la description et des options supplémentaires telles que le chemin d'accès de lecture du fichier, le regex du nom de fichier, le format de fichier à lire et le déplacement après l'intégration.

Schéma d'événement

Chaque attribut du schéma d'événement comporte des règles de préparation des données, appliquées avant l'ingestion des données d'événement. La préparation des données signifie que les données client sont validées, normalisées et transformées pendant la phase d'ingestion.

Dans l'image ci-dessous, nous voyons une page Modèle d'événement (étape 2). Ici, nous pouvons voir les types et les noms des champs. Vous pouvez créer de nouvelles zones à l'aide du bouton Créer nouveau nœud. Le modèle d'événement peut être défini à l'aide de l'interface utilisateur ou du schéma JSON. Il existe également une option permettant de supprimer un fichier contenant des exemples de données d'un profil client unique et le système définit le schéma en fonction de son contenu. L'attribut masterDataId sera utilisé à l'étape 3 comme règle de comparaison d'événements. Les attributs quand et eventId seront utilisés dans la configuration des métadonnées.

Page Modèle de configuration d'événement contenant la définition de schéma qui correspond à la structure des données à ingérer par l'événement.

Les schémas d'événements prennent en charge plusieurs types de données pour les attributs ou les champs d'événement, tels que Chaîne, Nombre, Booléen et même Objet et tableau. Avec le type de champ Objet, vous pouvez imbriquer des champs pour ingérer des types de données complexes. Les données d'événement ou les valeurs d'attribut d'événement peuvent être validées à l'aide de modèles intégrés, par exemple l'adresse e-mail, la date et l'heure et l'URL, en imitant les fonctionnalités de l'éditeur d'attributs Schémas client.

Propriétés communes de l'un des attributs de modèle d'événement contenant les zones Type, Sous forme de tableau, Nom, Nom d'affichage, Description.

Pour une logique de validation plus complexe, vous pouvez spécifier manuellement un modèle Expression régulière à tester par rapport aux valeurs de champ ou fournir une liste des valeurs d'énumération autorisées.

Validation d'un attribut de modèle d'événement. Le bouton à bascule Validation est activé, le Type de validation est Par format, le Format est Regex, le Modèle recherche un mot en minuscules commençant par une lettre majuscule et la chaîne Brandson est utilisée comme Texte de test (pour tester le modèle).

Les valeurs d'attribut d'événement peuvent également être normalisées pour supprimer la ponctuation et les espaces dans le champ de données. Vous pouvez rechercher et remplacer des parties spécifiques de la zone de données par Expressions régulières. Cela signifie que vous pouvez effectuer des contrôles qualité sur les données d'événement en utilisant vos propres règles de nettoyage des données avant de les ingérer dans SAP Customer Data Platform.

Normalisation d'un attribut de modèle d'événement. Le bouton à bascule Normalisation est activé, la ponctuation et la suppression des espaces sont contrôlées.

Métadonnées d'événement

La configuration des métadonnées d'événement est responsable de deux options importantes :

ID de déduplication
Utilisé pour identifier l'enregistrement des données utiles d'entrée. Il s'agit généralement d'un UUID généré, ou parfois même d'un total de contrôle. Elle est utilisée si les données utiles source ont plusieurs occurrences du même enregistrement de données client. Si c'est le cas, le système peut rejeter les suivantes en toute sécurité.
Zone d'horodatage
Utilisé pour informer SAP CDP de la dernière fois que ces informations ont été créées ou mises à jour. SAP CDP utilisera cette valeur pour tracer ces données client dans un calendrier lors du traitement d'analyses et de graphiques sensibles au temps ou pour effectuer des ingestions delta à la date butoir.
Écran de métadonnées avec eventId et lorsque les zones liées respectivement à ID de déduplication et Zone d'horodatage. Le format du champ d'horodatage peut être personnalisé à l'aide du format d'horodatage.

Mappage de règles de comparaison

Il s'agit de l'étape dans laquelle vous allez mapper les attributs d'identifiant d'application que vous voulez utiliser en fonction des informations d'identifiant de données client que vous avez disponibles dans le schéma de modèle d'événement.

Sur l'image, nous voyons une page Modèle d'événement (étape 3). Sur le côté gauche, vous pouvez sélectionner n'importe quel attribut disponible dans le modèle d'événement (schéma de données utiles d'entrée) qui peut être lié aux règles de comparaison existantes répertoriées sur le côté droit. Comme vous pouvez le voir, masterDataId a été glissé du côté gauche vers la règle de correspondance masterDataId correspondante à droite, créant un lien Identifiant d'application entre l'attribut de modèle d'événement masterDataId et son homologue Profile.

Si vous devez configurer un identifiant d'application composite, plusieurs attributs de modèle d'événement peuvent être combinés si vous les glissez-déplacez dans le même attribut cible.

Page Mappage des règles de correspondance contenant le schéma Modèle d'événement à gauche et les Règles de correspondance à droite. L'attribut masterDataId est lié en tant que Règle de comparaison d'événements.

Mappage de schéma

Cette étape vous permet de lier les attributs de modèle d'événement restants à leurs contrepoints de données client, qu'il s'agisse de données client de profil, de groupe ou d'activité. Vous pouvez choisir de :

  • Ne mappez que ceux dont vous avez besoin.
  • Mapper le même attribut de modèle d'événement à plusieurs cibles
  • Mapper plusieurs attributs de modèle d'événement dans une seule cible
  • configurer des transformations pour chaque valeur d'attribut pendant le pipeline d'ingestion

Dans l'image ci-dessous, nous voyons une page Mappage de schéma (étape 4). Nous pouvons voir le prénom et le nom de famille, ainsi que l'attribut de sexe mappé du modèle d'événement à gauche dans les attributs de profil à droite, comme cela s'est produit lors de l'étape précédente (Mappage des règles de comparaison).

La page Mappage de schéma contient le schéma Modèle d'événement à gauche et les attributs de profil à droite. Les attributs firstName, lastName et gender sont liés à leurs équivalents d'attributs de profil de données client.

Interrogation planifiée

Dans la dernière étape, vous pouvez éventuellement activer la planification pour extraire de nouvelles données d'événement de la source à un intervalle donné à partir d'une date et d'une heure spécifiques. Notez que certains connecteurs de l'application source peuvent avoir cette option, tandis que d'autres peuvent fournir un point de terminaison HTTP REST que les applications sources peuvent utiliser pour pousser les données client dans SAP Customer Data Platform.

Page d'interrogation planifiée affichant les options couramment trouvées dans les systèmes de planification, telles que la date et l'heure de début et l'intervalle de répétition.

Fonctionnalité Ingérer maintenant

Certaines applications source vous permettront de déclencher l'ingestion des données client manuellement chaque fois que cela est nécessaire. Vérifiez si cela est disponible dans le menu contextuel de la fiche Événement (trois points en haut à droite de la carte Événement) à l'aide de l'option Ingérer maintenant. Vous devez sélectionner une date et une heure tronquées à l'aide de la zone Depuis. Pour chaque enregistrement de données client extrait de la source, le système prend en compte l'ingestion uniquement lorsque son attribut Horodatage des métadonnées d'événement est supérieur ou égal à celui que vous avez défini dans la zone Depuis. Vous pouvez également placer une limite supérieure du nombre d'enregistrements de données client appliqués au pipeline d'ingestion lors de la définition de la zone Limite.

Ingérer maintenant affiche les zones Depuis et Limite.

Statut d'événement

Le statut des ingestions traitées pour chaque événement est conservé pendant 7 jours dans le système et peut être rapidement analysé à l'aide de l'option Afficher le statut du menu contextuel de la carte Événement. Pour chaque ingestion, cette option affiche le nombre d'enregistrements ingérés et le statut d'achèvement. Pour une analyse plus approfondie des problèmes liés aux ingestions de données client, envisagez d'utiliser la fonctionnalité de suivi. Pour en savoir plus, consultez Suivi de l'ingestion des données clients dans SAP Customer Data Platform.

Le Statut de l'événement affichant deux lots d'ingestions passées : un qui a réussi, prend 5 secondes et ingère 100 enregistrements, et un autre qui a échoué.

Espace de jeu d'événements

Le terrain de lecture des événements vous permet d'ingérer un seul enregistrement de données client dans SAP Customer Data Platform Console, y compris les données de profil, de groupe et d'activité. Pour ce faire, il crée un formulaire IU qui correspond aux zones d'attribut Modèle d'événement. Les exemples de données sont générés de manière aléatoire pour chaque champ en fonction de son type et de son format. Après avoir soumis le formulaire, le système affiche les résultats de l'ingestion sur un écran affichant chacune des étapes du pipeline d'ingestion, y compris les échecs possibles.

Écran de lecture d'événements affichant des exemples de données de profil client.Résultats d'une ingestion d'aire de jeux d'événements montrant certaines étapes du pipeline.

Configuration des événements entrants – Démo

Résumé

Dans cette leçon, vous avez appris à configurer SAP Customer Data Platform pour intégrer efficacement des données client provenant de sources externes en configurant des événements d'application. Vous avez exploré différents composants de la configuration de l'événement, de la spécification du format source et du format de fichier au mappage des schémas et à la définition des métadonnées d'événement. Les tâches essentielles incluent la configuration des paramètres d'événement, où vous définissez les objectifs de traitement requis, les modèles de nom de fichier et les protocoles d'ingestion tels que le déplacement des fichiers après l'ingestion. Le schéma d'événement joue un rôle crucial en autorisant la validation et la transformation des données, garantissant ainsi l'intégrité des données avant l'ingestion.

En outre, vous avez examiné l'importance des métadonnées d'événement dans le suivi de la déduplication et de l'horodatage, ce qui vous a permis de gérer efficacement les données à l'aide d'identifiants. Vous avez pratiqué le mappage des règles de correspondance et des attributs de schéma pour aligner les données d'événement avec les profils, les groupes et les activités des clients, garantissant ainsi une intégration transparente des données. Les options telles que l'interrogation planifiée et l'ingestion manuelle vous permettent de contrôler efficacement comment et quand les données sont extraites dans la plate-forme. La leçon a également introduit des fonctionnalités telles que l'aire de lecture de l'événement et le statut de l'événement, permettant le test de données en temps réel et le suivi de l'ingestion. En maîtrisant ces configurations, vous êtes équipé pour maximiser les capacités de SAP CDP dans la gestion d'ensembles de données clients divers et complexes afin de créer des informations exploitables.