Ce document explique comment importer des métadonnées de PostgreSQL dans Knowledge Catalog (anciennement Dataplex Universal Catalog) à l'aide d'un connecteur Knowledge Catalog.
Ce connecteur est compatible avec les instances PostgreSQL hébergées sur site, dans Cloud SQL ou dans d'autres environnements cloud.
Avant de commencer
Avant de pouvoir importer des métadonnées de PostgreSQL, effectuez les tâches suivantes :
- Attribuez les rôles et autorisations requis.
- Activez les API Knowledge Catalog et Service de transfert de données BigQuery.
- Respectez les conditions préalables de PostgreSQL.
- Respectez les conditions préalables de mise en réseau.
Rôles et autorisations IAM
Pour créer et gérer une tâche de connecteur Knowledge Catalog, vous avez besoin de rôles Identity and Access Management (IAM) qui accordent des autorisations pour Knowledge Catalog et Service de transfert de données BigQuery.
Pour obtenir les autorisations nécessaires pour configurer un connecteur PostgreSQL, demandez à votre administrateur de vous accorder les rôles IAM suivants :
- Pour créer et gérer des groupes d'entrées : administrateur de catalogue Dataplex
(
roles/dataplex.catalogAdmin), éditeur de catalogue Dataplex (roles/dataplex.catalogEditor) ou propriétaire du groupe d'entrées Dataplex (roles/dataplex.entryGroupOwner) sur le projet. - Pour créer et gérer des tâches de transfert Service de transfert de données BigQuery : administrateur BigQuery
(
roles/bigquery.admin) sur le projet. - Pour afficher les journaux dans Cloud Logging : lecteur de journaux
(
roles/logging.viewer) sur le projet.
De plus, vous devez accorder à l'agent de service Service de transfert de données BigQuery
(service-PROJECT_NUMBER@gcp-sa-bigquerydatatransfer.iam.gserviceaccount.com) l'autorisation
dataplex.entryGroups.import ou le rôle importateur de groupe d'entrées Dataplex
(roles/dataplex.entryGroupImporter). Vous pouvez accorder ce rôle au niveau du projet ou du groupe d'entrées.
Pour en savoir plus sur l'attribution de rôles, consultez la section Gérer les accès.
Activer les API
Activez les API Knowledge Catalog et Service de transfert de données BigQuery.
Conditions préalables de PostgreSQL
Assurez-vous de respecter les conditions préalables pour les transferts PostgreSQL. Pour en savoir plus, consultez la section Conditions préalables de PostgreSQL dans la documentation du Service de transfert de données BigQuery.
En plus des conditions préalables du Service de transfert de données BigQuery, votre base de données PostgreSQL doit répondre aux exigences suivantes pour l'extraction des métadonnées :
- Version minimale : PostgreSQL version 15 ou ultérieure.
- Autorisations minimales requises : l'outil d'extraction nécessite des autorisations spécifiques pour collecter correctement les métadonnées.
Pour accorder ces autorisations, exécutez les instructions SQL suivantes :
Accorder la connexion à la base de données :
GRANT CONNECT ON DATABASE DATABASE_NAME TO USERNAME;Accorder l'utilisation du schéma :
GRANT USAGE ON SCHEMA SCHEMA_NAME TO USERNAME;Accorder les rôles de lecture requis à l'utilisateur :
GRANT pg_read_all_data TO USERNAME; GRANT pg_read_all_settings TO USERNAME; GRANT pg_read_all_stats TO USERNAME;
Remplacez les éléments suivants :
DATABASE_NAME: nom de la base de données PostgreSQL à laquelle vous souhaitez accéder.USERNAME: utilisateur de la base de données que vous souhaitez configurer.SCHEMA_NAME: nom du schéma auquel vous souhaitez accéder.
Conditions préalables de mise en réseau
Un rattachement de réseau pour la connexion via Private Service Connect est requis lorsque vous vous connectez de manière sécurisée à des bases de données externes ou à des sources de données cloud tierces avec une adresse IP privée dans un réseau privé, afin d'autoriser le Service de transfert de données BigQuery à accéder à votre base de données.
Si vous vous connectez à un environnement sur site ou à une instance hébergée dans le cloud à l'aide d'une adresse IP publique, un rattachement de réseau n'est pas requis.
Configurer un connecteur PostgreSQL
Configurez un connecteur PostgreSQL à l'aide de la Google Cloud console ou de l'API.
Console
Dans la Google Cloud console, accédez à la page Knowledge Catalog.
- Dans le menu de navigation, dans la section Gérer, cliquez sur Connecteurs.
- Cliquez sur Ajouter une connexion.
- Dans la liste Connecteurs, sélectionnez la fiche PostgreSQL.
- Dans la section Détails de la source de données, fournissez les informations de connexion de votre instance PostgreSQL :
- Sous Rattachement de réseau, sélectionnez un rattachement de réseau existant si nécessaire, ou créez-en un.
- Saisissez le nom d'hôte, le port, le nom de la base de données, le nom d'utilisateur et le mot de passe.
- Si vous utilisez TLS, sélectionnez un mode TLS et fournissez un certificat PEM approuvé.
- Pour Objets de métadonnées PostgreSQL à importer, cliquez sur Parcourir pour sélectionner des objets.
- Dans la section Paramètres de destination :
- Cliquez sur Parcourir et sélectionnez un groupe d'entrées Knowledge Catalog existant pour stocker les métadonnées importées, ou cliquez sur Créer un groupe d'entrées.
- Choisissez si vous souhaitez définir les autorisations sur le groupe d'entrées maintenant ou plus tard.
Nous vous recommandons de définir des autorisations afin que les utilisateurs puissent afficher les métadonnées importées. Si vous n'avez pas accordé le rôle importateur de groupe d'entrées Dataplex
(roles/dataplex.entryGroupImporter) ou l'autorisation
dataplex.entryGroups.import à l'agent de service Service de transfert de données BigQuery
(
service-PROJECT_NUMBER@gcp-sa-bigquerydatatransfer.iam.gserviceaccount.com) au niveau du projet, vous devez l'accorder au niveau du groupe d'entrées.
- Dans la section Nom de la configuration du connecteur, sous Nom à afficher, saisissez un nom pour la tâche d'importation de métadonnées.
- Dans la section Options de programmation, configurez la fréquence de la tâche d'importation de métadonnées. Si vous sélectionnez À la demande, la tâche ne s'exécute que lorsque vous la déclenchez manuellement.
- Facultatif : dans la section Options de notification, configurez les notifications par e-mail ou Pub/Sub en cas d'échec de la tâche.
- Facultatif : dans la section Options avancées, configurez les paramètres de chiffrement. Si vous sélectionnez une clé de chiffrement gérée par le client (CMEK), notez que la clé est utilisée pour chiffrer toutes les données transitoires mises en scène avant de démarrer les tâches d'importation de métadonnées Knowledge Catalog. Elle n'est pas utilisée pour chiffrer les métadonnées dans le groupe d'entrées Knowledge Catalog de destination.
- Cliquez sur Enregistrer.
REST
Utilisez la projects.locations.transferConfigs.create
méthode. Dans la TransferConfig
ressource, configurez les champs suivants :
- Définissez le champ
dataSourceIdsur"postgresql". - Dans le champ
metadataDestination, remplissez l'dataplexConfigurationobjet avec le chemin d'accès à la ressource du groupe d'entrées Knowledge Catalog cible :projects/<var>PROJECT_ID</var>/locations/<var>LOCATION</var>/entryGroups/<var>ENTRY_GROUP_ID</var>
Une fois la tâche créée, Knowledge Catalog planifie la première exécution en fonction de votre configuration, ou vous pouvez la démarrer manuellement.
Étape suivante
- Découvrez comment gérer les tâches de connecteur.