במאמר הזה מוסבר איך לייבא מטא-נתונים מ-SQL Server אל Knowledge Catalog (לשעבר Dataplex Universal Catalog) באמצעות מחבר של Knowledge Catalog.
המחבר הזה תומך במופעים של SQL Server שמתארחים באופן מקומי, ב-Cloud SQL או בסביבות ענן אחרות.
לפני שמתחילים
לפני שתוכלו לייבא מטא-נתונים מ-SQL Server, תצטרכו לבצע את המשימות הבאות:
- נותנים את התפקידים וההרשאות הנדרשים.
- מפעילים את ממשקי ה-API של Knowledge Catalog ושל שירות העברת נתונים ל-BigQuery.
- עומדים בדרישות המוקדמות ל-SQL Server.
- עמידה בדרישות המוקדמות בנוגע לרשת.
תפקידים והרשאות של IAM
כדי ליצור ולנהל משימת מחבר של Knowledge Catalog, צריך תפקידים בממשק לניהול זהויות והרשאות גישה (IAM) שמעניקים הרשאות ל-Knowledge Catalog ולשירות העברת נתונים ל-BigQuery.
כדי לקבל את ההרשאות שדרושות להגדרת מחבר SQL Server, צריך לבקש מהאדמין להקצות לכם את תפקידי ה-IAM הבאים:
- כדי ליצור ולנהל קבוצות של רשומות: אדמין של Dataplex Catalog (
roles/dataplex.catalogAdmin), עורך של Dataplex Catalog (roles/dataplex.catalogEditor) או בעלים של קבוצת רשומות ב-Dataplex (roles/dataplex.entryGroupOwner) בפרויקט. - כדי ליצור משימות העברה של שירות העברת נתונים ל-BigQuery ולנהל אותן: BigQuery Admin (
roles/bigquery.admin) בפרויקט. - כדי לצפות ביומנים ב-Cloud Logging: מציג היומנים (
roles/logging.viewer) בפרויקט.
בנוסף, צריך להעניק לסוכן השירות של שירות העברת הנתונים ל-BigQuery (service-PROJECT_NUMBER@gcp-sa-bigquerydatatransfer.iam.gserviceaccount.com) את ההרשאה dataplex.entryGroups.import או את התפקיד Dataplex Entry Group Importer (roles/dataplex.entryGroupImporter). אפשר לתת את התפקיד הזה ברמת הפרויקט או ברמת קבוצת הרשומות.
מידע נוסף על מתן תפקידים זמין במאמר ניהול הגישה.
הפעלת ממשקי ה-API
מפעילים את ממשקי ה-API של Knowledge Catalog ושל שירות העברת נתונים ל-BigQuery.
דרישות מוקדמות ל-SQL Server
מוודאים שיש לכם חשבון משתמש במסד הנתונים של Microsoft SQL Server. מידע נוסף זמין במאמר יצירת משתמש עם פרטי כניסה.
המכונה של SQL Server צריכה לעמוד בדרישות הבאות:
גרסה מינימלית: קטלוג הידע תומך ב-Microsoft SQL Server מגרסה 14 (2017) ואילך.
משתמש במסד הנתונים: מוודאים שיש לכם חשבון משתמש במסד הנתונים של Microsoft SQL Server. מידע נוסף זמין במאמר בנושא יצירת משתמש עם פרטי כניסה.
הרשאות מינימליות: צריך להעניק למשתמש במסד הנתונים את ההרשאות הבאות:
הרשאות בסיסיות (נדרשות לכל ההגדרות):
GRANT VIEW DATABASE STATE TO USER_NAME;הרשאות גישה לסכימה ספציפית:
GRANT VIEW DEFINITION ON SCHEMA::TARGET_SCHEMA TO USER_NAME;הרשאות גישה לכל הסכימות האחרות:
GRANT VIEW DEFINITION ON DATABASE::TARGET_DATABASE TO USER_NAME;מחליפים את מה שכתוב בשדות הבאים:
-
USER_NAME: משתמש מסד הנתונים שרוצים להגדיר. -
TARGET_SCHEMA: השם של סכמת SQL Server שרוצים לגשת אליה. -
TARGET_DATABASE: השם של מסד הנתונים של SQL Server שרוצים לגשת אליו.
-
דרישות מוקדמות בנושא רשת
כדי להתחבר בצורה מאובטחת למסדי נתונים חיצוניים או למקורות נתונים בענן של צד שלישי עם כתובת IP פרטית בתוך רשת פרטית, נדרש מחבר רשת דרך Private Service Connect כדי לאפשר לשירות העברת נתונים ל-BigQuery לגשת למסד הנתונים.
אם מתחברים לסביבה מקומית או למופע שמתארח בענן באמצעות כתובת IP ציבורית, לא נדרש מחבר רשת.
הגדרת מחבר SQL Server
מגדירים מחבר SQL Server באמצעות Google Cloud המסוף או ה-API.
המסוף
נכנסים לדף Knowledge Catalog במסוף Google Cloud .
בתפריט הניווט, בקטע ניהול, לוחצים על מחברים.
לוחצים על הוספת חיבור.
ברשימה Connectors, בוחרים בכרטיס SQL Server.
בקטע פרטים של מקור הנתונים, מזינים את פרטי החיבור למופע של SQL Server:
- בקטע Network attachment (מחבר רשת), בוחרים מחבר רשת קיים אם נדרש, או יוצרים מחבר רשת.
- מזינים את המארח, היציאה, שם מסד הנתונים, שם המשתמש והסיסמה.
- אם משתמשים ב-TLS, בוחרים מצב TLS ומספקים אישור PEM מהימן.
- בקטע SQL Server metadata objects to import (אובייקטים של מטא-נתונים של SQL Server לייבוא), לוחצים על Browse (עיון) כדי לבחור אובייקטים.
בקטע הגדרות היעד:
- לוחצים על עיון ובוחרים קבוצה קיימת של רשומות ב-Knowledge Catalog כדי לאחסן את המטא-נתונים המיובאים, או לוחצים על יצירה של קבוצה חדשה של רשומות.
- בוחרים אם להגדיר הרשאות לקבוצת הרשומות עכשיו או מאוחר יותר. מומלץ להגדיר הרשאות כך שהמשתמשים יוכלו לראות את המטא-נתונים המיובאים. אם לא הענקתם את התפקיד Dataplex Entry Group Importer (ייבוא קבוצות רשומות ב-Dataplex) (roles/dataplex.entryGroupImporter) או את ההרשאה dataplex.entryGroups.import לסוכן השירות של שירות העברת הנתונים ל-BigQuery (
service-PROJECT_NUMBER@gcp-sa-bigquerydatatransfer.iam.gserviceaccount.com) ברמת הפרויקט, אתם צריכים להעניק אותם ברמת קבוצת הרשומות.
בקטע Connector config name (שם הגדרת המחבר), בשדה Display name (שם מוצג), מזינים שם למשימת ייבוא המטא-נתונים.
בקטע Schedule options (אפשרויות תזמון), מגדירים את התדירות של משימת ייבוא המטא-נתונים. אם בוחרים באפשרות על פי דרישה, העבודה תתבצע רק כשמפעילים אותה באופן ידני.
אופציונלי: בקטע אפשרויות התראה, מגדירים התראות באימייל או ב-Pub/Sub על כשלים בעבודות.
אופציונלי: בקטע אפשרויות מתקדמות, מגדירים את הגדרות ההצפנה. אם בוחרים מפתח הצפנה בניהול הלקוח (CMEK), חשוב לדעת שהמפתח משמש להצפנת נתונים זמניים שמוכנים לפני שמתחילים את עבודות הייבוא של המטא-נתונים של Knowledge Catalog. היא לא משמשת להצפנה של המטא-נתונים בקבוצת הרשומות של Knowledge Catalog ביעד.
לוחצים על Save.
REST
משתמשים בשיטה projects.locations.transferConfigs.create. במשאב TransferConfig, מגדירים את השדות הבאים:
- מגדירים את השדה
dataSourceIdלערך"sqlserver". - בשדה
metadataDestination, מאכלסים את אובייקטdataplexConfigurationבנתיב המשאב של קבוצת הרשומות של Knowledge Catalog:projects/<var>PROJECT_ID</var>/locations/<var>LOCATION</var>/entryGroups/<var>ENTRY_GROUP_ID</var>
אחרי שיוצרים את העבודה, Knowledge Catalog מתזמן את ההרצה הראשונה בהתאם להגדרות, או שאפשר להתחיל אותה באופן ידני.