שדרוג טבלאות Iceberg מגרסה 1 לגרסה 2

אם יש לכם טבלאות קיימות בגרסה 1 (V1) של Apache Iceberg, אתם צריכים לשדרג אותן באמצעות מנוע השאילתות לפני שמשתמשים בהן עם נקודת הקצה של קטלוג Apache Iceberg REST. מידע נוסף מופיע במאמר שינוי טבלה.

לפני שמתחילים

  1. מוודאים שהחיוב מופעל בפרויקט Google Cloud .

  2. מפעילים את BigLake API.

    תפקידים שנדרשים להפעלת ממשקי API

    כדי להפעיל ממשקי API, נדרשת ההרשאה serviceusage.services.enable. אם יצרתם את הפרויקט, סביר להניח שכבר יש לכם את ההרשאה הזו דרך התפקיד 'בעלים' (roles/owner). אחרת, תוכלו לקבל את ההרשאה הזו דרך התפקיד 'אדמין בממשק 'שימוש בשירות'' (roles/serviceusage.serviceUsageAdmin). איך מקצים תפקידים

    להפעלת ה-API

  3. מגדירים את קטלוג זמן הריצה של Lakehouse עם נקודת הקצה (endpoint) של קטלוג REST של Apache Iceberg.

התפקידים הנדרשים

כדי לקבל את ההרשאות שדרושות לשדרוג טבלה, צריך לבקש מהאדמין להקצות לכם את תפקידי ה-IAM הבאים בפרויקט ובקטגוריית האחסון:

  • שדרוג טבלה במצב של מכירת אישורים: BigLake Editor ‏ (roles/biglake.editor) – הפרויקט
  • שדרוג הטבלה במצב מכירת אישורים שאינו מאומת:
    • BigLake Editor (roles/biglake.editor) – הפרויקט
    • משתמש באובייקטים באחסון (roles/storage.objectUser) – קטגוריה של Cloud Storage

להסבר על מתן תפקידים, ראו איך מנהלים את הגישה ברמת הפרויקט, התיקייה והארגון.

יכול להיות שאפשר לקבל את ההרשאות הנדרשות גם באמצעות תפקידים בהתאמה אישית או תפקידים מוגדרים מראש.

שדרוג טבלה

כדי לשדרג טבלת Iceberg מגרסה 1 לגרסה 2, מריצים את הפקודה הבאה במנוע השאילתות:

Spark

ALTER TABLE CATALOG_NAME.SCHEMA_NAME.TABLE_NAME SET TBLPROPERTIES ('format-version'='2');

מחליפים את מה שכתוב בשדות הבאים:

  • CATALOG_NAME: השם של הקטלוג.
  • SCHEMA_NAME: השם של הסכימה.
  • TABLE_NAME: שם הטבלה.

המאמרים הבאים