يعمل التكامل مع كتالوج REST مع جداول Iceberg فقط.
يدعم هذا التكامل AWS S3 وغيره من موفري خدمات التخزين السحابي.
- بيئات التطوير المحلية (باستخدام إعدادات docker-compose)
- الخدمات المُدارة مثل Tabular.io
- تنفيذات كتالوج REST ذاتية الاستضافة
نظرًا إلى أن هذه الميزة لا تزال تجريبية، ستحتاج إلى تمكينها باستخدام:
SET allow_database_iceberg = 1;إعداد بيئة التطوير المحلية
المتطلبات الأساسية
- Docker وDocker Compose: تأكد من أن Docker مُثبّت ويعمل
- إعداد تجريبي: يمكنك استخدام إعدادات
docker-composeمختلفة (انظر صور Docker البديلة أدناه)
إعداد كتالوج REST محلي
docker-compose.yml مستخدمًا الإعدادات من Databricks docker-spark-iceberg.
الخطوة 2: بعد ذلك، أنشئ ملف docker-compose.override.yml وضع فيه إعدادات حاوية ClickHouse التالية:
يتطلب إعداد كتالوج REST تحميل بيانات العينة إلى جداول Iceberg أولاً. تأكد من أن بيئة Spark قد أنشأت الجداول وعبّأتها بالبيانات قبل محاولة الاستعلام عنها عبر ClickHouse. ويعتمد توفر الجداول على إعداد
docker-compose المستخدم والبرامج النصية لتحميل بيانات العينة.الاتصال بـ كتالوج REST المحلي
الاستعلام عن جداول كتالوج REST باستخدام ClickHouse
إذا لم تظهر أي جداول، فعادةً ما يعني ذلك أحد الأمور التالية:
- لم تُنشئ بيئة Spark الجداول النموذجية بعد
- لم تكتمل تهيئة خدمة كتالوج REST بعد
- لم تكتمل بعد عملية تحميل البيانات النموذجية
علامات الاقتباس المعكوسة مطلوبةعلامات الاقتباس المعكوسة مطلوبة لأن ClickHouse لا يدعم أكثر من مساحة أسماء واحدة.
تحميل البيانات من بحيرة البيانات لديك إلى ClickHouse
INSERT INTO SELECT: