La integración con el REST Catalog funciona solo con tablas Iceberg.
Esta integración es compatible tanto con AWS S3 como con otros proveedores de almacenamiento en la nube.
- Entornos de desarrollo local (con configuraciones de docker-compose)
- Servicios gestionados como Tabular.io
- Implementaciones self-hosted de REST Catalog
Como esta funcionalidad está en beta, deberá habilitarla con:
SET allow_database_iceberg = 1;Configuración para desarrollo local
Requisitos previos
- Docker and Docker Compose: Asegúrate de que Docker esté instalado y en funcionamiento
- Configuración de ejemplo: Puedes usar varias configuraciones de docker-compose (consulta las imágenes de Docker alternativas más abajo)
Configuración de un catálogo REST local
docker-compose.yml con la configuración de Databricks docker-spark-iceberg.
Paso 2: A continuación, cree un archivo docker-compose.override.yml y añada en él la siguiente configuración del contenedor de ClickHouse:
La configuración del catálogo REST requiere que primero se carguen datos de ejemplo en las tablas Iceberg. Asegúrate de que el entorno de Spark haya creado y rellenado las tablas antes de intentar consultarlas desde ClickHouse. La disponibilidad de las tablas depende de la configuración específica de
docker-compose y de los scripts de carga de datos de ejemplo.Conectarse al REST Catalog local
Consultar tablas del catálogo REST con ClickHouse
Si no ves ninguna tabla, normalmente significa lo siguiente:
- El entorno de Spark aún no ha creado las tablas de ejemplo
- El servicio de catálogo REST todavía no se ha inicializado por completo
- El proceso de carga de los datos de ejemplo aún no ha finalizado
Se requieren backticksLos backticks son obligatorios porque ClickHouse no admite más de un espacio de nombres.
Cargar datos desde tu lago de datos a ClickHouse
INSERT INTO SELECT: