
Lakehouse 2.0 không chỉ đặt transaction lên data lake. Kiến trúc mới mở cả table format, catalog, compute và streaming để nhiều công cụ có thể cùng làm việc trên một bản dữ liệu.

Lakehouse 2.0 không chỉ đặt transaction lên data lake. Kiến trúc mới mở cả table format, catalog, compute và streaming để nhiều công cụ có thể cùng làm việc trên một bản dữ liệu.

Giải thích Apache Iceberg từ bản chất: nó đứng ở đâu trong Data Lake, quản lý file như thế nào, phối hợp với Spark, Trino, Flink, Hive Metastore, Kafka và Airflow ra sao để hình...