Apache Iceberg es un formato de tabla de código abierto diseñado para gestionar grandes volúmenes de datos en entornos de almacenamiento distribuido, como data lakes. Permite operaciones eficientes y confiables en tablas de datos a gran escala, con características como:
Transacciones ACID: Garantiza consistencia en lecturas y escrituras.
Particionamiento evolucionado: Permite actualizar particiones sin reescribir datos.
Esquema flexible: Soporta evolución de esquemas sin interrumpir operaciones.
Compatibilidad: Funciona con motores como Spark, Flink, Trino, Presto, y más.
Gestión de snapshots: Facilita rollbacks y consultas históricas.
Es ideal para entornos de big data donde se requiere alta escalabilidad y fiabilidad.