View a markdown version of this page

Apache Iceberg Tische in AWS Clean Rooms - AWS Clean Rooms

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Apache Iceberg Tische in AWS Clean Rooms

Apache Icebergist ein Open-Source-Tabellenformat für Data Lakes. AWS Clean Rooms kann die in Apache Iceberg Metadaten gespeicherten Statistiken verwenden, um Abfragepläne zu optimieren und die Anzahl der Dateiscans bei der Verarbeitung von Abfragen im Reinraum zu reduzieren. Weitere Informationen finden Sie in der Apache Iceberg-Dokumentation.

Beachten Sie bei der Verwendung AWS Clean Rooms mit Iceberg-Tabellen Folgendes:

  • Apache Iceberg-Tabellen für S3 — Apache Iceberg Tabellen müssen in der Implementierung AWS Glue Data Catalog des Open-Source-Glue-Katalogs definiert werden.

  • Apache Iceberg-Tabellen für Athena — Weitere Informationen finden Sie unter https://docs.aws.amazon.com/athena/latest/ug/querying-iceberg.html

  • Apache Iceberg-Tabellen für Snowflake — Weitere Informationen finden Sie unter https://docs.snowflake.com/en/user-guide/tables-iceberg

  • Parquet-Dateiformat — unterstützt AWS Clean Rooms nur Iceberg-Tabellen im Parquet-Datendateiformat.

  • GZIP-, Snappy- und Zstd-Komprimierung — AWS Clean Rooms unterstützt Parquet mit GZIP-,Snappy, und Zstandard (Zstd) -Komprimierung.

  • Iceberg-Versionen — AWS Clean Rooms unterstützt das Ausführen von Abfragen für Iceberg-Tabellen der Versionen 1 und 2.

  • Partitionen — Sie müssen Partitionen für Ihre Apache Iceberg Tabellen nicht manuell hinzufügen. AWS Glue AWS Clean Rooms erkennt neue Partitionen in Apache Iceberg Tabellen automatisch und es ist kein manueller Vorgang erforderlich, um Partitionen in der Tabellendefinition zu aktualisieren. Iceberg-Partitionen erscheinen als reguläre Spalten im AWS Clean Rooms Tabellenschema und nicht separat als Partitionsschlüssel im konfigurierten Tabellenschema.

  • Einschränkungen

    • Nur neue Iceberg-Tabellen

      Apache IcebergAus Tabellen konvertierte Apache Parquet Tabellen werden nicht unterstützt.

    • Zeitreiseabfragen

      AWS Clean Rooms unterstützt keine Zeitreiseabfragen mit Apache Iceberg Tabellen.

    • Athena-Engine-Version 2

      IcebergTabellen, die mit der Athena-Engine Version 2 erstellt wurden, werden nicht unterstützt.

    • Dateiformate

      Avround ORC-Dateiformate (Optimized Row Columnar) werden nicht unterstützt.

Unterstützte Datentypen für Iceberg-Tabellen

AWS Clean Rooms kann Iceberg Tabellen abfragen, die die folgenden Datentypen enthalten:

  • BOOLEAN

  • DATE

  • DECIMAL

  • DOUBLE

  • FLOAT

  • INT

  • LIST

  • LONG

  • MAP

  • STRING

  • STRUCT

  • TIMESTAMP WITHOUT TIME ZONE

Weitere Informationen zu Iceberg-Datentypen finden Sie unter Schemata für Iceberg in der Apache-Iceberg-Dokumentation.