Amazon Aurora PostgreSQL がデータレイク上の Apache Iceberg と Parquet データへの直接クエリをサポート
CRANK
Amazon Aurora PostgreSQL で、データレイクに保存された Apache Iceberg および Apache Parquet 形式のデータを直接クエリできるようになりました。DuckDB が Aurora PostgreSQL に組み込まれ、ETL パイプラインなしで運用データとデータレイクのデータを 1 つのクエリで横断的に分析できます。
2 comments
AWSということでカタログはGlue Data Catalog。コマンド例を見るとFDWを使ってるので、pg_duckdbやDuckLakeとは別口かな(あちらはcreate table using icebergだったはず)。
Aurora PostgreSQLで、S3上のデータレイクにあるIcebergテーブルを読めるように。当然これは、最近のDuckLabs買収の効果の一つだそうです。
aws.amazon.com/jp/blogs/news/…