Aurora PostgreSQL, 데이터 레이크 직접 조회
최근 30일 조회수 —좋아요 —핵심 요약
AWS가 Aurora PostgreSQL에서 Iceberg·Parquet 데이터와 운영 데이터를 한 쿼리로 조회하는 기능을 공개했다.

AWS가 9월 30일 Amazon Aurora PostgreSQL에서 데이터 레이크의 Apache Iceberg와 Apache Parquet 데이터를 직접 조회하는 기능을 발표했다. 기존 PostgreSQL 애플리케이션과 도구로 Aurora의 운영 데이터와 Amazon S3·S3 Tables에 저장된 데이터를 한 쿼리에서 결합할 수 있다.1
AWS는 Aurora PostgreSQL에 DuckDB를 내장해 쿼리 처리가 Aurora 내부에서 이뤄지며, 커밋되지 않은 쓰기도 데이터 레이크 자료와 함께 조회할 수 있다고 설명했다. AWS Glue Data Catalog가 관리하는 Iceberg 테이블뿐 아니라 Iceberg REST Catalog(IRC) 호환 카탈로그도 지원한다. 이에 따라 과거 데이터를 Aurora로 복제하고 동기화하는 역 ETL 파이프라인을 줄일 수 있다.
지원 버전은 Aurora PostgreSQL 17.11 이상과 18.6 이상이다. 사용자는 클러스터에 AuroraAnalytics 기능이 설정된 IAM 역할을 연결하고 aurora_analytics 확장을 활성화한 뒤, Iceberg 또는 Parquet 데이터를 가리키는 외부 테이블을 만들어야 한다. 설정은 Amazon RDS 콘솔이나 psql 같은 PostgreSQL 클라이언트에서 할 수 있다.
Footnotes
-
AWS 공식 블로그, 「Amazon Aurora PostgreSQL now supports direct querying of Apache Iceberg and Parquet data in your data lake」 ↩
읽기 목록은 이 브라우저에 저장됩니다.
출처
- Amazon Aurora PostgreSQL now supports direct querying of Apache Iceberg and Parquet data in your data lake — AWS 공식 블로그 · 자료: 2026. 10. 1.
이 글은 위 출처를 근거로 자동 생성된 뒤 발행됐습니다. 원문을 함께 확인해 주세요. 교차 보도 없이 단독 출처로 작성됐습니다.