CLOUD & INFRA

Amazon Aurora PostgreSQL รองรับการคิวรีข้อมูล Apache Iceberg และ Parquet ใน Data Lake ได้โดยตรง

AWS News Blog30 Sep 2026
1 min read
Key Takeaways
  • ผู้ใช้ Amazon Aurora PostgreSQL สามารถคิวรีข้อมูล Apache Iceberg
  • Parquet ใน S3 ได้โดยตรงผ่าน SQL มาตรฐาน โดยไม่ต้องย้ายข้อมูลหรือทำ ETL

ทำไมเรื่องนี้ถึงสำคัญ

การรวมความสามารถในการคิวรี Data Lake เข้ากับฐานข้อมูลหลักช่วยลดความจำเป็นในการทำ ETL ซึ่งเป็นกระบวนการที่กินเวลาและค่าใช้จ่ายสูง ช่วยให้ทีมงานสายข้อมูลและนักพัฒนาสามารถเข้าถึงข้อมูลมหาศาลใน S3 ได้ด้วยประสิทธิภาพที่สูงขึ้นผ่าน DuckDB และลดภาระในการจัดการโครงสร้างพื้นฐานที่ซับซ้อน

Amazon ประกาศเพิ่มความสามารถใหม่ให้กับ Amazon Aurora PostgreSQL ให้สามารถคิวรีข้อมูลเชิงปฏิบัติการ (Operational Data) ร่วมกับข้อมูลใน Data Lake ที่เก็บในรูปแบบ Apache Iceberg และ Apache Parquet ได้โดยตรง การอัปเดตนี้ทำได้ผ่านการฝังเทคโนโลยี DuckDB เข้าไปในเอนจินของ Aurora ทำให้สามารถประมวลผลข้อมูลข้ามแหล่งที่มาได้ภายในอินเทอร์เฟซ PostgreSQL ที่คุ้นเคย

ฟีเจอร์นี้ช่วยแก้ปัญหาความซับซ้อนในอดีตที่นักพัฒนาต้องสร้างไปป์ไลน์ ETL เพื่อย้ายข้อมูลประวัติจาก Amazon S3 กลับเข้ามาในฐานข้อมูล ซึ่งนอกจากจะเพิ่มต้นทุนโครงสร้างพื้นฐานแล้ว ยังสร้างภาระในการดูแลรักษาระบบให้ซิงค์กันอยู่เสมอ โดยการประมวลผลรูปแบบใหม่นี้จะเกิดขึ้นภายใน Aurora ทั้งหมด ลดขั้นตอนการส่งข้อมูลผ่านเครือข่ายและไม่ต้องสำเนาข้อมูลซ้ำซ้อน เหมาะสำหรับการสร้าง Dashboard แบบเรียลไทม์ หรือการพัฒนา AI Agents ที่ต้องเข้าถึงทั้งข้อมูลสดและข้อมูลย้อนหลัง

สรุปประเด็นหลัก

รองรับการคิวรีข้อมูล Iceberg และ Parquet จาก Amazon S3 ได้ทันทีผ่าน Aurora PostgreSQL

ใช้เทคโนโลยี DuckDB ฝังตัวในเอนจินเพื่อช่วยประมวลผลข้อมูลจาก Data Lake อย่างรวดเร็ว

รองรับการใช้งานผ่าน AWS Glue Data Catalog และ IRC-compatible catalogs

นวัตกรรมและเทคโนโลยี

infrastructure

DuckDB Integration

ฝังเอนจิน DuckDB ไว้ใน Aurora เพื่อให้ประมวลผลการคิวรีข้อมูลขนาดใหญ่จากไฟล์ Parquet และ Iceberg ได้อย่างรวดเร็วภายในตัวฐานข้อมูล

platform

Zero-ETL Data Lake Access

เชื่อมโยงข้อมูล Transactional ใน Aurora เข้ากับข้อมูลประวัติใน S3 ได้ด้วยคำสั่ง SQL เดียวกันโดยไม่ต้องทำสำเนาข้อมูล

tools

AWS Glue Federation Support

รองรับการเชื่อมต่อกับ AWS Glue Data Catalog เพื่อเข้าถึงข้อมูลที่จัดการผ่านระบบ Catalog ภายนอกอื่นๆ ได้อย่างเป็นระบบ

Developer Impact
นักพัฒนาและทีม Data Engineer สามารถลดขั้นตอนการสร้าง Data Pipeline ที่ซับซ้อนลงได้ และสามารถใช้ทักษะ SQL เดิมในการดึงข้อมูลจาก Data Lake มาใช้งานร่วมกับข้อมูลในฐานข้อมูลหลักได้ทันที เพิ่มความคล่องตัวในการพัฒนาแอปพลิเคชันที่ต้องใช้ข้อมูลขนาดใหญ่
Keywords
#amazon aurora #postgresql #duckdb #apache iceberg #data lake
Original Source

อ่านข้อมูลเพิ่มเติมจากแหล่งข่าวหลัก

AWS News Blog