AWS ha destacado este 5 de octubre de 2026 una nueva capacidad de Amazon Aurora PostgreSQL que permite consultar directamente tablas Apache Iceberg y archivos Parquet almacenados en un data lake. La función busca combinar datos operativos y analíticos sin copiar previamente la información mediante procesos ETL, según el AWS Weekly Roundup oficial.
Qué problema intenta resolver
Muchas empresas mantienen los pedidos, clientes o transacciones en una base operativa y los históricos o grandes volúmenes en almacenamiento analítico. Para cruzarlos suelen crear pipelines que extraen, transforman y duplican datos. Esa arquitectura añade latencia, coste y puntos de fallo.
La nueva capacidad permite que Aurora PostgreSQL consulte información del data lake desde SQL, de modo que una aplicación pueda combinar tablas operativas con datasets externos sin importar físicamente todo al clúster.
Qué casos de uso pueden beneficiarse
Un ecommerce puede cruzar pedidos recientes con históricos almacenados en Parquet; una empresa industrial puede analizar telemetría archivada junto a incidencias actuales; y un SaaS puede enriquecer datos transaccionales con información agregada sin mantener otra copia.
La ventaja dependerá del patrón de acceso. Las consultas repetitivas y de baja latencia pueden seguir necesitando datos locales o materializados. El acceso directo es más útil cuando evita duplicar grandes conjuntos que se consultan de forma puntual.
Qué debería medir una pyme antes de usarlo
Conviene comparar tiempo de consulta, coste de lectura del almacenamiento, transferencia, frecuencia de uso y complejidad del ETL actual. También debe revisarse el modelo de permisos: que Aurora pueda consultar un dataset no significa que todos los usuarios de la base deban verlo.
La empresa debería probar consultas reales y establecer límites para evitar que una petición accidental recorra volúmenes masivos. El objetivo es simplificar arquitectura sin trasladar el problema a una factura de consultas impredecible.
Estas novedades se suman a otros cambios recientes para equipos técnicos: Spanner con colas nativas, memoria para agentes con AlloyDB, Web Search API de Cloudflare, el parche de SageMaker, los cambios de modelos en GitHub Copilot y el cifrado del lado del cliente de Workspace.
Fotografía: panumas nikhomkhai / Pexels.

