Skip to main content
Estudio de Juegos Móviles

Migración de Data Warehouse

Migración Snowflake → S3/Athena con 80% de reducción de costos y cutover dual-write sin tiempo de inactividad

80% reducción de costos

1.1 TB migrados

1,294 consultas BI$5/mes pipeline pLTV
Caso de estudio de migración de data warehouse, migración de 1.1 TB de Snowflake a S3/Athena con cutover dual-write sin pérdida de datos

El Problema

Costos de Snowflake consumiendo 80% del presupuesto de datos, infraestructura dividida entre regiones, 1,294 consultas BI bloqueadas en warehouse heredado

Costos de Snowflake consumiendo 80% del presupuesto de datos, infraestructura dividida entre regiones, 1,294 consultas BI bloqueadas en warehouse heredado. Un estudio de juegos móviles ejecutaba su analítica en Snowflake a través de dos regiones AWS a $3,500/mes, con el 90% del gasto generado por un solo warehouse de BI. Pipelines de ingresos, datos de atribución y reportes financieros estaban divididos entre regiones sin camino claro hacia la consolidación. Dependencias externas de compartición de datos y 1,294 consultas Metabase creaban riesgo de migración que hacía imposible un lift-and-shift.

Diseñamos un plan de migración de 9 fases que reemplazó Snowflake con S3 + Glue + Athena en una sola región. La decisión arquitectónica clave fue una estrategia dual-write: cada pipeline de producción escribe tanto en Snowflake como en el nuevo stack S3/Iceberg en paralelo, permitiendo reconciliación fila por fila antes del cutover con cero riesgo de pérdida de datos.

13 pipelines ETL de ingresos fueron auditados, containerizados en ECS Fargate y extendidos para escribir tablas Apache Iceberg junto a sus cargas existentes de Snowflake. 223 tablas del Catálogo de Datos Glue fueron registradas en tres bases de datos (ingresos, atribución, finanzas). Un pipeline diario de pLTV entrega datos de atribución a nivel de cohorte a un socio externo de modelado a $5/mes de costo operativo, reemplazando una dependencia de compartición de datos del proveedor.

La migración fue secuenciada para minimizar la disrupción al negocio: pipelines de ingresos primero (mayor costo, esquema más simple), luego datos de atribución (más complejos, dependencias externas), luego cutover de BI (1,294 consultas Metabase validadas contra Athena). Cada fase incluye reconciliación automatizada antes de desactivar el writer de Snowflake.

80%

Cost reduction

1,294

BI queries migrated

$5/mo

pLTV pipeline cost

Why it mattered

Operating need

The studio needed to lower warehouse cost without interrupting 1,294 BI queries or revenue pipelines.

What changed

The dual-write plan let every pipeline reconcile against Snowflake before cutover, so migration risk was handled in measurable steps.

Contexto

Un estudio de juegos móviles gastaba $3,500/mes en Snowflake a través de dos regiones AWS. El 90% del costo del warehouse provenía de consultas BI. Pipelines de ingresos y atribución estaban divididos entre regiones sin camino de consolidación.

Restricción

1,294 consultas Metabase dependían de Snowflake. Dependencias externas de compartición de datos no tenían equivalente directo en Athena. Se requería cero pérdida de datos durante la migración.

Intervención

Diseñamos una migración dual-write de 9 fases: Snowflake → S3/Iceberg/Athena. 13 pipelines escribiendo en ambos sistemas en paralelo, 223 tablas Glue registradas, reconciliación automatizada por fase y un pipeline pLTV de $5/mes reemplazando una compartición de datos del proveedor.

Resultado

80% de reducción de costos proyectada, 7 pipelines dual-writing en producción, consolidación en una sola región, 223 tablas Glue operativas, pipeline pLTV de $5/mes activo con 91–100% de precisión de datos.

Arquitectura

Migración dual-write de Snowflake a S3/Iceberg con cutover sin tiempo de inactividad

Pipelines Dual-Write

13 pipelines ECS Fargate escriben tanto en Snowflake como en S3/Iceberg en paralelo. Registro de tablas Glue y escrituras Iceberg junto a cargas existentes. Reconciliación a nivel de fila valida paridad antes de cada fase de cutover.

Data Lake Iceberg

Tablas Apache Iceberg en S3 con Catálogo de Datos Glue (223 tablas en ingresos, atribución y finanzas). Almacenamiento Parquet con compresión snappy. Consolidación en una sola región reemplazando despliegue Snowflake de dos regiones.

Pipeline de Entrega pLTV

Pipeline diario de cohortes: convertidores Lambda (CSV → Parquet) + joins Athena + exportación ECS Fargate. Entrega datos de atribución entre cuentas a socio externo de modelado a $5/mes de costo operativo.

Migración de BI

1,294 preguntas Metabase migradas de SQL Snowflake a consultas nativas Athena. 4 grupos de trabajo Athena con controles de costos. Validación automatizada de consultas contra baseline de Snowflake antes del cutover.

Stack Tecnológico

Stack Destino

S3 + Glue + Athena (Apache Iceberg)

Stack Origen

Snowflake (1.1 TB, 5 bases de datos)

Pipelines

ECS Fargate + Lambda (Python 3.12)

Orquestación

EventBridge + Step Functions

BI

Metabase (1,294 consultas migradas)

Entrega

Exportación S3 pLTV entre cuentas

Resultados

80%

Reducción de costos proyectada

1.1 TB

Datos en migración

1,294

Consultas BI migradas

223

Tablas catálogo Glue

$5/mes

Costo pipeline pLTV

91–100%

Precisión de reconciliación

Advisory Mandate

¿Planeando un Mandato Similar?

Una llamada de descubrimiento directa para hablar del problema, las restricciones y la vía más creíble para avanzar.

Respondemos en un plazo de 4 horas durante el horario laboral

El brief operativo para líderes de AI en producción

El brief operativo dos veces al día para CTOs y fundadores que lanzan AI en producción.