Infraestructura de Plataforma Gaming
Plataforma de streaming de eventos multi-inquilino procesando 10M+ eventos/día con cero pérdida de datos en 15+ microservicios
15+ microservicios
438 tipos de eventos

El Problema
Silos de analítica heredados, sin telemetría centralizada, sin plataforma multi-inquilino para escalar entre títulos
Silos de analítica heredados, sin telemetría centralizada, sin plataforma multi-inquilino para escalar entre títulos. Un estudio de juegos móviles con múltiples títulos activos dependía de plataformas de analítica de terceros fragmentadas que no ofrecían acceso a datos crudos, instrumentación personalizada ni camino hacia inteligencia de producto centralizada. Cada título ejecutaba su propia pila de analítica. Los datos de comportamiento de jugadores estaban atrapados en dashboards de proveedores sin ruta de exportación. El estudio necesitaba una plataforma capaz de ingestar, transformar y presentar telemetría de cualquier título a través de una sola arquitectura.
Construimos una plataforma de streaming de eventos multi-inquilino en AWS. Un SDK Unity personalizado agrupa y envía eventos del juego a un servicio de telemetría Go ejecutándose en EKS con procesadores Graviton4. Los eventos se validan contra un registro de esquemas, se autentican vía JWT y se publican en tópicos Kafka, uno por título, para consumo downstream.
Amazon MSK Kafka alimenta 12 streams de entrega Firehose que depositan eventos crudos en un data lake S3 organizado como arquitectura medallón. Un pipeline dbt ejecutándose cada hora en ECS Fargate transforma eventos crudos Bronce a través de una capa de limpieza Plata hacia modelos KPI Oro, cohortes de retención, usuarios activos diarios, segmentación de ingresos y métricas de equilibrio económico. 30 modelos dbt con 136 pruebas automatizadas de datos garantizan cero desviación entre telemetría cruda y dashboards ejecutivos.
La plataforma fue sometida a pruebas de estrés a 1,700 eventos sostenidos por segundo con cero pérdida de datos, validada contra un conteo conocido de eventos. Limitación de tasa, trazabilidad distribuida vía OpenTelemetry y 112 alarmas CloudWatch proporcionan observabilidad de grado producción desde el cliente hasta el dashboard.
Event types
Sustained throughput
Automated data tests
Why it mattered
Operating need
The studio needed owned telemetry across titles instead of vendor dashboards with no raw data path.
What changed
A Unity SDK, Go ingestion service, Kafka streams, S3 medallion data lake, and dbt models gave each title the same reporting spine.
Contexto
Un estudio de juegos móviles con múltiples títulos activos dependía de analítica de terceros fragmentada (Unity, Firebase) sin acceso a datos crudos, sin telemetría centralizada y sin camino hacia inteligencia de producto multi-título.
Restricción
Cada título ejecutaba su propio silo de analítica. Los datos de comportamiento de jugadores estaban atrapados en dashboards de proveedores. La instrumentación personalizada y el análisis entre títulos eran imposibles sin una plataforma unificada.
Intervención
Construimos una plataforma de streaming de eventos multi-inquilino: SDK Unity → servicio de telemetría Go/EKS → Kafka → data lake medallón S3 → transformaciones dbt → dashboards Metabase. 15+ microservicios, 438 tipos de eventos, 136 pruebas automatizadas.
Resultado
Plataforma probada con datos reales de jugadores a 1,700 eventos/seg sostenidos y cero pérdida de datos. 30 modelos dbt potencian dashboards de retención, ingresos y economía.
Arquitectura
Desde el cliente del juego hasta el dashboard ejecutivo en una sola arquitectura de streaming
Ingesta de Eventos
Procesamiento de Streams
Transformación de Datos
Analítica y Observabilidad
Stack Tecnológico
Backend
Go 1.24+ (EKS, Graviton4/ARM64)
Streaming
Amazon MSK Kafka (27 tópicos)
Data Lake
S3 Medallón (Bronce / Plata / Oro)
Transformación
dbt + Amazon Athena (30 modelos)
Cómputo
EKS + ECS Fargate + Firehose
Observabilidad
OpenTelemetry + X-Ray + Prometheus
Resultados
¿Planeando un Mandato Similar?
Una llamada de descubrimiento directa para hablar del problema, las restricciones y la vía más creíble para avanzar.
Respondemos en un plazo de 4 horas durante el horario laboral
