Caso de éxito
Justo recorta casi un 50% el costo diario de desarrollo con un FinOps integral en AWS
Resumen
Justo es una plataforma de e-commerce y software para restaurantes y delivery, con punto de venta, logística y pedidos online impulsados por IA, alojada en AWS con bases de datos en MongoDB Atlas. Craftech ejecutó un proyecto FinOps integral que atacó uso, tarifas y arquitectura: recortó un 49,83% el costo diario de desarrollo (de ~US$53 a ~US$26), depuró 9,8 TB de logs antiguos de ALB en S3, migró el cómputo productivo a Fargate Spot y actualizó los clústeres EKS para evitar el Soporte Extendido de AWS.
-49.83%
costo diario de desarrollo (de ~US$53 a ~US$26)
9.8 TB
logs antiguos de ALB en S3 depurados con Lifecycle
Justo es una plataforma de e-commerce y software para restaurantes y delivery: integra punto de venta, logística, pedidos online y herramientas impulsadas por inteligencia artificial para que los negocios gastronómicos vendan y operen mejor. Como toda plataforma que crece rápido, su infraestructura en AWS había acumulado capas de gasto que ya no se justificaban. Justo necesitaba una mirada FinOps integral que ordenara el uso, las tarifas y la arquitectura sin frenar la operación, y eligió a Craftech para hacerlo.
Solución implementada
- Unificó todos los servicios de ECS/Fargate al capacity provider Fargate Spot, con una base de 2 nodos On-Demand para disponibilidad y el escalado horizontal sobre Spot
- Redefinió las reglas de autoescalado por CPU y memoria para eliminar recursos ociosos
- Ejecutó un borrado agresivo de infraestructura en desuso: clústeres EKS de desarrollo abandonados, EC2 huérfanas, Load Balancers, Target Groups, EFS y buckets S3 obsoletos
- Configuró reglas de Lifecycle en Amazon S3 para depurar automáticamente los logs de ALB con más de 3 meses (9,8 TB)
- Analizó VPC Flow Logs para detectar los servicios que generaban sobrecostos en el NAT Gateway y proyectó VPC Peering/PrivateLink con balanceadores internos
- Actualizó los clústeres EKS de la versión 1.25 a la 1.29 para evitar el costoso Soporte Extendido de AWS
- Aplicó compresión y caché en Amazon CloudFront para reducir costos de transferencia
Desafío de negocio
El punto de partida tenía varios focos de ineficiencia. En almacenamiento, S3 sumaba 45 TB, de los cuales 9,8 TB eran solo logs antiguos de ALB acumulados desde 2021 sin políticas de retención, con una factura promedio de USD 2.258,74 mensuales. En cómputo, los servicios productivos corrían sobre Fargate on-demand sin aprovechar Spot, con un autoescalado subóptimo que mantenía recursos ociosos. El tráfico interno entre las apps y las bases MongoDB se enrutaba por IPs públicas y NAT Gateway, encareciendo la transferencia de datos. A eso se sumaban recursos obsoletos que seguían facturando —clústeres de desarrollo abandonados, EC2, ELBs, Target Groups, EFS y bases en desuso— y clústeres EKS en la versión 1.25, a un paso de caer en el costoso Soporte Extendido de AWS.
Solución
Craftech encaró el proyecto como un proceso FinOps integral que atacó tres frentes: uso, tarifas y arquitectura. En cómputo, unificó todos los servicios de ECS y Fargate al capacity provider Fargate Spot, dejando una base de 2 nodos On-Demand para garantizar disponibilidad y todo el escalado horizontal sobre Spot, y redefinió las reglas de escalado por CPU y memoria. En paralelo ejecutó una limpieza agresiva de infraestructura en desuso —clústeres EKS de desarrollo abandonados, EC2 huérfanas, Load Balancers, Target Groups, EFS y buckets S3 obsoletos— que seguía facturando sin aportar valor. Para el almacenamiento, configuró reglas de Lifecycle en S3 que depuran automáticamente los logs de ALB con más de 3 meses, eliminando 9,8 TB de datos. Con VPC Flow Logs identificó qué servicios disparaban el costo del NAT Gateway (el tráfico al puerto 27017 de MongoDB) y proyectó VPC Peering/PrivateLink, unificando Load Balancers y migrando el Ingress a balanceadores internos. Como modernización preventiva, actualizó los clústeres EKS de herramientas internas de la 1.25 a la 1.29 para evitar el Soporte Extendido, y sumó compresión y caché en CloudFront.
Resultados
- Costo diario de desarrollo reducido un 49,83% (de ~US$53 a ~US$26) en los primeros días
- 9,8 TB de logs antiguos de ALB depurados de S3 con políticas de Lifecycle
- Cómputo productivo migrado a Fargate Spot, con base On-Demand para disponibilidad
- Baja estructural en la factura mensual de AWS por la combinación de Spot, Lifecycle y limpieza de recursos
- Clústeres EKS actualizados a la 1.29, evitando penalizaciones futuras por Soporte Extendido
- Tráfico interno reorientado para reducir el sobrecosto del NAT Gateway
Trabajar con Craftech
Más que una optimización puntual, el trabajo fue un proceso ordenado de FinOps: medir, priorizar y ejecutar sobre las palancas de mayor impacto sin interrumpir un servicio productivo crítico. Craftech combinó la limpieza de recursos de alto retorno inmediato con cambios estructurales —Fargate Spot, Lifecycle en S3, rediseño del tráfico interno— y modernizaciones preventivas que evitan costos futuros. El resultado es una infraestructura más eficiente y con criterios de costo incorporados a la operación diaria.
Tecnologías utilizadas
El proyecto se apoyó en Amazon ECS con AWS Fargate y Fargate Spot como base de cómputo, Amazon EKS para las herramientas internas (actualizado a la 1.29), Amazon S3 con políticas de Lifecycle para el almacenamiento, y Amazon CloudFront con compresión y caché en el frente. El análisis de red se hizo con VPC Flow Logs para dimensionar el costo del NAT Gateway y proyectar VPC Peering/PrivateLink, mientras las bases de datos siguen en MongoDB Atlas. Todo dentro del ecosistema AWS, con foco FinOps en cada decisión.
Stack & tecnologías
¿Tu equipo enfrenta un desafío parecido?
Pedí un assessment gratuito de costos y arquitectura en AWS.