Caso de éxito
tapi optimiza su infraestructura ECS en AWS con FinOps, seguridad reforzada y plan de recuperación ante desastres
Resumen
tapi es la red de pagos de servicios líder de Latinoamérica, que permite a bancos, fintechs y wallets procesar pagos de servicios, recargas y gift cards mediante una única integración. Su plataforma corría sobre AWS con ECS y RDS, pero había crecido sin un equipo DevOps propio. Craftech ejecutó un proyecto de optimización y FinOps —financiado por AWS— que la dejó con cómputo optimizado, una postura de seguridad reforzada y un plan de recuperación ante desastres documentado.
tapi conecta a bancos, fintechs y wallets de toda Latinoamérica con la posibilidad de procesar pagos de servicios, recargas y gift cards desde una sola integración. Es infraestructura financiera crítica: cuando un usuario paga la luz o recarga su teléfono desde su app, detrás corre tapi. Su plataforma vivía sobre AWS con Amazon ECS y RDS, pero había crecido rápido y sin un equipo DevOps propio, acumulando deuda técnica en cómputo, costos y seguridad. Para ordenar esa base, tapi encaró junto a Craftech un proyecto de optimización y FinOps financiado por AWS.
Solución implementada
- Aplicó rightsizing de CPU y RAM sobre los servicios de Amazon ECS para eliminar el sobredimensionamiento
- Optimizó los Dockerfiles para reducir los tiempos de despliegue
- Habilitó AWS Fargate + Spot con un procedimiento operativo documentado
- Implementó VPC Endpoints hacia Secrets Manager y migró la obtención de variables a AWS Systems Manager Parameter Store
- Restringió las claves KMS con SCPs multi-región y ejecutó pruebas de eliminación y recuperación de claves, más un pentesting de caja negra
- Analizó y optimizó Amazon DocumentDB, sumó análisis de performance con PMM/Percona y revisó flujos de backup
- Documentó un plan de recuperación ante desastres (DRP) y entregó un informe final con presentación
Desafío de negocio
El punto de partida era una infraestructura productiva que funcionaba, pero no estaba afinada. Los contenedores y servicios estaban sobredimensionados, lo que inflaba el costo sin aportar rendimiento. La gestión de secretos y la observabilidad necesitaban orden, la retención de logs estaba sin acotar y la postura de seguridad pedía un refuerzo acorde a un servicio financiero. A todo esto se sumaba una pieza faltante crítica: no había un plan de recuperación ante desastres documentado, algo indispensable para una operación que no puede permitirse caídas.
Solución
Craftech encaró el proyecto en tres frentes. En cómputo, aplicó rightsizing de CPU y RAM sobre los servicios de Amazon ECS, optimizó los Dockerfiles para acelerar los despliegues y habilitó AWS Fargate + Spot con un procedimiento documentado, atacando el costo sin resignar capacidad. En red y seguridad, implementó VPC Endpoints hacia Secrets Manager, llevó la obtención de variables a Parameter Store, acotó la retención de los CloudWatch Log Groups y reforzó el control sobre las claves KMS con SCPs multi-región, validándolo con pruebas reales de eliminación y recuperación de claves y un pentesting de caja negra. En datos, analizó y optimizó Amazon DocumentDB, incorporó análisis de performance con PMM/Percona y revisó resizing y flujos de backup. El proyecto cerró con un plan de recuperación ante desastres documentado y un informe de entregables con presentación final.
Resultados
- Infraestructura ECS optimizada en cómputo: rightsizing, Dockerfiles más livianos y Fargate + Spot
- Postura de seguridad reforzada: VPC Endpoints, Parameter Store y restricción de KMS multi-región
- Resiliencia validada con pruebas de recuperación de claves y un pentesting de caja negra
- Plan de recuperación ante desastres documentado para sostener un servicio financiero crítico
- Observabilidad y retención de logs ordenadas, con costos de CloudWatch bajo control
- Base de operación más eficiente, segura y auditable, formalizada en un informe de entregables
Trabajar con Craftech
Como partner de AWS, Craftech aportó el equipo DevOps especializado que tapi no tenía in-house, y trabajó con un enfoque de transferencia: cada práctica quedó documentada —desde el procedimiento de Fargate + Spot hasta el plan de recuperación ante desastres— para que el equipo de tapi pudiera operar y sostener la mejora por su cuenta. El proyecto, financiado por AWS, dejó la infraestructura con una base más eficiente, segura y resiliente.
Tecnologías utilizadas
El trabajo se apoyó en Amazon ECS como plataforma de contenedores, con AWS Fargate + Spot para el cómputo y Docker en la base de las imágenes. La seguridad y la gestión de configuración se reforzaron con AWS Secrets Manager, AWS Systems Manager Parameter Store y AWS KMS bajo SCPs multi-región, con observabilidad y retención gestionadas en Amazon CloudWatch. En datos se trabajó sobre Amazon DocumentDB y Amazon RDS, con análisis de performance vía PMM/Percona y revisión de los flujos de backup.
Stack & tecnologías
¿Tu equipo enfrenta un desafío parecido?
Pedí un assessment gratuito de costos y arquitectura en AWS.