Caso de éxito

Reconstrucción de la infraestructura y CI/CD en AWS para Chekin: de incidentes diarios a esporádicos

Travel Tech / Software Proyecto de reconstrucción de infraestructura y CI/CD en AWS
MigracionModernizacion

Resumen

Chekin es una plataforma de Travel Tech que automatiza el check-in y check-out de huéspedes, la verificación de identidad y el cumplimiento legal para hospedajes, con presencia en más de 20 países y más de 18.000 clientes. Craftech encontró una plataforma que fallaba a diario, con más de 100 servicios en un mismo namespace y casi sin monitoreo, y la reconstruyó por completo sobre AWS con infraestructura como código, CI/CD en GitHub Actions y observabilidad. El resultado: los incidentes pasaron de diarios a esporádicos.

Chekin automatiza uno de los momentos más sensibles de la hospitalidad: el check-in y check-out de huéspedes, junto con la verificación de identidad y el cumplimiento legal. Su plataforma se integra con los sistemas de reserva de hospedajes y da servicio a más de 18.000 clientes en más de 20 países. A esa escala, la estabilidad de la infraestructura no es un detalle técnico: es la base del producto. Cuando Craftech tomó contacto con Chekin, esa base estaba comprometida.

Solución implementada

  • Rehízo la infraestructura desde cero y la migró a una arquitectura conocida y documentada
  • Recreó las bases de networking (VPCs, subnets, route tables) sobre AWS
  • Implementó nuevos clusters con Amazon EKS e infraestructura como código en Terraform
  • Gestionó las dependencias: bases de datos relacionales y no relacionales y colas de mensajería
  • Migró el CI/CD a GitHub Actions y normalizó los despliegues con Helm
  • Implementó un API Gateway para migrar una API a la vez con rollback rápido entre clusters
  • Instaló un stack personalizado de logging, monitoreo y alertas con notificaciones de métricas de infraestructura y de negocio
  • Segmentó redes y permisos e implementó backups en los servicios críticos con datos persistentes

Desafío de negocio

La plataforma no era estable: múltiples servicios fallaban a diario, la arquitectura era compleja y el monitoreo casi inexistente, lo que dificultaba encontrar los errores y alargaba la resolución de cada incidente. Los despliegues no conservaban un estado válido en los repositorios —todas las imágenes usaban el tag latest—, había más de 100 servicios en un mismo namespace expuestos a internet, procesos manuales sin versionar y un RabbitMQ desplegado dentro del cluster que hacía caer servicios críticos, sin backups ni posibilidad de escalar. La arquitectura se había acumulado durante años hasta el punto de que el propio equipo desconocía la totalidad de sus servicios.

Solución

Frente a una arquitectura que nadie conocía por completo, Craftech tomó una decisión de fondo: rehacer la infraestructura y migrarla a una conocida y documentada. Recreó las bases de networking sobre AWS —VPCs, subnets y route tables— e implementó nuevos clusters con Amazon EKS, definidos como código con Terraform, junto con dependencias gestionadas: bases relacionales sobre Amazon RDS, bases no relacionales y colas de mensajería. El CI/CD migró a GitHub Actions y los despliegues se normalizaron con Helm. Para mover el tráfico del entorno viejo al nuevo sin sobresaltos, Craftech implementó un Amazon API Gateway que permitió migrar una API a la vez con rollback rápido. Por encima de todo, instaló un stack personalizado de logging, monitoreo y alertas con notificaciones automáticas de métricas tanto de infraestructura como de negocio, dándole al equipo la visibilidad que antes faltaba.

Resultados

  • Los incidentes pasaron de diarios y en múltiples servicios a esporádicos y puntuales
  • Tiempo de resolución de incidentes reducido gracias al nuevo monitoreo
  • Despliegue automatizado de todas las aplicaciones, con provisión de recursos mucho más simple
  • Redes y permisos segmentados, con los cuellos de botella eliminados
  • Backups implementados en los servicios críticos con datos persistentes
  • Infraestructura conocida, documentada y reproducible como base operativa

Trabajar con Craftech

Más que ejecutar una migración, Craftech le devolvió a Chekin el control sobre su propia plataforma. El equipo de Craftech —ingenieros certificados y partner de AWS— no solo reconstruyó la infraestructura, sino que la dejó documentada, segmentada y observable, con despliegues automatizados que simplificaron el día a día de los desarrolladores y les permitieron provisionar nuevos recursos con mucha mayor facilidad. El cambio más visible fue en la estabilidad: una plataforma que fallaba a diario pasó a tener incidentes esporádicos y puntuales.

Tecnologías utilizadas

La nueva plataforma corre sobre Amazon EKS con Kubernetes como orquestador, con toda la infraestructura definida como código en Terraform y los despliegues empaquetados con Helm. Las bases de datos relacionales se gestionan con Amazon RDS, y la mensajería con RabbitMQ ya fuera del cluster de aplicaciones. El CI/CD se ejecuta en GitHub Actions y la migración de tráfico se orquestó con Amazon API Gateway. Sobre todo eso opera un stack personalizado de logging, monitoreo y alertas con notificaciones automáticas de métricas de infraestructura y de negocio.

Stack & tecnologías

Amazon EKSKubernetesTerraformHelmGitHub ActionsAmazon API GatewayAmazon RDSRabbitmq
“Muy buenos profesionales, me están ayudando a cambiar todos mis procesos.”
Fernan Nestier · Chekin

¿Tu equipo enfrenta un desafío parecido?

Pedí un assessment gratuito de costos y arquitectura en AWS.

El futuro de tu empresa despega
con Craftech

Apalancá nuestra experiencia en AWS para llevar tu producto a la nube.

Pedí tu assessment gratis