
Compañía de referencia del sector aéreo que está impulsando su transformación tecnológica mediante soluciones orientadas a mejorar la eficiencia, automatización y escalabilidad de sus operaciones. Su área tecnológica trabaja con equipos de producto y metodologías ágiles para desarrollar y operar servicios críticos, con especial atención a la estabilidad, rendimiento, seguridad e innovación tecnológica.
Buscamos un/a Site Reliability Engineer (SRE) para asumir un papel clave en la disponibilidad, resiliencia y rendimiento de aplicaciones y servicios críticos.
La posición combina aproximadamente un 75% de componente técnico y un 25% de gestión y coordinación, por lo que buscamos una persona con sólida experiencia técnica que también pueda ejercer liderazgo, coordinar equipos y actuar como referente en materia de fiabilidad y operaciones.
La posición está ubicada en La Muñoza (Madrid).
Operar y optimizar la infraestructura sobre AWS, garantizando su fiabilidad, escalabilidad y eficiencia.
Definir y evolucionar la estrategia de observabilidad y monitorización, utilizando herramientas como Dynatrace para anticipar, detectar y mitigar incidencias.
Garantizar la disponibilidad, resiliencia y rendimiento de aplicaciones y servicios.
Actuar como referente técnico y service owner, coordinándose con equipos de soporte, desarrollo, infraestructura, arquitectura, ciberseguridad y FinOps.
Liderar la respuesta ante incidentes críticos y coordinar análisis post-incidente orientados a identificar causas raíz y aplicar soluciones sostenibles.
Trabajar con SLIs, SLOs, SLAs y KPIs, asegurando el cumplimiento de los niveles de servicio establecidos.
Automatizar tareas operativas para reducir el trabajo manual y el operational toil.
Colaborar con los equipos de desarrollo en la evolución de pipelines CI/CD y la adopción de buenas prácticas DevSecOps, utilizando GitHub.
Mantener una postura sólida de seguridad cloud mediante herramientas como WIZ y contribuir al cumplimiento de requisitos de auditoría.
Gestionar la obsolescencia tecnológica y el ciclo de vida de componentes de infraestructura.
Diseñar y validar estrategias de Disaster Recovery, asegurando el cumplimiento de los objetivos RTO/RPO.
Crear y mantener runbooks operativos, informes de incidentes y planes de mejora de fiabilidad.
Liderar y acompañar a los equipos de soporte y operaciones, fomentando una cultura de ownership y mejora continua.
Experiencia sólida trabajando como Site Reliability Engineer, Cloud Engineer, DevOps Engineer o en posiciones similares dentro de entornos de producción críticos.
Experiencia práctica operando workloads en AWS, incluyendo servicios como EC2, ECS, S3, IAM o CloudWatch.
Experiencia con plataformas de observabilidad y monitorización, especialmente Dynatrace.
Conocimiento sólido de los principios SRE y experiencia trabajando con SLIs, SLOs y SLAs.
Experiencia en gestión y resolución de incidentes, análisis de causa raíz y mejora de la fiabilidad de sistemas.
Experiencia con GitHub y workflows de CI/CD.
Capacidad para desarrollar automatizaciones que reduzcan tareas manuales y carga operativa.
Experiencia coordinando o liderando equipos técnicos de soporte u operaciones.
Conocimientos de seguridad, cumplimiento operativo y procesos de auditoría.
Capacidad de liderazgo, comunicación y colaboración con equipos técnicos multidisciplinares.
Titulación en Ingeniería Informática, Sistemas de Información, Ingeniería Aeronáutica/Aeroportuaria o disciplinas relacionadas.
Certificaciones de AWS, como Solutions Architect, SysOps Administrator o equivalentes.
Experiencia con Terraform para automatización de infraestructura.
Familiaridad con herramientas de seguridad cloud como WIZ.
Conocimientos de ITIL y frameworks de gestión de incidentes.
Experiencia trabajando con metodologías Agile y prácticas DevSecOps.
Conocimientos de gestión del ciclo de vida y obsolescencia de componentes tecnológicos.
Tendrás la oportunidad de trabajar en un entorno tecnológico de alta criticidad donde la fiabilidad, automatización y escalabilidad tienen un impacto directo en el negocio. Es una posición con un peso técnico elevado y capacidad real para influir en la evolución de las operaciones, impulsar prácticas SRE y trabajar transversalmente con ingeniería, arquitectura, ciberseguridad y FinOps.