SRE
2026-08-25
Madrid
Site Reliability Engineer (SRE)Descripción de la compañíaCompañía de referencia del sector aéreo que está impulsando su transformación tecnológica mediante soluciones orientadas a mejorar la eficiencia, automatización y escalabilidad de sus operaciones. Su área tecnológica trabaja con equipos de producto y metodologías ágiles para desarrollar y operar servicios críticos, con especial atención a la estabilidad, rendimiento, seguridad e innovación tecnológica.Misión y ubicación del puestoBuscamos un/a Site Reliability Engineer (SRE) para asumir un papel clave en la disponibilidad, resiliencia y rendimiento de aplicaciones y servicios críticos.La posición combina aproximadamente un 75% de componente técnico y un 25% de gestión y coordinación, por lo que buscamos una persona con sólida experiencia técnica que también pueda ejercer liderazgo, coordinar equipos y actuar como referente en materia de fiabilidad y operaciones.La posición está ubicada en La Muñoza (Madrid).Descripción de responsabilidadesOperar y optimizar la infraestructura sobre AWS, garantizando su fiabilidad, escalabilidad y eficiencia.Definir y evolucionar la estrategia de observabilidad y monitorización, utilizando herramientas como Dynatrace para anticipar, detectar y mitigar incidencias.Garantizar la disponibilidad, resiliencia y rendimiento de aplicaciones y servicios.Actuar como referente técnico y service owner, coordinándose con equipos de soporte, desarrollo, infraestructura, arquitectura, ciberseguridad y FinOps.Liderar la respuesta ante incidentes críticos y coordinar análisis post-incidente orientados a identificar causas raíz y aplicar soluciones sostenibles.Trabajar con SLIs, SLOs, SLAs y KPIs, asegurando el cumplimiento de los niveles de servicio establecidos.Automatizar tareas operativas para reducir el trabajo manual y el operational toil.Colaborar con los equipos de desarrollo en la evolución de pipelines CI/CD y la adopción de buenas prácticas DevSecOps, utilizando GitHub.Mantener una postura sólida de seguridad cloud mediante herramientas como WIZ y contribuir al cumplimiento de requisitos de auditoría.Gestionar la obsolescencia tecnológica y el ciclo de vida de componentes de infraestructura.Diseñar y validar estrategias de Disaster Recovery, asegurando el cumplimiento de los objetivos RTO/RPO.Crear y mantener runbooks operativos, informes de incidentes y planes de mejora de fiabilidad.Liderar y acompañar a los equipos de soporte y operaciones, fomentando una cultura de ownership y mejora continua.Requisitos esencialesExperiencia sólida trabajando como Site Reliability Engineer, Cloud Engineer, DevOps Engineer o en posiciones similares dentro de entornos de producción críticos.Experiencia práctica operando workloads en AWS, incluyendo servicios como EC2, ECS, S3, IAM o CloudWatch.Experiencia con plataformas de observabilidad y monitorización, especialmente Dynatrace.Conocimiento sólido de los principios SRE y experiencia trabajando con SLIs, SLOs y SLAs.Experiencia en gestión y resolución de incidentes, análisis de causa raíz y mejora de la fiabilidad de sistemas.Experiencia con GitHub y workflows de CI/CD.Capacidad para desarrollar automatizaciones que reduzcan tareas manuales y carga operativa.Experiencia coordinando o liderando equipos técnicos de soporte u operaciones.Conocimientos de seguridad, cumplimiento operativo y procesos de auditoría.Capacidad de liderazgo, comunicación y colaboración con equipos técnicos multidisciplinares.Requisitos deseablesTitulación en Ingeniería Informática, Sistemas de Información, Ingeniería Aeronáutica/Aeroportuaria o disciplinas relacionadas.Certificaciones de AWS, como Solutions Architect, SysOps Administrator o equivalentes.Experiencia con Terraform para automatización de infraestructura.Familiaridad con herramientas de seguridad cloud como WIZ.Conocimientos de ITIL y frameworks de gestión de incidentes.Experiencia trabajando con metodologías Agile y prácticas DevSecOps.Conocimientos de gestión del ciclo de vida y obsolescencia de componentes tecnológicos.Por qué unirse a la compañíaTendrás la oportunidad de trabajar en un entorno tecnológico de alta criticidad donde la fiabilidad, automatización y escalabilidad tienen un impacto directo en el negocio. Es una posición con un peso técnico elevado y capacidad real para influir en la evolución de las operaciones, impulsar prácticas SRE y trabajar transversalmente con ingeniería, arquitectura, ciberseguridad y FinOps.