Chat rápido, mejores ofertas — Descargar

Ingeniero Senior de Confiabilidad del Sitio

100.000-120.000 €/año
Indeed

Compañía

Tipo de empleoTiempo completo
Modalidad de trabajoHíbrido
Nivel de experienciaMás de 10 años
Nivel educativoSin requisito de título

Descripción

**Acerca de Comply365** Esta es una excelente oportunidad para unirse a Comply365, líder de mercado en gestión de contenido operativo, gestión de seguridad y gestión de formación, que presta servicios a los sectores global de la aviación, la defensa y el ferrocarril, con una base de clientes excepcional de más de 550 clientes en más de 80 países y que ofrece, por primera vez en la industria, una plataforma conectada impulsada por inteligencia artificial en estos ámbitos críticos para las misiones. La plataforma Comply365 es una plataforma interconectada e inteligente pionera en la industria, con soluciones de máxima calidad en **Gestión de Contenido Operativo**, **Gestión de Seguridad, Riesgos y Calidad**, y **Gestión de Formación**. Impulsada por inteligencia artificial específica del sector, nuestra plataforma unificada conecta datos e información procedentes de las operaciones, la seguridad y la formación, eliminando la complejidad y generando mejoras cuantificables en eficiencia y productividad para organizaciones de aviación, ferrocarril y defensa de todo el mundo. **Acerca del puesto** En SafetyManager365 actuamos con rapidez, construimos con propósito y nos centramos en resolver problemas que realmente importan a nuestros clientes y al sector de la aviación. Las aerolíneas generan enormes volúmenes de informes de seguridad, datos operativos e investigaciones. Nuestra plataforma ayuda a los equipos de seguridad a analizar esa información, identificar riesgos de forma temprana y tomar mejores decisiones operativas. Como equipo recién creado dentro del grupo más amplio de Comply365, aportamos la energía y la mentalidad de una startup, respaldadas por la solidez y estabilidad de una empresa consolidada. Nuestras cargas de trabajo de IA y procesamiento de datos ya se ejecutan íntegramente en AWS, y ahora estamos ampliando ese enfoque a medida que modernizamos el resto de la plataforma. Buscamos un Ingeniero Senior de Confiabilidad del Sitio para desempeñar un papel clave en este proceso: mejorar la confiabilidad, configurar nuestra arquitectura en la nube, reducir la carga operativa repetitiva y ofrecer mentoría a nuestro equipo de infraestructura mientras adopta prácticas modernas de nube y SRE. Este puesto es ideal para alguien que se siente genuinamente motivado por hacer avanzar las cosas: quien detecta un proceso manual y, de forma instintiva, se pregunta cómo podría automatizarse, y quien aboga por soluciones duraderas («una vez y ya») en lugar de aplicar reiteradamente las mismas correcciones. Nos encontramos en una etapa inicial de nuestro recorrido hacia la madurez en la nube y necesitamos a una persona cómoda trabajando con ambigüedad, no alguien que busque una lista de comprobación. Se trata de un puesto de alto impacto situado en la intersección entre ingeniería de confiabilidad, infraestructura en la nube y habilitación de ingeniería, ideal para quien desee combinar liderazgo técnico con ingeniería práctica. Desempeñará un papel fundamental al definir cómo construimos, operamos y escalamos la plataforma. Colaborará estrechamente con ingenieros de software para mejorar la preparación para producción, la seguridad de los despliegues, la observabilidad y la madurez operativa en toda la plataforma, reduciendo futuros incidentes mediante un mejor diseño de sistemas, su simplificación y unos fundamentos operativos más sólidos. El puesto es a tiempo completo (40 horas semanales), con horario central de 10:00 a 17:00 CET para garantizar una fuerte alineación y colaboración del equipo, aunque sigue permitiendo flexibilidad fuera de dicho horario. Es un puesto híbrido con al menos 2 días presenciales semanales en nuestras oficinas de Barcelona y depende jerárquicamente de la dirección técnica del grupo SafetyManager365. ***Tenga en cuenta que este puesto es híbrido y tiene su sede en Barcelona.*** **Principales responsabilidades** * Identificar proactivamente riesgos, debilidades y cuellos de botella operativos, introduciendo soluciones estructuradas para transformar la plataforma de reactiva a fiable y estratégica. * Asumir la propiedad integral de los retos relacionados con la confiabilidad y la infraestructura, llevándolos hasta una resolución duradera mediante el tratamiento de las causas fundamentales, no de los síntomas, y manteniendo estándares superiores a las soluciones temporales de corto plazo. * Diseñar, construir y mejorar continuamente la infraestructura en AWS, centrándose en escalabilidad, resiliencia, rendimiento y eficiencia de costes. * Liderar la migración de servicios y cargas de trabajo desde entornos dedicados heredados hacia arquitecturas modernas nativas de la nube en AWS. * Desarrollar y mantener la infraestructura como código (Infrastructure as Code) para automatizar el aprovisionamiento, reducir el esfuerzo manual y garantizar la coherencia entre entornos. Se requiere dominio de al menos un lenguaje de scripting o de propósito general (preferiblemente Python); durante el proceso de entrevista se le pedirá resolver un problema práctico de programación o automatización. * Mejorar las canalizaciones CI/CD para permitir despliegues seguros, rápidos y repetibles, incrementando así la productividad general de los desarrolladores y la estabilidad del sistema. * Ofrecer mentoría y apoyo a los ingenieros de infraestructura, promoviendo prácticas modernas de nube y SRE y aprovechando herramientas de IA donde corresponda para mejorar la automatización, la eficiencia y los resultados de ingeniería. * Identificar y eliminar la carga repetitiva (toil): cuando una tarea es recurrente y automatizable, debe automatizarse. Aplicar criterio para priorizar dónde la automatización aporta mayor valor, documentando al mismo tiempo las áreas que aún no lo son, evitando así puntos únicos de fallo. * Construir y desarrollar capacidades de observabilidad en métricas, registros (logging), seguimiento (tracing) y alertas, para permitir una monitorización efectiva y una respuesta rápida ante incidentes. * Establecer buenas prácticas para la gestión de incidentes y colaborar con los equipos de ingeniería para mejorar la preparación para producción, la resiliencia, el rendimiento y la arquitectura del sistema. **Habilidades y calificaciones** * Al menos 8 años de experiencia en este puesto o en roles similares. Se requiere experiencia significativa gestionando plataformas SaaS en producción en un rol senior de SRE, plataforma o ingeniería de infraestructura. * Una mentalidad genuinamente proactiva: no solo reactiva, sino anticipatoria. Detecta problemas antes de que se agraven, propone soluciones concretas sin que se lo pidan y se siente incómodo con el statu quo. Si prefiere realizar tareas manuales repetitivas en lugar de impulsar su automatización, es probable que este puesto no sea adecuado para usted. * Capacidad demostrada para actuar de forma independiente y pensar estratégicamente en entornos complejos y ambiguos, aplicando un juicio sólido y excelentes habilidades para la resolución de problemas, sin esperar a tener una visión completa. * Experiencia profunda y práctica con AWS, incluido el diseño y la operación de arquitecturas en la nube escalables, resilientes y eficientes en costes. * Experiencia demostrada en la migración y modernización de infraestructuras heredadas hacia entornos nativos de la nube. * Conocimientos sólidos en Linux, redes e internos de sistemas, con experiencia en el diseño para alta disponibilidad, tolerancia a fallos y resiliencia operativa a gran escala. * Competencia con herramientas de infraestructura como código (IaC), tales como Terraform, Pulumi o similares, junto con experiencia en la mejora de prácticas CI/CD y automatización. * Excelentes habilidades de comunicación y colaboración, con una mentalidad orientada a la mentoría y experiencia trabajando estrechamente con equipos de ingeniería para mejorar la confiabilidad, la observabilidad y la madurez operativa. **Deseables** * Experiencia profunda en AWS, con capacidad demostrada para diseñar, operar y optimizar plataformas seguras, escalables, resilientes y eficientes en costes; las certificaciones de AWS son un valor añadido. * Trayectoria probada definiendo y gestionando indicadores de nivel de servicio (SLI), objetivos de nivel de servicio (SLO) y presupuestos de errores, respaldada por experiencia práctica con plataformas modernas de observabilidad (por ejemplo, Prometheus, Grafana, Datadog) y seguimiento distribuido (distributed tracing). * Experiencia operando sistemas distribuidos y arquitecturas de microservicios, incluidos enfoques como mallas de servicios (service meshes), ingeniería del caos (chaos engineering) y pruebas de resiliencia. * Exposición a cargas de trabajo de IA/ML o de grandes volúmenes de datos en producción, con experiencia en entornos regulados o sensibles en materia de cumplimiento, y un enfoque pragmático para aprovechar la IA y mejorar los resultados de ingeniería. **Beneficios** * ️Equipamiento: portátil (MacBook), monitor y cualquier otro elemento necesario para ser productivo. Presupuesto anual para formación: cursos, libros, conferencias, coaching. ️Presupuesto para conferencias y participación como ponente: asistencia a eventos del sector. Presupuesto para herramientas de IA: elija las herramientas que le ayuden a mejorar, nosotros las cubriremos. Jornada anual de equipo fuera de las instalaciones. *Salario: entre 100 000 € y 120 000 € brutos anuales.* *El salario ofrecido se determinará dentro de este rango según la experiencia, las cualificaciones y las competencias demostradas.*

Fuentea: indeed
Parte del contenido se ha traducido automáticamente

Publicado por

David Muñoz

Indeed · HR

Ubicación

David Muñoz

Indeed · HR

Empleos similares

Ingeniero Senior de Confiabilidad del Sitio empleo de Indeed en 2026 | ok.com