Descripción
Resumen:
Camlin busca un Ingeniero Senior de SRE práctico para garantizar servicios de producción fiables, seguros y predecibles, centrándose en la respuesta a incidencias, la resiliencia y la automatización.
Aspectos destacados:
1. Asumir la responsabilidad de la fiabilidad y la resiliencia de los servicios de producción en vivo
2. Liderar la respuesta a incidencias y contribuir a revisiones posteriores a las incidencias sin asignación de culpas
3. Mentorizar a ingenieros y contribuir a las mejores prácticas de ingeniería de confiabilidad del sitio (SRE)
**Acerca de Camlin**
Camlin es un líder tecnológico global que opera con la visión de dar vida a productos revolucionarios para una amplia gama de industrias, incluidos los sectores de energía y ferrocarril, y también tiene intereses en diversos proyectos de I\u0026D en múltiples sectores científicos.
En Camlin creemos en la ingeniería y el diseño de alta calidad, lo que nos permite desarrollar productos y servicios líderes en el mercado. En resumen, nos encanta crear valor para nuestros clientes al resolver problemas complejos. Actualmente, Camlin opera en más de 20 países de todo el mundo.
**Acerca del puesto**
Buscamos un Ingeniero Senior de SRE práctico para garantizar que nuestros servicios de producción funcionen de forma fiable, segura y predecible a gran escala.
Te centrarás en el comportamiento real de los sistemas: detectar fallos, liderar la respuesta a incidencias, mejorar la resiliencia y utilizar indicadores de nivel de servicio (SLI) y objetivos de nivel de servicio (SLO), junto con la automatización, para hacer explícitas las compensaciones entre fiabilidad, riesgo, coste y entrega.
**Tus responsabilidades**
* Asumir la responsabilidad de la fiabilidad y la resiliencia de los servicios de producción en vivo
* Definir y evolucionar los SLI/SLO alineados con el impacto en el cliente
* Mejorar la observabilidad, la calidad de las alertas y las señales operativas
* Liderar durante las incidencias y contribuir a revisiones posteriores a las incidencias sin asignación de culpas
* Fortalecer la recuperación ante desastres y la capacidad de recuperación (tiempo objetivo de recuperación RTO / punto objetivo de recuperación RPO)
* Reducir la carga operativa mediante una automatización inteligente
* Apoyar la concienciación sobre costes y las compensaciones entre coste y fiabilidad (mentalidad FinOps)
* Mentorizar a ingenieros y contribuir a las mejores prácticas de ingeniería de confiabilidad del sitio (SRE)
**Qué buscamos**
* Amplia experiencia gestionando sistemas de producción en vivo en un rol de SRE o de fiabilidad
* Profundo conocimiento de los modelos basados en SLI/SLO
* Experiencia demostrada en respuesta a incidencias y en turnos de guardia
* Competencias sólidas en observabilidad y automatización
* Experiencia en la nube (preferentemente AWS)
* Actitud serena y estructurada bajo presión
* Inglés fluido
**Nuestros valores**
* Trabajamos juntos
* Creemos en las personas
* No aceptamos la expresión «así siempre se ha hecho»
* Escuchamos para aprender
* Intentamos hacer lo correcto
**Declaración de igualdad de oportunidades laborales**
Las personas que solicitan empleo en Camlin son evaluadas sin tener en cuenta su raza, color, religión, origen nacional, edad, sexo, estado civil, ascendencia, discapacidad física o mental, identidad de género u orientación sexual.