Chat rápido, mejores ofertas — Descargar

Ingeniero Senior de Confiabilidad del Sitio

Indeed

Compañía

Tipo de empleoTiempo completo
Modalidad de trabajoRemoto
Nivel de experienciaMás de 10 años
Nivel educativoSin requisito de título

Descripción

**Quiénes Somos** -------------- La inteligencia artificial está transformando la forma en que se desarrolla software. La producción de código se está volviendo una mercancía. El enfoque se desplaza de escribir código a orquestar, verificar y gobernar los cambios; y la cadena de herramientas es ahora la nueva restricción. Estamos en el centro de este cambio. Desarrollamos Develocity, una plataforma de observabilidad e inteligencia para cadenas de herramientas utilizada por algunas de las organizaciones de software más destacadas del mundo: Netflix, Airbnb, Spotify, SAP, importantes bancos globales y cientos más. Develocity ayuda a los equipos de software a lograr la excelencia en la entrega mediante una observabilidad profunda, la aceleración de compilaciones y pruebas, y una inteligencia impulsada por IA en toda la cadena de herramientas —con soporte actual para Gradle Build Tool, Apache Maven™, sbt, npm y Python. Somos una empresa nacida con IA. La IA no es una característica que añadimos posteriormente; es central en cómo trabajamos, cómo pensamos sobre nuestro producto y hacia dónde nos dirigimos. Estamos invirtiendo profundamente para hacer que los datos únicos de Develocity y décadas de experiencia en el dominio sean accesibles tanto para personas como para agentes de IA, con la confianza, la evidencia y la explicabilidad como pilares fundamentales de todo lo que construimos. Hemos colaborado con la Apache Software Foundation, la Commonhaus Foundation, la Micronaut Foundation y otros proyectos de código abierto como Spring, Quarkus, Kotlin, JUnit, AndroidX y muchos más para llevar también los valores de Develocity a la comunidad de código abierto. **Nuestros Valores** -------------- **Buscar Comprender:** Todo comienza con escuchar y comprender; nos esforzamos por entender distintos puntos de vista, problemas y motivaciones. Antes de actuar, nos aseguramos de captar verdaderamente los desafíos, perspectivas y objetivos. **Conocer el Porqué:** Abordamos nuestro trabajo con un propósito claro, garantizando que cada paso sea deliberado y enfocado. Tomamos acciones significativas con urgencia, pero nunca a costa de una reflexión cuidadosa. **Innovar e Iterar:** Aceptamos los desafíos y no tememos probar cosas nuevas, incluso si podrían fracasar. Con una comprensión profunda y un propósito claro, podemos desarrollar soluciones creativas y audaces para abordar los desafíos. **Asumir el Resultado:** Contamos con autonomía para tomar la iniciativa y mantenemos transparencia en nuestro trabajo y sus resultados. Al ejecutar, asumimos la responsabilidad de nuestras decisiones, medimos el éxito de nuestras innovaciones y aprendemos de los resultados. **Quién Eres** --------------- Estamos creando un nuevo equipo de SRE y buscamos miembros fundadores que nos ayuden a definir cómo operaremos. Como Líder SRE, serás un líder técnico y operativo en materia de confiabilidad para Develocity. Ayudarás a definir nuestra visión de SRE, establecer estándares para la operación de servicios de producción y orientar a otros SRE a medida que el equipo crezca. Se trata de un puesto práctico con una influencia amplia sobre los equipos de ingeniería, plataforma en la nube y equipos que interactúan con los clientes. El equipo de SRE será responsable de la confiabilidad, rendimiento y disponibilidad de las instancias de Develocity que atienden a clientes de pago, proyectos de código abierto y servicios públicos, además de la infraestructura de apoyo como los registros de artefactos. Trabajarás en nuestra Plataforma de Aplicaciones en la Nube, desarrollada internamente, y en Kubernetes sobre AWS, adquiriendo una experiencia profunda en ambas. Cuando ocurran incidentes, investigarás problemas en toda la pila, desde la aplicación hasta la infraestructura. Colaborarás con el equipo de Plataforma en la Nube para mejorar las herramientas de las que dependes, y con los equipos de ingeniería para integrar la confiabilidad en cómo entregamos software. Si te gusta automatizar tareas y odias repetir la misma tarea dos veces, te sentirás muy cómodo aquí. Formarás parte de un equipo distribuido y remoto desde el inicio, que valora la comunicación asíncrona y la documentación escrita. Una fuerte capacidad de autodirección y una comunicación clara a través de distintos husos horarios son esenciales. **Responsabilidades** -------------------- * Operar y mantener todas las instancias de Develocity y los servicios de apoyo en producción. * Definir y evolucionar los estándares, prácticas y modelos operativos de SRE, incluyendo turnos de guardia, respuesta ante incidentes, análisis posteriores y SLO. * Participar en una rotación de guardias «sigue al sol», actuando como punto técnico de escalación para incidentes complejos o de alta gravedad. * Liderar la respuesta ante incidentes y las revisiones retrospectivas sin culpa, asegurando que los aprendizajes se traduzcan en mejoras medibles de la confiabilidad. * Establecer prioridades de confiabilidad utilizando riesgo, impacto en los clientes, objetivos comerciales, SLO y presupuestos de errores. * Identificar riesgos sistémicos de confiabilidad y evolucionar continuamente las operaciones SaaS de Develocity a medida que la plataforma y la base de clientes crecen. * Liderar e influir en revisiones arquitectónicas y de diseño para garantizar confiabilidad, escalabilidad y operabilidad. * Impulsar la automatización en despliegues, actualizaciones, monitoreo, autorrecuperación, recuperación y flujos operativos. * Construir y mantener una observabilidad integral para todos los servicios gestionados, incluyendo registros, métricas, trazas y alertas. * Asumir la responsabilidad de la recuperación ante desastres, copias de seguridad y la planificación y ejecución de la continuidad del negocio. * Colaborar con el liderazgo de ingeniería para equilibrar la entrega de funciones con la confiabilidad y la excelencia operativa. * Orientar y capacitar a los SRE, apoyando su crecimiento técnico y buenas prácticas operativas. * Ayudar a incorporar nuevos SRE y contribuir al proceso de contratación definiendo y evaluando la excelencia en SRE en Develocity. * Comunicarse con claridad con los clientes durante incidentes y ventanas de mantenimiento. * Optimizar el rendimiento, la utilización de recursos y los costos operativos. **Requisitos mínimos** -------------------------- * 7\+ años de experiencia en SRE, DevOps o un rol equivalente operando servicios de producción a gran escala. * Experiencia liderando iniciativas de confiabilidad en múltiples equipos o servicios. * Capacidad demostrada para influir en la dirección técnica sin autoridad directa. * Experiencia diseñando y operando sistemas con SLO y presupuestos de errores, ejerciendo un sólido criterio al equilibrar confiabilidad, velocidad y costo. * Amplia experiencia práctica con Kubernetes en entornos productivos. * Conocimientos especializados en infraestructura en la nube, preferiblemente en AWS (EKS, RDS, S3, EC2\). * Competencia con herramientas de observabilidad (Prometheus, Grafana) y con Infraestructura como Código (Terraform). * Historial comprobado en gestión y respuesta ante incidentes en un entorno de guardia 24/7. * Competencia en scripting (Python, Bash) para automatización. * Excelentes habilidades de comunicación escrita y verbal en inglés. **Requisitos preferidos** ---------------------------- * Experiencia como SRE fundador o temprano, estableciendo prácticas en una organización SaaS en crecimiento. * Conocimiento previo de Develocity. * Experiencia con lenguajes JVM (Java, Kotlin). * Experiencia en comunicaciones ante incidentes dirigidas a clientes y niveles ejecutivos. **Qué Ofrecemos** ----------------- * Un puesto fundamental en un nuevo equipo de SRE: tú definirás cómo hacemos las cosas, no heredarás decisiones tomadas por otros. * Responsabilidad real sobre sistemas de producción utilizados por ingenieros de empresas que conoces. * Interacción directa con los clientes cuando surgen problemas (y también cuando todo funciona bien). * Una cultura que valora la automatización por encima de los actos heroicos. * Reuniones presenciales, como nuestra reunión anual de la empresa y las reuniones de equipo. * Trabajo desde casa en un entorno remoto desde el inicio. * Salarios competitivos y asignaciones de acciones. **Ubicación** ------------ * Remoto desde cualquier lugar de Europa (GMT). * Aunque nuestro equipo trabaja de forma remota y está distribuido por todo el mundo, valoramos profundamente las interacciones diarias y la colaboración.

Fuentea: indeed
Parte del contenido se ha traducido automáticamente

Publicado por

David Muñoz

Indeed · HR

Ubicación

David Muñoz

Indeed · HR

Empleos similares

Ingeniero Senior de Confiabilidad del Sitio empleo de Indeed en 2026 | ok.com