Chat rápido, mejores ofertas — Descargar

Ingeniero de Plataforma de Observabilidad — Neocloud

Indeed

Compañía

Tipo de empleoTiempo completo
Modalidad de trabajoRemoto
Nivel de experiencia1 a 2 años
Nivel educativoSin requisito de título

Descripción

**Descripción de la empresa** **Acerca de Mirantis** Mirantis es la empresa de infraestructura nativa de Kubernetes para IA, que permite a las organizaciones construir y operar infraestructuras escalables, seguras y soberanas para aplicaciones modernas de IA, aprendizaje automático y aplicaciones intensivas en datos. Al combinar la innovación de código abierto con una profunda experiencia en la orquestación de Kubernetes, Mirantis capacita a los equipos de ingeniería de plataformas para ofrecer plataformas de desarrollador modulares y listas para producción en cualquier entorno: local, en la nube, en el borde o en centros de datos soberanos. A medida que las empresas navegan por la creciente complejidad de las cargas de trabajo impulsadas por IA, Mirantis ofrece la automatización, la orquestación de GPU y el control basado en políticas necesarios para gestionar la infraestructura con confianza y agilidad. Comprometida con los estándares abiertos y la libertad frente al bloqueo, Mirantis garantiza que los clientes conserven el control total sobre su estrategia de infraestructura. Mirantis atiende a muchas de las principales empresas mundiales, entre ellas Adobe, DocuSign, Liberty Mutual, PayPal, Reliance Jio, Societe Generale, Splunk y Volkswagen. Más información en www.mirantis.com. **Descripción del puesto** **Acerca del rol** Mirantis está ampliando su oferta de servicios Neocloud: gestionar infraestructuras a gran escala con altos niveles de acuerdos de nivel de servicio (SLA) para clientes que ejecutan cargas de trabajo computacionales exigentes. A medida que esta oferta se expande, también lo hace el volumen y la complejidad de la telemetría que debemos recopilar, correlacionar y actuar. Buscamos a un Ingeniero de Plataforma de Observabilidad para diseñar y construir la plataforma de monitorización, registro, seguimiento distribuido y alertas de la que dependen nuestros equipos de operaciones para detectar y resolver incidencias rápidamente —a gran escala y en un entorno distribuido globalmente. Este es un puesto práctico y centrado en la construcción. Usted será la persona que transforme frases como «no tenemos visibilidad sobre esto» en una plataforma que muestre la señal adecuada en el momento preciso, y que convierta expresiones como «nos enteramos por el cliente» en «lo detectamos antes de que ellos lo notaran». **Responsabilidades clave** * Diseñar, construir y operar componentes de la plataforma de observabilidad —métricas, registros, seguimiento distribuido y alertas— para entornos de infraestructura a gran escala * Construir canalizaciones de telemetría capaces de manejar datos de alta cardinalidad y alto volumen procedentes de grandes flotas de infraestructura, prestando atención al costo, la retención y el rendimiento de las consultas * Definir e implementar marcos SLO/SLI y estrategias de alertas que reduzcan el ruido y destaquen señales reales para los ingenieros de guardia * Colaborar estrechamente con los equipos de entrega de servicios y operaciones para comprender qué necesitan ver durante una incidencia y construir en función de eso —no solo para paneles de control que nadie abre * Integrar las herramientas de observabilidad con los flujos de trabajo de gestión de incidencias, incluyendo soporte para análisis de causa raíz y datos para revisiones posteriores a la incidencia * Mejorar continuamente la velocidad de detección y reducir el tiempo medio hasta la detección (MTTD) y el tiempo medio hasta la resolución (MTTR) en toda la plataforma * Contribuir al plan estratégico de herramientas operativas asistidas por IA (por ejemplo, triaje automatizado, detección de anomalías, herramientas de asistencia al ingeniero) a medida que maduren * Asumir la responsabilidad de la fiabilidad, escalabilidad y seguridad de la propia pila de observabilidad —debe estar activa incluso cuando todo lo demás esté en llamas * Documentar la arquitectura, los manuales operativos y las prácticas operativas para garantizar que la plataforma sea mantenible más allá de su participación **Qué significa el éxito** * Los equipos de operaciones pueden diagnosticar incidencias más rápidamente porque los datos adecuados se muestran automáticamente, sin necesidad de buscarlos manualmente * El volumen de alertas presenta una alta señal y bajo ruido: los ingenieros confían en las alertas que se disparan * La plataforma de observabilidad se escala limpiamente a medida que crece la huella de infraestructura, sin sorpresas relacionadas con costos ni rendimiento * Tendencias decrecientes de MTTD/MTTR, rastreadas y demostrables a lo largo del tiempo * Una plataforma en la que otros ingenieros realmente deseen construir, no evitar **Requisitos** * Experiencia comprobada diseñando y construyendo plataformas de observabilidad para entornos de infraestructura de producción a gran escala (no solo utilizando una configuración existente, sino construyéndola realmente) * Amplia experiencia práctica con herramientas de métricas, registros y seguimiento distribuido (por ejemplo, Prometheus, Grafana, OpenTelemetry, Loki, Thanos/Cortex/Mimir, Elasticsearch/OpenSearch, Jaeger/Tempo u equivalentes) * Experiencia con canalizaciones de telemetría de alto volumen y conocimiento de los compromisos implicados (cardinalidad, retención, costo, latencia de consulta) * Fuertes habilidades de ingeniería de software en al menos un lenguaje comúnmente utilizado en este ámbito (por ejemplo, Go, Python, Rust) * Experiencia con Kubernetes e infraestructura nativa de la nube * Conocimientos sólidos sobre prácticas de SLO/SLI/presupuesto de errores y diseño de alertas que minimicen el ruido * Capacidad para trabajar en un entorno dinámico donde la plataforma se construye simultáneamente con la infraestructura que está monitoreando * Excelentes habilidades comunicativas: capacidad para colaborar directamente con los equipos de operaciones y entrega de servicios para comprender sus verdaderas necesidades de respuesta ante incidencias, no solo especificaciones técnicas **Habilidades y experiencia deseables** * Experiencia construyendo observabilidad para infraestructuras GPU/HPC u otros entornos especializados de cómputo de alto rendimiento * Experiencia con herramientas de observabilidad basadas en eBPF * Conocimientos sobre detección de anomalías o sistemas de triaje automatizado basados en AIOps/ML * Experiencia operando en contextos de servicios gestionados (MSP), donde la observabilidad impulsa directamente los SLA orientados al cliente * Contribuciones a proyectos de observabilidad de código abierto **Información adicional** **¿Qué le ofrece Mirantis?** * Trabajar con un líder consolidado de Silicon Valley en la industria de infraestructura en la nube; * Trabajar con colegas excepcionalmente apasionados, talentosos y comprometidos, ayudando a clientes de Fortune 500 y Global 2000 a implementar tecnologías en la nube de próxima generación; * Formar parte de una innovación de código abierto puntera; * Desarrollarse en un entorno dinámico de una empresa joven, donde se valoran la apertura, la colaboración, la asunción de riesgos y el crecimiento continuo; * Desarrollo profesional y formación; * Asistir a conferencias y grupos de trabajo; * Actividades corporativas, happy hours, hackathons y charlas técnicas; * Recibir un paquete de compensación competitivo con un sólido plan de beneficios. **Se entiende que Mirantis, Inc. puede utilizar tecnología de toma de decisiones automatizada (ADMT) para ciertas decisiones laborales específicas. Puede solicitar excluirse del uso de ADMT para decisiones relacionadas con la evaluación y revisión vinculadas a la decisión laboral específica para el puesto al que se postula. También tiene derecho a apelar cualquier decisión tomada mediante ADMT enviando su solicitud a isamoylova@mirantis.com** Al enviar su currículum, usted consiente el procesamiento y almacenamiento de sus datos personales de conformidad con las leyes aplicables de protección de datos, con fines de evaluación de su candidatura para oportunidades laborales actuales y futuras. ¡Somos Líderes en Gestión de Contenedores en G2 (#2 tras AWS)! ¡Somos Líderes en Gestión de Contenedores en G2 (#2 tras AWS)!

Fuentea: indeed
Parte del contenido se ha traducido automáticamente

Publicado por

David Muñoz

Indeed · HR

Ubicación

David Muñoz

Indeed · HR

Empleos similares

Ingeniero de Plataforma de Observabilidad — Neocloud empleo de Indeed en 2026 | ok.com