Descripción
Resumen:
Axiomatic AI busca un Ingeniero Senior de Plataforma para asumir la responsabilidad de la fiabilidad, el despliegue y la excelencia operativa de su plataforma de IA, centrándose en infraestructura, CI/CD y automatización.
Aspectos destacados:
1. Dirigir estrategias de despliegue y tuberías CI/CD en múltiples entornos
2. Diseñar y mantener infraestructura multi-nube y local (on-premise)
3. Desarrollar herramientas y scripts de automatización para mejorar la eficiencia operativa
**Sobre nosotros:**
Axiomatic AI está construyendo una nueva clase de sistemas de IA diseñados para razonar con el rigor del método científico. Al combinar el aprendizaje profundo con lógica formal y modelado basado en física, creamos sistemas de IA verificables e interpretables que colaboran con investigadores humanos y los apoyan en flujos de trabajo científicos y de ingeniería de alta relevancia.
Nuestra misión, 30×30, es lograr una mejora del 30× en la velocidad, accesibilidad y costo del desarrollo de hardware semiconductor y fotónico para 2030.
Buscamos revolucionar el diseño y la simulación de hardware en estos sectores y estamos conformando un equipo de profesionales altamente motivados para llevar estas innovaciones desde la investigación hasta productos comerciales.
**Descripción del puesto**
Como Ingeniero Senior de Plataforma en Axiomatic, usted será responsable de la fiabilidad, el despliegue y la excelencia operativa de nuestra plataforma de IA. Este puesto se centra principalmente en infraestructura, CI/CD y operaciones, con responsabilidades adicionales en automatización y desarrollo de herramientas.
**Usted:**
* Dirigirá **estrategias de despliegue** y tuberías CI/CD en múltiples entornos
* Diseñará y mantendrá infraestructura **multi-nube** (Azure, AWS, GCP) y despliegues **locales (on-premise)**
* Será responsable de la **infraestructura como código** mediante Terraform para automatizar el aprovisionamiento y la configuración
* Construirá sistemas integrales de **observabilidad**: monitorización, métricas, registro de eventos (logging) y alertas
* Implementará controles de **seguridad**, marcos de cumplimiento y políticas de gobernanza de datos
* Desarrollará herramientas, APIs y scripts de automatización (en Python) para mejorar la eficiencia operativa
* Garantizará la fiabilidad, el rendimiento y la escalabilidad del sistema
* Liderará la respuesta ante incidencias, análisis posteriores (postmortems) y la mejora continua
* Diagnosticará problemas de infraestructura y aplicaciones en múltiples entornos.
**Su misión**
**Despliegue y CI/CD**
* Diseñará e implementará **tuberías de despliegue** para lanzamientos en múltiples entornos (desarrollo, preproducción, producción)
* Asumirá el ciclo completo de despliegue: estrategias de compilación, pruebas, lanzamiento y reversión
* Implementará despliegues blue-green, versiones canary y lanzamientos progresivos
* Creará herramientas y flujos de trabajo automatizados para despliegues
* Garantizará despliegues sin tiempo de inactividad (zero-downtime) y capacidad de reversión
* Optimizará el rendimiento de las compilaciones y los despliegues
* Gestionará repositorios de artefactos y registros de contenedores
**Infraestructura y operaciones en la nube**
* Diseñará y operará **infraestructura multi-nube** en Azure, AWS y GCP
* Diseñará e implementará soluciones **locales (on-premise)** para clientes empresariales (basadas en Linux)
* Gestionará clústeres de Kubernetes, orquestación de contenedores y redes
* Implementará recuperación ante desastres, estrategias de copia de seguridad y continuidad del negocio
* Optimizará los costos en la nube y la utilización de recursos
* Definirá y supervisará **indicadores de nivel de servicio (SLI), objetivos de nivel de servicio (SLO) y presupuestos de errores** para servicios críticos
**Infraestructura como código**
* Escribirá y mantendrá módulos de **Terraform** para el aprovisionamiento de infraestructura
* Implementará flujos de trabajo GitOps para cambios en la infraestructura
* Automatizará la escalabilidad, las actualizaciones y las operaciones de infraestructura
* Garantizará una infraestructura reproducible y controlada por versiones
**Observabilidad y monitorización**
* Diseñará sistemas integrales de monitorización, registro de eventos (logging) y alertas (Prometheus, Grafana, Datadog o similares)
* Creará paneles de control para la salud del sistema, el rendimiento y las métricas empresariales
* Implementará seguimiento distribuido (distributed tracing) para microservicios
* Realizará planificación de capacidad y análisis de rendimiento
* Impulsará mejoras en la fiabilidad mediante conocimientos basados en datos
**Seguridad y cumplimiento**
* Implementará buenas prácticas de seguridad: gestión de identidades, gestión de secretos, políticas de red
* Trabajará para obtener o mantener **certificaciones de seguridad** (SOC 2, ISO 27001 o similares)
* Realizará auditorías de seguridad y corrección de vulnerabilidades
* Implementará políticas de **gobernanza de datos** para tuberías de IA y datos de usuarios
* Garantizará el cumplimiento de las regulaciones sobre privacidad de datos (GDPR, CCPA)
**Automatización y desarrollo de herramientas**
* Escribirá scripts y herramientas de automatización en Python para tareas operativas
* Desarrollará herramientas internas para despliegues, monitorización y respuesta ante incidencias
* Creará manuales operativos (runbooks), automatizaciones y sistemas de autorrecuperación (self-healing)
* Desarrollará APIs para operaciones de infraestructura cuando sea necesario
* Mantendrá altos estándares de calidad de código y pruebas para las herramientas
**Fiabilidad y gestión de incidencias**
* Participará en turnos de guardia (on-call) y liderará la respuesta ante incidencias
* Realizará análisis posteriores (postmortems) sin asignación de culpas y gestionará los puntos de acción
* Creará y mantendrá manuales de respuesta ante incidencias
* Mejorará la resiliencia del sistema y sus modos de fallo
**Colaboración**
* Colaborará con equipos de ingeniería en estrategias de despliegue y arquitectura
* Trabajará con el equipo de seguridad en cumplimiento y gobernanza
* Mentorizará a ingenieros en mejores prácticas operativas
* Documentará sistemas, procedimientos y manuales operativos (runbooks)
**Requisitos clave**
* **Más de 7 años de experiencia** en puestos de Ingeniería de Plataforma, Ingeniería de Fiabilidad del Sitio (SRE), DevOps o Ingeniería de Infraestructura
* **Experto en despliegues**: Amplia experiencia con tuberías CI/CD, estrategias de lanzamiento y despliegues en producción a gran escala
* **Experiencia multi-nube**: Experiencia práctica obligatoria con **Azure y AWS** (GCP es un plus)
* **Experiencia en despliegues locales (on-premise)**: Administración de sistemas Linux, aprovisionamiento en servidores físicos (bare-metal), redes
* **Experto en Terraform**: Amplia experiencia escribiendo y manteniendo infraestructura como código
* **Sistemas de observabilidad**: Trayectoria comprobada construyendo plataformas de monitorización, alertas y métricas
* **Mentalidad orientada a la seguridad**: Experiencia implementando controles y buenas prácticas de seguridad. **Se prefiere certificación en seguridad** (CISSP, CEH, especialidad en seguridad de AWS/Azure u otras similares)
* **Gobernanza de datos**: Conocimiento de privacidad de datos, requisitos de residencia de datos y marcos de gobernanza
* **Habilidades de backend/scripting**: Python (preferido) o Go para automatización, desarrollo de herramientas y scripts operativos
* Kubernetes y orquestación de contenedores en producción
* Fuerte administración y scripting en Linux/Unix (Bash, Python)
* Plataformas CI/CD: GitHub Actions, GitLab CI, Jenkins o similares
* Control de versiones y prácticas GitOps
* Excelentes habilidades de resolución de problemas y depuración
* Dominio fluido del inglés (el español es un plus)
**Deseable**
* Competencia en Python para automatización y herramientas internas
* Experiencia con **plataformas de IA en la nube** (Vertex AI, Azure ML, AWS SageMaker)
* Experiencia con malla de servicios (Istio, Linkerd) o pasarelas de API
* Experiencia con cargas de trabajo GPU e infraestructura para aprendizaje automático (ML)
* FinOps y optimización de costos en la nube
* Experiencia con marcos de cumplimiento (SOC 2, ISO 27001, HIPAA, FedRAMP)
* Operaciones de bases de datos: administración de PostgreSQL, Redis
* Experiencia con FastAPI o frameworks similares para herramientas internas
* Contribuciones a proyectos de infraestructura de código abierto
* Antecedentes en industrias de hardware o semiconductores
**Modelo de trabajo y expectativas de ubicación:**
* **Modelo de trabajo del equipo:**
*Híbrido. Se acepta trabajo remoto*
* **Ubicación principal:**
Zona horaria preferible: UE
* **Expectativas presenciales:**
Este puesto puede ser híbrido o remoto. En arreglos híbridos, esperamos aproximadamente 2 días por semana en la oficina (con flexibilidad). Puede requerirse viajar ocasionalmente a nuestras oficinas de Barcelona o Boston si trabaja de forma remota.
* **Nota del gestor de contratación:**
Dado que una parte significativa del equipo trabaja de forma remota, estamos abiertos a acuerdos laborales flexibles, incluidos modelos híbridos o totalmente remotos, según la ubicación y las necesidades del equipo.
**¿Por qué unirse a nosotros?**
En Axiomatic\_AI, trabajará en tecnologías que impulsan la innovación en IA para aplicaciones científicas y de ingeniería, alineadas con nuestra misión 30X30.
Esta es su oportunidad de contribuir al desarrollo de nuevas arquitecturas de IA capaces de razonar de forma coherente y producir soluciones interpretables y verificables. Así, podrá ver cómo esas ideas se comercializan en productos que moldearán el futuro del hardware y la computación, mientras colabora con un equipo global de ingenieros y especialistas en IA.
Creemos en superar los límites de lo posible y buscamos constantemente redefinir la intersección entre la IA, con especial énfasis en la consistencia formal. Si está listo para llevar su experiencia en inteligencia artificial y física al siguiente nivel, ¡queremos conocerlo!
*¿Le preocupa no cumplir todos los requisitos? Estudios demuestran que las mujeres y las personas de color son menos propensas a solicitar empleos a menos que cumplan todos los requisitos enumerados. En Axiomatic\-AI, nos dedicamos a crear un entorno laboral diverso, inclusivo y auténtico. Si este puesto le entusiasma pero su trayectoria no coincide perfectamente con cada requisito, ¡le animamos a postularse de todas formas! Podría ser el candidato ideal para este puesto o para otra oportunidad con nosotros.*