Descripción
Buscamos un/a **Arquitecto/a de IA Generativa** para unirse a nuestro equipo en Madrid en un entorno de trabajo híbrido. La persona seleccionada liderará el diseño e implementación de soluciones basadas en IA generativa, asegurando escalabilidad, seguridad y alineación con las necesidades del negocio. Trabajará en colaboración con equipos multidisciplinares para impulsar casos de uso innovadores en entornos empresariales.
EPAM NEORIS es un acelerador digital que acompaña a algunas de las compañías más importantes del mundo en sus desafíos de negocio y evolución tecnológica, combinando excelencia global en ingeniería con experiencia regional y cercanía local.
Con presencia en 11 países de Iberoamérica y más de 4\.000 profesionales en la región, impulsamos una cultura diversa e inclusiva enfocada en la colaboración, el aprendizaje continuo y la innovación.
Como parte de EPAM, una red global con más de 60\.000 profesionales en más de 55 países, ayudamos a las organizaciones a escalar, modernizar y acelerar sus capacidades digitales a través de Cloud, Data \& Analytics, Inteligencia Artificial, Ciberseguridad, Automatización Inteligente, Consultoría Estratégica e Ingeniería de Software.
En EPAM NEORIS creemos que el crecimiento también se construye desde las personas. Por eso, promovemos un entorno donde cada profesional pueda desarrollarse, aportar nuevas ideas y participar en proyectos de impacto regional y global.
**Responsibilities**
* Diseñar arquitecturas end\-to\-end de soluciones de IA generativa, incluyendo RAG, agentes, copilots y estrategias de ajuste de modelos
* Definir patrones de diseño para el uso de modelos de lenguaje en entornos productivos, incluyendo prompting, orquestación y tool calling
* Implementar pipelines de recuperación de información con embeddings, bases de datos vectoriales y mecanismos de ranking
* Integrar soluciones de IA generativa en productos y plataformas mediante APIs y arquitecturas de microservicios
* Optimizar el rendimiento de las soluciones en producción mediante mejoras de coste, latencia, escalabilidad y observabilidad
* Garantizar la seguridad, privacidad y cumplimiento normativo en el uso de modelos y datos empresariales
**Requirements**
* Experiencia sólida en arquitectura e implementación de soluciones de IA generativa con modelos de lenguaje de gran escala (LLMs)
* Experiencia profesional en arquitecturas RAG y bases de datos vectoriales como Pinecone, Weaviate o similares
* Conocimiento avanzado de frameworks de orquestación como LangChain, LlamaIndex o equivalentes
* Dominio de entornos cloud, especialmente Azure, y arquitecturas distribuidas
* Experiencia demostrable en MLOps o LLMOps, incluyendo despliegue, monitorización y versionado de modelos
* Conocimientos sólidos de APIs, microservicios y sistemas empresariales en producción
* Experiencia mínima de 5 años en arquitectura de soluciones de datos, IA o software, incluyendo experiencia relevante en IA generativa
* Formación universitaria en Ingeniería Informática, Telecomunicaciones, Matemáticas, Física o disciplinas afines
* Nivel profesional de inglés para colaborar en entornos internacionales
**Nice to have**
* Experiencia con fine\-tuning, RLHF o técnicas de model alignment
* Conocimiento de agentes autónomos y patrones avanzados de tool use
* Experiencia en evaluación de modelos de lenguaje, guardrails y estrategias de red teaming
* Familiaridad con modelos open source como Llama, Mistral o similares
* Certificaciones cloud en Azure o especializaciones relacionadas con inteligencia artificial
**We offer**
* • Contrato indefinido con salario competitivo• Modalidad flexible y posibilidad de trabajo remoto• Plan de carrera personalizado y formación continua• Participación en proyectos estables con alto componente técnico• Flexibilidad horaria y enfoque en la conciliación• Beneficios sociales adaptados a tus necesidades