Ingeniero de Habilitación de Usuarios

Compañía
Descripción
Resumen: Como Ingeniero de Habilitación de Usuarios, optimizarás el software dirigido al usuario y los entornos de investigación para maximizar la productividad de la comunidad científica de Roche. Aspectos destacados: 1. Maximizar la productividad de la comunidad científica de Roche 2. Productizar y dar soporte a suites de software avanzadas como NVIDIA AI Enterprise 3. Actuar como consultor técnico para equipos de investigación En Roche puedes ser tú mismo y serás valorado por tus cualidades únicas. Nuestra cultura fomenta la expresión personal, el diálogo abierto y las conexiones genuinas. Aquí serás apreciado, aceptado y respetado por lo que eres. Esto crea un entorno en el que puedes crecer tanto personal como profesionalmente. Juntos queremos prevenir, detener y curar enfermedades, y garantizar que todas las personas tengan acceso a la atención sanitaria, hoy y en el futuro. Únete a Roche, donde cada voz cuenta. El puesto Como Ingeniero de Habilitación de Usuarios dentro del equipo de Ingeniería de Cómputo Acelerado (ACE), serás responsable de supervisar la implementación, la optimización y el funcionamiento diario del software dirigido al usuario, los marcos de aplicaciones y los entornos de investigación en nuestras plataformas de Computación de Alto Rendimiento (HPC) y Fábrica de IA. Tu misión es maximizar la productividad de la comunidad científica de Roche al proporcionar un acceso sin fricciones a herramientas computacionales de vanguardia. Con la introducción de nuestra infraestructura líder en la industria de la Fábrica de IA de NVIDIA, desempeñarás un papel fundamental en la productización y el soporte de suites de software avanzadas como NVIDIA AI Enterprise. Al asegurar que marcos complejos de IA/ML, herramientas de modelos de lenguaje grande (LLM) y entornos especializados de simulación estén perfectamente ajustados a nuestros clústeres, acelerarás directamente el tiempo hasta el valor para los investigadores que entrenan modelos complejos de IA y ejecutan cargas de trabajo científicas computacionales a gran escala. Descripción del área Hosting e Infraestructura (HI) proporciona infraestructura crítica local, alojamiento en la nube, conectividad y productos tecnológicos que permiten a todas las funciones en cada sede de Roche desarrollar, innovar, conectarse y ofrecer productos digitales conformes en toda la empresa Roche. Los Flujos de Valor — el equipo de Ingeniería de Cómputo Acelerado (ACE) se centra en impulsar tanto el éxito del cliente como el del plataforma actuando como centro de excelencia y entrega para la infraestructura de cómputo de alto rendimiento y de IA que respalda los casos de uso de IA y HPC en Roche. Este equipo facilita una incorporación y adopción fluidas para los clientes verticales comerciales que necesitan cómputo acelerado, ayudando a esos consumidores de infraestructura con necesidades optimizadas para alta disponibilidad, transferencia de datos sin interrupciones, flexibilidad, velocidad y las necesidades cambiantes rápidamente de la IA, logrando así un tiempo rápido hasta el valor. Responsabilidades del puesto Gestión de plataformas y entornos dirigidos al usuario * Implementar, dar soporte y optimizar portales y plataformas de entornos dirigidos al usuario, incluidos los entornos ROCs y SCOOP de Roche para HPC. * Gestionar el ciclo de vida y la disponibilidad de pilas de software estándar, módulos y entornos de aplicaciones contenerizados. * Colaborar estrechamente con ingenieros de infraestructura para garantizar que los portales dirigidos al usuario se integren perfectamente con las capas centrales de programación y transferencia de datos. Productización de la Fábrica de IA y la pila de software * Diseñar y gestionar la implementación de la suite de software NVIDIA AI Enterprise, asegurando una integración adecuada y una optimización de licencias. * Proporcionar y dar soporte a pipelines de IA y plataformas de desarrollo de vanguardia, incluidos NVIDIA NeMo para IA generativa/LLMs y NVIDIA Omniverse para simulaciones industriales avanzadas y gemelos digitales. * Crear, evaluar y mantener compilaciones de contenedores altamente optimizadas para marcos estándar de IA/ML (como PyTorch y TensorFlow), incorporando servidores de inferencia de aprendizaje profundo como Dynamo\-Triton para maximizar la utilización de GPU. Consultoría científica y habilitación técnica * En colaboración con el equipo de Ingeniería de Valor y Resultados, actuar como punto técnico de entrada y consultor para los equipos de investigación, ayudándolos a migrar su código, algoritmos y modelos a las plataformas ACE. * Desarrollar, seleccionar y mantener documentación para desarrolladores, repositorios de código de ejemplo y guías de usuario para permitir una incorporación autónoma. * Diagnosticar y resolver cuellos de botella complejos en la capa de software, conflictos de dependencias y problemas de compilación que abarcan paquetes de software científico, entornos virtuales de Python y bibliotecas aceleradas por GPU (por ejemplo, CUDA, cuDNN). Cualificaciones **Formación/Experiencia:** * Licenciatura o título superior en Ciencias de la Computación, Ciencia de Datos, Bioinformática, Química Computacional o una disciplina técnica similar. * Más de 5 años de experiencia en un puesto de ingeniería centrado en la compilación de software científico, la habilitación de usuarios o DevOps para entornos de investigación computacional avanzada. * Conocimientos profundos en la navegación y gestión de aplicaciones de usuario dentro de sistemas multiusuario de Linux empresarial (RHEL/Ubuntu). **Habilidades técnicas y comerciales:** * Herramientas de IA/ML e inferencia: Experiencia configurando y optimizando aplicaciones de NVIDIA AI Enterprise, específicamente NeMo, Omniverse y arquitecturas del Servidor de Inferencia Triton. * Dominio de marcos: Comprensión profunda de los marcos modernos de IA/ML (PyTorch, Jax, TensorFlow) y su ajuste de rendimiento en arquitecturas modernas de GPU. * Provisionamiento de entornos: Competencia con herramientas de gestión de entornos (como Lmod/Módulos de Entorno, Conda) y tecnologías de contenedores (Singularity/Apptainer, Docker). * Secuencias de comandos: Capacidad sólida de secuencias de comandos (Python, Bash) para automatizar configuraciones de entornos de usuario y pipelines de pruebas de aplicaciones. * Aplicar rigurosamente una mentalidad de configuración como código e infraestructura como código, reemplazando intervenciones manuales con scripts de automatización repetibles. **Liderazgo y mentalidad:** * Mentalidad Lean y Ágil: Altamente enfocada en impulsar capacidades de autoservicio y automatizar la entrega de aplicaciones para escalar el soporte. * Defensor del cliente: Una pasión genuina por trabajar con investigadores, comprender sus puntos problemáticos técnicos y traducir infraestructuras complejas en servicios accesibles. * Inteligencia y curiosidad: Una fuerte pasión por la innovación y por mantenerse actualizado con el panorama cambiante de software de IA/ML de código abierto y comercial. Quiénes somos Un futuro más saludable nos impulsa a innovar. Más de 100\.000 empleados en todo el mundo trabajan juntos para lograr avances científicos y garantizar que todas las personas tengan acceso a la atención sanitaria, hoy y para las generaciones futuras. Gracias a nuestro compromiso, más de 26 millones de personas reciben tratamiento con nuestros medicamentos y se realizan más de 30 mil millones de pruebas con nuestros productos de diagnóstico. Animamos mutuamente a explorar nuevas posibilidades, fomentar la creatividad y establecer objetivos ambiciosos para ofrecer soluciones sanitarias transformadoras. Juntos podemos forjar un futuro más saludable. Roche es un empleador que promueve la igualdad de oportunidades.
Publicado por

David Muñoz
Indeed · HR




