Chat rápido, mejores ofertas — Descargar

Arquitecto de IA (IA de voz)

Indeed

Compañía

Tipo de empleoContrato
Modalidad de trabajoRemoto
Nivel de experiencia6 a 10 años
Nivel educativoMaestría

Descripción

**Acerca del proyecto** ***(descripción, duración, fase)*** ---------------------------------------------------------- El cliente es la mayor red estadounidense de hospicio veterinario y cuidados paliativos a domicilio. Un importante patrocinador estadounidense de capital privado impulsa el programa de IA y planea más proyectos en su cartera. Hemos desarrollado un copiloto de voz en tiempo real para sus Coordinadores de Atención Veterinaria (VCC, por sus siglas en inglés). El copiloto escucha llamadas en vivo con las familias de las mascotas. Extrae campos relacionados con citas y aspectos clínicos mientras la llamada está en curso. Rellena el sistema de programación del cliente mediante una extensión para Chrome. Un segundo flujo de trabajo, el **Copiloto de Visitas Veterinarias**, envía por correo electrónico (Amazon SES) a cada veterinario un resumen previo a la visita generado por IA. A continuación viene la **fase de producción**. **Fase:** documento de alcance (SOW) para producción en alineación ejecutiva; inicio previsto para septiembre de 2026. **Duración:** varios meses, con alta probabilidad de prórroga. Mínimo 0,5 FTE; aumento progresivo hasta 1,0 FTE conforme se escale la producción. **Motivo de apertura del puesto:** el arquitecto actual pasa a otro desarrollo estratégico. Permanecerá en **0,15–0,2 FTE para supervisión y transferencia de conocimientos** durante la fase de ramp-up, de modo que el nuevo arquitecto reciba una transición estructurada. **Objetivo** ------------- * Ser responsable de la arquitectura técnica y la entrega del copiloto de voz, desde la prueba de concepto validada hasta la producción * Cumplir con los criterios que este cliente utiliza para evaluar: latencia, precisión, concurrencia y costo * Mantener las expectativas alineadas: ahora forma parte del alcance lograr un producto pulido para producción; proteger al equipo de ampliaciones silenciosas del alcance * Transferir continuamente conocimientos al equipo del cliente y a los ingenieros de Neurons Lab **Áreas de responsabilidad** --------------------------- ### **Arquitectura técnica y aplicación práctica** * Ser responsable de toda la canalización: conversión de voz a texto en tiempo real, extracción de campos mediante LLM, entrega mediante extensión para Chrome e infraestructura de AWS * Impulsar el trabajo sobre latencia: reducir el percentil 95 (P95) de aproximadamente 6 s a cerca de 2 s; eliminar casos especiales de posprocesamiento (retrasos ocasionales de aproximadamente 1 minuto en un tipo de campo) * Realizar pruebas A/B con modelos (actualmente: Claude Haiku frente a GPT Luna), evaluando con conjuntos de referencia dorados la precisión en nombres fonéticos y correos electrónicos * Ser responsable de la evaluación y el costo: trazas de Langfuse, paneles de precisión, costo real por llamada obtenido a partir de llamadas reales y un plan de optimización * Robustecer para producción: 5–10+ llamadas simultáneas, aislamiento estricto de datos entre usuarios, monitoreo, alertas y capacidad de reversión segura * Entregar epics de extremo a extremo (por ejemplo: el servicio de resúmenes por correo electrónico vía SES); mantener siempre una alternativa demostrable para garantizar que ninguna sesión en vivo falle ### **Colaboración con los interesados del cliente** * Dirigir discusiones técnicas con un cliente meticuloso; los VCC prueban casos límite y esperan calidad de producción * Presentar comportamientos concretos del sistema, respaldados con cifras — esta cuenta valora la evidencia, no las presentaciones * Mantener firme el alcance: vincular cada comentario recibido al SOW; derivar elementos del plan estratégico (bucle de aprendizaje, memoria persistente) a fases posteriores * Mantener las discusiones internas dentro del equipo; todos los materiales dirigidos al cliente deben ser revisados por ADM antes de su envío ### **Equipo y conocimiento** * Liderar al ingeniero de IA y al equipo multidisciplinar (pod): asignar tareas, revisar resultados y resolver bloqueos rápidamente * Asimilar la transferencia de conocimientos del arquitecto saliente (ventana de supervisión de 0,15–0,2 FTE) y alcanzar autonomía con rapidez * Dirigir sesiones de transferencia de conocimientos; el proyecto no debe tener ningún punto único de fallo * Apoyar el SOW de producción con estimaciones y opciones de arquitectura cuando el equipo comercial así lo solicite **Habilidades** ---------- * Canalizaciones de voz en tiempo real: STT en streaming, manejo de turnos, inferencia de LLM de baja latencia — experiencia práctica * Ingeniería de LLM: ingeniería de indicaciones (prompt engineering), extracción estructurada, salvaguardias y evaluación A/B de modelos * Observabilidad y evaluaciones: Langfuse o herramienta similar; conjuntos de datos de referencia dorados; paneles de latencia, precisión y costos por llamada * AWS: Bedrock, patrones sin servidor (serverless), SES; economía de tokens e ingeniería de costos por llamada * Pragmatismo full-stack: sólidos conocimientos de Python; suficientes conocimientos de TypeScript / extensiones para Chrome para asumir la integración * Inglés hablado y escrito claro, dirigido a ejecutivos estadounidenses exigentes **Conocimientos** ------------- * Patrones y métricas de centros de contacto / asistencia a agentes (tiempo de atención, costo por llamada, concurrencia) * Operaciones de LLM en producción: pruebas de carga, aislamiento de datos, manejo de incidencias * Deseable: experiencia en ámbitos sensibles a la empatía (sanidad, veterinaria, seguros) y despliegues patrocinados por fondos de capital privado (PE) **Experiencia** -------------- Características clave (evaluar las cuatro): * **IA de voz en producción — obligatorio.** Haber lanzado al menos un producto de voz o habla en tiempo real a usuarios reales (asistencia a agentes, bot de voz, copiloto de transcripción en vivo). Los candidatos deberán mostrar artefactos reales durante la entrevista. * **Más de 6 años de experiencia práctica en ingeniería de IA/ML**, con sólida práctica reciente en producción de LLM * **Historial comprobado de latencia y fiabilidad.** Capacidad de mostrar reducciones medidas del percentil 95 (P95) y correcciones de concurrencia en un sistema en producción * **Experiencia consultiva o frente al cliente en posición senior.** Actitud serena y precisa ante revisiones detalladas de aceptación por el usuario (UAT); gestión adecuada de expectativas Deseable: * Entrega mediante extensiones para Chrome; pilas de telefonía / streaming (Amazon Connect, Twilio, LiveKit) * Langfuse en producción * Experiencia con clientes estadounidenses y solapamiento horario con la zona este (Eastern Time)

Fuentea: indeed
Parte del contenido se ha traducido automáticamente

Publicado por

David Muñoz

Indeed · HR

Ubicación

David Muñoz

Indeed · HR

Arquitecto de IA (IA de voz) empleo de Indeed en 2026 | ok.com