Buscamos un perfil senior para liderar la evolución de una plataforma de inteligencia artificial de nueva generación basada en Databricks orientada a la construcción de capacidades de IA auto-servicio para equipos de data science e ingeniería de distintas unidades de negocio. Responsabilidades .- Definir y evolucionar el stack de MLOps de referencia para una plataforma de AI Agentic. .- Diseñar estándares de CI/CD para modelos y agentes incluyendo promoción entre entornos aprobaciones versionado y estrategias de despliegue (canary rollback blue/green). .- Definir topologías de serving entre Databricks Serverless y Kubernetes (Seldon) estableciendo criterios técnicos y decision records. .- Implementar estrategias de evaluación monitorización y observabilidad de modelos y agentes basadas en MLflow y herramientas de telemetría. .- Diseñar mecanismos de detección de drift calidad de modelos y seguimiento de comportamiento en producción. .- Integrar políticas de gobernanza y trazabilidad de datos (lineage permisos auditoría) en pipelines mediante Unity Catalog. .- Operar la plataforma en producción bajo SLOs definidos respuesta a incidencias capacity planning optimización de costes y análisis post-mortem. .- Impulsar la estandarización de golden paths para despliegue de IA dentro de la organización. Stack tecnológico .- Databricks (Workflows Model Serving Mosaic AI Vector Search) .- MLflow (tracking registry evaluación) .- Unity Catalog (gobernanza lineage políticas) .- Azure Cloud (principal) y AWS (secundario) .- Kubernetes + Seldon (casos específicos) .- CI/CD Azure DevOps y/o GitHub Actions .- Infraestructura como código Terraform o Crossplane .- Observabilidad Prometheus Grafana OpenTelemetry .- Herramientas adicionales ArgoCD Istio Knative OpenSearch Requisitos imprescindibles .- Más de 5 años de experiencia en MLOps SRE o Platform Engineering con cargas de trabajo de IA en producción. .- Experiencia sólida en Databricks y MLflow en entornos empresariales. .- Experiencia en diseño de pipelines CI/CD para entornos multi-stage (dev test prod) con control de accesos secretos y gobernanza. .- Conocimiento avanzado de Azure (imprescindible) y experiencia en AWS valorable. .- Experiencia con Kubernetes en entornos productivos. .- Conocimiento de infraestructura como código (Terraform o Crossplane). .- Experiencia en observabilidad SLOs incident response y gestión de sistemas en producción. .- Nivel de inglés mínimo B2. Requisitos valorables .- Experiencia operando Kubernetes con Seldon para serving de modelos. .- Conocimiento en arquitectura de agentes de IA y evaluación de sistemas agentic (task success tool reliability). .- Experiencia en RAG pipelines y observabilidad de Vector Search. .- Experiencia en entornos multi-cloud y optimización de latencia entre regiones. .- Conocimiento práctico de Unity Catalog aplicado a auditoría y cumplimiento normativo. Qué ofrecemos .- Participación en un proyecto de referencia en AI Platform Engineering a nivel enterprise. .- Trabajo 100 remoto desde cualquier punto de España. Fomentamos un ambiente de trabajo multicultural e inclusivo no discriminamos por edad género o creencias así como ofrecemos igualdad de oportunidades a todo el personal Desarrollamos nuestras actividades bajo los principios del cuidado del medioambiente la sostenibilidad y la responsabilidad social corporativa colaborando en proyectos de reforestación y sostenibilidad. Apoyamos los 10 principios del Pacto Mundial y los 17 Objetivos de Desarrollo Sostenible en materia de derechos humanos condiciones laborales medio ambiente y anticorrupción. Los procesos de reclutamiento se desarrollan bajo altos estándares de calidad definiendo la incorporación en base a la experiencia y habilidades del candidato. Somos una empresa española líder en servicios tecnológicos y atracción del talento presente en el mercado desde 1995. Contamos con más de 600 empleados en proyectos.
Sourced from Tecnoempleo. Relocantly aggregates public job postings; apply on the original site.