Relocantly← All jobs

🇪🇸 Madrid, Spain · 1d ago

Principal DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom

LinkedInlead
Apply on LinkedIn →Get jobs like this daily
Deine AufgabeNVIDIA und die Deutsche Telekom entwickeln gemeinsam eine industrielle KI-Cloud für Europa. Diese KI-Fabrik in Deutschland wird 10.000 GPUs auf NVIDIA DGX B200-Systemen und RTX Pro Servern hosten. Als DevOps Engineer Principal begleitest du Unternehmenskunden durch Onboarding, Schulung und frühe Einführung der KI-Plattform. Deine Verantwortung umfasst das Verstehen von Kundenanforderungen, die Unterstützung beim Lösungsdesign, die Durchführung von Proofs of Concept (PoCs) und die Sicherstellung einer reibungslosen Integration von Kunden-Workloads (LLMs, GPU-Computing, KI-Pipelines). Du agierst als vertrauenswürdiger technischer Berater und hilfst Kunden, ihre GPU-Cluster und KI-Toolchains effizient zu nutzen.Wir suchen einen DevOps Engineer Principal, der eine Schlüsselrolle dabei spielt, unseren Unternehmenskunden zu helfen, unsere KI-Plattform erfolgreich einzuführen und zu skalieren. In dieser Position begleitest du Kunden durch Onboarding, Schulung und frühe Implementierung modernster KI-Lösungen. Du arbeitest eng mit ihnen zusammen, um ihre technischen und geschäftlichen Anforderungen zu verstehen, unterstützt das Design maßgeschneiderter Architekturen und leitest Proofs of Concept, die den realen Mehrwert validieren. Du stellst die reibungslose Integration komplexer Workloads sicher – vom LLM-Deployment und der GPU-Computing-Optimierung bis hin zum Aufbau von End-to-End-KI/ML-Pipelines. Als vertrauenswürdiger technischer Berater befähigst du Kunden, ihre GPU-Cluster und KI-Toolchains effizient zu nutzen, Herausforderungen zu beheben und Best Practices zu übernehmen, die ihre KI-Reise beschleunigen.AufgabenBeratung von Kunden zu allen technischen Aspekten rund um GPU-Infrastruktur und PlattformnutzungLeitung von Onboarding und Schulungen, Mentoring von Kundenspezialisten zur optimalen Nutzung ihrer GPU-Cluster und KI-UmgebungenDesign und Implementierung von PoCs, einschließlich Umgebungssetup, Datenverarbeitungspipelines und Deployment-WorkflowsDurchführung von Anforderungsanalysen, Übersetzung von Geschäftsanforderungen in technische SpezifikationenUnterstützung von Kunden bei Performance-Optimierung, Troubleshooting, Feinabstimmung und Validierung gelieferter LösungenAgieren als zentraler technischer Ansprechpartner, Koordination funktionsübergreifender Teams in den Bereichen Infrastruktur, Netzwerk, Automatisierung, Sicherheit und KI-ServicesVorschlag und Entwicklung von Automatisierungskonzepten zur Verbesserung von Services, Prozessen und BetriebsmodellenSicherstellung, dass Best Practices in Bezug auf Zuverlässigkeit, Skalierbarkeit und Sicherheit über den gesamten Kundenlebenszyklus hinweg angewendet werdenUnterstützung bei Monitoring, Observability und Kapazitätsplanung für KI-Workloads und GPU-AuslastungDein ProfilWir suchen einen DevOps Engineer Principal mit umfangreicher Erfahrung in Cloud-Infrastruktur, GPU-basierten Systemen, Kubernetes und Automatisierungstools. Der ideale Kandidat verfügt über ausgeprägte technische Expertise in Container-Technologien, CI/CD-Pipelines, Scripting und Monitoring sowie über ausgezeichnete Kommunikations- und Führungsfähigkeiten.Muss-KriterienMindestens 3 Jahre Erfahrung im Design und der Bereitstellung von Systemen basierend auf IaaS, PaaS und SaaSErfahrung mit GPU-basierter InfrastrukturFundierte Kenntnisse in Kubernetes-basierten Container-TechnologienExpertenkenntnisse in Skriptsprachen (Python/Bash)Expertenkenntnisse in Automatisierungstools und automatisierten Deployments (Ansible/Salt-Stack/Terraform/Helm)Expertenkenntnisse in CI/CD in einer Kubernetes-Umgebung und Repository-ManagementExperte in Automatisierung mit Git (GitHub, GitLab) und CI/CD-Tools wie GitHub Actions oder GitLab CI/CDAusgeprägte Erfahrung mit Linux OSErfahrung mit Monitoring- und Visualisierungstools (Grafana, Prometheus)Englischkenntnisse auf B2-NiveauGute KommunikationsfähigkeitenAnalytisches DenkenTeamfähigkeitPräsentationsfähigkeitenVerhandlungsgeschickGrundlegende Projektmanagement-KenntnisseGrundlegende FührungsfähigkeitenFortgeschrittene Kenntnisse im QualitätsmanagementVon VorteilDeutschkenntnisseÜber unsT-Systems ist Teil der Deutsche Telekom Gruppe mit rund 30.000 Mitarbeitern weltweit. Wir schaffen Technologie mit Sinn, um eine positive Wirkung auf die Gesellschaft zu erzielen. Wir suchen neugierige Talente, die lernbegierig sind, Herausforderungen annehmen und Ideen einbringen, die die Erfahrung unserer Kunden transformieren.Wir vertrauen Menschen: Wir bieten Autonomie, kontinuierliche Unterstützung und ein kollaboratives Umfeld, in dem du ohne Grenzen wachsen kannst. Wir sind ein globales Team, geleitet von Respekt, Integrität und der Leidenschaft, jeden Tag besser zu werden.Arbeitsumfeld & FlexibilitätInternationales, dynamisches und kollaboratives UmfeldT-Social: soziale Initiativen (Sport, Community, Gesundheit, ...)Hybrides Arbeitsmodell (remote/vor Ort)Flexible ArbeitszeitenWachstum & EntwicklungMaßgeschneiderte Schulungen: Zugang zu Coursera, um zu lernen, was du willst, wann du willstWöchentliche Sprachkurse (Englisch, Spanisch & Deutsch)Internationale Mentoring-Sessions & Experience DaysVergütung & BenefitsFlexibler Vergütungsplan (Krankenversicherung, Essensgutscheine, Kinderbetreuung, Transport)TelemedizinLebens- und UnfallversicherungSozialfondsWohlbefinden & Freizeit26+ Arbeitstage Urlaub pro JahrKostenloser Zugang zu Fachdiensten (medizinisch, rechtlich, Wellness)100% Gehaltsfortzahlung während KrankheitsurlaubBewerbungsinformationenWenn du eine neue Herausforderung suchst, zögere nicht, uns deinen Lebenslauf zu schicken! Bitte sende deinen Lebenslauf auf Englisch.T-Systems Iberia wird nur die Lebensläufe von Kandidaten bearbeiten, die die für jedes Angebot angegebenen Anforderungen erfüllen.

Sourced from LinkedIn. Relocantly aggregates public job postings; apply on the original site.