Vollständige Stellenanzeige von Akkodis
Originaltext · vollständig und lesefreundlich formatiert
In dieser Position übernimmst du die Verantwortung für den Betrieb, die Sicherheit und die Weiterentwicklung moderner KI-Plattformen und GPU-basierter Infrastrukturen. Du stellst den stabilen Betrieb von Inferenz-Clustern sicher, betreust Large Language Models und entwickelst skalierbare Plattformlösungen für anspruchsvolle KI-Anwendungen. Dabei arbeitest du an der Schnittstelle von Infrastruktur, Plattformbetrieb, Security und AI-Governance.
Akkodis ist ein globales Beratungsunternehmen für Digital Engineering, das Technologie und Talente zusammenbringt, um Transformation zu beschleunigen, Innovation voranzutreiben und eine intelligentere Zukunft zu gestalten. Mit mehr als 50.000 Expert:innen in über 30 Ländern verbinden wir Branchen und Technologien miteinander - von AI und Data Analytics bis zu Cloud, Edge, Automatisierung und Cybersecurity.
Aufgaben
- Betrieb, Überwachung und Weiterentwicklung einer hochverfügbaren KI-Plattform und GPU-Infrastruktur
- Administration von Kubernetes-Clustern sowie Optimierung von KI- und Inferenz-Workloads
- Planung und Umsetzung von Storage-, Netzwerk- und Infrastrukturkonzepten für KI-Anwendungen (z. B. Ceph, NFS, S3-kompatible Systeme)
- Planung und Optimierung von Netzwerkarchitekturen für Hochleistungs-KI-Systeme (RDMA, InfiniBand, High-Speed Ethernet)
- Automatisierung von Deployments und Betriebsprozessen mithilfe moderner DevOps-Methoden
- Deployment und Betrieb von Large Language Models (LLMs)
- Sicherstellung von IT-Sicherheit, Governance sowie Compliance-Anforderungen im KI-Umfeld
- Analyse und Behebung von Störungen sowie Erstellung technischer Dokumentationen
- Aufbau und Weiterentwicklung von Monitoring- und Observability-Lösungen
Profil
- Abgeschlossenes Studium der Informatik, Ausbildung als Fachinformatiker Systemintegration oder vergleichbare Qualifikation
- Erfahrung im Betrieb von KI-Plattformen, Kubernetes-Umgebungen und Linux-basierten Infrastrukturen
- Kenntnisse im Umgang mit NVIDIA-GPU-Infrastrukturen sowie dem Deployment von Large Language Models (LLMs)
- Erfahrung mit Container- und Automatisierungstechnologien wie Docker, Helm, ArgoCD oder GitOps
- Kenntnisse in Monitoring- und Observability-Lösungen (z. B. Prometheus, Grafana)
- Verständnis für IT-Sicherheit, Governance-Anforderungen sowie regulatorische Vorgaben wie DSGVO und EU AI Act
- Strukturierte Arbeitsweise, Eigeninitiative und ausgeprägte Teamfähigkeit
Unser Angebot
Die Benefits können je nach Standort und Position variieren.
- Möglichkeit, teilweise im Homeoffice / remote zu arbeiten (hybrides, flexibles Arbeiten)
- Teamspirit und Diversität
- Work‑Life‑Balance
- Attraktive Vergütung
- Sozialleistungen
- Vielseitige Weiterbildungsmöglichkeiten
- Team‑ und Sportevents
- Globales Netzwerk
- Attraktives Mitarbeiterempfehlungsprogramm
Bereit?
Bewerbung für Akkodis fortsetzen · kein Konto nötig.