Stellenbeschreibung
Bei uns gestaltest du die Zukunft im Bereich Artificial Intelligence aktiv mit! Du bist massgeblich am Betrieb und der Weiterentwicklung unserer AI Platform (OnPrem & Cloud) beteiligt und treibst diese gemeinsam im engagierten (intern / extern) Team voran. Wir suchen eine Persönlichkeit, die beim Eintauchen in Konzepte und Code nie den Blick für das Wesentliche verliert.
Was du bewegst
- Du verantwortest Betrieb und Weiterentwicklung der hybriden AI‑Plattform (OpenShift & Azure) und stellst Stabilität, Skalierbarkeit, Hochverfügbarkeit und effiziente GPU‑Nutzung sicher.
- Den reibungslosen Betrieb des AI-Operations-Stacks (z.B. MLflow, Dagster, vLLM, Triton) stellst du sicher.
- Du verantwortest das Deployment und Serving von LLM- und ML‑Modellen sowohl auf der On‑Prem‑Plattform (OpenShift) als auch über Azure‑Services (z. B. Azure AI Foundry).
- Betrieb und Optimierung der CI/CD‑Pipelines und Infrastructure as Code. Du definierst Deployment‑ & Konfigurationsstandards und stellst Security‑, Compliance‑ und Vulnerability‑Mgt. sicher.
- Du sorgst für ein robustes Daten‑Fundament (RDBMS, Object Storage, NoSQL, Backup & Recovery) und begleitest Migrationen von und zwischen On‑Prem und Azure.
- Du entwickelst die AI‑Plattform in bestehende Observability‑Stacks weiter und stellst einen stabilen Plattformbetrieb sicher (OpenTelemetry, Splunk, Dynatrace, Azure Monitor).
Was du mitbringst
- Mindestens 5 Jahre
- AI Engineering / Dev Ops
- Master-Studium (Universität, Fachhochschule)
- Computer Science / Informatik
- Deutsch (verhandlungssicher)
- Englisch (sehr gute Kenntnisse)
- Mehrjährige Erfahrung im Aufbau und Betrieb von AI‑Plattformen in hybriden Umgebungen mit Fokus auf Skalierbarkeit, Automatisierung und Hochverfügbarkeit.
- Sehr gute Kenntnisse in Containerisierung, Orchestrierung, Automatisierung und Deployment‑Patterns (z.B. Kubernetes/OpenShift, AKS, Helm, CI/CD).
- Erfahrung mit GPU‑Compute und AI Inferencing (z.B. Nvidia GPU Operator, vLLM, Triton) und Azure‑Services (z.B. Azure ML, Azure OpenAI).
- Kenntnisse in MLOps und Agentic AI insbesondere Experiment‑Tracking (z. B. MLflow), Orchestrierung von ML‑Pipelines (z. B. Dagster, Azure ML) sowie Konzeption und Betrieb von AI‑Agents.
- Gute Kenntnisse in Datenbanken, Object Storage, Data Lifecycle, Backup & Recovery, Monitoring sowie Security‑, Vulnerability‑ und Identity‑Management (z.B. Azure AD).
Was wir dir bieten
- Zentraler Arbeitsort (GABS) – Optimal erreichbar mit dem Zug (10 Minuten vom Zürich HB) oder Auto
- Moderne Infrastruktur – Zukunftsgerichteter und ergonomischer Arbeitsplatz
- Flexibler Arbeitsort / Home Office – Individuelle Möglichkeiten für Home Office
- Flexible Arbeitszeit – Jahresarbeitszeit für alle und Vertrauensarbeitszeit für viele
- Mutterschaftsurlaub / Vaterschaftsurlaub – 18 Wochen für Mütter und 4 Wochen für Väter
- Kinderbetreuung – bis CHF 300 pro Monat und Kind an die externe Kinderbetreuung
- Berufliche Vorsorge – Sehr attraktive Pensionskasse mit überdurchschnittlichem Arbeitgeberbeitrag
- Sozialleistungen – Optimale Deckung bei Krankheit und Unfall «Privat»
- Mitarbeiterangebote – Jährliches grosszügiges Well-being-Guthaben