StellenbeschreibungppbSkysec Defence /b ist ein Schweizer Unternehmen, das sich auf die Entwicklung modernster C-UAS (Counter-Unmanned Aircraft Systems) Lösungen spezialisiert hat. Mit unserem Team aus erfahrenen Ingenieuren und Entwicklern arbeiten wir an der Spitze der Drohnentechnologie und entwickeln Systeme, die neue Massstäbe in der Luftabwehr setzen. /p h3Deine Rolle /h3 pDu möchtest künstliche Intelligenz nicht nur anwenden, sondern lokale AI-Infrastruktur aktiv betreiben, optimieren und weiterentwickeln? In dieser Rolle bist du verantwortlich für unsere on-premise betriebene AI-Umgebung. Aufgrund unseres Tätigkeitsfelds im sicherheitskritischen Umfeld setzen wir bewusst auf No-Cloud, Open Source First und lokal betriebene Modelle. Du arbeitest mit unserem eigenen AI-Cluster, dockerisierten AI-Modellen, GPU-unterstützten Systemen, zentralen Schnittstellen wie OpenLLM sowie Inferenz-Stacks wie vLLM, SGLang oder vergleichbaren Technologien. Dein Fokus liegt auf Performance, Verfügbarkeit, Stabilität, Automatisierung, Monitoring und der sinnvollen Integration von AI in unsere internen Prozesse und Entwicklungsabläufe. Es handelt sich nicht um eine reine Prompting- oder Research-Rolle. Wir suchen jemanden, der AI-Systeme produktiv betreiben, Modelle bewerten, Infrastruktur verstehen und lokale AI-Lösungen technisch weiterbringen kann. /p h3Das bewegst du bei uns /h3 ul liDu betreibst, wartest und optimierst unseren lokalen AI-Cluster /li liDu arbeitest mit dockerisierten AI-Modellen und GPU-unterstützten Systemen /li liDu stellst sicher, dass unsere lokalen Modelle stabil, schnell und hoch verfügbar betrieben werden /li liDu evaluierst neue Open-Source-Modelle und prüfst deren Einsatzfähigkeit für unsere Anforderungen /li liDu testest, vergleichst und optimierst Modelle hinsichtlich Performance, Qualität, Ressourcenverbrauch und Stabilität /li liDu findest geeignete Parametrisierungen für Modelle und automatisierst Test- und Optimierungsprozesse /li liDu betreust zentrale AI-Schnittstellen wie OpenLLM und stellst diese für interne Applikationen bereit /li liDu arbeitest mit Inferenz-Stacks wie vLLM, SGLang oder alternativen Lösungen, wenn diese bessere Resultate liefern /li liDu integrierst AI-Funktionen in interne Tools, Chat-Anwendungen, Entwicklungsworkflows und Automatisierungsprozesse /li liDu unterstützt AI-gestützte Entwicklungs- und Programmierprozesse im Unternehmen /li liDu arbeitest mit Automatisierungslösungen wie n8n und AI-Integrationen /li liDu baust Monitoring für Modelle, Cluster, Ressourcen, Performance und Verfügbarkeit auf und entwickelst es weiter /li liDu arbeitest nach MLOps-Prinzipien und unterstützt den produktiven Lebenszyklus von AI-Modellen /li liDu dokumentierst Modelle, Konfigurationen, Schnittstellen und Betriebsprozesse nachvollziehbar /li liDu beteiligst dich an der Evaluation neuer Hardware und spezialisierter GPU-Systeme /li liDu unterstützt bei Assemblierung, Konfiguration und Ausbau unserer lokalen AI-Systeme /li liDu bringst dich aktiv in die Weiterentwicklung unserer AI-Plattform und internen AI-Strategie ein /li /ul h3Anforderungen /h3 pDas bringst du mit /p ul liFundierte Erfahrung mit AI-Systemen, Large Language Models oder vergleichbaren Machine-Learning-Anwendungen /li liGutes Verständnis für den Betrieb von lokalen oder selbst gehosteten AI-Modellen /li liErfahrung mit Docker, containerisierten Umgebungen und Linux-Systemen /li liErfahrung mit GPU-basierten Workloads und Performance-Optimierung /li liVerständnis für Inferenz, Modellparameter, Kontextlängen, Quantisierung, Ressourcenverbrauch und Latenz /li liErfahrung mit Open-Source-Modellen und Bereitschaft, neue Modelle systematisch zu evaluieren /li liInteresse an MLOps, Monitoring, Automatisierung und produktivem Betrieb von AI-Systemen /li liFähigkeit, Modelle kritisch zu testen und deren Nutzen für konkrete Anwendungsfälle zu beurteilen /li liVerständnis für Schnittstellen, APIs und die Integration von AI in bestehende Applikationen /li liBewusstsein für Datenschutz, Security und den Betrieb sensibler Systeme ohne Cloud-Abhängigkeit /li liStrukturierte, selbstständige und lösungsorientierte Arbeitsweise /li liFreude daran, neue Technologien auszuprobieren, aber pragmatisch und robust in den Betrieb zu überführen /li /ul h3Nice to have /h3 ul liErfahrung mit OpenLLM, vLLM, SGLang oder vergleichbaren Inferenz-Frameworks /li liErfahrung mit n8n, Workflow-Automatisierung oder AI-gestützten Prozessketten /li liErfahrung mit Monitoring von AI-Systemen, GPU-Ressourcen, Latenzen und Modellverfügbarkeit /li liErfahrung mit MLOps-Tools, Modellversionierung, Deployment-Pipelines oder automatisierten TestsKenntnisse in Python, APIs, Skripting oder Backend-Integration /li liErfahrung mit GPU-Hardware, Treibern, CUDA, VRAM-Management oder Hardware-Evaluation /li liErfahrung mit lokalen AI-Clustern oder selbst aufgebauter AI-Infrastruktur /li liVerständnis für AI-gestützte Softwareentwicklung und moderne Coding-Workflows /li liErfahrung mit Retrieval-Augmented Generation, Embeddings oder internen Wissenssystemen /li liInteresse an sicherheitskritischen, vollständig on-premise betriebenen AI-Lösungen /li /ul h3Angebot /h3 h3Was wir dir bieten können /h3 h3Motivierendes Umfeld /h3 ul liFlache Hierarchien, klare Ziele und moderne Technologie /li /ul h3Flexible Arbeitszeiten /h3 ul liGleitarbeitszeit für eine gute Work-Life-Balance /li /ul h3Zukunftstechnologie /h3 ul liArbeite an der Drohnentechnologie von morgen mit /li /ul h3Bezahlte Zertifizierungen /h3 ul liDrohnenprüfungen, Erneuerungen und relevante Weiterbildungen werden unterstützt /li /ul h3Innovation wird gefördert /h3 ul liDeine Ideen sind willkommen und werden aktiv weiterverfolgt /li /ul h3Gratis Kaffee /h3 ul liBester Kaffee der Kaffeeröstrei Küng, kostenlos für alle /li /ul h3Fitness-Abo /h3 ul liVergünstigtes Fitness-Abo direkt neben dem Büro /li /ul h3Attraktive Konditionen /h3 ul liAttraktive Vergütung und wachsende Sozialleistungen /li /ul h3Team-Events /h3 ul liRegelmässige Teamevents, Apéros und gemeinsame Essen /li /ul h3Bereit, mit uns die Drohnentechnologie der Zukunft zu gestalten? /h3 /p #J-18808-Ljbffr