Stellenbeschreibungph3AI Engineer /h3 pUnser Kunde ist ein wachsendes Schweizer Technologieunternehmen, das moderne Systeme in einem sicherheitsrelevanten Zukunftsmarkt entwickelt. Im Fokus stehen selbst kontrollierte Technologien, hohe Verfügbarkeit, sichere Infrastruktur und innovative Lösungen ohne Cloud-Abhängigkeit. Dich erwartet ein technisches Umfeld mit flachen Hierarchien, kurzen Entscheidungswegen und viel Raum, um die interne AI-Plattform aktiv mitzugestalten. /p h3Das bietet die Firma /h3 ul liEine Vollzeitstelle mit einem Pensum von 80 bis 100 Prozent /li liArbeitsort am Hauptsitz in Aadorf /li liEine spannende Aufgabe im Bereich IT Services und lokale AI-Infrastruktur /li liKonsequentes On-Premise-Umfeld mit No-Cloud-Ansatz /li liArbeit mit Open-Source-Modellen, GPU-Systemen, Docker und modernen Inferenz-Stacks /li liViel Raum für Performance-Optimierung, Automatisierung, Monitoring und MLOps /li liFlache Hierarchien, klare Ziele und moderne Technologien /li liFlexible Arbeitszeiten mit Gleitarbeitszeit /li liAttraktive Vergütung und wachsende Sozialleistungen /li liUnterstützung bei relevanten Weiterbildungen und Zertifizierungen /li liEin Umfeld, in dem Innovation und eigene Ideen aktiv gefördert werden /li liVergünstigtes Fitness-Abo direkt neben dem Büro /li liKostenloser Kaffee für alle Mitarbeitenden /li liRegelmässige Teamevents, Apéros und gemeinsame Essen /li liEine langfristige Perspektive in einem spannenden Zukunftsmarkt /li /ul h3Unser Kunde wünscht /h3 ul liFundierte Erfahrung mit AI-Systemen, Large Language Models oder vergleichbaren Machine-Learning-Anwendungen /li liGutes Verständnis für den Betrieb lokaler oder selbst gehosteter AI-Modelle /li liErfahrung mit Docker, containerisierten Umgebungen und Linux-Systemen /li liErfahrung mit GPU-basierten Workloads und Performance-Optimierung /li liVerständnis für Inferenz, Modellparameter, Kontextlängen, Quantisierung, Ressourcenverbrauch und Latenz /li liErfahrung mit Open-Source-Modellen und systematischer Evaluation neuer Modelle /li liInteresse an MLOps, Monitoring, Automatisierung und produktivem Betrieb von AI-Systemen /li liFähigkeit, Modelle kritisch zu testen und den Nutzen für konkrete Anwendungsfälle zu beurteilen /li liVerständnis für Schnittstellen, APIs und die Integration von AI in bestehende Applikationen /li liBewusstsein für Datenschutz, Security und den Betrieb sensibler Systeme ohne Cloud-Abhängigkeit /li liStrukturierte, selbstständige und lösungsorientierte Arbeitsweise /li liFreude daran, neue Technologien auszuprobieren und pragmatisch in stabile Lösungen zu überführen /li liSehr gute Deutschkenntnisse /li liGute Englischkenntnisse von Vorteil /li liErfahrung mit OpenLLM, vLLM, SGLang oder vergleichbaren Inference-Frameworks von Vorteil /li liErfahrung mit n8n, Workflow-Automatisierung oder AI-gestützten Prozessketten von Vorteil /li liKenntnisse in Python, APIs, Skripting oder Backend-Integration von Vorteil /li liErfahrung mit GPU-Hardware, Treibern, CUDA, VRAM-Management oder Hardware-Evaluation von Vorteil /li liErfahrung mit Retrieval-Augmented Generation, Embeddings oder internen Wissenssystemen von Vorteil /li /ul h3Das erwartet dich /h3 ul liDu betreibst, wartest und optimierst einen lokalen AI-Cluster /li liDu arbeitest mit dockerisierten AI-Modellen und GPU-unterstützten Systemen /li liDu stellst sicher, dass lokale Modelle stabil, schnell und hoch verfügbar laufen /li liDu evaluierst neue Open-Source-Modelle und prüfst deren Einsatzfähigkeit /li liDu vergleichst Modelle hinsichtlich Performance, Qualität, Ressourcenverbrauch und Stabilität /li liDu findest geeignete Parametrarisierungen und automatisierst Test- und Optimierungsprozesse /li liDu betreust zentrale AI-Schnittstellen und stellst diese für interne Applikationen bereit /li liDu arbeitest mit Inferenz-Stacks wie vLLM, SGLang oder alternativen Lösungen /li liDu integrierst AI-Funktionen in interne Tools, Chat-Anwendungen, Entwicklungsworkflows und Automatisierungsprozesse /li liDu unterstützt AI-gestützte Entwicklungs- und Programmierprozesse im Unternehmen /li liDu arbeitest mit Automatisierungslösungen und AI-Integrationen /li liDu baust Monitoring für Modelle, Cluster, Ressourcen, Performance und Verfügbarkeit auf /li liDu arbeitest nach MLOps-Prinzipien und unterstützt den produktiven Lebenszyklus von AI-Modellen /li liDu dokumentierst Modelle, Konfigurationen, Schnittstellen und Betriebsprozesse nachvollziehbar /li liDu beteiligst dich an der Evaluation neuer Hardware und spezialisierter GPU-Systeme /li liDu unterstützt bei Assemblierung, Konfiguration und Ausbau lokaler AI-Systeme /li liDu bringst dich aktiv in die Weiterentwicklung der AI-Plattform und internen AI-Strategie ein /li /ul h3Details /h3 ul libWork location /b 8355 Aadorf (TG) /li libWorkload /b 100% /li libEmployment start /b Immediate /li libEmployment duration /b Permanent /li /ul /p #J-18808-Ljbffr