Talent.com
Infomaniak Network SA
AI DevOps / Infrastructure / OptimisationInfomaniak Network SA • genf, Switzerland
AI DevOps / Infrastructure / Optimisation

AI DevOps / Infrastructure / Optimisation

Infomaniak Network SA • genf, Switzerland
Vor 30+ Tagen
Stellenbeschreibung
ph3AI DevOps / Infrastructure / Optimisation /h3 h3Contexte : /h3 pInfomaniak développe une plateforme IA open source hébergée sur ses propres datacenters suisses. Nous déployons des modèles de langage à grande échelle et construisons des agents intelligents pour nos produits (kChat, kMeet, kDrive). Nous recherchons un·e AI DevOps pour concevoir, implémenter et optimiser nos agents IA, avec un focus sur la qualité, la fiabilité et l’expérience utilisateur. /p h3Tes responsabilités /h3 ul libDéploiement Orchestration : /b Déployer, maintenir et optimiser des LLM sur Kubernetes en maximisant l’efficacité des ressources GPU / Compute. /li libCI/CD Automatisation : /b Améliorer et industrialiser nos pipelines Gitlab CI pour les modèles IA (build, test, déploiement, rollback). Piloter les déploiements via Flux CD (GitOps). /li libMonitoring Observabilité : /b Renforcer notre stack Prometheus / Grafana / Victoria Metrics pour une visibilité fine sur les performances, la consommation GPU, la latence, la disponibilité et de manière générale la santé des services IA. /li libOptimisation des ressources : /b Travailler sur l’efficacité des coûts et des performances (autoscaling, scheduling, gestion des quotas, optimisation des images…) /li libQualité Fiabilité : /b Garantir la robustesse, la sécurité et la reproductibilité des déploiements dans un environnement critique /li /ul h3Le profil qui nous fait vibrer : /h3 ul liMaîtrise des frameworks modernes de serving (ex : vLLM, TGI, TensorRT-LLM…) /li liMaîtrise de GitLab CI (pipelines, runners, variables, intégration avec Kubernetes). /li liExpérience confirmée en Kubernetes (operators, Helm, CRDs, networking, autoscaling). /li liExpérience avec Flux CD (GitOps, HelmReleases, Kustomize, automatisation des déploiements). /li liExpérience avec Prometheus / Grafana (dashboards, alerting, exporters). /li liConnaissance des infrastructures GPU (NVIDIA, CUDA, GPU scheduling, monitoring). /li liAppétence pour la qualité, la fiabilité et la performance. /li liCapacité à travailler en environnement critique (SLA élevé, haute disponibilité). /li liBonne capacité à collaborer avec des équipes ML et Dev. /li /ul h3Un + si tu as des connaissances en : /h3 ul liCuriosité technique, goût pour les challenges innovants et l’optimisation. /li liLes contributions open source ou les side projects sont appréciés /li liTu aimes travailler en équipe, et fais preuve d’une communication positive /li liTon humour, ta flexibilité et ton esprit d’équipe sont des atouts indispensables pour travailler dans le fun /li /ul h3La stack technique que l’on utilise : /h3 ul liLangChain /li liPydantic-ai /li livLLM /li liFastAPI /li liGitlab /li liSentry /li liQdrant /li /ul h3Le poste : /h3 ul liContrat à durée indéterminée /li liTaux d’occupation : 80 - 100% /li liLocalisation : Genève /li liDisponibilité : Au plus vite /li /ul /p #J-18808-Ljbffr
Jobalert für diese Suche erstellen

AI DevOps / Infrastructure / Optimisation • genf, Switzerland