Infrastructure Edge-AI et Cloud
Ref : 260916O002-
Date de début01/10/2026
-
Localisation
92 - LA DEFENSE
-
Durée20 jours ouvrés (renouvelables)
-
Profil
Consultant
-
Secteur d'activité
Services divers
Nous recherchons un infrastructure Edge-AI et Cloud pour une mission de 20 jours avec renouvellement possible. 
Mission A TEMPS PARTIEL
CONTEXTE
- Intelligence Lab : programme du Pôle : infrastructure Edge-AI sur les campus (baies DGX Spark, Jetson, Raspberry Pi) couplée à une plateforme cloud OVH (assistant de codage sur modèles open-weight), pilotée depuis le portail.
- Déploiement engagé : baie de Paris en service (mise à niveau à réaliser) baies, matériel réseau et postes NVIDIA déjà livrés à Marseille, Bordeaux et Lyon OVHcloud retenu le 4/09 (2 × H100 + 2 × L40S, embeddings, VM LiteLLM, région Gravelines, oct. 2026 → juin 2027) modèle Qwen3 27B benchmarké, remplaçable
- Partenariat OVHcloud « Cloud for Education » : en cours de signature 100 k€ HT de crédits pour ~4 000 bénéficiaires, distribués par lots de codes via les enseignants et le Responsable Intelligence Lab pseudonymisation des étudiants imposée par le cahier des charges (exigence FC-25), accès par clés API
- Départ du chef de projet technique en place : reprendre et finaliser le déploiement avec l'équipe en place : deux étudiants qui portent le run et l'installation sur site à Marseille et Lyon, la DSI, les référents campus pas de prestataire de MCO
- Priorités : 1) baie de Paris opérationnelle et plateforme cloud, 2) baie de Marseille Bordeaux et Lyon en tranche optionnelle selon l'avancement
- Objectif : livrer une infrastructure opérationnelle de bout en bout (edge, cloud, portail), équipée de ses outils de supervision, de suivi de consommation et de gouvernance, documentée et transférable (plateforme groupe gérée, reprise possible par la DSI à 1-2 ans)
- Hors périmètre : aménagement des salles, mobilier, signalétique, peinture et logistique physique des campus pas de baie à Rennes
MISSIONS
Lot 0 – Pilotage et gouvernance, transverse (≈ 3 j)
- Reprendre le backlog des livrables, fixer le planning cible par priorité et le RACI des contributeurs
- Animer le point hebdomadaire, tenir le journal des risques et des décisions, produire un reporting bimensuel au Demandeur et à la Direction
- Travailler en binôme avec le Responsable Intelligence Lab (interlocuteur désigné d'OVHcloud, recrutement en cours) et avec la DSI encadrer techniquement les deux étudiants qui portent le run
- Proposer le modèle de MCO cible (prestataire, DSI ou équipe école) avec son RACI de run et son coût, pour décision avant la fin de mission
Priorité 1 – Baie de Paris opérationnelle (≈ 5 j)
- Mettre à niveau l'infrastructure existante (DGX Spark, Jetson Orin Nano Super, Jetson Thor, Raspberry Pi) déployer Docker et Kubernetes sur les machines de la baie
Priorité 1 – Supervision et sécurité (≈ 4 j)
- Construire le tableau de bord de supervision unifié, conçu multi-campus (VPN site à site) et mis en service sur Paris
- Déployer la VM Fortinet et l'export des logs vers les serveurs de la DSI.
- Monitorer les onduleurs Eaton (cartes SNMP, sondes) mettre en place les alertes température / incendie / fumée / fuite d'eau avec extinction automatique des machines et notification des services généraux
Priorité 2 – Baie de Marseille (≈ 2 j)
- Obtenir de la DSI et du référent campus les prérequis : arrivée internet dédiée jusqu'à la baie (≥ 1 G ou IP non filtrée, sans date à ce jour), électricité, climatisation, câblage RJ45
- Mettre en service la baie DGX Spark (UPS, switch, sondes) à partir de la configuration de référence Paris raccorder à la supervision centralisée
- Recetter l'environnement de calcul local avec le référent campus
Documentation et transfert (≈ 2 j)
- Rédiger la documentation technique (edge, cloud, réseau, supervision) et les procédures d'exploitation au niveau attendu pour une reprise par un prestataire de MCO ou la DSI
- Produire les tutoriels étudiants et enseignants assurer le transfert de compétences aux équipes de l'école et DSI
COMPETENCES REQUISES
- Conteneurisation et orchestration : Docker, Kubernetes (bare-metal / K3s), PXE boot, Linux, architectures ARM (Jetson, Raspberry Pi)
- Infrastructure GPU et IA : NVIDIA DGX / Jetson, CUDA, serving de LLM open-weight (vLLM, LiteLLM), gestion de clés API et de quotas
- Cloud : OVH Cloud (instances GPU, stockage), sauvegardes distantes, Infrastructure as Code
- Réseau et sécurité : VPN site à site, VLAN, Fortinet, centralisation de logs, gestion des accès
- Supervision : Grafana / Prometheus ou équivalent, monitoring UPS (SNMP / NUT), alerting environnemental
- Intégration : API REST, intégration à un portail web existant, scripting Python / Bash
- Pilotage : coordination multi-sites, encadrement de contributeurs juniors, reporting, documentation
PROFIL
- Ingénieur DevOps / infrastructure senior (5 ans et plus) avec expérience de tech lead ou de chef de projet technique sur des déploiements multi-sites
- Déploiements GPU / IA on-premise et cloud menés de bout en bout, idéalement en environnement éducatif ou de recherche
- Autonome et pragmatique : reprendre un projet en cours, trancher, clôture