Votre AI Factory souveraine.
Propulsée par OpenNebula, opérée avec Slurm.
Cloud Inspire déploie et opère votre infrastructure IA sur OpenNebula : GPU partagés entre équipes, clusters Slurm pour l'entraînement, vLLM et Kubernetes pour l'inférence.
Open source, sur votre site ou chez un hébergeur souverain.
Le modèle EuroHPC AI Factories
Du supercalculateur
à l'AI Factory.
En Europe, les centres de calcul EuroHPC deviennent des « AI Factories » : des plateformes de services IA ouvertes aux chercheurs, aux start-up, à l'industrie et au secteur public. Le calcul intensif garde sa fiabilité et devient accessible comme un cloud. Nous appliquons ce modèle à votre infrastructure, avec OpenNebula.
Multi-tenant, une seule console
Chaque équipe dispose de son environnement : clusters Slurm, clusters Kubernetes ou machines virtuelles, sur le même socle, avec les mêmes règles d’isolation.
GPU au plus près du matériel
Accès direct aux GPU par PCI passthrough, réseau SR-IOV, partage des GPU entre applications. Accélérateurs NVIDIA et AMD.
GPU, LLM et IA « as a Service »
Catalogue d’applications et de modèles prêts à l’emploi : vos équipes lancent un modèle ou un environnement de travail en libre-service.
VM plutôt que bare metal
Les machines virtuelles isolent mieux les équipes et se provisionnent plus vite. OpenNebula mesure un surcoût de performance de 0 à 3 % par rapport au bare metal.
Multi-sites et hybride
Plusieurs sites pilotés chacun localement, reliés entre eux. Capacité étendue au besoin chez un fournisseur externe, par exemple Scaleway.
Open source et souverain
OpenNebula est open source et indépendant des fournisseurs. Vous gardez la maîtrise de l’infrastructure, des modèles et des données.
Source : OpenNebula — EuroHPC AI Factories
Cas d'usage
Entraîner et affiner vos modèles
avec Slurm, sur OpenNebula.
Slurm est l'ordonnanceur de référence du calcul intensif. Sur OpenNebula, il tourne dans des machines virtuelles avec accès direct aux GPU : fine-tuning de LLM, entraînement par lots dans les laboratoires de recherche et les centres de calcul.
- 1
Déployer le contrôleur Slurm
Appliance « Slurm Controller » prête à l’emploi, depuis la marketplace OpenNebula.
- 2
Ajouter les workers GPU
Appliances « Slurm Worker » avec GPU en PCI passthrough, pour des performances proches du matériel. Authentification Munge configurée automatiquement.
- 3
Lancer les jobs
Vos chercheurs et data scientists soumettent leurs jobs avec les commandes habituelles : srun, sbatch.
- 4
Ajuster la capacité
Les workers sont ajoutés ou libérés selon la file d’attente des jobs. Les GPU ne restent pas inutilisés.
Slurm sur OpenNebula
- Cluster Slurm opérationnel en quelques minutes
- Réseau haute performance InfiniBand (SR-IOV ou passthrough)
- Annuaire LDAP / SSO et stockage partagé NFS ou Lustre
- Les chercheurs gardent Slurm, les administrateurs pilotent OpenNebula
Inférence et LLM en service
Les modèles entraînés sous Slurm sont servis avec vLLM sur Kubernetes, sur la même plateforme. Entraînement, inférence et gestion au même endroit.
GPU mutualisés entre équipes
Recherche, data science, métiers : chaque équipe a son environnement isolé, et les GPU sont partagés au lieu d’être réservés.
Gratuit · Réponse sous 48h · Sans engagement
AI Factory souveraine
Vos GPU, vos modèles, vos données.
Sur votre infrastructure.
Nous étudions votre contexte — équipes, cas d'usage, GPU disponibles ou à acquérir — et nous vous proposons l'architecture de votre AI Factory sur OpenNebula.