Votre AI Factory souveraine.
Propulsée par OpenNebula, opérée avec Slurm.

Cloud Inspire déploie et opère votre infrastructure IA sur OpenNebula : GPU partagés entre équipes, clusters Slurm pour l'entraînement, vLLM et Kubernetes pour l'inférence.
Open source, sur votre site ou chez un hébergeur souverain.

GPU as a Service Slurm à la demande Kubernetes & vLLM Open source & souverain

Le modèle EuroHPC AI Factories

Du supercalculateur
à l'AI Factory.

En Europe, les centres de calcul EuroHPC deviennent des « AI Factories » : des plateformes de services IA ouvertes aux chercheurs, aux start-up, à l'industrie et au secteur public. Le calcul intensif garde sa fiabilité et devient accessible comme un cloud. Nous appliquons ce modèle à votre infrastructure, avec OpenNebula.

Multi-tenant, une seule console

Chaque équipe dispose de son environnement : clusters Slurm, clusters Kubernetes ou machines virtuelles, sur le même socle, avec les mêmes règles d’isolation.

SlurmKubernetesVM

GPU au plus près du matériel

Accès direct aux GPU par PCI passthrough, réseau SR-IOV, partage des GPU entre applications. Accélérateurs NVIDIA et AMD.

PCI passthroughSR-IOVNVIDIAAMD

GPU, LLM et IA « as a Service »

Catalogue d’applications et de modèles prêts à l’emploi : vos équipes lancent un modèle ou un environnement de travail en libre-service.

vLLMHugging FaceMistralEuroLLMNVIDIA NIM

VM plutôt que bare metal

Les machines virtuelles isolent mieux les équipes et se provisionnent plus vite. OpenNebula mesure un surcoût de performance de 0 à 3 % par rapport au bare metal.

IsolationProvisioning rapide

Multi-sites et hybride

Plusieurs sites pilotés chacun localement, reliés entre eux. Capacité étendue au besoin chez un fournisseur externe, par exemple Scaleway.

FédérationMulti-sitesCloud hybride

Open source et souverain

OpenNebula est open source et indépendant des fournisseurs. Vous gardez la maîtrise de l’infrastructure, des modèles et des données.

Open sourceSans lock-in

Cas d'usage

Entraîner et affiner vos modèles
avec Slurm, sur OpenNebula.

Slurm est l'ordonnanceur de référence du calcul intensif. Sur OpenNebula, il tourne dans des machines virtuelles avec accès direct aux GPU : fine-tuning de LLM, entraînement par lots dans les laboratoires de recherche et les centres de calcul.

Inférence et LLM en service

Les modèles entraînés sous Slurm sont servis avec vLLM sur Kubernetes, sur la même plateforme. Entraînement, inférence et gestion au même endroit.

GPU mutualisés entre équipes

Recherche, data science, métiers : chaque équipe a son environnement isolé, et les GPU sont partagés au lieu d’être réservés.

Gratuit · Réponse sous 48h · Sans engagement

AI Factory souveraine

Vos GPU, vos modèles, vos données.
Sur votre infrastructure.

Nous étudions votre contexte — équipes, cas d'usage, GPU disponibles ou à acquérir — et nous vous proposons l'architecture de votre AI Factory sur OpenNebula.