Marcus Chen, YuSMP Group
Marcus Chen Ingénieur Principal, Backend & Cloud, YuSMP Group · Architecture cloud et infrastructure pour produits US/EU
Baies de serveurs haute densité avec câbles réseau colorés et voyants LED dans un centre de données d'entreprise moderne

En bref

Le 25 août 2026, Cisco a annoncé l'élargissement de la Secure AI Factory with NVIDIA via un nouveau partenariat avec Supermicro. Cette extension intègre des systèmes GPU rack-scale haute densité refroidis par liquide dans l'architecture full-stack existante de Cisco — validés pour faire tourner les clusters NVIDIA Vera Rubin NVL72 et HGX Rubin NVL8, capables d'entraîner des modèles à l'échelle du trillion de paramètres. Le refroidissement liquide prend désormais en charge des densités supérieures à 200 kW par baie. Les nouveaux Cisco Validated Infrastructure Services (CVIS), alignés sur le programme NVIS de NVIDIA, certifieront les déploiements par rapport aux architectures de référence. Les solutions seront commercialisées à partir d'octobre 2026.

Pour les équipes d'entreprise qui évaluent une infrastructure cloud et IA, cette annonce marque un tournant : le calcul IA à l'échelle du rack entre désormais dans le cycle d'achat entreprise comme un produit prévalidé et de bout en bout — et non plus comme un projet d'intégration sur mesure.

Ce qu'apporte l'extension

La Secure AI Factory with NVIDIA originelle de Cisco proposait un réseau d'entreprise (commutateurs front-end basés sur Cisco Silicon One et commutateurs back-end NVIDIA Spectrum-X, unifiés par Cisco Nexus One) associé à des options de serveurs GPU standard. La mise à jour d'août 2026 ajoute une troisième couche : des systèmes serveur rack-scale et haute densité Supermicro, disponibles en variantes refroidies par air et par liquide.

La véritable avancée tient au budget énergétique. Les systèmes IA d'entreprise standard fonctionnent généralement dans une plage de 20 à 50 kW par baie. Les nouvelles configurations refroidies par liquide supportent plus de 200 kW par baie, ce qui déverrouille des plateformes comme le NVIDIA Vera Rubin NVL72 (72 GPU liés au sein d'un domaine NVL unique) qui ne peuvent tout simplement pas fonctionner dans des environnements refroidis par air classiques. Cette évolution déplace la frontière matérielle de « l'inférence et du fine-tuning » vers « le pré-entraînement et l'inférence à l'échelle du trillion de paramètres » — une catégorie jusqu'alors réservée aux centres de données hyperscaler.

L'annonce introduit également le refroidissement liquide de baie à tissu réseau : les systèmes réseau refroidis par liquide de Cisco fonctionnent désormais en parallèle avec les serveurs refroidis par liquide de Supermicro, permettant aux opérateurs de faire fonctionner l'intégralité de la baie — réseau inclus — dans une boucle de refroidissement liquide directe, sans les ponts d'air qui complexifient la gestion thermique.

Architecture full-stack et conformité NCP

La Secure AI Factory élargie propose des solutions conformes au programme NVIDIA Cloud Partner (NCP) — un programme qui certifie des piles d'infrastructure complètes (et non de simples composants individuels) par rapport à l'architecture de référence NVIDIA pour les charges de travail d'entraînement et d'inférence. La conformité NCP simplifie les achats en supprimant l'étape de validation qui retarde habituellement les déploiements de clusters IA d'entreprise de plusieurs semaines, voire de plusieurs mois.

Cisco précise qu'elle est le seul partenaire technologique NVIDIA à fournir ses propres commutateurs réseau et son propre système d'exploitation au sein d'une solution conforme NCP. C'est techniquement significatif : la plupart des déploiements NCP utilisent NVIDIA InfiniBand ou de l'Ethernet tiers pour le tissu d'interconnexion GPU haute performance, et Cisco est le premier fournisseur à proposer un back-end entièrement géré par Cisco reposant sur NVIDIA Spectrum-X, plutôt qu'un mélange de fournisseurs dans la même baie. Pour les acheteurs entreprise, cela se traduit par un interlocuteur unique : un seul contrat de support, un seul cycle de mise à jour du firmware, et une observabilité unifiée via AgenticOps sur Cisco Cloud Control.

Le nouveau programme Cisco Validated Infrastructure Services (CVIS), aligné sur les NVIDIA Infrastructure Services (NVIS), certifiera que chaque déploiement est construit exactement selon l'architecture de référence. Cisco construit un laboratoire IA à grande échelle dédié au développement des outils CVIS et aux tests logiciels avant qu'ils n'atteignent les clients.

Pourquoi le cloud souverain est l'enjeu caché

La couverture médiatique s'est concentrée sur les chiffres de calcul rack-scale, mais l'élément le plus déterminant pour les entreprises américaines et européennes est peut-être l'orientation vers le cloud souverain. Cisco désigne explicitement les opérateurs de cloud souverain comme un marché cible aux côtés des entreprises et des néoclouds — et l'architecture répond directement à la question de savoir pourquoi le démarrage de l'IA souveraine a tardé : les designs de référence validés pour les dernières plateformes GPU NVIDIA n'étaient historiquement accessibles qu'à travers les hyperscalers, et non en déploiement sur site ou dans une infrastructure régionalement isolée.

Les entreprises européennes dans les secteurs réglementés — services financiers (MiFID II, DORA), santé (RGPD, MDR) et secteur public (NIS2) — ont fait face à une contrainte réelle : l'infrastructure d'entraînement IA la plus performante exigeait que les données transitent par des régions hyperscaler, créant un risque en matière de résidence des données et de conformité réglementaire. Les déploiements Vera Rubin NVL72 conformes NCP, désormais accessibles aux opérateurs de cloud souverain, modifient directement cette équation. Un néocloud européen ou un opérateur de cloud national peut désormais proposer une puissance de calcul IA de classe hyperscaler au sein de ses frontières, sans intégration personnalisée.

Pour les acteurs français, cette annonce s'inscrit dans le prolongement de la Stratégie Nationale pour l'Intelligence Artificielle (SNIA) et de l'initiative « Cloud au Centre » du gouvernement. Des fournisseurs de cloud souverain comme OVHcloud ou Scaleway peuvent désormais intégrer des configurations Vera Rubin NVL72 certifiées NCP sans intégration personnalisée. Les grandes entreprises françaises soumises à la réglementation RGPD et à la supervision de l'ACPR ou de l'AMF — notamment dans les secteurs financier, aérospatial et énergétique — disposent ainsi d'un chemin concret vers du calcul à l'échelle du rack conforme aux exigences de résilience de DORA.

Pour les équipes qui développent des produits IA à destination de clients soumis à la réglementation européenne, cette annonce ouvre une voie vers l'inférence sur site ou en cloud souverain européen qui n'était pas commercialement viable avant ce jour.

Ce que cela signifie pour les équipes tech

Pour les équipes évaluant une infrastructure IA : La question « construire ou acheter » pour le calcul IA évolue. L'infrastructure GPU rack-scale a historiquement nécessité une intégration personnalisée : concevoir le tissu réseau, s'approvisionner en serveurs compatibles, valider le refroidissement et négocier des contrats de support distincts pour chaque composant. L'extension de Cisco — avec la certification CVIS et un modèle de support à fournisseur unique — transforme l'IA rack-scale d'un projet d'intégration systèmes en une décision d'achat. Les équipes qui planifient une infrastructure d'entraînement à l'horizon de 12 à 18 mois devraient dès maintenant évaluer cette option face aux alternatives en colocation ou en cloud hyperscaler, avant que la disponibilité d'octobre ne crée des contraintes de délais.

Pour les équipes s'appuyant sur le cloud public pour les charges de travail IA : Cette annonce ne modifie pas immédiatement l'économie de l'exécution des charges de travail IA sur AWS, Azure ou GCP. Le calcul à la demande des hyperscalers reste moins contraignant pour les charges variables. Mais pour les équipes avec une inférence à l'état stable à grande échelle, des pipelines de fine-tuning ou des exécutions de pré-entraînement où les coûts par token s'accumulent, l'économie à long terme d'une infrastructure rack-scale détenue ou louée devient de plus en plus favorable à mesure que le processus d'achat se simplifie. Le chemin Cisco/NVIDIA est conçu précisément pour ce segment.

Pour les considérations de cloud souverain européen : Si votre feuille de route inclut de l'IA à grande échelle dans un environnement contraint par le RGPD, ou si vous développez pour des clients du secteur public ou des services financiers soumis à des exigences de résidence des données, la Secure AI Factory élargie offre la première voie commercialement disponible vers du calcul de classe Vera Rubin validé NCP hors d'un hyperscaler. Suivez attentivement le programme de certification CVIS — c'est le mécanisme qui rend les déploiements souverains pratiquement réalisables, et non seulement théoriquement possibles.

Pour les équipes qui n'ont pas encore atteint la maturité nécessaire à l'entraînement : L'inférence aux tailles de LLM actuelles (7 à 70 milliards de paramètres) fonctionne toujours bien sur du matériel de classe HGX H100 ou H200 disponible auprès de plusieurs fournisseurs cloud. Le Vera Rubin NVL72 est une plateforme nouvelle génération principalement pertinente pour les organisations qui entraînent ou font tourner des modèles de classe frontier (>200 milliards de paramètres). Si votre charge de travail IA tient aujourd'hui dans un seul nœud H100, le scénario du calcul rack-scale est encore à 12 à 18 mois d'affecter directement vos décisions d'infrastructure.

Questions fréquentes

Qu'est-ce que la Cisco Secure AI Factory with NVIDIA ?

La Cisco Secure AI Factory with NVIDIA est une architecture d'infrastructure IA d'entreprise validée et full-stack, combinant les équipements réseau Cisco (commutateurs Silicon One et NVIDIA Spectrum-X unifiés par Cisco Nexus One) avec les GPU NVIDIA. L'extension d'août 2026 intègre des systèmes serveur rack-scale Supermicro, permettant l'entraînement à l'échelle du trillion de paramètres et l'inférence à haut débit à des densités dépassant 200 kW par baie. Elle cible les entreprises, les néoclouds et les opérateurs de cloud souverain qui ont besoin d'une infrastructure IA prévalidée, gérée en termes de chaîne d'approvisionnement et sécurisée du silicium à l'application.

Quelles plateformes matérielles NVIDIA l'extension prend-elle en charge ?

L'architecture élargie prend en charge le NVIDIA Vera Rubin NVL72 et le NVIDIA HGX Rubin NVL8. Ce sont deux plateformes de clusters GPU nouvelle génération conçues pour l'entraînement IA à grande échelle et l'inférence. Supermicro fournit les systèmes serveur en variantes refroidies par liquide et par air ; Cisco assure le réseau de bout en bout. L'ensemble est conforme au programme NVIDIA Cloud Partner (NCP), ce qui signifie que l'architecture de référence a été validée par rapport aux exigences NVIDIA pour les charges de travail d'inférence et d'entraînement.

À partir de quand les solutions seront-elles disponibles ?

Cisco commencera à proposer les solutions de calcul Supermicro dans le cadre de la Secure AI Factory with NVIDIA à partir d'octobre 2026. Les Cisco Validated Infrastructure Services (CVIS) — alignés sur les NVIDIA Infrastructure Services (NVIS) — certifieront que l'infrastructure est construite conformément aux architectures de référence, réduisant le risque de déploiement et raccourcissant le délai de mise en production.

Que signifie cette extension pour les clients de cloud souverain en Europe ?

Les clients de cloud souverain en Europe font face à deux contraintes : les exigences réglementaires (RGPD, AI Act, résidence des données) et la nécessité de disposer d'une puissance de calcul IA capable sans que les données transitent par des régions hyperscaler. L'extension de la Secure AI Factory répond directement à ces deux enjeux : les solutions conformes NCP permettent aux opérateurs européens de déployer une infrastructure de classe Vera Rubin sans intégration personnalisée, et la couche réseau Cisco fournit l'observabilité et les contrôles de sécurité qu'attendent les régulateurs. Les entreprises de l'UE dans la FinTech, la HealthTech et les secteurs réglementés disposent désormais d'un chemin certifié vers du calcul à l'échelle du trillion de paramètres au sein des frontières européennes.

Sources

Cisco Newsroom — Cisco élargit la Secure AI Factory with NVIDIA pour l'ère rack-scale, 25 août 2026 (source principale)
SiliconANGLE — Cisco étend l'infrastructure rack-scale de sa Secure AI Factory pour les néoclouds et clouds souverains, 25 août 2026
Cisco Investor Relations — Dépôt d'annonce officiel, 25 août 2026