2026
AI Orchestrator, proto du webinaire NVIDIA x Gcore
Prototype de démonstration d'IA souveraine « Orange x Gcore AI Orchestrator », vibe-codé avec Claude Code en moins d'une journée pour le webinaire mondial NVIDIA x Gcore (juin 2026). Vision d'architecture : NVIDIA Dynamo pour l'inférence à la périphérie. En ligne.

fig. 01 · AI Orchestrator, le catalogue de modèles avec son Sovereignty Index
En juin 2026, Orange Business a participé à un webinaire mondial NVIDIA x Gcore, avec Gcore côtoyé comme partenaire. Pour ce contexte, j'ai construit « Orange x Gcore AI Orchestrator », un prototype de démonstration d'IA souveraine, vibe-codé avec Claude Code en moins d'une journée. Ce n'est pas un produit : c'est un support de démonstration qui illustre la vision d'architecture, avec NVIDIA Dynamo pour l'inférence à la périphérie (edge inference). Le proto est en ligne.
Sovereignty Index

fig. 02 · Le Sovereignty Index calculé en direct dans l'assistant de déploiement (données de démo)
Le proto note chaque configuration sur quatre dimensions de souveraineté (données, technique, opérationnelle, juridique) et recalcule l'index en direct quand on change les options. C'est un support de démonstration, pas un produit : les scores sont des données de démo.
Déploiement souverain

fig. 03 · Étape 1 de l'assistant : sites, matériel et résumé de la configuration (données de démo)
Depuis le catalogue, un modèle ouvert se déploie en trois étapes sur une infrastructure européenne : choix des sites, du matériel GPU et du mode d'allocation, avec le résumé et l'index de souveraineté en colonne. Vibe-codé avec Claude Code en moins d'une journée.
NVIDIA Dynamo

fig. 04 · Étape 3 : optimisation NVIDIA Dynamo et routage edge (données de démo)
La vision d'architecture repose sur NVIDIA Dynamo pour l'inférence à la périphérie : l'étape Scaling active l'optimisation Dynamo et le routage via le réseau edge Orange avant le lancement du déploiement.
Inférence en périphérie

fig. 05 · AI Grid : routage des jetons vers le point de présence le plus proche (données de démo)
L'écran AI Grid illustre l'inférence à la périphérie : le modèle tourne sur les régions cloud européennes et les jetons sont servis depuis des points de présence edge, sans sortir de l'UE. Une vision d'architecture, présentée dans le cadre du webinaire mondial NVIDIA x Gcore de juin 2026.
Supervision en direct

fig. 06 · Le tableau de bord de supervision du point de terminaison déployé (données de démo)
Un tableau de bord de supervision complète la démonstration : requêtes, latence, débit, utilisation GPU, réutilisation du KV cache Dynamo, coût et empreinte carbone. Le proto est en ligne sur proto-ai-webinar.vercel.app.
Résultats
- Prototype construit avec Claude Code en moins d'une journée
- Présenté dans le contexte du webinaire mondial NVIDIA x Gcore (juin 2026)
- Vision d'architecture d'inférence à la périphérie fondée sur NVIDIA Dynamo
- En ligne sur proto-ai-webinar.vercel.app
Technologies
Sovereign AI · NVIDIA Dynamo · Claude Code · React · Inference