Aller au contenu principal

Private GPT souverain

Vos équipes utilisent déjà l'IA, et le vrai enjeu est de savoir elles le font. Faute d'outil interne, les collaborateurs collent des données de l'entreprise dans ChatGPT, Copilot ou Gemini. C'est le Shadow IA, et l'entreprise perd le contrôle de sa donnée. Private GPT ramène ces usages sous votre gouvernance, avec une IA centralisée souveraine hébergée en France, chat et interrogation de vos documents inclus.

Private GPT assemble deux briques open source, opérées pour vous par France Nuage :

  • Open WebUI : l'interface de chat (équivalent ChatGPT), avec RAG pour interroger vos documents internes.
  • vLLM Semantic Router : le routeur IA qui reçoit chaque requête et l'aiguille, par intention et par effort de raisonnement, vers un backend LLM local au client ou une IA cloud souveraine.

Aucune licence à payer sur les deux logiciels. France Nuage facture l'hébergement souverain managé et l'accompagnement.

À qui ça s'adresse

Aux organisations qui veulent offrir un assistant IA à leurs équipes sans exposer leur donnée à des plateformes soumises au droit américain, et qui manipulent des documents sensibles (cabinets comptables et juridiques, RH, santé, secteur public, ETI). Le RAG permet d'interroger une base documentaire interne ; les documents ne quittent jamais l'infrastructure France Nuage.

Architecture

En pratique, la WebUI parle uniquement à la passerelle Envoy (API compatible OpenAI), qui consulte le Semantic Router (ExtProc) pour classer la requête et choisir la route. Le guard PII détecte les données personnelles ; une requête contenant un type de PII non autorisé est bloquée avant tout appel cloud (fail-closed), jamais laissée passer en clair. Aucune donnée personnelle ne part vers le cloud. Les détections sont comptées dans les métriques du routeur (une journalisation par détection est en roadmap). Les embeddings des documents pour le RAG sont calculés sur le backend privé, et les documents ne partent jamais vers le cloud.

Contrainte d'infrastructure

Le cluster France Nuage ne sert pas les poids des modèles (pas de GPU). Les deux services (Open WebUI, Semantic Router) sont des workloads CPU. L'inférence lourde est déléguée à des backends externes, un backend local/privé que vous fournissez (chat et embeddings) et Mistral La Plateforme (cloud souverain UE) sur votre compte.

Ce que fait le routage

Type de requêteRouteComportement
SensibleBackend privéFail-closed : si le backend privé est indisponible, la requête échoue avec une erreur explicite. Jamais de bascule vers le cloud.
GénéralMistral La Plateforme (UE)PII détectées ; une requête portant un type de PII non autorisé est bloquée avant l'envoi (fail-closed). Choix du modèle (small/large) selon l'effort de raisonnement.
RAG (documents)Embeddings sur le backend privéLes documents et leurs vecteurs restent dans France Nuage (pgvector sur PostgreSQL).

Aucune défaillance n'est silencieuse. Une indisponibilité du backend privé sur une route sensible reste visible (erreur claire), et toute requête portant une PII non autorisée est bloquée avant le cloud plutôt que laissée fuir.

Recommandations RSSI & DSI

Le Private GPT ne garantit la maîtrise de la donnée que si les accès aux IA publiques sont bloqués côté réseau. Sans ce blocage, les collaborateurs contournent l'outil et exposent la donnée de l'entreprise. France Nuage recommande aux RSSI/DSI :

  • Bloquer au niveau DNS/proxy les domaines des IA publiques grand public (par exemple chatgpt.com, chat.openai.com, gemini.google.com, claude.ai) et rediriger les usages vers le Private GPT interne.
  • Accompagner la bascule par de la formation, pour que les équipes adoptent l'outil interne plutôt que de le contourner.
  • Superviser les tentatives d'accès résiduelles aux IA publiques.

Ce blocage relève du réseau du client. France Nuage fournit la liste recommandée des domaines et l'accompagnement au changement, mais n'opère pas ce blocage.

Sans blocage réseau, pas de maîtrise

Un Private GPT déployé sans blocage des IA publiques laisse la porte ouverte au Shadow IA. La technique (hébergement souverain, détection et blocage des données personnelles) ne suffit pas seule. Elle doit être accompagnée d'une politique réseau et d'une conduite du changement.

Référence de configuration (values.yaml)

Chaque paramètre du chart porte une description, une unité, un défaut et des bornes ; la référence exhaustive est le values.yaml commenté du chart. Principales options :

Authentification

ParamètreTypeDéfautDescription
auth.sso.enabledbooléenfalseActive le SSO OIDC. Par défaut, auth Open WebUI native.
auth.oidc.issuerUrlurlaucunIssuer de l'IdP client (ex. votre Nextcloud).
auth.oidc.scopeschaîneopenid email profileScopes OIDC demandés.

Rétention & effacement

ParamètreTypeDéfautDescription
retention.chatsDaysentier ≥ 00Purge des chats après N jours. 0 = pas de purge.
retention.ragDocsDaysentier ≥ 00Purge des documents RAG après N jours. 0 = pas de purge.
retention.piiLogsDaysentier ≥ 090Rétention des logs de détection des données personnelles.

Ces paramètres décrivent la politique de rétention cible. Dans ce lot, la purge automatique n'est pas encore active. L'effacement est manuel et documenté ; la purge programmée et l'effacement self-service sont en roadmap.

Routeur, guards et backends

ParamètreTypeDéfautDescription
semanticRouter.replicaCountentier 1..42Le routeur est dans le chemin de chaque requête ; au moins 2 réplicas.
semanticRouter.guards.pii.enabledbooléentrueActive la détection PII sur la route cloud.
semanticRouter.guards.pii.piiTypesAllowedliste[EMAIL_ADDRESS]Types de PII tolérés vers le cloud. Un type détecté hors de cette liste bloque la route cloud (détection + blocage, pas de rédaction).
semanticRouter.guards.pii.thresholdflottant 0..10.9Seuil de confiance du classifieur PII.
semanticRouter.failClosedbooléentrueFail-closed global : guard PII ou backend privé indisponible sur une route sensible = erreur explicite, jamais de bascule cloud.
semanticRouter.modelCache.sizeGo (≥ 30)40GiCache local des modèles du routeur (évite le re-téléchargement au redémarrage).

Open WebUI et RAG

ParamètreTypeDéfautDescription
openWebui.rag.vectorStoreénumpgvectorMagasin de vecteurs, sur le PostgreSQL CNPG.
openWebui.rag.embedding.modelchaînebge-m3Modèle d'embeddings, servi par le backend privé.
openWebui.limits.maxFileSizeMbentier 1..1024200Taille maximale par fichier. Rejet au-delà.
openWebui.limits.maxFileCountentier 1..100020Nombre maximal de fichiers par envoi. Rejet au-delà.
openWebui.limits.maxDocsPerUserentier ≥ 12000Plafond de documents par utilisateur. Indicatif (roadmap).
openWebui.limits.maxCorpusMbentier ≥ 120480Taille totale du corpus (20 Go par défaut). Indicatif (roadmap).
openWebui.limits.allowedTypesliste[pdf, docx, txt, md, csv, xlsx]Types de fichiers acceptés. Indicatif (roadmap).

Seules la taille par fichier (maxFileSizeMb) et le nombre de fichiers par envoi (maxFileCount) sont appliquées par la plateforme, avec rejet au-delà. Le plafond de documents par utilisateur, la taille totale de corpus et les types de fichiers autorisés (allowedTypes) restent indicatifs dans ce lot (application produit en roadmap).

Conformité RGPD

Un outil qui traite les échanges des équipes et une base documentaire interne manipule des données personnelles. Private GPT est conçu pour rester sous RGPD, avec une résidence UE de bout en bout. Avant la mise en production d'un tenant réel, France Nuage applique une porte de contrôle go-live :

  • DPA-type Mistral : le client contractualise un accord de sous-traitance (art. 28 RGPD) avec Mistral pour le leg cloud, résidence UE vérifiée.
  • DPA-type France Nuage → client : France Nuage est sous-traitant (héberge les chats et les documents RAG). Un accord de sous-traitance est fourni en modèle.
  • Registre des traitements (modèle) : finalités, catégories de données, durées de conservation (alignées sur retention.*), destinataires (backend privé, Mistral).
  • Mentions RGPD dans l'interface et la documentation : information des utilisateurs, base légale, droits.
  • Vérification de la résidence UE de l'endpoint Mistral et des sauvegardes (MinIO en France).
Coûts cloud

Le client fournit sa propre clé d'API Mistral et paie ses tokens en direct, sur son propre compte. France Nuage ne refacture pas la consommation cloud.

Ce que comprend le service managé

  • Hébergement souverain managé des deux services sur le cloud français France Nuage.
  • Support, mises à jour, sauvegardes et supervision. Les documents RAG uploadés sont sauvegardés ; consultez le guide des sauvegardes externalisées.
  • Secrets chiffrés (clé Mistral du client, clé du backend privé, identifiants PostgreSQL, OIDC) gérés via SealedSecrets.
  • Base de données PostgreSQL managée (CNPG, pgvector) ; voir le guide PostgreSQL managé.
  • Accès au backend privé possible via un tunnel souverain ; voir le VPN Zero Trust Headscale.

Le diagnostic IT & IA, l'accompagnement des directions (CODIR/DG et DSI) et les formations sont assurés avec nos partenaires NoBullshit Conseil et Netir Academy, sur devis, hors forfait.

Souveraineté

Le leg cloud passe uniquement par Mistral La Plateforme (UE), sur le compte du client, sans aucun fournisseur américain par défaut. Les embeddings du RAG sont calculés en local, et les documents restent dans France Nuage. Les deux logiciels sont open source, vous pouvez donc rapatrier le service sur votre propre infrastructure.

Démarrage

  1. Souscrivez depuis la page Private GPT ou la page des tarifs.
  2. Après souscription, l'onboarding démarre avec la clé Mistral de votre compte, l'endpoint de votre backend privé (via tunnel souverain), la signature des DPA et la validation de la porte go-live RGPD.
  3. France Nuage déploie, câble et supervise les deux services. Vous accédez à l'interface de chat et commencez à interroger vos documents.

Exploitation (runbook)

Opérations courantes du service managé, assurées par l'équipe France Nuage.

  • Déploiement / mise à jour : ./deploy.sh <org> [env] (idempotent). Une montée de version se fait en changeant les tags d'image dans les values (Open WebUI, Semantic Router, Envoy) puis en rejouant deploy.sh ; jamais de helm upgrade direct.
  • Rollback : helm rollback <release> revient à la révision précédente. Pour la base, restauration ponctuelle CloudNativePG (PITR) depuis la sauvegarde S3.
  • Sauvegarde / restauration : la base Postgres est sauvegardée en continu vers S3 (MinIO, résidence UE) via CloudNativePG ; les documents RAG uploadés sont sauvegardés par velero. La restauration s'appuie sur ces deux sources.
  • Bascule SSO : activer auth.sso.enabled et renseigner le bloc auth.oidc (issuer, client, secret) dans les values du tenant, puis rejouer deploy.sh. Le retour à l'auth native se fait en repassant auth.sso.enabled à false.
  • Supervision : les métriques du Semantic Router et d'Envoy sont scrapées et branchées au Grafana managé ; alertes sur la charge CPU des guards et les requêtes bloquées (fail-closed).

Références