Sommaire
Souveraineté et conformité

Souveraineté des données et IA générative : ce qu'une IA souveraine garantit vraiment

« Souverain » est devenu un argument de vente, rarement une définition. Pour une IA générative, la question se pose flux par flux : qui exécute les traitements, sous quel droit, qui peut accéder aux données, et pouvez-vous partir. Ce guide donne la grille, les textes qui s'appliquent et les vérifications à faire.

Publié le 22 septembre 2026

Ce que « souverain » veut dire pour une IA

Le guide L'IA générative on-premise en entreprise distingue trois notions souvent confondues : le lieu d'exécution, le droit applicable et l'accès effectif. Pour une IA générative, il faut en ajouter une quatrième : la capacité à changer de fournisseur sans perdre ce qui a été construit.

Lieu

Où les traitements s'exécutent et où les données sont stockées, y compris les journaux et les copies de sauvegarde.

Droit

Quelle loi s'applique à l'entité qui opère le service, et quelle autorité peut la contraindre à remettre des données.

Accès

Qui peut techniquement lire les données : l'éditeur, son support, ses sous-traitants, le fournisseur du modèle.

Réversibilité

Si vous changez de modèle ou de fournisseur, ce que vous récupérez : documents indexés, paramétrages, historiques.

Une IA souveraine répond à ces quatre questions pour chaque flux, pas pour le projet dans son ensemble.

Aucune de ces propriétés ne se déduit des trois autres. Un hébergement en France opéré par une filiale de groupe américain règle le lieu, pas le droit. Un fournisseur européen qui conserve vos prompts pour améliorer ses modèles règle le droit, pas l'accès. Un déploiement local sur un format propriétaire règle l'accès, pas la réversibilité.

Pourquoi l'IA générative pose la question plus fortement

Un logiciel métier classique manipule des données structurées, dans un périmètre connu. Un assistant ou un agent d'IA générative reçoit ce que les utilisateurs y collent : un contrat, un dossier salarié, un extrait de code, un courriel client. Le contenu des flux n'est donc pas prévisible, et il est souvent plus sensible que ce que le projet avait envisagé.

Cinq flux distincts sont à examiner, et ils ne partent pas forcément au même endroit :

  • Le prompt : la question de l'utilisateur, avec tout ce qu'il y a joint.
  • Le contexte ajouté : les extraits de documents qu'un moteur de recherche documentaire (RAG) injecte dans la requête envoyée au modèle.
  • La réponse : elle peut reprendre et recombiner des données personnelles ou confidentielles.
  • Les journaux : chez vous, chez l'éditeur de la plateforme, et chez le fournisseur du modèle, avec des durées de conservation différentes.
  • Les index : les représentations vectorielles de vos documents, qui se stockent quelque part et se reconstituent partiellement.
Point de vigilance

Le fournisseur du modèle n'est pas le seul acteur. L'éditeur de la plateforme, l'hébergeur et le fournisseur de recherche web éventuel voient chacun une partie des flux. La souveraineté se juge sur le maillon le plus exposé.

Les textes qui s'appliquent, et ce qu'ils demandent

Plusieurs textes se superposent. Ils ne posent pas la même question, et aucun ne se résume à « héberger en Europe ».

TexteCe qu'il viseLa question pour vous
RGPDTout traitement de données personnelles, y compris dans les prompts et les réponsesBase légale, analyse d'impact, contrat de sous-traitance, transferts hors Union
Cloud Act (États-Unis)Les fournisseurs de services soumis à la juridiction américaine, quel que soit le lieu de stockageQui opère le service, et de qui dépend-il ?
AI ActLes fournisseurs et les déployeurs de systèmes d'IA, selon le niveau de risque de l'usageQuels usages relèvent du haut risque, quelles obligations de transparence ?
SecNumCloud (ANSSI)Un référentiel de qualification des offres cloud, pas une loiLe fournisseur est-il qualifié, sur quel service exactement ?
Data ActLe changement de fournisseur de services de traitement de donnéesPouvez-vous partir, et à quel coût ?

Le RGPD reste le socle. Les transferts de données personnelles hors de l'Union sont encadrés par son chapitre V, et son article 48 prévoit qu'une décision d'une autorité d'un pays tiers exigeant la remise de données n'est reconnue que si elle repose sur un accord international. Le guide RGPD et IA générative détaille les questions à trancher avant de déployer.

Le Cloud Act est souvent cité, rarement lu. Il vise l'opérateur, pas le datacenter : c'est l'objet du guide Cloud Act et IA, qui explique ce qui est réellement exposé et comment le vérifier.

L'AI Act ajoute des obligations propres à l'IA, dont une partie pèse sur l'entreprise qui utilise un système, pas seulement sur celle qui le développe. Son calendrier a été modifié en 2026 : le guide AI Act : obligations de l'entreprise fait le point.

Le référentiel SecNumCloud de l'ANSSI traduit l'exigence de protection vis-à-vis du droit extra-européen en critères vérifiables. Dans sa version 3.2, il exige notamment que le siège du prestataire soit dans l'Union et limite la part du capital détenue par des entités extra-européennes (24 % individuellement, 39 % collectivement). C'est un repère utile même si vous ne visez pas la qualification.

Enfin, le Data Act, applicable depuis le 12 septembre 2025, encadre le changement de fournisseur de services cloud et prévoit la suppression des frais de changement à partir du 12 janvier 2027. Il traite la réversibilité côté infrastructure ; celle de vos paramétrages et de vos index reste à négocier.

Cartographier les flux d'un projet d'IA

La souveraineté ne se décrète pas au niveau d'un projet. Elle se construit en classant les données, puis en décidant, pour chaque usage, où chaque flux a le droit d'aller.

  1. Classer les donnéesDistinguez au minimum : publiques, internes, confidentielles, personnelles, et personnelles sensibles au sens de l'article 9 du RGPD (santé, opinions, appartenance syndicale).
  2. Lister les usagesPour chaque usage prévu, notez quelles classes de données il manipule réellement, y compris ce que les utilisateurs risquent d'y coller.
  3. Tracer les fluxPour chaque usage, suivez les cinq flux : prompt, contexte, réponse, journaux, index. Notez qui les reçoit et sous quel droit.
  4. Fixer une règle par classeDonnées sensibles : traitement local uniquement. Données personnelles : fournisseur européen ou pseudonymisation avant envoi. Données publiques : libre.
  5. Contrôler dans l'outilUne règle qui n'existe que dans une charte n'est pas appliquée. Elle doit se traduire en paramétrage : modèles autorisés par usage, détection des données personnelles, journalisation.
De la classification des données à une règle appliquée par l'outil, usage par usage.

Cette cartographie produit un résultat concret : la liste des traitements qui ne doivent jamais sortir. Une fois cette liste établie, le choix d'architecture devient une conséquence, pas un point de départ.

Trois architectures, trois niveaux de garantie

Le choix entre local, cloud et hybride est traité dans le guide On-premise, SaaS ou hybride. Du seul point de vue de la souveraineté, chaque option garantit des choses différentes.

  • Modèle exécuté localement : aucun flux ne sort, les quatre questions se règlent chez vous. La contrepartie est l'accès limité aux modèles ouverts et une infrastructure à exploiter.
  • Fournisseur européen : le lieu et le droit peuvent être maîtrisés, à condition de vérifier l'actionnariat et les sous-traitants de l'opérateur, pas seulement son siège. L'accès dépend de ses conditions d'utilisation : conservation des prompts, réutilisation pour l'entraînement.
  • Fournisseur extra-européen : le droit applicable n'est pas le vôtre. L'usage reste possible pour des données publiques ou pour des données dont les éléments personnels ont été retirés avant l'envoi, ce que traite le guide Anonymiser ou pseudonymiser avant un LLM.

Dans la plupart des organisations, les trois coexistent. Ce qui compte, c'est que la règle de routage soit explicite et appliquée par l'outil, pas laissée au choix de chaque utilisateur.

Les questions à poser à un fournisseur

Ces questions valent pour l'éditeur d'une plateforme comme pour le fournisseur d'un modèle. Demandez des réponses écrites, et vérifiez-les dans le contrat.

  • Quelle entité juridique opère le service, et quelle est sa société mère ? Où sont leurs sièges ?
  • Quels sous-traitants ultérieurs interviennent, dans quels pays, et pour quelles opérations ?
  • Les prompts et les réponses sont-ils conservés, combien de temps, et à quelles fins ? Sont-ils utilisés pour entraîner des modèles ? Peut-on le refuser par contrat ?
  • Qui peut accéder aux données en exploitation : support, administrateurs, sous-traitants ? Depuis quels pays ?
  • Que se passe-t-il si l'on coupe les flux sortants ? Ce qui cesse de fonctionner décrit exactement ce qui quitte votre système d'information.
  • Que récupère-t-on en partant, dans quel format, et dans quel délai ?
  • Quelles qualifications ou certifications sont effectivement obtenues, sur quel périmètre ? Une certification annoncée « en cours » n'en est pas une.
Le test qui tranche

Demandez l'organigramme juridique de l'opérateur jusqu'à la société de tête. La réponse à la question du droit applicable s'y trouve, bien plus sûrement que dans une page commerciale.

Les erreurs fréquentes

Confondre hébergement en France et immunité juridique

Un datacenter en France opéré par une entité soumise à une loi étrangère reste exposé à cette loi. La nationalité de l'opérateur et de sa maison mère compte plus que l'adresse des serveurs.

Ne regarder que le modèle

Les journaux de la plateforme, le support de l'éditeur et le service de recherche web sont aussi des flux. Un modèle local derrière une plateforme qui envoie sa télémétrie à l'étranger ne règle pas la question.

Croire qu'un contrat suffit

Des clauses contractuelles encadrent un transfert, elles n'empêchent pas une autorité étrangère de contraindre l'opérateur. Seule l'architecture réduit l'exposition ; le contrat la répartit.

Oublier la sortie

Un projet évalué sur sa mise en service, jamais sur sa réversibilité, découvre sa dépendance le jour où les prix ou les conditions changent.

Questions fréquentes

Une IA hébergée en France est-elle souveraine ?

Pas nécessairement. L'hébergement règle le lieu d'exécution, pas le droit applicable à l'opérateur ni l'accès effectif aux données. Il faut vérifier qui opère le service, de quel groupe il dépend, et ce que deviennent les prompts et les journaux.

Peut-on utiliser un modèle américain et rester souverain ?

Pour certains usages, oui : ceux qui ne portent que sur des données publiques, ou dont les données personnelles et confidentielles ont été retirées avant l'envoi. Les données sensibles doivent rester sur un modèle exécuté localement ou chez un opérateur dont vous avez vérifié le droit applicable.

La qualification SecNumCloud est-elle obligatoire ?

Pas pour une entreprise privée en général. C'est un référentiel de qualification de l'ANSSI, qui peut être exigé dans certains contextes, notamment publics. Ses critères de protection vis-à-vis du droit extra-européen restent un bon outil d'évaluation, même hors obligation.

Où se situe SmartAGT

SmartAGT se déploie on-premise, dans votre périmètre. Le fournisseur de modèle est à votre choix : 100 % local, sans aucun flux sortant, ou un fournisseur cloud que vous contractez directement. L'administrateur peut restreindre le catalogue aux fournisseurs européens.

En mode hybride, les données personnelles sont détectées et pseudonymisées de façon réversible, dans un coffre, avant tout appel sortant, et aucun prompt brut n'est stocké. Le détail est sur la page Sécurité.

SOUVERAIN PAR ARCHITECTURE

Une question que ces guides
ne tranchent pas ?