Shadow AI : le vrai risque de fuite n'est pas l'hébergement de vos données

Shadow AI : le vrai risque de fuite n'est pas l'hébergement de vos données

Shadow AI : le vrai risque de fuite n'est pas l'hébergement de vos données

Dans les comités de direction, la question qui revient sur l'IA est presque toujours la même : où seront hébergées les données. Faut-il un modèle européen, une instance en France, un engagement contractuel de non-transfert hors de l'Union. La question est légitime et elle mérite d'être instruite.

Elle a un défaut de calendrier. Pendant qu'on l'instruit, les documents de l'entreprise circulent déjà, et ils ne passent pas par l'outil dont on débat. Ils passent par les comptes personnels des collaborateurs, sur des formules gratuites dont les conditions d'utilisation indiquent noir sur blanc que le contenu envoyé peut servir à entraîner les modèles.

Le seul repère chiffré public que nous citons sur ce point date de mai 2024 : dans le Work Trend Index de Microsoft et LinkedIn, mené auprès de 31 000 salariés dans 31 pays, 78 % des utilisateurs d'IA déclaraient apporter leurs propres outils au travail, et 80 % dans les petites et moyennes entreprises. Deux ans et demi plus tard, aucune raison de penser que la proportion a baissé, mais nous n'avons pas de mesure plus récente à mettre à la place : le chiffre est donné avec son millésime.

Ce que l'hébergement décide, et ce qu'il ne décide pas

Choisir un éditeur européen ou une instance hébergée en France a des effets réels. La localisation des serveurs, le droit applicable, l'autorité de contrôle compétente, la question des transferts hors Union européenne : tout cela se joue là, et c'est important.

Une chose ne s'y joue pas : savoir si le modèle apprend sur ce que vous lui envoyez. Cette question ne se règle pas au niveau du pays d'hébergement. Elle se règle au niveau du type de compte, et parfois au niveau d'un réglage individuel dans les préférences d'un utilisateur.

C'est pour cette raison qu'une entreprise peut avoir tranché le débat de la souveraineté, signé pour une solution hébergée en Europe, et continuer à perdre ses documents les plus sensibles par un canal dont elle n'a jamais discuté.

Ce que disent les éditeurs, selon le type de compte

Voici ce que nous avons relu directement chez les éditeurs, le 18 septembre 2026. Ces politiques changent, parfois de mois en mois : la date de consultation fait partie de l'information.

OpenAI. Sur sa page consacrée à l'usage des données pour améliorer les modèles, mise à jour le 13 mars 2026, OpenAI distingue deux régimes. Pour les services destinés aux particuliers, dont ChatGPT, le contenu peut être utilisé pour entraîner les modèles, et l'utilisateur peut s'y opposer depuis ses réglages. Pour les offres destinées aux entreprises, l'éditeur indique qu'il n'entraîne pas, par défaut, sur les entrées et les sorties des produits professionnels, et cite nommément ChatGPT Team, ChatGPT Enterprise et l'API. Les intitulés commerciaux de ces offres évoluent : vérifiez le nom de celle que vous détenez.

Anthropic. Les conditions grand public, applicables aux formules Free, Pro et Max, reposent sur un réglage d'entraînement que l'utilisateur choisit lui-même. Depuis le 8 octobre 2025, ce choix est obligatoire pour continuer à utiliser Claude. Si l'utilisateur l'accepte, la durée de conservation passe à cinq ans, contre trente jours sinon. Ces conditions ne s'appliquent pas aux services relevant des conditions commerciales : Claude for Work, Claude for Education, Claude for Government et l'usage par API, y compris via Amazon Bedrock ou Google Cloud Vertex AI.

Mistral. La politique de confidentialité prévoit un contrôle permettant à l'utilisateur de s'opposer, depuis son compte, à l'usage de ses entrées et de ses sorties pour l'entraînement des modèles. La base légale invoquée est l'intérêt légitime, et l'usage des produits figure parmi les sources de données d'entraînement, dans la limite des conditions applicables. Le réglage par défaut dépend de la formule souscrite et a évolué récemment : il se lit dans les paramètres du compte, pas dans un article de blog.

Pour Copilot et pour Gemini, la règle applicable à votre entreprise ne se lit pas sur une page publique : elle se lit dans votre contrat Microsoft 365 ou Google Workspace, et dans les paramètres de votre environnement. C'est la personne qui administre votre tenant qui détient la réponse.

SituationEntraînement sur vos contenusOù se prend la décision
Compte particulier, formule gratuite ou payantePossible, selon l'éditeur et le réglageDans les préférences du collaborateur
Compte professionnel sous conditions entrepriseExclu par défaut chez OpenAI et AnthropicDans le contrat signé par l'entreprise
Accès par API ou déploiement dédiéExclu par défaut chez les trois éditeurs citésDans le contrat signé par l'entreprise

Politiques relues le 18/09/2026 · à revérifier avant toute décision d'achat.

Un dernier point mérite d'être lu attentivement, parce qu'il vaut pour tous les éditeurs et pas seulement pour celui qui l'écrit. Mistral précise que lorsqu'une demande porte sur l'entraînement des modèles, les droits de la personne connaissent des limites techniques, et que leur exécution peut impliquer un processus complexe. Autrement dit : une donnée qui est entrée dans un cycle d'entraînement ne se récupère pas sur simple demande. C'est ce qui distingue cet incident de la plupart des fuites de données. Il n'est pas réparable.

Sur un compte personnel, l'arbitrage a déjà été rendu

Voilà le point qui devrait retenir l'attention d'un dirigeant.

Quand un collaborateur utilise une formule grand public, la question de savoir si les documents de votre entreprise alimentent l'entraînement d'un modèle a été tranchée. Pas par le comité de direction, pas par le responsable informatique, pas par le délégué à la protection des données. Par ce collaborateur, seul, dans une fenêtre de réglages, à un moment où il voulait surtout finir sa tâche.

Ce n'est pas un problème de discipline, et le traiter comme tel conduit à la mauvaise décision. Un collaborateur qui n'a pas de compte professionnel et qui a une note de synthèse à produire avant 18 heures fait ce que n'importe qui ferait. L'absence d'alternative fournie est une décision d'entreprise, elle aussi.

Ce qui se perd en même temps que la donnée

La fuite est la conséquence visible. Il y en a une seconde, qui apparaît plus tard, généralement au pire moment.

Quand une donnée personnelle de client, de salarié ou de candidat part sur un compte personnel, votre entreprise reste responsable du traitement, mais elle n'a aucun des actes qui le rendent défendable. L'article 28 du RGPD impose que le recours à un sous-traitant soit encadré par un contrat définissant l'objet, la durée et les instructions du traitement. Un compte ouvert au nom d'un salarié avec une adresse personnelle n'en produit aucun. Il n'y a pas de contrat, pas d'instruction documentée, pas de durée de conservation opposable, et donc rien à présenter.

S'y ajoute l'obligation de littératie de l'article 4 du règlement européen sur l'intelligence artificielle, le règlement UE 2024/1689, en vigueur depuis le 2 février 2025 et contrôlable depuis le 2 août. Cet article n'exige aucune certification de vos salariés et ne figure pas dans la liste des sanctions de l'article 99 : il n'emporte donc pas d'amende autonome. Ce qui est attendu, ce sont les mesures prises. Et un parc d'outils que vous ne connaissez pas est exactement ce qui empêche de décrire ces mesures.

Le problème n'est pas réparti uniformément dans vos équipes

C'est ce que nous observons de façon répétée en session, et c'est ce qui rend la plupart des politiques d'usage inopérantes.

Dans un cabinet d'expertise comptable marseillais de six personnes, formé sur une session et demie en mai 2026, les questionnaires de fin de module montrent deux extrêmes assis dans la même salle, le même jour. Une participante écrit qu'elle n'avait aucune connaissance du sujet avant de commencer. Un autre participant cite NotebookLM par son nom et indique précisément les travaux sur lesquels il compte l'utiliser, pour un outil que personne dans le cabinet n'avait choisi.

Dans une agence d'architecture de douze personnes formée en juin 2026, sur le module d'initiation à la rédaction de prompts, les notes d'utilité perçue vont de 7 à 10, sur les douze questionnaires remplis. La question mesure l'utilité ressentie et non le niveau, mais la dispersion dit quelque chose : les personnes n'arrivaient pas au même endroit.

Conséquence pratique : une note de service adressée à tout le monde manque sa cible. Le risque n'est pas réparti en moyenne, il est concentré sur les quelques personnes les plus avancées, celles qui utilisent déjà plusieurs outils, souvent les plus utiles à l'entreprise, et celles dont les usages sont précisément les plus difficiles à deviner de l'extérieur.

Fournir, cadrer, former, dans cet ordre

Interdire est la réponse la plus fréquente et la moins efficace : un outil gratuit accessible depuis un navigateur ne s'interdit pas, il se déplace hors de vue. Nous l'avons traité en détail dans notre modèle de charte d'usage de l'IA, qui explique pourquoi une règle non vérifiable n'a pas d'effet.

L'ordre des opérations compte plus que leur contenu.

Fournir d'abord. Un compte professionnel disponible, pour les personnes qui en ont l'usage, avant toute règle. Tant qu'il n'existe pas, chaque interdiction produit mécaniquement l'inverse de son objet.

Cadrer ensuite. Ce qui peut être envoyé, ce qui doit être anonymisé, ce qui ne sort jamais, et à qui poser la question en cas de doute. Un doute sans destinataire se tranche toujours dans le sens de l'usage.

Former enfin. Un compte professionnel règle la question de l'entraînement. Il ne dit pas à un collaborateur ce qu'il ne faut pas envoyer, ni comment vérifier une réponse plausible mais fausse. C'est l'objet de nos formations à l'IA pour les équipes en entreprise.

Une limite, pour finir, parce qu'elle vaut mieux qu'un argument de plus. Un compte professionnel ne rend pas une donnée publiable. L'engagement de non-entraînement ne supprime ni la conservation temporaire, ni l'erreur de manipulation, ni le fait qu'une pièce couverte par un accord de confidentialité reste couverte. Et la qualification juridique d'un transfert relève du conseil de votre entreprise, pas d'un organisme de formation.

Le registre d'usage à une page

C'est le document qui manque au dossier de la plupart des entreprises, et il n'a pas besoin d'être plus long qu'une page. Aucun formulaire à remplir pour l'obtenir : le voici.

Une ligne par outil réellement utilisé, y compris ceux que vous n'avez pas choisis.

OutilType de compteQui paieEntraînement par défautRétentionHébergementContrat signé par l'entreprise

Quatre règles pour le remplir utilement :

  1. Commencez par demander, pas par chercher. En dessous de cinquante personnes, aucun outil technique ne détecte un compte personnel ouvert depuis un navigateur. La seule méthode disponible est la question posée, et elle ne fonctionne que si la réponse est sans conséquence pour la personne qui la donne. Annoncez-le avant de poser la question.
  2. Une ligne par outil, même les extensions. Les extensions de navigateur et les assistants intégrés à un logiciel métier sont les plus souvent oubliés, et ce sont ceux dont les conditions sont les moins lues.
  3. La colonne « contrat signé par l'entreprise » se remplit par oui ou par non. Un « oui » sans référence de contrat est un « non ».
  4. Datez le registre et prévoyez sa relecture. Une fois par an au minimum, et à chaque nouvel outil déployé. Un registre de dix-huit mois décrit une autre entreprise que la vôtre.

Quand ce registre est rempli, le débat sur l'hébergement redevient utile : il porte enfin sur des usages réels, et non sur ceux que l'on imagine.

Vous voulez faire cet inventaire avec vos équipes et décider ensuite ? Parlons-en.

À lire aussi