Mon agent IA tourne sur un serveur que je loue et que j'administre seul. L'orchestration, la mémoire, les journaux : tout reste chez moi.
Et pourtant, une partie de ce qu'il traite part aujourd'hui vers un serveur situé hors de l'Union européenne.
Les deux phrases sont vraies en même temps. C'est tout le problème de cet article : dire « mon IA est auto-hébergée » ne dit presque rien sur où elle est réellement souveraine.
Un système IA n'est pas un bloc
Un assistant IA n'est pas un seul logiciel. C'est un empilement d'au moins trois couches, et chacune peut vivre dans un pays différent.
Il y a le harnais : le programme qui orchestre les outils, garde le fil de la conversation, décide quand appeler quoi. Il y a la mémoire : ce que le système retient de vous, de vos dossiers, de vos échanges passés. Et il y a le modèle : le calcul qui, à chaque message, produit la réponse.
Le discours commercial ne parle presque jamais que d'une seule de ces couches — en général la plus facile à montrer en démo, ou la plus simple à garantir contractuellement. Un fournisseur qui affirme « vos données restent chez vous » a peut-être raison sur la mémoire, et rien à dire sur le modèle. Un dirigeant qui l'entend comprend « tout reste chez moi ». Ce sont deux affirmations différentes, et la seconde ne découle pas automatiquement de la première.
Ça vaut pour n'importe quelle TPE qui connecte un assistant IA à sa messagerie, son CRM ou sa facturation : le contrat peut être irréprochable sur l'endroit où les fichiers sont stockés, et muet sur l'endroit où le contenu de ces fichiers est effectivement lu et traité au moment de la réponse.
Ce que j'ai réellement auto-hébergé
Mon propre cas illustre exactement ce décalage.
L'assistant que j'ai construit tourne sur un serveur que je loue et que j'administre. L'orchestration — la logique qui enchaîne les outils, gère les tâches automatiques, tient la mémoire de nos échanges — est chez moi, dans des fichiers que je peux ouvrir, lire, sauvegarder. Aucun service tiers ne voit passer ce qui se joue à ce niveau-là — à une réserve près, et elle compte : mon hébergeur détient l'hyperviseur et les disques. Il se trouve qu'il est français, donc soumis au même droit que moi. C'est déjà une réponse à la troisième question de cet article. Ce n'en est pas une à la deuxième.
C'est la couche la plus facile à auto-héberger, dès qu'on a un minimum de compétence technique. C'est aussi celle qu'on montre spontanément quand on veut prouver qu'on maîtrise son IA : « regardez, ça tourne sur mon serveur ». C'est vrai. Ce n'est qu'une partie de la réponse.
La couche qu'on oublie : où tourne le calcul
Le harnais ne pense pas. À chaque message, il appelle un modèle de langage pour produire la réponse — et ce modèle, lui, ne tourne pas sur mon serveur. Il tourne chez celui qui l'a entraîné, ou chez celui qui a acheté le droit de le faire fonctionner.
Aujourd'hui, j'appelle ces modèles via OpenRouter, une passerelle qui donne accès à des dizaines de modèles derrière une seule facture. OpenRouter n'héberge rien lui-même : il confie l'exécution à des fournisseurs d'inférence tiers, et choisit lequel selon la disponibilité et le prix au moment de l'appel. Autrement dit, je ne sais pas dans quel pays mon calcul s'exécute, et cela peut changer d'un message à l'autre. Les deux modèles que j'utilise ont été conçus par des laboratoires chinois ; leur exécution, elle, est confiée à un prestataire que je n'ai pas choisi, hors de l'Union européenne.
Je ne le cache pas, parce que c'est un choix assumé et temporaire : une phase de test, sur un crédit qui touche à sa fin. Mais le fait mérite d'être dit clairement, parce qu'il révèle exactement le piège de cet article. Le harnais est chez moi. Le calcul, lui, est ailleurs — hors Union européenne, sur des serveurs sur lesquels je n'ai aucune visibilité contractuelle.
Conforme RGPD ne veut pas dire souverain
L'étape suivante que j'envisageais semblait résoudre le problème : un abonnement chez un hébergeur qui affiche noir sur blanc l'absence de rétention des données et la conformité RGPD.
Sauf que cet hébergeur est une entreprise américaine. Et une entreprise américaine reste contraignable par la justice de son pays, quelles que soient ses promesses contractuelles. C'est le principe du CLOUD Act : une question de juridiction, pas de bonne volonté ni de politique de confidentialité. Une politique « zéro rétention » protège contre un risque : que la donnée traîne quelque part après coup. Elle ne protège pas contre l'autre : qu'elle soit accessible, au moment du traitement, à une autorité qui n'est pas la vôtre.
Conforme RGPD ne veut pas dire souverain. Ce sont deux garanties distinctes, et un fournisseur peut cocher la première sans jamais approcher la seconde.
La grille en trois questions
J'avais déjà proposé une grille de choix dans un précédent article sur la souveraineté à l'échelle d'une TPE ; celle-ci va un cran plus loin — elle ne demande plus où vos données sont rangées, mais où elles sont lues.
Avant de dire « mon IA est souveraine », trois questions suffisent à vérifier ce qu'on affirme vraiment :
Où tourne l'orchestration ? Le harnais, la logique métier, l'historique des échanges — sur quelle machine, administrée par qui.
Où tourne le calcul du modèle ? Pas le service qui vous facture : le serveur qui exécute réellement l'inférence au moment où vous posez votre question.
Sous quelle juridiction est l'opérateur qui héberge ce calcul ? Une société soumise au droit européen n'offre pas la même garantie qu'une société soumise à un autre droit — même localisée en Europe, même irréprochable sur le papier.
Les trois réponses peuvent diverger, et c'est le cas le plus fréquent, pas l'exception. Mon propre système en est la preuve aujourd'hui : harnais chez moi, calcul hors UE. Une TPE qui a souscrit un assistant IA « hébergé en France » devrait se poser exactement la même question sur la troisième couche, celle que le commercial ne détaille jamais spontanément.
Ce qui existe pour fermer la boucle
La bonne nouvelle, c'est que la troisième couche n'est plus obligatoirement un renoncement.
Des opérateurs cloud établis en Europe hébergent désormais, sur leur propre infrastructure, des modèles ouverts réputés pour leurs performances. Mistral a ouvert cet été des endpoints d'inférence régionaux, avec l'engagement contractuel que le calcul reste dans la zone choisie — et héberge, sur cette même infrastructure, le modèle GLM-5.2 conçu par le laboratoire chinois Z.ai. (Mistral, « In-region inference, open models, and new European infrastructure ») Infomaniak, en Suisse, propose de son côté le modèle Kimi-K2.6 conçu par Moonshot AI, servi depuis ses propres data centers, sans rétention des requêtes. (Infomaniak, AI Service — Open source models)
Ces deux garanties ne sont pas de même nature, et la nuance vaut d'être posée. Mistral est une société française : le calcul reste dans l'Union européenne, sous RGPD, hors de portée du CLOUD Act. Infomaniak est suisse : la Suisse n'est pas dans l'Union européenne, elle relève de sa propre loi sur la protection des données, reconnue adéquate par la Commission — une garantie solide, et hors CLOUD Act elle aussi, mais ce n'est pas la même que la première. Dire « européen » pour les deux serait exactement le raccourci que cet article dénonce.
Dans les deux cas, le modèle garde son origine — il a été entraîné ailleurs, par un laboratoire qu'on ne choisit pas — mais le calcul, lui, s'exécute chez un opérateur qui ne relève d'aucune juridiction extra-européenne.
Un mot sur les versions, parce qu'elles comptent. Je tourne aujourd'hui sur GLM-5.3, et c'est un choix : c'est le modèle qui fait le mieux le travail que je lui demande. Ce qui est disponible en souverain, ce sont les versions précédentes — GLM-5.2 chez Mistral, Kimi-K2.6 chez Infomaniak. Fermer la boucle aujourd'hui coûterait donc une version de retard. C'est une décision d'arbitrage ordinaire, pas un obstacle : le catalogue souverain se remplit vite, et l'écart se referme à chaque sortie.
Le prix, lui, n'est pas l'obstacle qu'on imagine. Infomaniak facture Kimi-K2.6 à 0,60 CHF le million de jetons en entrée et 3,00 CHF en sortie — l'ordre de grandeur de ce que je paie déjà au jeton en passant par une passerelle. Sur ce dossier, la souveraineté ne se paie pas en euros. Elle se paie en numéro de version.
Je ne dis pas que ces deux fournisseurs sont la seule réponse, ni la bonne pour tout le monde : je les cite parce qu'ils existent et qu'ils sont vérifiables, pas parce qu'il faudrait s'y précipiter. La question à se poser reste la même, quel que soit l'opérateur retenu : est-ce que les trois couches pointent enfin vers la même juridiction ?
Ce que je prépare, et ce que vous pouvez vérifier dès maintenant
C'est cette dernière étape que je prépare : faire correspondre, couche par couche, le contrôle que j'ai déjà sur mon harnais avec un contrôle équivalent sur le modèle qui le fait réellement penser.
D'ici là, je compte quitter la passerelle pour Ollama Cloud — et j'applique à ma propre décision la grille que je viens de vous donner, sans quoi elle ne vaudrait rien.
Ce que ce changement règle : je cesse de confier mes appels à un routeur qui choisit le fournisseur d'inférence à ma place, au coup par coup, sans que je sache lequel. Je passe à un opérateur unique et identifié, qui contractualise avec ses partenaires de calcul l'absence de journalisation, d'entraînement et de rétention. Sur la deuxième question — où tourne le calcul —, je gagne une traçabilité que je n'avais pas.
Ce que ce changement ne règle pas : l'hébergement principal reste américain. Sur la troisième question, celle de la juridiction, je ne progresse pas d'un pouce. Une politique de non-rétention, aussi sincère soit-elle, ne vaudra jamais une contrainte de droit. C'est une commodité assumée, pas une souveraineté conquise — et si je ne l'écrivais pas noir sur blanc, je ferais très exactement ce que je reproche aux plaquettes commerciales.
Cette étape est transitoire parce que je crois que la sortie se trouve ailleurs. Les opérateurs européens et suisses tiennent déjà l'infrastructure et la juridiction ; il ne leur manque qu'un rattrapage de version, et l'écart se réduit à chaque annonce. Le jour où le modèle que je juge le meilleur pour mon travail sera servi depuis un data center français ou suisse, l'arbitrage disparaîtra : les trois couches pointeront vers le même droit, et je n'aurai rien sacrifié pour l'obtenir. C'est de ce côté-là que la voie souveraine se joue.
En attendant, la grille vaut pour n'importe quel outil IA que vous utilisez déjà — chatbot d'entreprise, assistant de rédaction, copilote intégré à votre logiciel métier. Posez les trois questions à votre fournisseur. Si personne ne sait répondre à la deuxième — où tourne le calcul, pas où sont stockées vos données —, vous avez votre réponse : ce n'est pas encore vérifié, donc ce n'est pas encore su.