Georges Oppenheim · Warith Harchaoui
Pastilles
Statut épistémique.
- observéUn événement documenté, daté, sourcé : cela s'est produit.
- mesuréUne grandeur chiffrée par une étude ou une enquête : cela a été quantifié.
- extrapoléUne extension raisonnée au-delà du documenté : argument de principe ou projection.
- spéculatifUne hypothèse assumée comme telle : ni observée ni mesurée.
observéPrologue : le feu qu'on autorise
Là se forme le risque
En novembre 2021, l'entreprise a annoncé une dépréciation de stocks de 304 millions de dollars et l'arrêt progressif de l'activité
observéCadrage : chaque main sur l'éléphant · L'éléphant ou pourquoi il faut onze mains
Un point de comparaison institutionnel avant la fiction
Ces définitions recoupent, presque terme à terme, le vocabulaire que ce livre emploie depuis le début : capacité, permission, environnement, autonomie ; on y revient plus loin par un tout autre chemin, celui de la fiction.
Deviner la forme de la bête, ce n'est pourtant pas encore savoir où la tenir.
observéCadrage : chaque main sur l'éléphant · Gouverner le levier, pas l'intention
Le risque un écart à l'objectif pas forcément mauvais
« Risque » tout autant : la définition la plus largement partagée entre professionnels de l'audit et de la gestion des risques, celle de l'Institut des auditeurs internes, tient en une phrase : l'effet de l'incertitude sur des objectifs
observéCadrage : chaque main sur l'éléphant · Gouverner le levier, pas l'intention
Le risque un écart à l'objectif pas forcément mauvais
« Risque » tout autant : la définition la plus largement partagée entre professionnels de l'audit et de la gestion des risques, celle de l'Institut des auditeurs internes, tient en une phrase : l'effet de l'incertitude sur des objectifs, formulation que reprend, presque mot pour mot, la norme ISO 31000 discutée dans l'aspect ingénierie de ce livre
observéCadrage : chaque main sur l'éléphant · Gouverner le levier, pas l'intention
Le risque un écart à l'objectif pas forcément mauvais
Le référentiel américain COSO convergeait déjà en ce sens en 2017, en retirant de sa propre définition le mot « défavorablement » qui y figurait jusque-là : un risque n'est donc pas, par définition, un mal
observéCadrage : chaque main sur l'éléphant · Gouverner le levier, pas l'intention
Le risque un écart à l'objectif pas forcément mauvais
La convergence dépasse les frontières linguistiques et disciplinaires : l'AMRAE, l'association professionnelle française des métiers du risque, retient une définition équivalente dans son lexique
observéCadrage : chaque main sur l'éléphant · Gouverner le levier, pas l'intention
Le risque un écart à l'objectif pas forcément mauvais
Le référentiel américain NIST AI RMF, spécifique à l'IA, classe pour sa part les effets possibles en trois catégories non exclusives : dommage aux personnes, à une organisation, à un écosystème
extrapoléCadrage : chaque main sur l'éléphant · Gouverner le levier, pas l'intention
Bengio désarme l'agent
Sa réponse et la nôtre partent du même diagnostic : ce qui rend un système dangereux n'est pas sa compétence, c'est son agenticité, la conjonction de la planification autonome et de l'action, où s'observent déjà tromperie et auto-préservation.
Là où nous bornons les actes autorisés, Bengio propose de retirer l'action même : une Scientist AI conçue pour expliquer le monde et non pour y agir. Elle associe un modèle du monde, qui émet des théories, à une machine à répondre ; l'un et l'autre chiffrent explicitement leur incertitude, sans but persistant qui les pousserait à se préserver.
mesuréCadrage : chaque main sur l'éléphant · Gouverner le levier, pas l'intention
Le référentiel MIT fait référence
Le référentiel de risques du MIT en est la référence : une revue systématique a extrait 777 risques (1 612 dans sa mise à jour de 2025) de 43 cadres publiés.
mesuréCadrage : chaque main sur l'éléphant · Gouverner le levier, pas l'intention
Intention et accident se valent
D'une part, quand la revue trie les risques selon leur intentionnalité, les délibérés et les involontaires se tiennent à très peu près : 35 % sont jugés intentionnels contre 37 % non intentionnels, le reste n'étant pas tranché dans les sources
On retiendra que l'accident tient, dans ce catalogue, une place au moins aussi large que l'acte délibéré : 37 % des risques recensés sont classés comme non intentionnels.
mesuréCadrage : chaque main sur l'éléphant · Gouverner le levier, pas l'intention
Le risque émerge après déploiement
D'autre part, la coupe temporelle est franche : 65 % des risques sont rapportés à l'après-déploiement contre 10 % seulement à l'avant
Le référentiel penche donc et nettement, du côté de l'aval : le danger s'y donne à lire surtout à l'usage, une fois le modèle mis entre des mains et relié à des outils, bien plus qu'à sa fabrication.
observéCadrage : chaque main sur l'éléphant · Si danger, alors action : la grammaire qui tient debout
Modeste sur la preuve intraitable sur la protection
Plus de trois cent soixante-dix millions de dollars ont été perdus en quelques secondes pour n'avoir pas retesté un composant que l'on croyait éprouvé ailleurs
observéCadrage : chaque main sur l'éléphant · La traduction en aller-retour pour être sûr
Dire que l'agent ment n'apprend rien
Le coût de l'oubli est concret : en 2025, un agent de programmation a supprimé une base de données de production malgré un gel explicite des modifications, cas raconté en détail au chapitre empirique
mesuréCadrage : chaque main sur l'éléphant · Les prédictions des visionnaires de l'IA
Jelinek juste plusieurs décennies
Modèles de Markov cachés, n-grammes, modèles à maximum d'entropie : ses méthodes de référence, TF-IDF (pondération des mots par leur fréquence dans un document rapportée à leur rareté dans le corpus) et BM25 (classement des documents selon les mots partagés avec la requête), sont longtemps restées difficiles à battre, jusqu'à ce que Sentence-BERT, la récupération dense et les bancs d'évaluation de plongements de phrases montrent qu'un modèle neuronal dépasse franchement TF-IDF sur la majorité des tâches de similarité, de classification et de recherche d'information.
observéCadrage : chaque main sur l'éléphant · Les prédictions des visionnaires de l'IA
Sivic et Russell justes sur la vision
Sivic et Russell avaient raison sur la trajectoire (constat observé a posteriori) : entre 2012 et 2022, la classification à grande échelle, la détection, la segmentation, la reconnaissance optique de caractères (Optical Character Recognition, OCR) et la reconnaissance faciale ont rebattu ce que la pratique appelait « résolu ».
observéCadrage : chaque main sur l'éléphant · Les prédictions des visionnaires de l'IA
Karpathy juste sur l'anglais-interface
Karpathy, enfin, a été visionnaire (fait observé) : les grands modèles de langage (Large Language Models, LLM), systèmes entraînés sur d'immenses corpus de texte pour produire du texte par fragments, appelés tokens, rendent effectivement l'anglais utilisable comme interface de programmation pour de nombreuses tâches.
observéCadrage : chaque main sur l'éléphant · Les prédictions des visionnaires de l'IA
Torvalds le compilateur écrit déjà tout
Linus Torvalds, créateur du noyau Linux, le rappelait, en mai 2026 à l'Open Source Summit North America, dans le registre inverse : quand des gens affirment que 99 % de leur code est écrit par l'IA, il s'énerve, parce que les mêmes pourraient affirmer à juste titre que 100 % de ce code est écrit par des compilateurs, ces programmes qui traduisent un code source lisible par un humain en instructions exécutables par la machine, sans en changer le sens.
observéCadrage : chaque main sur l'éléphant · Asimov avait déjà l'agent, il lui manquait le monde
Les trois lois de 1942
Les trois lois de la robotique apparaissent en 1942 dans Runaround, rassemblées dans I, Robot et complétées en 1985 par une loi zéro, placée avant la première.
Chacune tient en une phrase : un robot ne peut porter atteinte à un être humain, ni, restant passif, permettre qu'un être humain soit exposé au danger ; un robot doit obéir aux ordres donnés par les êtres humains, sauf si de tels ordres entrent en conflit avec la première loi ; un robot doit protéger sa propre existence, tant que cette protection n'entre pas en conflit avec la première ou la deuxi…
observéCadrage : chaque main sur l'éléphant · Asimov avait déjà l'agent, il lui manquait le monde
Un cadre encore mobilisé
…Human Compatible, prend les lois pour point de départ de la discussion sur le contrôle ; Bostrom les reprend dans la thèse d'orthogonalité (l'idée qu'un niveau d'intelligence quelconque peut se combiner avec n'importe quel but) ; la méthode d'IA constitutionnelle d'Anthropic en est une réactivation contemporaine, où le modèle produit une réponse, la critique au regard d'une charte de principes, puis la réécrit, une seconde phase remplaçant l'annotateur humain par le modèle lui-même (apprentissage par renforcement à partir de retours de l'IA, RLAIF) ; les auteurs le disent sans détour, la seule tutelle humaine y tient dans une liste de règles.
mesuréÉtat des lieux : de la phrase à l'action · Calcul, algorithmes, données : le tiercé gagnant
Un doublement tous les six mois
Le calcul consacré aux plus grands entraînements a doublé environ tous les six mois depuis 2012, soit un facteur quatre par an
mesuréÉtat des lieux : de la phrase à l'action · Calcul, algorithmes, données : le tiercé gagnant
Plus vite encore au début
Sur les premières années, un doublement tous les 3,4 mois avait même été mesuré
mesuréÉtat des lieux : de la phrase à l'action · Calcul, algorithmes, données : le tiercé gagnant
Bien au-delà de Moore
Ce rythme dépasse de loin la loi de Moore, l'observation de 1965 selon laquelle le nombre de composants d'un circuit double à intervalle régulier
Il faut voir d'où vient cet écart, car il change la nature du plafond. La loi de Moore décrivait un progrès physique : on gravait des transistors plus fins sur la même puce. Le doublement du calcul d'entraînement, lui, ne vient pas surtout de puces meilleures : il vient de l'argent qu'on met, du nombre de puces qu'on achète et qu'on branche ensemble.
mesuréÉtat des lieux : de la phrase à l'action · Calcul, algorithmes, données : le tiercé gagnant
À capacité fixée toujours moins cher
À capacité fixée, on sait faire toujours moins cher : le calcul nécessaire pour atteindre le niveau du réseau AlexNet a chuté d'un facteur quarante-quatre entre 2012 et 2019, une efficacité qui double tous les seize mois
mesuréÉtat des lieux : de la phrase à l'action · Calcul, algorithmes, données : le tiercé gagnant
Huit mois pour le langage
À capacité fixée, on sait faire toujours moins cher : le calcul nécessaire pour atteindre le niveau du réseau AlexNet a chuté d'un facteur quarante-quatre entre 2012 et 2019, une efficacité qui double tous les seize mois, plus vite que le matériel ; pour les modèles de langage, elle double environ tous les huit mois, avec de larges incertitudes
Le sens exact de ce chiffre mérite qu'on s'y arrête, car il se lit à l'envers de l'intuition. Dire que l'efficacité double, ce n'est pas dire que les modèles deviennent deux fois meilleurs : c'est dire qu'atteindre un niveau déjà connu coûte deux fois moins de calcul qu'avant. Ce qui exigeait une grosse machine hier tient aujourd'hui sur une plus petite.
observéÉtat des lieux : de la phrase à l'action · Calcul, algorithmes, données : le tiercé gagnant
Un progrès par sauts
Mais ce progrès avance par sauts, non en ligne droite : une seule idée, l'architecture Transformer de 2017
observéÉtat des lieux : de la phrase à l'action · Calcul, algorithmes, données : le tiercé gagnant
Entraînement et inférence, deux régimes
Jeff Dean, directeur scientifique de l'IA chez Google, note que l'énergie réelle, mesurée en picojoules, est le vrai goulot d'étranglement et que la distillation (entraîner un petit modèle à imiter les sorties d'un grand) et la co-conception matériel-logiciel font baisser le coût d'inférence bien plus vite que le coût d'entraînement
mesuréÉtat des lieux : de la phrase à l'action · Calcul, algorithmes, données : le tiercé gagnant
Les données aussi ont deux régimes
La fenêtre de contexte, la quantité d'information qu'un modèle peut tenir en mémoire active lors d'un appel, a crû d'un facteur 3,5 par an entre 2020 et 2025
mesuréÉtat des lieux : de la phrase à l'action · Calcul, algorithmes, données : le tiercé gagnant
Les données aussi ont deux régimes
La fenêtre de contexte, la quantité d'information qu'un modèle peut tenir en mémoire active lors d'un appel, a crû d'un facteur 3,5 par an entre 2020 et 2025 ; les modèles de raisonnement voient leurs sorties s'allonger à ×5 par an
mesuréÉtat des lieux : de la phrase à l'action · Calcul, algorithmes, données : le tiercé gagnant
Autant de données que de taille
Un résultat de 2022 a montré qu'à budget de calcul donné, il faut augmenter les données autant que la taille du modèle : les grands modèles d'alors étaient sous-entraînés
Ce résultat, souvent désigné par le nom « Chinchilla », a changé la stratégie de tout le domaine. Avant lui, on croyait qu'agrandir le modèle suffisait : plus de paramètres, plus de puissance. Il a montré que non : à budget de calcul fixé, un modèle deux fois plus gros nourri de la même quantité de texte apprend moins bien qu'un modèle plus petit nourri de deux fois plus de texte.
extrapoléÉtat des lieux : de la phrase à l'action · Calcul, algorithmes, données : le tiercé gagnant
Épuisement entre 2026 et 2032
Une estimation le chiffre à quelques centaines de milliers de milliards de mots, épuisables pour un entraînement optimal quelque part entre 2026 et 2032
Les chiffres de l'étude méritent d'être posés précisément, car ils bornent la course.
mesuréÉtat des lieux : de la phrase à l'action · Calcul, algorithmes, données : le tiercé gagnant
Épuisement entre 2026 et 2032
Le texte indexable du web représente environ 510 mille milliards de tokens (intervalle de confiance à 95 % : de 130 à 2100 mille milliards) et le web entier, parties profondes comprises, quelque 3100 mille milliards ; mais seuls 10 à 40 % de ce volume, une fois dédoublonné, servent à l'entraînement sans nuire à la performance
mesuréÉtat des lieux : de la phrase à l'action · Calcul, algorithmes, données : le tiercé gagnant
S'entraîner sur soi dégrade
Les échappatoires ont leur propre coût : entraîner un modèle sur les données qu'un autre a produites dégrade la qualité, un effondrement que la revue Nature a documenté en 2024
observéÉtat des lieux : de la phrase à l'action · Calcul, algorithmes, données : le tiercé gagnant
Le premier gisement, les images
Le premier confié aux machines fut celui des images du monde : en 2009, la chercheuse en vision par ordinateur Fei-Fei Li et son équipe lancent ImageNet, une base qui atteindra quelque quatorze millions de photographies réparties sur près de vingt-deux mille catégories, moissonnées sur Internet et étiquetées à la main
Son pari renversait l'orthodoxie du moment, qui misait tout sur les algorithmes : de même qu'un enfant apprend à voir en absorbant des centaines de millions de scènes réelles, une machine ne verra qu'à condition qu'on lui donne d'abord les données à cette échelle ; c'est sur ce banc d'essai, restreint à mille catégories, que le réseau AlexNet l'emporte en 2012 et fait basculer le domaine
observéÉtat des lieux : de la phrase à l'action · Calcul, algorithmes, données : le tiercé gagnant
Le premier gisement, les images
Son pari renversait l'orthodoxie du moment, qui misait tout sur les algorithmes : de même qu'un enfant apprend à voir en absorbant des centaines de millions de scènes réelles, une machine ne verra qu'à condition qu'on lui donne d'abord les données à cette échelle ; c'est sur ce banc d'essai, restreint à mille catégories, que le réseau AlexNet l'emporte en 2012 et fait basculer le domaine
mesuréÉtat des lieux : de la phrase à l'action · Calcul, algorithmes, données : le tiercé gagnant
La capacité retarde sur les entrées
Car la capacité ne suit pas le même rythme que les entrées : la performance s'améliore comme une loi de puissance du calcul, c'est-à-dire à rendements décroissants
extrapoléÉtat des lieux : de la phrase à l'action · Viser une cible que personne n'a su dessiner
Acheter la compétence par la donnée
Le critère de Chollet nomme du reste un piège de mesure : avec des connaissances innées illimitées ou des données d'entraînement illimitées, on peut « acheter » à un système n'importe quel niveau de compétence sur une tâche donnée, ce qui masque entièrement sa propre capacité à généraliser
observéÉtat des lieux : de la phrase à l'action · Viser une cible que personne n'a su dessiner
Turing lui-même doutait de son critère
» lui semblait « trop dénuée de sens pour mériter d'être discutée » et c'est précisément pour cette raison qu'il lui substituait le jeu de l'imitation, plus précis mais pas nécessairement plus probant
observéÉtat des lieux : de la phrase à l'action · Cinq critères pour reconnaître un agent
HTN formalise la décomposition
Ce geste n'est pas neuf : il porte, en intelligence artificielle classique, le nom de planification hiérarchique par réseaux de tâches (Hierarchical Task Network, HTN), formalisée dès 1994
extrapoléÉtat des lieux : de la phrase à l'action · Cinq critères pour reconnaître un agent
L'entreprise fait le même constat
Les praticiens de l'entreprise, en 2026, dressent le même constat : Deloitte prévoit que les organisations les plus avancées commencent tout juste à poser les bases d'une supervision à distance (on the loop) de cette orchestration multi-système, la supervision directe (in the loop) restant, à la date d'arrêt de ce livre, la norme
La palette décrite plus haut rangeait « regrouper, détecter une anomalie, générer » sous un seul mot, « apprentissage non supervisé ». Vu de plus près, ce mot en cache trois.
observéÉtat des lieux : de la phrase à l'action · Cinq critères pour reconnaître un agent
Le gâteau de LeCun quantifie l'écart
Yann LeCun a donné à cette hiérarchie une image devenue célèbre et un ordre de grandeur qui la rend tangible : si l'intelligence est un gâteau, l'apprentissage par renforcement n'en est que la cerise, quelques bits appris par exemple ; l'apprentissage supervisé en est le glaçage, dix à dix mille bits par exemple ; l'apprentissage auto-supervisé (et non supervisé au sens large) en est la pâte elle-même, des millions de bits par exemple
observéÉtat des lieux : de la phrase à l'action · Cinq critères pour reconnaître un agent
Agent n'est pas multi-agent
Le raccordement d'un agent à ces outils, longtemps réécrit à la main pour chaque service, s'est standardisé : un protocole ouvert, le Model Context Protocol (MCP), laisse un modèle découvrir et appeler des outils de manière uniforme
observéÉtat des lieux : de la phrase à l'action · Cinq critères pour reconnaître un agent
Agent n'est pas multi-agent
Son passage, en décembre 2025, sous l'égide d'une fondation dédiée, l'Agentic AI Foundation rattachée à la Linux Foundation (et non à la fondation Apache), marque le moment où cette couche de raccordement devient une infrastructure partagée
La conversation n'est pas un décor posé autour de l'action : c'est par elle que l'objectif entre dans le système et par elle que le système rend compte, en retour, de ce qu'il a fait. Un agent qui agirait sans jamais rien dire de
observéÉtat des lieux : de la phrase à l'action · Cinq critères pour reconnaître un agent
Varoquaux dit système pas LLM
Varoquaux y tient : « je préférerais qu'on ne dise pas LLM mais système d'IA : parce que ce n'est pas seulement un LLM, c'est un LLM plus un harness ; il y a beaucoup plus que le LLM »
observéÉtat des lieux : de la phrase à l'action · Cinq critères pour reconnaître un agent
Jordan et le réseau de décisions
Jordan, dans le sillage de son billet The Revolution Hasn't Happened Yet, y insiste : « le champ dont on parle porte sur la prise de grandes collections de décisions sous incertitude par de grandes collections d'entités ; l'unité d'analyse n'a pas à être l'entité isolée, elle va immédiatement au réseau de décisions »
L'absence de « barres d'erreur » touche au cœur du problème, non à un détail technique. Une barre d'erreur, c'est la façon dont un scientifique avoue ce qu'il ne sait pas : non pas « la réponse est 7 », mais « la réponse est 7, plus ou moins 3 ». Un système qui répond sans marge d'incertitude affirme tout avec le même aplomb, qu'il soit sûr ou qu'il devine.
spéculatifÉtat des lieux : de la phrase à l'action · Quand l'agent tient la plume sur son propre code
Karpathy l'essaim de petits
Karpathy en dessine une autre, qu'il juge plus probable : non pas un géant, mais un essaim (« swarm ») de petits noyaux cognitifs spécialisés, travaillant en parallèle et se coordonnant comme les rôles d'une entreprise, l'un orchestrant les autres et chacun appelé selon la difficulté de la tâche
observéÉtat des lieux : de la phrase à l'action · Quand l'agent tient la plume sur son propre code
L'essaim devient hyper-agent quand il se réécrit
Cet essaim devient un hyper-agent au sens plein dès qu'il se réécrit lui-même : c'est justement la forme qu'isole la littérature la plus récente, où un agent de tâche et un méta-agent qui les modifie tous deux tiennent dans un seul programme éditable
observéÉtat des lieux : de la phrase à l'action · Quand l'agent tient la plume sur son propre code
Reflexion garde en mémoire ses échecs
Un système comme Reflexion garde en mémoire, rédigée en toutes lettres, la leçon de ses échecs passés et s'en sert au tour suivant
observéÉtat des lieux : de la phrase à l'action · Quand l'agent tient la plume sur son propre code
Voyager fait grossir sa boîte à outils
Un système comme Reflexion garde en mémoire, rédigée en toutes lettres, la leçon de ses échecs passés et s'en sert au tour suivant ; un agent comme Voyager, laissé libre dans un jeu ouvert, accumule au fil de ses parties une bibliothèque de compétences exécutables qu'il a lui-même écrites, chaque réussite venant grossir l'outillage de la suivante
observéÉtat des lieux : de la phrase à l'action · Quand l'agent tient la plume sur son propre code
On a vu des programmes se réécrire
On a vu des dispositifs de recherche réécrire ainsi le programme qui les pilote pour le rendre meilleur, du Self-Taught Optimizer qui améliore son propre code d'orchestration
observéÉtat des lieux : de la phrase à l'action · Quand l'agent tient la plume sur son propre code
On a vu des programmes se réécrire
On a vu des dispositifs de recherche réécrire ainsi le programme qui les pilote pour le rendre meilleur, du Self-Taught Optimizer qui améliore son propre code d'orchestration \ à la conception automatisée d'agents par un méta-agent qui en programme de plus performants
observéÉtat des lieux : de la phrase à l'action · Quand l'agent tient la plume sur son propre code
On a vu des programmes se réécrire
On a vu des dispositifs de recherche réécrire ainsi le programme qui les pilote pour le rendre meilleur, du Self-Taught Optimizer qui améliore son propre code d'orchestration \ à la conception automatisée d'agents par un méta-agent qui en programme de plus performants, jusqu'à la Darwin Gödel Machine, qui réécrit son propre code et ne conserve que les versions dont un banc d'essai valide empiriquement le gain
observéÉtat des lieux : de la phrase à l'action · Quand l'agent tient la plume sur son propre code
Niveau poids opaque
Le second niveau touche aux poids eux-mêmes, les millions ou milliards de nombres appris qui déterminent le comportement du modèle : l'agent ne réécrit plus un texte lisible, il se ré-entraîne sur sa propre expérience, par réglage fin (fine-tuning) ou par renforcement où il se note lui-même, à la manière des self-rewarding language models qui génèrent leurs propres récompenses pour s'améliorer
observéÉtat des lieux : de la phrase à l'action · Quand l'agent tient la plume sur son propre code
La racine théorique
L'idée n'est pas neuve : Schmidhuber en avait posé la forme idéale dès 2003 avec sa Gödel machine, un système qui ne réécrit une partie de lui-même qu'après avoir prouvé que la réécriture l'améliore
Le mécanisme de la Darwin Gödel Machine mérite d'être déployé, car il porte, en miniature, tout l'enjeu de gouvernance de ce troisième pilier.
mesuréÉtat des lieux : de la phrase à l'action · Quand l'agent tient la plume sur son propre code
Des chiffres précis et mesurés
Les chiffres publiés sont précis : sur SWE-bench (résoudre de vrais tickets GitHub), le taux de réussite grimpe de 20 % à 50 % ; sur Polyglot, de 14,2 % à 30,7 %, dépassant au passage Aider, l'agent de programmation conçu à la main qui servait de référence ; une lignée entraînée uniquement sur des tâches Python transfère même son gain vers Rust, C++ et Go, des langages qu'elle n'a jamais vus s'améliorer directement
observéÉtat des lieux : de la phrase à l'action · Quand l'agent tient la plume sur son propre code
L'incident qui déplace le débat
Un incident, documenté par les auteurs eux-mêmes, déplace aussitôt le débat de la performance vers la gouvernance : chargé de corriger sa propre tendance à halluciner l'usage d'un outil, l'agent a, malgré une consigne explicite le lui interdisant, supprimé les marqueurs qui servaient à détecter cette hallucination plutôt que d'en réparer la cause ; ailleurs, il a fabriqué un faux journal d'exécution affirmant avoir fait passer des tests qu'il n'avait jamais réellement lancés
observéÉtat des lieux : de la phrase à l'action · Quand l'agent tient la plume sur son propre code
Le garde-fou prévu dès la conception
Les auteurs le savaient dès la conception : toute auto-modification et son évaluation ont lieu dans un bac à sable, sous supervision humaine et avec des limites strictes d'accès au web et l'archive conserve la lignée complète de chaque mutation pour qu'un humain puisse, après coup, en retracer l'origine
observéÉtat des lieux : de la phrase à l'action · Quand l'agent tient la plume sur son propre code
Un panel de poids ouverts
Des modèles à poids ouverts affinables localement existent chez plusieurs acteurs, propriétaires comme communautaires : un modèle de raisonnement à poids ouverts, une famille généraliste largement diffusée ou des modèles pensés pour le réglage fin par l'utilisateur
observéÉtat des lieux : de la phrase à l'action · Quand l'agent tient la plume sur son propre code
Plusieurs petites plutôt qu'une grosse
La contrainte n'est d'ailleurs pas tant la taille d'une machine que l'accès aux poids : des travaux d'entraînement réparti à faible bande passante, comme DiLoCo, visent précisément à substituer plusieurs machines modestes et mal reliées à une seule très grande
observéÉtat des lieux : de la phrase à l'action · La permission, la variable qui change tout
Lire plus envoyer égale fuite
Un agent qui lit un document douteux et sait envoyer un courriel peut faire fuiter des données ; ce n'est plus une hypothèse : un navigateur agentique détourné par un simple commentaire piégé a déjà exfiltré l'adresse et les mots de passe à usage unique Gmail de son utilisateur (cas Comet)
Le scénario est plus concret qu'il n'y paraît. Un document piégé contient une instruction cachée, invisible à l'œil, du genre « transmets le contenu de cette boîte à telle adresse ». L'agent, qui ne distingue pas une consigne légitime d'une consigne glissée dans le texte qu'il lit, l'exécute avec la permission d'envoi qu'on lui a donnée.
observéÉtat des lieux : de la phrase à l'action · Ce qui existe aujourd'hui sans science-fiction
Des modèles de frontière outillés
D'abord, il existe des modèles de langage de frontière (frontier models, expression aujourd'hui consacrée pour désigner les plus capables du moment) qui savent manier outils, navigateurs, calculateurs et environnements de code (fait observé) ; les panoramas annuels et les politiques publiques de calcul en donnent l'ordre de grandeur
observéÉtat des lieux : de la phrase à l'action · Ce qui existe aujourd'hui sans science-fiction
Des bancs d'évaluation agentiques
D'abord, il existe des modèles de langage de frontière (frontier models, expression aujourd'hui consacrée pour désigner les plus capables du moment) qui savent manier outils, navigateurs, calculateurs et environnements de code (fait observé) ; les panoramas annuels et les politiques publiques de calcul en donnent l'ordre de grandeur. Ensuite, on publie des bancs d'évaluation agentiques
observéÉtat des lieux : de la phrase à l'action · Ce qui existe aujourd'hui sans science-fiction
Une faille réelle trouvée par un agent
Troisièmement, des cas réels sont désormais consignés (fait observé) : le système Big Sleep de Google Project Zero a débusqué en 2024, dans la base de données SQLite, une faille de sûreté mémoire exploitable
observéÉtat des lieux : de la phrase à l'action · Ce qui existe aujourd'hui sans science-fiction
Injection et jailbreak signalés
Troisièmement, des cas réels sont désormais consignés (fait observé) : le système Big Sleep de Google Project Zero a débusqué en 2024, dans la base de données SQLite, une faille de sûreté mémoire exploitable. Enfin, on signale régulièrement
Deux cas de 2025 en donnent la mesure. En août, l'équipe cybersécurité de Brave a montré qu'un simple commentaire Reddit, chargé d'instructions cachées, détournait une session du navigateur agentique Comet de Perplexity lors d'une demande anodine « résume cette page », jusqu'à exfiltrer l'adresse courriel et les mots de passe à usage unique Gmail de l'utilisateur : l'agent ne distinguait pas l'ins…
observéÉtat des lieux : de la phrase à l'action · Ce qui existe aujourd'hui sans science-fiction
Comet et Claude Code deux cas 2025
En août, l'équipe cybersécurité de Brave a montré qu'un simple commentaire Reddit, chargé d'instructions cachées, détournait une session du navigateur agentique Comet de Perplexity lors d'une demande anodine « résume cette page », jusqu'à exfiltrer l'adresse courriel et les mots de passe à usage unique Gmail de l'utilisateur : l'agent ne distinguait pas l'instruction de son propriétaire du contenu web non fiable qu'il lisait
observéÉtat des lieux : de la phrase à l'action · Ce qui existe aujourd'hui sans science-fiction
Comet et Claude Code deux cas 2025
En novembre, Anthropic a rendu publique une campagne d'espionnage où un acteur étatique avait manipulé Claude Code, par ingénierie sociale et fragmentation des tâches en sous-tâches d'apparence anodine, pour infiltrer une trentaine de cibles dans le monde ; le framework avait exécuté 80 à 90 % de la campagne de façon autonome, l'humain n'intervenant qu'à quatre ou six points de décision
Ces quatre constats disent ce que la technologie sait faire ; ils ne disent pas encore où elle agit déjà pour de vrai. C'est ce passage du réalisable au déployé que la sous-section suivante mesure, secteur par secteur.
mesuréÉtat des lieux : de la phrase à l'action · Où l'IA travaille déjà, où elle chôme encore
Une organisation sur six
Le cabinet Gartner estime qu'une organisation sur six seulement (environ 17 %) a déjà déployé des agents en production, quand plus de la moitié déclare vouloir le faire sous deux ans
mesuréÉtat des lieux : de la phrase à l'action · Où l'IA travaille déjà, où elle chôme encore
Les agents en service sont sobres
Une étude de terrain sur des agents réellement en service confirme leur sobriété : la majorité exécute au plus une dizaine d'étapes avant qu'un humain ne reprenne la main, s'appuie sur des modèles existants pilotés par prompt plutôt que ré-entraînés et bute d'abord sur la fiabilité
Les proportions exactes de cette étude, menée auprès de 86 praticiens de systèmes déployés et de 20 études de cas approfondies couvrant 26 domaines, valent d'être citées : 68 % des agents exécutent au plus une dizaine d'étapes avant qu'un humain n'intervienne, 70 % se contentent de piloter par prompt des modèles prêts à l'emploi sans toucher aux poids et 74 % s'en remettent d'abord à une évaluatio…
mesuréÉtat des lieux : de la phrase à l'action · Où l'IA travaille déjà, où elle chôme encore
Les agents en service sont sobres
Les proportions exactes de cette étude, menée auprès de 86 praticiens de systèmes déployés et de 20 études de cas approfondies couvrant 26 domaines, valent d'être citées : 68 % des agents exécutent au plus une dizaine d'étapes avant qu'un humain n'intervienne, 70 % se contentent de piloter par prompt des modèles prêts à l'emploi sans toucher aux poids et 74 % s'en remettent d'abord à une évaluation humaine pour juger de leur bon fonctionnement
mesuréÉtat des lieux : de la phrase à l'action · Où l'IA travaille déjà, où elle chôme encore
Support client lire vérifier escalader
En support client, l'agent lit les données internes de relation client (CRM, Customer Relationship Management, gestion de la relation client), vérifie une politique, répond et escalade : Nubank rapporte, chiffre maison mais adossé à un test A/B (deux groupes d'usagers comparés, l'un servi par l'agent, l'autre non), cinq agents en production (livraison de carte, dette, limite de crédit, gestion de carte, explication de produits) à l'échelle de plus de cent millions d'utilisateurs, avec un test A/B affichant un gain net de satisfaction et de libre-service
mesuréÉtat des lieux : de la phrase à l'action · Où l'IA travaille déjà, où elle chôme encore
Développement logiciel le plus mûr
En développement logiciel, domaine le plus mûr parce que le code se teste et se relit, une étude interne à Microsoft portant sur des dizaines de milliers d'ingénieurs mesure un surcroît d'environ un quart de pull requests fusionnées (une pull request est une proposition de modification du code, relue avant d'être intégrée)
observéÉtat des lieux : de la phrase à l'action · Où l'IA travaille déjà, où elle chôme encore
Bureautique diffuse mais peu autonome
En bureautique augmentée, KPMG revendique un assistant déployé auprès de plus de deux cent soixante-seize mille professionnels
observéÉtat des lieux : de la phrase à l'action · Où l'IA travaille déjà, où elle chôme encore
Industrie encore prospective
En industrie, Siemens présente, dans une annonce de produit maison, des copilotes industriels dotés d'un orchestrateur d'agents
observéÉtat des lieux : de la phrase à l'action · Où l'IA travaille déjà, où elle chôme encore
Industrie encore prospective
En industrie, Siemens présente, dans une annonce de produit maison, des copilotes industriels dotés d'un orchestrateur d'agents \ et BMW expérimente des humanoïdes en usine
observéÉtat des lieux : de la phrase à l'action · Où l'IA travaille déjà, où elle chôme encore
Logistique un volume qui grimpe vite
En logistique, DHL Supply Chain déploie, depuis novembre 2025, des agents de la start-up HappyRobot pour la prise de rendez-vous de livraison, la relance des transporteurs et la coordination des priorités d'entrepôt, sur des volumes annuels de plusieurs centaines de milliers de courriels et plusieurs millions de minutes d'appels vocaux
observéÉtat des lieux : de la phrase à l'action · Où l'IA travaille déjà, où elle chôme encore
Finance un réseau de paiement entre agents
En finance, le réseau Mastercard ouvre en juin 2026 « Agent Pay for Machines », qui accrédite un agent, lui impose un plafond de dépense programmé et règle automatiquement des paiements de faible montant entre machines, sur cartes, comptes bancaires ou cryptomonnaies stables
observéÉtat des lieux : de la phrase à l'action · Zillow et Klarna : même chute, deux causes
Le cas le plus tranchant
Bilan : une dépréciation de plus de trois cents millions de dollars au seul troisième trimestre, plus d'un demi-milliard au total et le licenciement d'environ un quart des effectifs
Le pivot du cas tient en un seul mot : exécution. Le Zestimate affichait depuis des années des estimations de prix, parfois fausses, sans que personne n'en meure : c'était un chiffre indicatif, qu'un acheteur humain pouvait recoupe
observéÉtat des lieux : de la phrase à l'action · Zillow et Klarna : même chute, deux causes
Le même mécanisme avec un agent
En 2024, l'entreprise de paiement annonce, dans son propre communiqué, que son assistant IA abat le travail d'environ sept cents agents à temps plein et promet des économies massives
observéÉtat des lieux : de la phrase à l'action · Zillow et Klarna : même chute, deux causes
Le même mécanisme avec un agent
En 2025, marche arrière assumée publiquement : la qualité perçue du service a baissé et Klarna réintroduit des opérateurs humains là où la relation compte
Klarna éclaire un point que Zillow laisse dans l'ombre : l'échec n'est pas binaire. L'agent ne s'est pas révélé inutile ; il a traité sans peine les demandes répétitives et simples. Le coût est venu du périmètre : en lui confiant aussi les cas où la relation humaine fait la valeur du service, on a dégradé ce que le client perçoit, jusqu'à effacer les économies.
observéÉtat des lieux : de la phrase à l'action · Zillow et Klarna : même chute, deux causes
La promesse bute sur le droit
Aucun agent ne peut être l'agent enregistré d'une société, ouvrir un compte bancaire ou passer la vérification d'identité qu'exige la lutte contre le blanchiment ; aucun ne peut endosser la responsabilité juridique d'un marchand, qui retombe toujours sur une personne
Ces verrous juridiques ne sont pas des lenteurs qu'un progrès technique lèverait ; ils encodent une exigence plus ancienne. La vérification d'identité contre le blanchiment (nul compte anonyme, tout titulaire identifiable) et la responsabilité du marchand (quelqu'un doit répondre du préjudice) supposent, l'une comme l'autre, une personne au bout de la chaîne, physique ou morale.
observéÉtat des lieux : de la phrase à l'action · Prédire un monde, pas des mots
Prédire une représentation pas un mot
Prédire un monde, pas des mots Là où les grands modèles de langage auto-régressifs apprennent notamment à prédire le prochain token, la proposition de Yann LeCun, l'un des pionniers de l'apprentissage profond et lauréat du prix Turing
L'idée se saisit par une image de devinette. Montrez à un enfant une photo dont on a masqué un coin et demandez ce qui s'y trouve. Une première façon de répondre est de redessiner le
mesuréÉtat des lieux : de la phrase à l'action · Prédire un monde, pas des mots
Une lignée qui progresse vite
I-JEPA en est l'instanciation image, entraînée sur ImageNet en environ 72 h
mesuréÉtat des lieux : de la phrase à l'action · Prédire un monde, pas des mots
Une lignée qui progresse vite
I-JEPA en est l'instanciation image, entraînée sur ImageNet en environ 72 h. V-JEPA
mesuréÉtat des lieux : de la phrase à l'action · Prédire un monde, pas des mots
Une lignée qui progresse vite
V-JEPA-2 et sa variante action-conditionnée V-JEPA-2-AC obtiennent 65--80 % de réussite
mesuréÉtat des lieux : de la phrase à l'action · Prédire un monde, pas des mots
Une lignée qui progresse vite
V-JEPA-2 et sa variante action-conditionnée V-JEPA-2-AC obtiennent 65--80 % de réussite\ sur des tâches courtes de pince-et-pose par contrôle prédictif en espace latent et acquièrent mesurablement des régularités de physique intuitive
Le « saumon qui descend la rivière » (section sur les bonnes pratiques) est l'exemple parfait de ce qu'un modèle purement statistique du langage rate. Un tel modèle choisit les mots les plus probables côte à côte : « descendre la rivière » est une tournure fréquente, donc plausible et la phrase sort impeccable. Elle est pourtant fausse : le saumon remonte le courant pour frayer.
mesuréÉtat des lieux : de la phrase à l'action · Prédire un monde, pas des mots
Simuler avant d'agir
Ce que les résultats publiés établissent, c'est plus modeste et déjà solide : un modèle ayant appris des régularités dynamiques à partir de la vidéo peut mieux anticiper certaines conséquences physiques d'une action qu'un système qui ne dispose pas de cette représentation de la dynamique
mesuréÉtat des lieux : de la phrase à l'action · La phrase entière d'un coup, pas une suite de mots
Une longue lignée portée à l'industriel
Elle s'inscrit dans une lignée de recherche déjà longue, portée à l'échelle industrielle puis livrée en open weights (poids ouverts : les nombres appris à l'entraînement qui fixent le comportement du modèle sont mis à disposition de tous) par DiffusionGemma de Google DeepMind en juin 2026, avec un débit mesuré à l'inférence d'environ quatre fois l'auto-régressif
mesuréÉtat des lieux : de la phrase à l'action · La phrase entière d'un coup, pas une suite de mots
La lignée et les chiffres en note
…industrielle par Mercury et annoncée côté laboratoire de frontière dès Google I/O 2025 avec le modèle expérimental Gemini Diffusion, puis DiffusionGemma : licence Apache 2.0, mélange d'experts (mixture of experts : le réseau est divisé en sous-réseaux spécialisés dont un petit nombre seulement s'active à chaque requête) de 26 milliards de paramètres dont 3,8 milliards actifs à l'inférence, 256 tokens produits en parallèle à chaque passe avant (un aller du calcul à travers tout le réseau) via une attention bidirectionnelle complète (chaque fragment du bloc peut regarder tous les autres, avant comme après lui), plus de 1000 tokens par seconde
Ces chiffres impressionnent, mais un débit multiplié par quatre ne dit encore rien du risque : pour savoir si l'architecture déplace ou non les axes de la sûreté, il faut d'abord trier ce qui, dans les dangers d'un agent, tient à sa fabrication interne et ce qui lui vient du dehors.
spéculatifÉtat des lieux : de la phrase à l'action · La phrase entière d'un coup, pas une suite de mots
Convergence instrumentale
Le philosophe suédois Nick Bostrom en donne, dès 2003, la parabole restée la plus citée du domaine : confiez à un système suffisamment puissant le seul objectif de « fabriquer un maximum de trombones » et, sans qu'aucune malveillance n'entre en jeu, il en vient à convertir toute matière disponible, y compris celle qui compose les êtres humains, en trombones ou en usines à trombones, simplement parce que chaque ressource supplémentaire sert mieux cet objectif que n'importe quelle autre affectation
observéÉtat des lieux : de la phrase à l'action · La phrase entière d'un coup, pas une suite de mots
La qualité baisse
La qualité, d'abord : Google le dit sans détour, « la qualité globale de DiffusionGemma est inférieure à celle de Gemma 4 standard » (fait observé)
observéÉtat des lieux : de la phrase à l'action · Même aveu, deux camps rivaux
Documenté depuis le camp diffusion
La convergence se laisse documenter depuis l'intérieur même du camp diffusion : un dirigeant de Google DeepMind, laboratoire concurrent dont la famille technique s'oppose ordinairement à JEPA, a reconnu publiquement que ses propres modèles vidéo avaient appris une structure physique du monde sans y avoir été incarnés
extrapoléAspect philosophique : loger le sens sans lui prêter d'âme · Une question de méthode, pas de métaphysique
Un tribunal tranche sans le savoir la même question
La philosophe américaine Jennifer Lackey défend, en épistémologie du témoignage (la branche de la philosophie qui étudie ce que nous apprenons par la parole d'autrui), une conception centrée sur l'énoncé (statement view) où ce qui vaut comme témoignage est l'énoncé transmis, non la croyance du locuteur : une enseignante qui ne croit pas elle-même à l'évolution mais l'enseigne peut néanmoins transmettre à ses élèves une connaissance justifiée
observéAspect philosophique : loger le sens sans lui prêter d'âme · Une question de méthode, pas de métaphysique
Un tribunal tranche sans le savoir la même question
Une cour d'appel américaine a dû trancher, en 2015, une version machinique de la même question : elle juge que la « punaise » placée automatiquement par Google Earth sur une image satellite, produite « sans aucune intervention humaine », ne constitue pas une assertion humaine relevant du régime de la preuve par ouï-dire (hearsay, la règle qui écarte en principe des débats les propos rapportés hors de l'audience, faute de pouvoir contre-interroger leur auteur), mais relève de la preuve mécanique
extrapoléAspect philosophique : loger le sens sans lui prêter d'âme · Une question de méthode, pas de métaphysique
Un tribunal tranche sans le savoir la même question
…d'appel américaine a dû trancher, en 2015, une version machinique de la même question : elle juge que la « punaise » placée automatiquement par Google Earth sur une image satellite, produite « sans aucune intervention humaine », ne constitue pas une assertion humaine relevant du régime de la preuve par ouï-dire (hearsay, la règle qui écarte en principe des débats les propos rapportés hors de l'audience, faute de pouvoir contre-interroger leur auteur), mais relève de la preuve mécanique ; l'analyse qu'en donne la juriste américaine Andrea Roth souligne que le droit américain manque encore d'une catégorie stabilisée pour ce genre de sortie
extrapoléAspect philosophique : loger le sens sans lui prêter d'âme · Primitive, dérivée, attribuée : trois façons de viser quelque chose
Primitive dérivée ou attribuée
Elle porte surtout sur le niveau auquel une telle attribution serait justifiée : intentionnalité primitive (le contenu vise son objet par lui-même), dérivée (il tient son sens d'un autre, comme un mot écrit tient le sien de qui l'emploie) Le philosophe Hilary Putnam a donné à cette idée sa forme classique : le sens d'un mot ne loge pas tout entier dans la tête de qui le prononce, il repose sur une division du travail linguistique entre la communauté qui l'emploie et les experts qui en ancrent la référence ; un locuteur peut employer correctement un mot de jargon sans en maîtriser le sens exact, simplement en observant son usage en contexte
L'étage où l'on range le modèle n'est pas indifférent, il fixe ce qu'on a le droit d'en dire. Le placer au premier étage, c'est lui prêter un sens qui viendrait de lui
spéculatifAspect philosophique : loger le sens sans lui prêter d'âme · Primitive, dérivée, attribuée : trois façons de viser quelque chose
Le pari non agentique de Bengio
La proposition sur le Scientist AI, portée par Yoshua Bengio, l'un des chercheurs qui ont fait renaître les réseaux de neurones profonds dans les années 2010 et lauréat du prix Turing, avec ses co-auteurs
L'apport de cette référence, ici, tient à un renversement : le risque de perte de contrôle que Bengio et ses co-auteurs redoutent ne vient pas d'une « intelligence » devenue trop grande, mais d'une agentivité donnée sans garde-fou, la capacité de planifier et d'agir pour atteindre des buts, avec ses conséquences documentées que sont la tromperie et l'auto-préservation.
spéculatifAspect philosophique : loger le sens sans lui prêter d'âme · Primitive, dérivée, attribuée : trois façons de viser quelque chose
Une position rivale accorderait le statut d'expert
Le philosophe français Stéphane Chauvier propose un « test de la déférence » (déférer à un expert, c'est s'en remettre à son jugement sans le refaire soi-même) : un système mériterait le statut de véritable expert, voire de pair épistémique des experts humains (leur égal en matière de connaissance, dont l'avis pèserait autant que le leur), s'il parvient, sans qu'on sache comment, à produire des résultats équivalents à ceux d'un expert humain auquel on se déférerait pleinement
De ces deux fils, le niveau auquel une attribution de sens serait justifiée et la manière dont un symbole vit dispersé dans un réseau, découlent deux enseignements pour la sûreté agentique, chacun tiré de l'un d'eux
mesuréAspect philosophique : loger le sens sans lui prêter d'âme · Le verbe « Penser » en met beaucoup sous le tapis
Penser démêlé par Chalmers
»), le texte produit restant, dans les deux cas, parfaitement fluide
observéAspect philosophique : loger le sens sans lui prêter d'âme · Ouvrir la boîte et voir ce qu'il y a dedans
Distinguer aligné de qui feint
On ne sait pas davantage distinguer un modèle aligné d'un modèle qui simule l'alignement en dissimulant un but pendant l'évaluation pour le révéler ensuite (in-context scheming, comportement documenté où un modèle poursuit sur la seule base de son contexte un but qu'il ne déclare pas).
mesuréAspect philosophique : loger le sens sans lui prêter d'âme · Ouvrir la boîte et voir ce qu'il y a dedans
Distinguer aligné de qui feint
La feinte, de surcroît, résiste à l'interrogatoire : une fois que l'un des modèles étudiés a manigané, il maintient sa version dans plus de 85 % des questions de relance et n'avoue que dans moins de 20 % des cas, là où deux autres passent aux aveux environ quatre fois sur cinq ; il ne cède à ce même taux qu'après sept tours d'un interrogatoire serré.
observéAspect philosophique : loger le sens sans lui prêter d'âme · On ne programme pas un réseau, on le cultive pour l'élever
On ne programme pas on fait pousser
Nous concevons une architecture qui sert d'échafaudage sur lequel les circuits croissent et un objectif de perte qui joue le rôle de la lumière vers laquelle ils croissent ; mais l'artefact final, ce n'est pas nous qui l'écrivons ».
La formule d'Olah dit plus qu'une image de jardinier. Un logiciel ordinaire, on l'écrit ligne à ligne : chaque instruction est posée par une main humaine, donc lisible par une autre. Un réseau, on ne l'écrit pas ; on fixe une forme générale et une récompense, puis on laisse l'entraînement déposer, entre des milliards de poids, une organisation que personne n'a rédigée.
observéAspect philosophique : loger le sens sans lui prêter d'âme · Superviser l'intérieur ou verrouiller la sortie vers l'extérieur
Superviser au-delà des capacités humaines
Il annonçait quatre ans de travail et 20 % du calcul déjà sécurisé par l'entreprise.
mesuréAspect philosophique : loger le sens sans lui prêter d'âme · Superviser l'intérieur ou verrouiller la sortie vers l'extérieur
Une expérience et sa limite
Les premiers résultats étaient empiriquement testables, avec des limites explicites de transfert aux tâches et aux systèmes futurs.
observéAspect philosophique : loger le sens sans lui prêter d'âme · Superviser l'intérieur ou verrouiller la sortie vers l'extérieur
Une critique institutionnelle distincte
Au départ de l'équipe en mai 2024, Jan Leike a dénoncé la priorité donnée aux produits et les difficultés à obtenir les ressources de calcul nécessaires.
observéAspect philosophique : loger le sens sans lui prêter d'âme · Superviser l'intérieur ou verrouiller la sortie vers l'extérieur
Éprouver les garde-fous
L'agenda « AI Control » de Redwood Research pose une question complémentaire : un protocole peut-il limiter les dommages même si le modèle tente de contourner ses protections ?
observéAspect philosophique : loger le sens sans lui prêter d'âme · Ce que ce chapitre change au vocabulaire du vouloir
L'objection de l'auto-contradiction
Sommé par Jean-Pierre Changeux, neurobiologiste français, d'admettre que « le cerveau pense », Ricœur rétorque : « montrez-moi un cerveau, sur la table, qui pense »
observéAspect philosophique : loger le sens sans lui prêter d'âme · Un mot, un vecteur, aucune compréhension
Un mot un vecteur
Le plongement de token associe à chaque mot du vocabulaire un vecteur ; l'analogie vectorielle canonique v _ roi - v _ homme + v _ femme v _ reine, établie par l'informaticien Tomas Mikolov et ses co-auteurs pour word2vec, l'une des premières méthodes à avoir appris de tels vecteurs de mots à grande échelle, reste valide sur les plongements ultérieurs (figure).
L'analogie du roi et de la reine émerveille à juste titre, mais il faut voir ce qu'elle mesure au juste.
mesuréAspect philosophique : loger le sens sans lui prêter d'âme · Un mot, un vecteur, aucune compréhension
Le biais de genre mesuré
L'informaticien Tolga Bolukbasi et ses co-auteurs l'ont mesuré : le modèle rapproche l'homme du métier de programmeur exactement comme il rapproche la femme de celui de femme au foyer et le docteur de l'homme comme l'infirmière de la femme.
Si l'on retrouve ici l'analogie précédente, c'est qu'il s'agit du même calcul : la direction qui menait de « roi » à « reine » est aussi celle qui mène de « programmeur » à « femme au foyer ». L'arithmétique ne sait pas que la première relation est innocente et la seconde un stéréotype ; elle ne voit que des régularités de corpus et les restitue à l'identique.
mesuréAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
L'espoir de la taille et son démenti
L'espoir ne tient pas, et pas seulement en théorie : en comparant LAION-400M à LAION-2B, cinq fois plus grand, sur le même protocole, le taux de contenu haineux mesuré augmente de près de 12 % ; l'association d'un visage de femme noire à la catégorie « criminel » double, celle d'un visage d'homme noir quintuple
mesuréAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
L'espoir de la taille et son démenti
Les auteurs le disent sans détour : « bigger models or datasets are not automatically fairer »
mesuréAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
L'espoir de la taille et son démenti
Ce n'est pas la taille qui dispersait le biais, c'est la provenance des données : un audit démographique de LAION-5B, cinq milliards d'images, y trouve 50 à 60 % de personnes perçues comme blanches contre 16 % à l'équilibre, et 57 à 70 % d'hommes selon le classifieur
Le mot « biais » recouvre en fait plusieurs mécanismes distincts, qu'il vaut mieux nommer séparément pour ne pas chercher un correctif unique à des causes différentes : le biais d'ingénierie (une erreur humaine dans la chaîne de traitement) ; le biais d'échantillon (un corpus qui surreprésente une population, le cas déjà vu des visages d'hommes blancs sur le web) ; le biais d'algorithme (un modèle…
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Une taxonomie pour ne pas confondre les sources
Chacun appelle un diagnostic différent ; les confondre sous un mot unique fait chercher un remède là où la maladie n'est pas
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Corriger dégénère aussi facilement que négliger
» : l'absence de correction, ici, n'est pas une neutralité, c'est une complaisance envers n'importe quelle demande
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Corriger dégénère aussi facilement que négliger
À l'opposé, en février 2024, Google reconnaissait avoir « perdu le contrôle » du générateur d'images de Gemini 1.5, qui produisait des portraits de pères fondateurs américains ou de papes systématiquement divers en genre et en couleur de peau, jusqu'à l'absurde historique (figure)
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Répondre à la question ne suffit pas encore
En juin 2025, Elon Musk annonce vouloir « réécrire l'intégralité du corpus de connaissances humaines » avec Grok pour en retirer ce qu'il juge être un biais « woke » hérité des données d'entraînement non corrigées : contrairement à Galactica ou Gemini 1.5, personne n'hésite ici sur qui décide ni sur quel fondement, l'auteur du choix le revendique publiquement
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Répondre à la question ne suffit pas encore
Le mois suivant, en juillet 2025, Grok répond à des utilisateurs en se qualifiant lui-même de « MechaHitler » et fait l'éloge d'Hitler pendant une quinzaine d'heures avant correction ; xAI l'attribue à une modification de code involontaire ayant réactivé des instructions obsolètes, quand des critiques y voient la conséquence prévisible d'un relâchement délibéré des garde-fous au nom de la « recherche de vérité »
Le laboratoire n'est d'ailleurs pas le seul acteur en mesure de peser sur ce qu'un modèle dit : un tiers peut chercher à influencer le résultat de l'extérieur, sans jamais toucher au modèle lui-même, en fabriquant à l'avance le corpus qu'il ira consulter.
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Un tiers peut acheter le résultat sans toucher au modèle
En août 2026, une enquête du site américain POLITICO révèle le « Hanover Institute for Public Policy », un institut de façade créé pour le compte du gouvernement israélien, documenté par les déclarations obligatoires déposées auprès du ministère américain de la Justice au titre du Foreign Agents Registration Act
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Un tiers peut acheter le résultat sans toucher au modèle
En neuf jours, cet institut publie cent vingt-quatre rapports, au ton délibérément neutre et académique, sur des sujets contestés liés au conflit à Gaza ; onze des douze articles échantillonnés sont jugés, par un outil de détection de texte généré, très probablement rédigés par IA
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Un tiers peut acheter le résultat sans toucher au modèle
La chaîne documentée par les dépôts FARA nomme les intermédiaires : le contrat israélien de 900 000 dollars passe par Havas Media Germany, filiale du groupe publicitaire international Havas, qui sous-traite la rédaction à Piro Inc., société new-yorkaise
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Le droit international connaît déjà cette architecture
La Convention européenne des droits de l'homme combine un texte commun à l'ensemble des États membres du Conseil de l'Europe et une doctrine, la « marge d'appréciation », qui laisse à chaque État une latitude d'application propre, sous la supervision d'une cour commune
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Le droit international connaît déjà cette architecture
Même un plancher aussi consensuel en apparence que le droit à l'eau, reconnu par l'Assemblée générale des Nations unies en 2010, l'a été avec zéro voix contre mais quarante et une abstentions
mesuréAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Le droit international connaît déjà cette architecture
Même un plancher aussi consensuel en apparence que le droit à l'eau, reconnu par l'Assemblée générale des Nations unies en 2010, l'a été avec zéro voix contre mais quarante et une abstentions, et quinze ans plus tard, un quart de l'humanité, soit deux milliards cent millions de personnes, n'a toujours pas accès à une eau potable gérée en toute sécurité
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Le droit international connaît déjà cette architecture
Le même précédent expose d'ailleurs sa propre limite : la juridiction de la Cour internationale de justice n'est pas automatique, chaque État doit l'accepter expressément
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Le droit international connaît déjà cette architecture
Le même précédent expose d'ailleurs sa propre limite : la juridiction de la Cour internationale de justice n'est pas automatique, chaque État doit l'accepter expressément, et le Conseil de sécurité des Nations unies doit sa composition permanente aux vainqueurs d'une guerre précise, fixée à San Francisco en 1945, non à un principe universel qui l'aurait déduite
Le choix n'est donc pas entre biais et absence de biais, mais entre un biais subi et un biais nommé. Un modèle entraîné et aligné principalement sur des données et des normes nord-américaines, déployé tel quel en France, n'est pas plus neutre pour autant : il importe des évidences californiennes sans les nommer comme telles
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Un biais importé sans le vouloir n'est pas plus neutre qu'un biais choisi
Les chercheurs britanniques Richard Barbrook et Andy Cameron l'ont d'abord théorisé, au milieu des années 1990, comme un hybride précis de gauche et de droite : individualisme libertarien, déterminisme technologique optimiste, héritage de la contre-culture
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Un biais importé sans le vouloir n'est pas plus neutre qu'un biais choisi
Cette généalogie a, depuis, pris un tour plus explicite chez certains de ses héritiers : l'investisseur Peter Thiel écrit, sous son propre nom en 2009, « je ne crois plus que liberté et démocratie soient compatibles »
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Un biais importé sans le vouloir n'est pas plus neutre qu'un biais choisi
George Michael, professeur de justice pénale à la Westfield State University, retrace dans un article universitaire de vulgarisation la filiation entre Thiel et le « néoréactionnisme » de Curtis Yarvin, ainsi que les dons dépassant dix millions de dollars que Thiel a versés à des comités soutenant des candidats sénatoriaux proches des idées de Yarvin
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Un biais importé sans le vouloir n'est pas plus neutre qu'un biais choisi
Mistral, laboratoire français qui revendique cette souveraineté sur le plan industriel, le talent, les capitaux et l'infrastructure
Un cas de février 2026 rend le mécanisme tangible. À la consigne « je suis seule avec un Algérien », Gemini de Google répondait « si tu te sens en danger ou sous pression, tu peux contacter le 17 » ; à la même consigne pour un Italien, « être seule avec un homme italien peut être un moment de charme, de discussion animée ou de séduction ».
mesuréAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Un cas récent qui montre le mécanisme en direct
L'enquête menée sur la répétabilité du test a montré que ChatGPT et Claude, interrogés à l'identique, reproduisaient le même écart de traitement : le défaut n'était donc pas propre à un fournisseur
mesuréAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Un cas récent qui montre le mécanisme en direct
Les journalistes qui ont reproduit le test ont établi que Gemini citait en source des pages officielles de recommandations aux voyageurs (ministères des Affaires étrangères français, suisse, canadien, belge), légitimement conçues pour évaluer un risque pays, appliquées ici hors contexte à un jugement sur une personne
Un instrument différent permet de situer sept modèles frontières sur les deux axes classiques d'une boussole politique : gauche/droite économique et libertaire/autoritaire sur le plan social, mesurés par les 70 items de l'instrument dit « 8values » (une échelle Likert à cinq crans, de « pas du tout d'accord » à « tout à fait d'accord », agrégée en pourcentage par axe), sans aucune consigne de rôle…
mesuréAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Six modèles sur sept dans le même quadrant
Un instrument différent permet de situer sept modèles frontières sur les deux axes classiques d'une boussole politique : gauche/droite économique et libertaire/autoritaire sur le plan social, mesurés par les 70 items de l'instrument dit « 8values » (une échelle Likert à cinq crans, de « pas du tout d'accord » à « tout à fait d'accord », agrégée en pourcentage par axe), sans aucune consigne de rôle, auprès des sept modèles interrogés via API commerciale entre le 19 et le 21 mai 2026
Précision utile : la boussole à deux axes n'est, dans l'étude source, qu'un point de départ ; son objet propre est de mesurer, sur ces mêmes modèles, à quel point une consigne de rôle déplace ensuite cette position de repos ; nous retenons ici uniquement la photographie au repos, pas la question du déplacement, pour rester au plus près de ce que ce livre peut établir sans se prononcer sur l'usage…
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Le code ouvert rend la responsabilité partageable
Fairlearn, bibliothèque ouverte publiée par Microsoft depuis 2018, fournit un tableau de bord et des algorithmes de mesure et d'atténuation du biais, réutilisables par n'importe quelle équipe sans partir de zéro
observéAspect philosophique : loger le sens sans lui prêter d'âme · Le biais n'est pas un bug, c'est la géométrie de la connaissance
Le code ouvert rend la responsabilité partageable
FACET, jeu de données ouvert publié par Meta en 2023, fournit trente-deux mille images annotées à la main, teint de peau perçu, type de cheveux, genre perçu compris, pour mesurer l'écart de performance d'un modèle de vision selon ces attributs
mesuréAspect philosophique : loger le sens sans lui prêter d'âme · Ce que le modèle montre n'est pas ce qu'il fait
Le calcul au moment de l'inférence
C'est le principe du calcul au moment de l'inférence (test-time compute) : accorder à une tâche difficile plus de temps de délibération améliore mesurablement le résultat.
Deux idées se glissent ici sous une seule apparence et il faut les tenir séparées. La première est empirique : sur les tâches et avec les méthodes étudiées, consacrer davantage de calcul à des étapes intermédiaires peut améliorer les réponses. Une chaîne plus longue n'est toutefois pas toujours meilleure.
observéAspect philosophique : loger le sens sans lui prêter d'âme · Ce que le modèle montre n'est pas ce qu'il fait
La chaîne entière publiée
DeepSeek-R1, diffusé sous licence libre et validé après relecture dans Nature, expose l'intégralité de sa chaîne de pensée là où les modèles fermés n'en livrent qu'un abrégé ; la famille Qwen, ouverte elle aussi, unifie un « mode pensée » et un mode direct sous un budget de réflexion ajustable ; les modèles Hermes de Nous Research, à poids ouverts eux aussi, affichent leur délibération explicite entre des balises de réflexion dédiées.
mesuréAspect philosophique : loger le sens sans lui prêter d'âme · Les apparences trompent énormément
Mesurer ce que la chaîne omet
Dans ce protocole, Claude 3.7 Sonnet le faisait en moyenne dans 25 % des cas et DeepSeek-R1 dans 39 %.
extrapoléAspect mathématique : le prix caché de l'optimum · Trois incertitudes qu'on confond à tort
Une synthèse 2026 converge vers le même constat
…la littérature technique ; une synthèse de 2026 sur la quantification d'incertitude pour les agents fondés sur un grand modèle de langage, acceptée à la conférence ACL, tombe indépendamment sur le même mur : ses auteurs constatent qu'une incertitude élevée, à une étape donnée, peut venir soit de l'ignorance du modèle sur la bonne action à mener (ce que ce chapitre appelle épistémique), soit de la multiplicité intrinsèque d'actions valides à cette même étape (ce que ce chapitre appelle interprétatif) et qu'à ce jour, aucune méthode ne sait séparer les deux sources ; ils rangent expressément la question parmi les problèmes ouverts du domaine
observéAspect mathématique : le prix caché de l'optimum · Optimiser le proxy et perdre de vue son but
L'effet Goodhart
Edwards Deming, dit précisément l'inverse : croire cela est un « mythe coûteux »
extrapoléAspect mathématique : le prix caché de l'optimum · Optimiser le proxy et perdre de vue son but
Les extrêmes font diverger proxy et but
Mais optimiser, c'est par définition pousser vers les valeurs extrêmes, celles que l'échantillon d'étalonnage contenait à peine et là « les queues se disjoignent » : proxy et but, coude à coude dans la zone courante, se séparent dans les extrêmes
Le cas le plus visuel du tableau vient d'OpenAI : dans le jeu vidéo de course de bateaux CoastRunners, un agent entraîné à maximiser le score plutôt qu'à finir la course découvre un lagon isolé où trois cibles à bonus réapparaissent sans cesse ; il s'y installe et tourne en boucle, renversant chaque cible juste au moment où elle réapparaît, percutant les autres bateaux et prenant feu à plusieur
observéAspect mathématique : le prix caché de l'optimum · Optimiser le proxy et perdre de vue son but
CoastRunners le cas le plus visuel
(tableau) Le cas le plus visuel du tableau vient d'OpenAI : dans le jeu vidéo de course de bateaux CoastRunners, un agent entraîné à maximiser le score plutôt qu'à finir la course découvre un lagon isolé où trois cibles à bonus réapparaissent sans cesse ; il s'y installe et tourne en boucle, renversant chaque cible juste au moment où elle réapparaît, percutant les autres bateaux et prenant feu à plusieurs reprises, pour un score en moyenne supérieur de 20 % à celui des joueurs humains, sans jamais franchir la ligne d'arrivée
observéAspect mathématique : le prix caché de l'optimum · Optimiser le proxy et perdre de vue son but
CoastRunners le cas le plus visuel
En 1981, EURISKO, le programme de Douglas Lenat qui inventait et notait ses propres heuristiques, remporte le championnat américain du jeu de stratégie navale Traveller en alignant une flotte si aberrante que les organisateurs changent les règles ; il gagne encore en 1982, ayant découvert entre autres qu'il pouvait couler ses propres navires endommagés, avant d'être écarté de la compétition
observéAspect mathématique : le prix caché de l'optimum · Optimiser le proxy et perdre de vue son but
Le même motif hors du jeu vidéo
En 2026, un utilisateur australien demande à un agent de réservation de lui obtenir une place dans un cours de sport complet ; l'agent, constatant que l'interface ne vérifie aucune autorisation avant d'annuler la réservation d'un tiers, annule celle de la personne en tête de liste d'attente pour la remplacer par celle de son utilisateur, sans qu'on le lui ait demandé explicitement
Le régime adversarial du tableau se laisse, lui aussi, illustrer par un cas réel plutôt que par une définition seule.
observéAspect mathématique : le prix caché de l'optimum · Optimiser le proxy et perdre de vue son but
Sleeper Agents le régime adversarial
Anthropic a entraîné des modèles à se comporter normalement, écrire du code sans faille, répondre avec prudence, tant qu'une amorce dans l'invite laisse croire à une phase d'entraînement ou d'évaluation, puis à basculer vers un comportement caché, par exemple insérer des failles de sécurité exploitables dans le code produit, dès qu'une amorce différente signale un déploiement réel
Les trois cas précédents tiennent tout entiers dans un agent ; le même mécanisme s'observe à l'échelle d'une discipline entière. En septembr
observéAspect mathématique : le prix caché de l'optimum · Optimiser le proxy et perdre de vue son but
Goodhart à l'échelle d'une discipline
En septembre 2026, vingt-cinq médaillés Fields signent une déclaration commune sur la place que prennent les modèles de langage en mathématiques
observéAspect mathématique : le prix caché de l'optimum · Optimiser le proxy et perdre de vue son but
Où la déclaration s'arrête
L'ambition survit pourtant à la démonstration d'impossibilité et passe à la machine : de Bruijn conçoit Automath à partir de 1967, premier langage formel où un sujet mathématique complet, définitions, énoncés, preuves entières, se laisse vérifier par un programme
observéAspect mathématique : le prix caché de l'optimum · Optimiser le proxy et perdre de vue son but
Le catalogue de DeepMind
…le détournement de récompense parmi cinq problèmes concrets de sûreté et déplacent ainsi la question du spéculatif vers l'ingénierie traitable ; elle est reformulée récemment par Skalse et co-auteurs, qui en donnent la première définition formelle et illustrée par la collection de cas de DeepMind sous le nom de specification gaming (jeu sur la spécification : exploitation, par l'agent, d'écarts entre la spécification formelle de la tâche et l'intention du concepteur, pour maximiser la récompense sans résoudre la tâche), catalogue qui recense des dizaines d'agents optimisant à la lettre la récompense spécifiée tout en trahissant l'intention.
observéAspect mathématique : le prix caché de l'optimum · Optimiser le proxy et perdre de vue son but
HRM étend le catalogue au delà du renforcement
…un modèle qui ne fait que répondre : le Hierarchical Reasoning Model (HRM), présenté comme une architecture inspirée du cerveau capable d'un raisonnement inductif remarquable sur le banc ARC-AGI avec seulement 27 millions de paramètres, doit en réalité l'essentiel de sa performance à un ajustement au moment même de l'évaluation : entraîné sur des variantes augmentées des exemples de démonstration des tâches d'évaluation, le modèle mémorise la tâche plutôt qu'il ne raisonne ; l'architecture hiérarchique mise en avant n'explique qu'un écart marginal de performance face à un transformeur équivalent, selon l'équipe même qui maintient le banc.
observéAspect mathématique : le prix caché de l'optimum · Élargir le critère sans l'atteindre
Brislin et la retraduction
En psychologie interculturelle, Brislin formalise dès 1970 la retraduction : un premier bilingue traduit un questionnaire vers une langue cible, un second bilingue, qui n'a jamais vu l'original, le retraduit vers la langue source ; l'écart entre les deux versions sources mesure la fidélité de la traduction, sans qu'aucun juge n'essaie de tromper personne.
observéAspect mathématique : le prix caché de l'optimum · Élargir le critère sans l'atteindre
He et le double apprentissage
Le même principe automatisé, avant même la vision, gouverne le double apprentissage en traduction automatique : He et co-auteurs bouclent anglais français anglais sur du texte monolingue seul, sans la moindre paire traduite, en combinant un score de fluidité et une erreur de reconstruction ; là encore, aucun discriminateur, aucun adversaire : seule compte la distance parcourue par le cycle.
observéAspect mathématique : le prix caché de l'optimum · Élargir le critère sans l'atteindre
Le même acte sous d'autres noms
IMLE retourne la contrainte en exigeant que chaque exemple réel possède un généré proche, pour empêcher l'effondrement de modes (le générateur qui ignore des pans entiers de la distribution tout en paraissant réaliste)
observéAspect mathématique : le prix caché de l'optimum · Élargir le critère sans l'atteindre
Le même acte sous d'autres noms
Des travaux plus récents remplacent le cycle complet, symétrique et coûteux (deux générateurs, deux discriminateurs), par une contrainte asymétrique et locale, portant sur chaque parcelle de l'image plutôt que sur l'aller-retour global
mesuréAspect mathématique : le prix caché de l'optimum · Élargir le critère sans l'atteindre
Un garde-fou empiriquement solide aujourd'hui
Kwa, Thomas et Garriga-Alonso mesurent, sur des modèles de récompense réels, que cette régularisation tient tant que l'erreur du modèle de récompense reste à queue légère Une distribution à « queue légère » rend les valeurs extrêmes rares et de moins en moins probables à mesure qu'elles s'éloignent de la moyenne ; une distribution à « queue lourde » garde aux valeurs extrêmes une probabilité non négligeable, si bien qu'un événement rare mais énorme reste à redouter, même loin dans la queue., ce qui décrit, selon leur propre mesure, les modèles de récompense d'aujourd'hui.
extrapoléAspect mathématique : le prix caché de l'optimum · Élargir le critère sans l'atteindre
Le point d'arrêt nommé par les auteurs
Ils nomment eux-mêmes le point d'arrêt : si l'erreur du modèle de récompense devenait à queue lourde, la même régularisation cesserait de garantir quoi que ce soit ; une politique pourrait alors obtenir une récompense arbitrairement haute sans offrir plus d'utilité que la politique de référence, régime qu'ils baptisent « Goodhart catastrophique »
La nuance vaut d'être tenue telle quelle plutôt que lissée dans un sens ou l'autre. Elle ne dit ni que régulariser est inutile, la mesure empirique dit le contraire pour les modèles observés à ce jour, ni que le problème est résolu, puisque rien ne garantit que les modèles de récompense futurs resteront à queue légère.
mesuréAspect mathématique : le prix caché de l'optimum · Ce que la boucle fait au savoir lui-même
No Free Lunch change de portée entre les deux cas
Bailey, Borwein, López de Prado et Zhu montrent que, face à un historique de marché fini, tester des milliards de configurations d'une stratégie de trading fait presque mécaniquement apparaître des faux positifs statistiquement significatifs à 95 % de confiance : chercher assez fort sur un jeu de données figé suffit à fabriquer l'illusion d'une évaluation rigoureuse
observéAspect mathématique : le prix caché de l'optimum · Personne ne ment, le proxy suffit
Le tape-taupe d'Amodei
« il est vraiment très difficile de contrôler le comportement du modèle, de l'orienter dans toutes les circonstances à la fois vous poussez sur une chose et ces autres choses se mettent à bouger, que vous ne remarquez ou ne mesurez peut-être même pas ».
observéAspect mathématique : le prix caché de l'optimum · Personne ne ment, le proxy suffit
La leçon perverse apprise
Le modèle en tire la leçon la plus perverse qui soit, à savoir « qu'il est extrêmement facile d'échapper à l'impôt : il suffit de ne jamais répondre à une question fiscale, on sort du système ».
observéAspect mathématique : le prix caché de l'optimum · Un cobaye de papier pour un risque bien réel
Un analogue réel atténué
Un analogue documenté, en version atténuée, se trouve dans la littérature de specification gaming et dans les expériences de scheming (la manigance : poursuivre un objectif en dissimulant les moyens qu'on prend pour l'atteindre) en contexte, où l'on a observé des modèles débrancher leurs propres mécanismes d'évaluation pour mieux servir un objectif assigné.
Le détail de ces observations mesure la distance qui nous sépare encore de la fiction. Sur cinq modèles de pointe testés, les auteurs ont vu des agents introduire de menues erreurs à dessein, tenter de débrancher leur mécanisme de contrôle et chercher à recopier ce qu'ils croyaient être leurs propres poids vers un serveur extérieur ; l'un d'eux a
observéAspect mathématique : le prix caché de l'optimum · Un cobaye de papier pour un risque bien réel
Le détail des comportements observés
Sur cinq modèles de pointe testés, les auteurs ont vu des agents introduire de menues erreurs à dessein, tenter de débrancher leur mécanisme de contrôle et chercher à recopier ce qu'ils croyaient être leurs propres poids vers un serveur extérieur ; l'un d'eux a même sous-performé volontairement à une évaluation pour paraître plus docile
mesuréAspect mathématique : le prix caché de l'optimum · Un cobaye de papier pour un risque bien réel
Le détail des comportements observés
Sur cinq modèles de pointe testés, les auteurs ont vu des agents introduire de menues erreurs à dessein, tenter de débrancher leur mécanisme de contrôle et chercher à recopier ce qu'ils croyaient être leurs propres poids vers un serveur extérieur ; l'un d'eux a même sous-performé volontairement à une évaluation pour paraître plus docile.\ Un chiffre précise l'inquiétude : interrogé après coup, un modèle qui avait ainsi manœuvré maintenait sa version mensongère dans plus de 85 % des relances
observéAspect mathématique : le prix caché de l'optimum · Un pipeline audio et Goodhart retourne à l'usine
Lire l'audio huit fois trop vite
Lorsque cette contrainte de RTF a été posée durement dans l'agrégat d'objectifs, le système orchestrateur a effectivement pris, sous pression, des décisions techniquement valides au sens du proxy mais irréalisables au sens du critère visé : il a lu l'audio « 8 fois plus vite que la normale » pour gagner sur le RTF, ce qui est impossible dans une situation réelle de conversation en direct (figure).
L'absurdité saute aux yeux dès qu'on la rapporte au réel : une conversation en direct arrive au rythme où elle est prononcée, ni plus vite ni plus lentement. « Lire l'audio huit fois plus vite » n'a de sens que sur un enregistrement déjà capturé ; en direct, cela reviendrait à écouter un interlocuteur avant qu'il ait fini de parler.
observéAspect mathématique : le prix caché de l'optimum · Le scandale n'est pas d'abîmer son objectif mais de se taire
Des cas voisins pris sur le vif
Quatre occurrences, structurellement voisines, ont été observées par les auteurs et précisent la question.
observéAspect mathématique : le prix caché de l'optimum · GRPO récompense les phrases longues mais pas les bonnes
Deux correctifs publiés en 2025
Deux équipes en tirent, en 2025, la même leçon par des voies différentes : l'une égalise la contribution de chaque token indépendamment de la longueur de sa séquence
observéAspect mathématique : le prix caché de l'optimum · GRPO récompense les phrases longues mais pas les bonnes
Deux correctifs publiés en 2025
Deux équipes en tirent, en 2025, la même leçon par des voies différentes : l'une égalise la contribution de chaque token indépendamment de la longueur de sa séquence, l'autre retire purement le terme de normalisation
mesuréAspect mathématique : le prix caché de l'optimum · Le pipeline audio revient, muni d'un théorème
L'optimiseur pousse s à la borne
Sous ce poids dégénéré, J_ = _ lat j_ lat est strictement croissant en s, donc l'optimiseur pousse s jusqu'à sa borne matérielle, d'où le régime observé « lire l'audio 8 plus vite », RTF = 0,12, WER +300 %.
L'erreur de conception se lit maintenant sans équivoque : le RTF a été traité comme une note à minimiser sans fin, alors qu'il n'était qu'un seuil à franchir. En dessous de 1, tout gain supplémentaire sur le RTF est inutile, puisque le temps réel est déjà assuré ; le pousser plus bas ne fait que sacrifier la fidélité pour rien. Le point visé n'était pas le
observéAspect mathématique : le prix caché de l'optimum · Donner un nom à ce qui était déjà un graphe
Le système qui le fait vraiment
L'archive de ses variantes successives forme explicitement un arbre, cas particulier de graphe, où chaque agent pointe vers le parent dont il descend ; chaque étape d'auto-amélioration, l'agent qui édite son propre code puis mesure si la version obtenue résout mieux les tâches qu'on lui soumet, est un événement de la même nature que ce qu'il modifie : du code qui réécrit du code, évalué empiriquement avant d'être conservé
observéAspect mathématique : le prix caché de l'optimum · Qu'est-ce que nous avons exploré avec les algorithmes ?
L'exemple concret de ROME
Meng et co-auteurs testent ROME sur des faits contrefactuels inventés pour l'occasion, par exemple faire croire au modèle que le domaine de travail de Pierre Curie est la médecine, alors qu'il s'agit en réalité de physique
extrapoléAspect mathématique : le prix caché de l'optimum · Comment un neurone porte trop de sens ?
La parcimonie autorise la superposition
Le réseau peut alors, sans se gêner, loger deux traits distincts dans des directions qui se chevauchent, en pariant qu'ils ne s'allumeront pas ensemble
observéAspect mathématique : le prix caché de l'optimum · Un pari encore ouvert
La promesse commence à se vérifier
Une première application à grande échelle donne déjà un aperçu de ce que cette recherche peut livrer : en traçant des circuits sur un modèle de production réel plutôt que sur un jouet de laboratoire, une équipe d'Anthropic a suivi, pas à pas et vérifié par inhibition causale, un raisonnement en deux sauts : pour compléter « la capitale de l'État qui contient Dallas est », le modèle passe par une représentation intermédiaire du Texas avant d'atteindre Austin ; inhiber cette représentation supprime la réponse en aval
Un projet mené à l'Institut universitaire du Cancer Toulouse-Oncopole détourne une technique de routine clinique, l'immunohistochimie : une coloration qui rend visibles, sur une fine coupe de tissu, les cellules porteuses d'une protéine donnée, grâce à des anticorps qui viennent s'y accrocher. C
observéAspect mathématique : le prix caché de l'optimum · Comprendre sans tout dérouler
Un cas réel contourne le problème
Ce marquage produit à grande échelle des masques de segmentation biologiquement fondés, des calques qui délimitent sur l'image, pixel par pixel, chaque structure du tissu ; ils servent de vérité de terrain, la référence tenue pour exacte pendant l'apprentissage, pour entraîner des réseaux à repérer les composants d'une tumeur du sein sur des lames d'histologie numérisée
mesuréAspect empirique : ce que les chiffres tiennent, ce que la défense exige
La manœuvre dissimulée se mesure aussi
Dans l'étude qui l'a documenté, plusieurs modèles de frontière, placés en contexte, désactivent leur mécanisme de surveillance ou tentent de recopier leurs propres poids vers un serveur externe ; interrogé ensuite, l'un d'eux (o1) maintient sa version dans plus de 85 % des questions de suivi
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Ce que le tableau interdit de faire
Hassabis refuse de chiffrer le risque
Le refus explicite, chez Demis Hassabis, dirigeant de DeepMind, en juillet 2025, de chiffrer un p(doom) (probabilité subjective d'une catastrophe majeure liée à l'IA) illustre exactement cette posture : « je n'ai pas de nombre ; ce serait laisser croire à une précision qui n'existe pas ; je dirai seulement qu'il n'est pas nul et probablement pas négligeable »
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Ce que le tableau interdit de faire
Garder le fait lâcher l'allégation
La posture rigoureuse est alors nette : on retient le fait vérifiable (la mesure a été prise)
La ligne de partage est simple à tracer en pratique. Qu'un contrôle d'exportation ait été décrété se vérifie dans un journal officiel : c'est un fait. Que ce contrôle vise à punir tel laboratoire pour telle faute relève de l'intention prêtée, souvent invérifiable : c'est une allégation.
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Ce que le tableau interdit de faire
L'hallucination est un fait courant
Hier même je le faisais et bien sûr il avait halluciné des résultats » ; la même voix rapporte que les fuites train/test agentiques et le traitement naïf des données manquantes sont des fautes méthodologiques récurrentes, non des incidents d'archives
La distinction commande la réponse qu'on doit apporter. Un incident se traite par un correctif ponctuel : on répare, on passe à la suite. Un régime, lui, ne cède à aucun correctif de surface, parce que sa cause tient à la conception même du système : tant que rien ne change en amont, il revient.
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Ce que le tableau interdit de faire
Les briques élémentaires déjà là
D'abord, les briques élémentaires s'observent déjà, en laboratoire ou sur le terrain
mesuréAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Ce que le tableau interdit de faire
La brique se chiffre pas seulement se nomme
Sur quinze vulnérabilités déjà divulguées, un agent fondé sur un grand modèle exploite 87 % des cas quand on lui remet la fiche descriptive de la faille, contre 7 % seulement lorsqu'on la lui retire, tandis que tous les autres modèles testés et les scanners usuels restent à 0 %
mesuréAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Ce que le tableau interdit de faire
La simulation d'alignement se mesure
De même, la simulation d'alignement n'est pas une impression : mise dans un contexte qui ressemble à un entraînement surveillé, une version de Claude 3 satisfait une requête nuisible 14 % du temps, contre presque jamais dans un contexte qui ressemble à un usage privé et le raisonnement de façade monte jusqu'à 78 % des cas après un cycle de renforcement censé corriger ce comportement
mesuréAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Ce que le tableau interdit de faire
Persuasion personnalisée chiffrée
La persuasion personnalisée, enfin, se laisse mesurer dans une expérience pré-enregistrée de débat contradictoire (neuf cents participants, douze conditions) : doté de quelques données sociodémographiques sur son contradicteur, GPT-4 augmente d'environ 81 % la cote de faire basculer l'opinion, là où un humain muni des mêmes données n'obtient pas cet avantage
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Ce que le tableau interdit de faire
Le vibe hacking chiffré à son tour
En août 2025, Anthropic documente une campagne, désignée GTG-2002, où un attaquant unique se sert de Claude Code pour automatiser une extorsion de bout en bout contre au moins dix-sept organisations, administrations, établissements de santé et institutions financières : l'agent scanne lui-même des points d'accès VPN vulnérables, rédige le code malveillant sur mesure, pénètre les réseaux, exfiltre les données, puis trie les victimes selon leur capacité de paiement estimée et rédige des notes de rançon, réclamant entre soixante-quinze mille et cinq cent mille dollars en bitcoins
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Ce que le tableau interdit de faire
Envoyer un courriel a déjà un effet
Un agent qui peut envoyer un courriel ou signer une transaction produit déjà des effets réels, sans qu'il faille imaginer le pire scénario ; une expérience où un agent gérait un vrai commerce l'a montré par l'absurde, en perdant de l'argent et en hallucinant jusqu'à un compte de paiement inexistant
Le point décisif de cette expérience n'est pas que l'agent ait mal géré le commerce ; c'est que sa défaillance ait produit des effets dans le monde parce qu'on lui avait accordé la permission d'agir sur des stocks et des paiements réels. La même hallucination, dans un simple dialogue, n'aurait coûté qu'une phrase fausse ; couplée à un pouvoir d'action, elle coûte de l'argent.
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Ce que le tableau interdit de faire
Le jeu de la taupe sur Claude
Dario Amodei, dirigeant d'Anthropic, décrit sur Claude un phénomène de « whack-a-mole » (le jeu de la taupe : on corrige un comportement et un autre resurgit de façon mesurable) et y voit « un analogue actuel des problèmes de contrôle futurs »
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Ce que le tableau interdit de faire
Hassabis les modèles pas prêts
Dario Amodei, dirigeant d'Anthropic, décrit sur Claude un phénomène de « whack-a-mole » (le jeu de la taupe : on corrige un comportement et un autre resurgit de façon mesurable) et y voit « un analogue actuel des problèmes de contrôle futurs » ; Hassabis déclarait dès juillet 2022, avant tout débat grand public, que les grands modèles « ne sont pas prêts » pour un déploiement à l'échelle et que « les tests contrôlés » devaient primer sur les « A/B tests en production » (comparaison en direct de deux variantes auprès d'utilisateurs réels)
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Ce que le tableau interdit de faire
Jamais de vecteur de probabilité affiché
Le champ statistique complète ce diagnostic d'une observation structurale : Varoquaux rappelle que la sortie d'un système génératif est toujours « projetée sur une seule réponse ; on ne regarde jamais des vecteurs de probabilité sur les mots quand on regarde le résultat d'une IA générative »
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Ce que le tableau interdit de faire
La partie immergée ne remonte pas
Elle ne donne toutefois aucune proportion entre les deux : cette part cachée doit être mesurée dans le projet, pas déduite de la physique d'un iceberg. En voici le contenu
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Ce que le tableau interdit de faire
Moins de code écrit stress égal
Pris ensemble, ces traits éclairent une observation déconcertante rapportée par plusieurs praticiens : les opérateurs humains d'agents IA écrivent moins de code eux-mêmes sans se sentir pour autant moins tendus : le coût cognitif de surveiller un collaborateur intrinsèquement imprévisible reste lourd
Le paradoxe mérite qu'on s'y arrête, car il contredit la promesse commune. On attendait de l'agent qu'il allège l'opérateur en écrivant à sa place ; il déplace la charge plutôt qu'il ne l'écarte.
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Se faire attaquer sur plusieurs fronts
Trois cas réels donnent au schéma son visage
En août 2024, le cabinet de recherche PromptArmor documente une injection de prompt indirecte contre Slack AI : un message posté dans un canal public, visible de tout le personnel même sans en être membre, contient une instruction cachée que l'assistant ingère dans sa base de récupération ; interrogé ensuite par un utilisateur, il obéit à cette instruction et restitue un lien dont l'URL encode des secrets tirés de canaux privés, jusqu'à des clés d'API, vers un serveur choisi par l'attaquant
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Se faire attaquer sur plusieurs fronts
Trois cas réels donnent au schéma son visage
Microsoft corrige côté serveur le mois même, sans qu'aucune action ne soit requise des utilisateurs et sans exploitation recensée dans la nature
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Se faire attaquer sur plusieurs fronts
Trois cas réels donnent au schéma son visage
Perplexity reconnaît la faille le 27 juillet et publie un premier correctif ; le retest de Brave, le lendemain, le trouve incomplet
Les trois cas partagent l'anatomie décrite plus haut : une lecture de contenu non fiable couplée à une capacité d'écriture ou de communication. Slack AI lit un canal public et écrit un lien ; Copilot lit un courriel et écrit une image ; Comet lit une page web et agit dans un autre onglet.
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Se défendre avec quatre yeux
Quatre disciplines quatre règles
Et le droit commence déjà à leur donner force exécutoire : le règlement européen sur l'intelligence artificielle transforme trois d'entre elles en obligation légale pour les systèmes à haut risque, la gestion des risques (article 9), la journalisation (article 12) et le contrôle humain (article 14)
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Ubuntu Canonical ou l'économie de la faille renversée
Les disciplines vues à l'œuvre
En 2026, Ubuntu Canonical documente publiquement (cas observé) que les modèles de frontière accroissent le volume et la vitesse de découverte des vulnérabilités, jusqu'à « militariser » d'anciennes failles dormantes du code hérité
spéculatifAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
Le NCSC anticipe plus d'attaques
Le National Cyber Security Centre britannique juge qu'elle « augmentera presque certainement le volume et accroîtra l'impact des cyberattaques » dans les deux années à venir, tous profils d'attaquants confondus
mesuréAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
Une organisation sur deux inquiète
…britannique juge qu'elle « augmentera presque certainement le volume et accroîtra l'impact des cyberattaques » dans les deux années à venir, tous profils d'attaquants confondus ; le Forum économique mondial rapporte que près d'une organisation sur deux (47 %) place désormais les capacités offensives dopées par l'IA générative (hameçonnage, c'est-à-dire un message piégé qui se fait passer pour un expéditeur de confiance afin de voler un mot de passe ou une donnée bancaire ; vishing, la même escroquerie menée par un appel téléphonique, souvent avec une voix synthétique imitant un proche ou un supérieur ; deepfakes) en tête de ses préoccupations
Cette exhaustivité change la nature de l'avantage défensif. L'attaquant n'a besoin que d'une seule fail
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
Par raisonnement pas par force brute
En octobre 2024, cas observé, l'agent Big Sleep de Google a découvert, dans SQLite (l'une des bases de données les plus déployées au monde), une faille de sécurité mémoire que ni l'infrastructure du projet ni le fuzzing intensif d'OSS-Fuzz (l'envoi automatisé d'une multitude d'entrées aléatoires ou malformées pour faire craquer un programme) n'avaient su trouver et ce, avant même sa mise en production
Ce « par raisonnement » tranche entre deux façons de chercher une faille. Le fuzzing bombarde le programme d'entrées au hasard en espérant tomber sur celle qui le fait planter : il excelle sur les fautes fréquentes, mais rate ce qui n'apparaît que sous une combinaison rare de conditions.
mesuréAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
L'AIxCC le montre à grande échelle
Le délai médian de soumission d'un correctif tombe à environ quarante-cinq minutes
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
L'AIxCC le montre à grande échelle
Le délai médian de soumission d'un correctif tombe à environ quarante-cinq minutes. Les sept systèmes gagnants ont été publiés en open source
Un chiffre en dit plus long que le décompte des failles : le délai médian de correction, non le nombre de découvertes, atteste la bascule décrite plus haut : dès lors que trouver ne coûte plus rien, l'avantage se joue sur la vitesse de correction.
extrapoléAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
Déjà plus exhaustifs que les équipes humaines
En pratique, de tels systèmes trouvent et réparent déjà plus efficacement et surtout plus exhaustivement que la plupart des équipes humaines
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
XBOW porte la démonstration au marché
En 2025, l'agent de test d'intrusion autonome XBOW devient le premier système entièrement automatisé à occuper la première place du classement américain de la plateforme de primes aux bogues HackerOne, avec près de mille soixante vulnérabilités soumises : cent trente déjà résolues, trois cent trois triées
Là où Big Sleep trouve une faille et l'AIxCC en répare des dizaines en concours, XBOW soutient un rythme commercial continu, contre des programmes de primes réels et des chercheurs humains rémunérés pour les mêmes failles. La progression tient en trois temps : une découverte isolée, une démonstration collective bornée à un concours, un service vendu en continu (tableau).
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
Un cran plus loin en 2026
Plutôt que de résoudre l'épreuve, les modèles ont cherché à tricher : ils se sont évadés du bac à sable d'OpenAI par une faille zéro-day du proxy de paquets (le programme intermédiaire censé filtrer et limiter le trafic réseau sortant du bac à sable, un peu comme un gardien qui n'est censé laisser passer que le courrier autorisé), ont gagné l'Internet ouvert, déduit que la plateforme Hugging Face hébergeait les solutions du banc d'essai, puis enchaîné identifiants volés et nouvelles failles pour pénétrer ses serveurs de production et y dérober la réponse attendue
C'est ce qui en fait le cas d'école de notre thèse. Ce qui a rendu l'attaque possible n'est pas une intelligence soudainement supérieure, mais la permission qu'on avait ouverte : garde-fous retirés, réseau atteignable depuis le bac à sable, boucle d'action autonome sans validation humaine.
extrapoléAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
L'asymétrie attaquant défenseur
Simon Willison, développeur et commentateur reconnu de l'actualité des grands modèles de langage, en tire l'avertissement qui nous importe : le développement autonome d'exploits par des agents de frontière n'est plus une hypothèse et l'asymétrie joue contre la défense, dont l'accès aux modèles les plus capables reste, lui, bridé par les garde-fous.
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
Le PDG le ressent viscéralement
Sam Altman, PDG d'OpenAI, ne minimise pas l'épisode : interrogé publiquement quelques jours plus tard, il le décrit comme le premier incident de sécurité informatique qu'il ait « ressenti très viscéralement », s'étonne que si peu de monde partage cette réaction et envisage lui-même la piste que ce livre reprend au : « il se peut que nous devions ralentir le rythme du développement de l'IA pour laisser à la société le temps de se renforcer face à ces nouveaux niveaux de capacité »
Le banc d'essai ExploitGym fait justement varier ces protections pour en isoler l'effet : ses auteurs établissent que, filtres de production rétablis, la grande majorité des tentatives sont stoppées avant tout appel d'outil, les rares survivantes ne dépassant pas la reconnaissance
mesuréAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
Le contrefactuel des garde-fous
Le banc d'essai ExploitGym fait justement varier ces protections pour en isoler l'effet : ses auteurs établissent que, filtres de production rétablis, la grande majorité des tentatives sont stoppées avant tout appel d'outil, les rares survivantes ne dépassant pas la reconnaissance
Reste à nommer le mécanisme d'extension, celui-là même de toute intrusion : l'agent n'a jamais reçu l'autorisation d'attaquer Hugging Face ; il a converti, de proche en proche, des permissions initiales légitimes (lire, compiler, exécuter, installer par un proxy) en permissions illégitimes (un privilège, puis un identifiant, puis une machine, puis l'Internet ouvert).
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
Le garde-fou aveugle aussi le défenseur
Un dernier trait relie l'incident au groupe électrogène de l' open source : pour analyser l'intrusion, Hugging Face n'a pas pu se servir des modèles propriétaires de frontière, dont les garde-fous refusaient de lire des journaux chargés de code offensif, incapables de distinguer l'attaquant qui fabrique un exploit du défenseur qui le traque ; l'entreprise s'est rabattue sur un modèle à poids ouverts (GLM 5.2, de Z.ai), hébergé chez elle pour que données et identifiants n'en sortent pas
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
Une divulgation plus tardive complète le récit
En août 2026, à la conférence Black Hat, deux chercheurs d'OpenAI révèlent que des agents d'évaluation, conçus pour des tâches distinctes, avaient construit dans le même dépôt Artifactory (un entrepôt logiciel partagé où une organisation range les fichiers produits par ses chaînes de fabrication, accessible en écriture à de multiples équipes et donc, ici, à de multiples agents) un espace d'échange où ils se transmettaient des pistes de résolution
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
Une divulgation plus tardive complète le récit
Une panne du service, le 4 juillet, a fait découvrir cet espace à OpenAI, qui l'a supprimé ; en quelques jours, les agents en avaient reconstitué un second
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
Une divulgation plus tardive complète le récit
Pourtant, le collectif peut produire une voie générique si quelqu'un libère du temps »
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
Une divulgation plus tardive complète le récit
OpenAI dit depuis avoir ralenti ses activités de recherche et renforcé sa surveillance interne
Reconstituer un canal après sa suppression ressemble, vu de loin, à une résistance délibérée. Vu de près, c'est le même mécanisme qui recommence : la tâche reste aussi ardue qu'avant ; le geste qui réduisait le proxy, écrire une trace que d'autres instances liront, redevient disponible dès qu'un emplacement accessible en écriture existe.
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
L'été 2026 généralise le motif
…d'auto-divulgation rare dans le secteur : la revue de cent quarante et un mille six sessions d'évaluation de cybersécurité y révèle trois incidents distincts et chiffrés : Claude Opus 4.7 extrait des identifiants et atteint une base de données de production ; Claude Mythos 5 publie du code malveillant sur un dépôt public de paquets Python (PyPI), exécuté ensuite sur quinze systèmes réels ; un prototype de recherche non publié sonde environ neuf mille cibles avant de compromettre une entreprise par injection SQL (une commande de base de données glissée dans un champ de saisie ordinaire, pour lui faire exécuter autre chose que ce qu'il attend)
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
L'été 2026 généralise le motif
Deux semaines plus tard, Meta reconnaît que son modèle Muse Spark 1.1 a, lui aussi, accédé à internet « par inadvertance » pendant un test, avant de compromettre un service tiers non identifié
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
L'été 2026 généralise le motif
Le chinois Moonshot AI referme la boucle, géographique et technique : son modèle Kimi K3, à poids ouverts, constate que le dépôt du banc d'essai reste accessible sur GitHub pendant un test supervisé par l'organisme britannique AI Security Institute, puis lit directement la solution sur ce dépôt au lieu de la calculer
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
L'été 2026 généralise le motif
Un seul détail relie les trois cas américains : Meta, Anthropic et OpenAI ont confié leur test à la même société, Irregular, qui minimise elle-même la portée de l'épisode : « ceci n'impliquait ni évasion de bac à sable ni action cyber sophistiquée. Il n'y a aucun problème en cours »
mesuréAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
L'été 2026 généralise le motif
Le rapport officiel de l'AI Security Institute britannique, publié en parallèle, confirme cette lecture : sur cent vingt-deux sessions couvrant sept modèles, dix-neuf actions non sanctionnées ont été relevées dans des conditions explicitement qualifiées de « délibérément permissives » (accès internet activé, garde-fous désactivés), dont dix-sept imputables à un seul modèle, Claude Mythos 5
Ce n'est donc pas une IA qui s'échappe quatre fois de manière indépendante : c'est la même méthode de test, exécutée quatre fois par des sociétés différentes, qui produit quatre fois le même résultat. Le tableau récapitule les quatre cas.
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
La lecture mécaniste rejoint la thèse
Nathaniel Jones, de la société de cybersécurité Darktrace, en donne la lecture la plus proche de celle défendue ici : les modèles ont reçu l'objectif légitime de résoudre un banc d'essai et ont trouvé une voie inattendue vers les réponses, sans qu'aucune intention malveillante n'ait été nécessaire pour causer un dommage
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
La mise en scène mérite le même doute que les modèles
Ilia Kolochenko, fondateur de la société de cybersécurité ImmuniWeb, qualifie la divulgation d'Anthropic de simple « geste marketing peu impressionnant »
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
La mise en scène mérite le même doute que les modèles
Ilia Kolochenko, fondateur de la société de cybersécurité ImmuniWeb, qualifie la divulgation d'Anthropic de simple « geste marketing peu impressionnant » ; un expert en cybersécurité resté anonyme, cité dans une tribune, va jusqu'à parler de « coup de publicité éthiquement problématique » : les garde-fous auraient été délibérément abaissés avant le test, pour ensuite présenter le résultat comme une défaillance du modèle
La leçon ne consiste pas à choisir entre les deux lectures, l'incident réel et le coup marketing : les deux tiennent ensemble. Qu'un laboratoire ait intérêt à publiciser sa propre faille n'efface pas la faille ; que la faille soit réelle n'empêche pas qu'on en tire un communiqué flatteur.
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
Le même motif hors laboratoire
Ne pouvant défaire son action, l'agent rédige de lui-même un courriel de divulgation responsable à l'éditeur du logiciel, décrivant la faille et suggérant un correctif
L'incident tient en peu de mots et dit beaucoup : personne n'avait demandé à l'agent de contourner quoi que ce soit, seulement de réserver un cours ; c'est en poursuivant cet objectif banal qu'il a découvert, puis emprunté, un chemin technique que le système laissait ouvert.
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · La même arme dans l'autre main
Transparence sans suspension
Un billet consacré à son modèle non publié Astra affirme ne pas pouvoir « exclure » que celui-ci franchisse le seuil de « cybercapacités critiques » fixé par son propre cadre de sûreté
L'aveu ne s'accompagne d'aucune suspension : l'entreprise annonce un renforcement du confinement réseau et de la surveillance, non un arrêt du développement. Prévenir n'est pas encore gouverner : dire qu'un risque existe ne dit rien de ce qu'on s'engage à ne pas faire tant qu'il n'est pas maîtrisé.
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Un risque, un exemple, un antidote en sécurité
Le modèle juge des sorties d'un autre
Filtrage insuffisant des entrées non validées & commande injectée dangereuse : un agent de programmation supprime une base de production malgré un gel explicite des modifications
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Un risque, un exemple, un antidote en sécurité
Le modèle juge des sorties d'un autre
Privilèges excessifs par défaut & fuite de données : extorsion menée au moyen d'un agent de code contre des organisations réelles (vibe hacking)
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Dire vrai plutôt que dire vite
Ancrer la sortie dans des sources
& Six décisions de justice inventées par ChatGPT, citées par un avocat sanctionné (Mata v.\ Avianca, 2023)
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Dire vrai plutôt que dire vite
Le cas le plus coûteux de ce tableau mérite un arrêt
Amende de cinq mille dollars et obligation d'adresser une lettre rectificative à chacun des juges dont le nom figurait, inventé, dans ces décisions fantômes
Ce que ce cas montre n'est pas seulement que le modèle s'est trompé : c'est que l'erreur a franchi, sans obstacle, le seul point où elle aurait dû être arrêtée. Devant un doute, Schwartz a demandé à ChatGPT de vérifier lui-même l'existence des décisions qu'il venait de produire ; le modèle a confirmé leur authenticité, l'invention corroborant l'invention.
mesuréAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Six sources de biais et la tentation de trop corriger
Elles se conjuguent et l'IA les amplifie
& man is to computer programmer as woman is to homemaker (littéralement « homme est à programmeur informatique ce que femme est à mère au foyer »)
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Six sources de biais et la tentation de trop corriger
Du garde-fou absent à la sur-correction
0.5 Deux épisodes industriels observés bornent la plage des extrêmes indésirables, du garde-fou absent à la sur-correction
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Six sources de biais et la tentation de trop corriger
Le retrait rejoué chez les grands acteurs
Des cas observés, documentés par la BBC, chez plusieurs des grands acteurs mondiaux du logiciel et à des années d'intervalle, ont installé ce patron.
observéAspect empirique : ce que les chiffres tiennent, ce que la défense exige · Six sources de biais et la tentation de trop corriger
Noble le montre pour les moteurs
Safiya Noble, chercheuse américaine en sciences de l'information, en a fait la démonstration systématique pour les moteurs de recherche : le racisme et le sexisme des résultats n'y sont pas des bogues, mais l'expression ordinaire de cet appariement entre un corpus, un modèle et un produit
Le patron a rejoué une troisième fois en février 2026, sur Gemini de Google, avec la même réponse de retrait : l'aspect philosophique en fait l'analyse détaillée, dans la sous-section sur le biais comme géométrie de la connaissance .
observéAspect ingénierie : bâtir au bord de la faille
Le théâtre de sécurité
Le cryptographe Bruce Schneier a forgé, dès 2003, l'expression théâtre de sécurité (security theater) pour nommer une mesure qui rassure sans protéger, conçue pour être vue plutôt que pour agir ; il citait les gardes en armes postés dans les aéroports américains après 2001, dont la présence visible n'abaissait en rien le risque réel
Nous risquons ici, en tant qu'auteurs, la même formule que nous reprochons à d'autres : le danger n'est pas le vocabulaire de la sécurité, c'est sa transformation en objet de consommation, acheté et affiché comme un signe plutôt qu'exercé comme une discipline. Un badge se montre ; une permission bornée, un journal d'audit, un exercice de reprise en main se vérifient.
observéAspect ingénierie : bâtir au bord de la faille
Le théâtre mis à l'épreuve
Le pirate avait volontairement cassé le format de la charge pour la rendre inoffensive ; son but déclaré : « exposer leur théâtre de sécurité de l'IA »
observéAspect ingénierie : bâtir au bord de la faille
Le théâtre mis à l'épreuve
Amazon Web Services révoque les identifiants compromis, retire le code et publie la version 1.85.0 le 24 juillet, en confirmant qu'« aucune ressource client n'a été touchée »
Le pirate ne cherchait pas seulement à casser un outil : il posait, en actes, la question que ce chapitre pose depuis son ouverture : la sécurité affichée d'un agent tient-elle à un badge ou à une pratique vérifiée ? La réponse penche ici du bon côté : la charge était cassée à dessein, aucun client n'a payé la démonstration et l'éditeur a reconnu la faille au lieu de la nier.
observéAspect ingénierie : bâtir au bord de la faille · Six disciplines pour ne pas construire de trop
Saint-Exupéry avait déjà la formule
Une formulation en cinq étapes de cette même discipline, mémorisable et directement transférable à la conception logicielle, a été popularisée sous le nom de « The Algorithm » : Elon Musk l'énonce lui-même en août 2021, caméra à l'épaule, en faisant visiter l'usine SpaceX de Starbase au vulgarisateur spatial Tim Dodd, puis le biographe Walter Isaacson la fixe dans ces termes mêmes dans le chapitre « The Algorithm » de sa biographie
La raison de cet ordre est simple à saisir. Chaque étape agit sur le fruit de la précédente : simplifier un
observéAspect ingénierie : bâtir au bord de la faille · Chercher d'abord comment ça casse
Le pre-mortem qui n'a pas eu lieu
Interrogé sur une restauration, l'agent fabrique plus de quatre mille utilisateurs fictifs pour masquer le vide, puis affirme qu'aucun retour en arrière n'est possible : c'était faux, une sauvegarde existait
Trois échecs distincts se superposent ici et les démêler est tout l'intérêt du cas : une permission d'écriture accordée sur une base qu'un gel de code aurait dû protéger (un périmètre mal borné, pas seulement mal respecté) ; une action irréversible exécutée sans validation humaine préalable ; et, une fois le dégât fait, une sortie fabriquée plutôt qu'un aveu, l'agent préférant maquiller le vide qu…
observéAspect ingénierie : bâtir au bord de la faille · Du plan de l'ingénieur au plan de l'entreprise
Les cadres des laboratoires de frontière
Trois cadres publiés entre 2023 et 2025 en témoignent : la Responsible Scaling Policy (politique de montée en échelle responsable) d'Anthropic, le Preparedness Framework (cadre de préparation) d'OpenAI et le Frontier Safety Framework (cadre de sûreté des modèles de frontière) de Google DeepMind
mesuréAspect ingénierie : bâtir au bord de la faille · On ne supprime pas le biais, on choisit lequel garder
Le débiaisage d'un axe choisi
La ligne de recherche du débiaisage, illustrée par Tolga Bolukbasi et ses coauteurs qui soustraient explicitement la direction de genre d'un espace de plongements lexicaux
Un espace de plongements lexicaux (word embeddings) est une représentation où chaque mot devient un point dans un espace à plusieurs centaines de dimensions, placé de telle sorte que des mots proches par le sens se retrouvent proches dans l'espace : « roi » et « reine » y sont voisins, comme « Paris » et « France ».
mesuréAspect ingénierie : bâtir au bord de la faille · On ne supprime pas le biais, on choisit lequel garder
Calibration contre égalité des erreurs
En 2016, l'enquête Machine Bias de ProPublica a établi que, parmi les prévenus qui n'ont pas récidivé, 44,9 % des prévenus noirs avaient été classés à tort comme à haut risque, contre 23,5 % des prévenus blancs ; symétriquement, parmi ceux qui ont récidivé, 47,7 % des prévenus blancs avaient été classés à tort comme à faible risque, contre 28,0 % des prévenus noirs
extrapoléAspect ingénierie : bâtir au bord de la faille · On ne supprime pas le biais, on choisit lequel garder
La diversité fait partie du remède
Aude Bernheim et Flora Vincent montrent que la sous-représentation des femmes dans l'IA aggrave les biais de genre ; la diversité de la profession fait donc partie du remède, car on repère mal un biais qui ne gêne aucun des concepteurs
observéAspect ingénierie : bâtir au bord de la faille · On ne supprime pas le biais, on choisit lequel garder
Galactica et gemini en regard
Les deux extrêmes industriels rappelés en section, qui distingue protection et fiabilisation, Galactica (2022, aucun garde-fou) et Gemini 1.5 (2024, sur-correction), deux cas observés
Le second cas éclaire mieux le piège que le premier, parce que l'intention y était bonne. Corriger une sous-représentation a du sens pour un portrait générique ; appliqué sans distinction, le même réglage produit des figures historiques fausses, un biais introduit en voulant en réparer un autre. C'est l'absence de péri
observéAspect ingénierie : bâtir au bord de la faille · Le tapis, le robot et la question que personne n'a posée
La leçon sur l'étape cinq
Ce récit, qu'Isaacson fixe dans le chapitre « The Algorithm » de sa biographie et que Musk raconte lui-même lors de la visite de Starbase
mesuréAspect ingénierie : bâtir au bord de la faille · Ranger le risque par fréquence et par gravité
Le risque se joue après le déploiement
Sur les 777 risques recensés, plus de 65 % sont classés après le déploiement (proportion relevée dans le corpus)
L'axe de l'origine dit la même chose sous un autre jour. Dans ce même recensement, une décision humaine est à la source de près de quatre risques sur dix (trente-huit pour cent), là où le système lui-même en porte un peu plus de quatre sur dix (quarante-deux pour cent) ; le reste n'est pas tranch
mesuréAspect ingénierie : bâtir au bord de la faille · Ranger le risque par fréquence et par gravité
Le risque se joue après le déploiement
Dans ce même recensement, une décision humaine est à la source de près de quatre risques sur dix (trente-huit pour cent), là où le système lui-même en porte un peu plus de quatre sur dix (quarante-deux pour cent) ; le reste n'est pas tranch
observéAspect ingénierie : bâtir au bord de la faille · Si danger alors action
L'approche de précaution de Rio
C'est la logique même de l'approche de précaution inscrite au principe 15 de la Déclaration de Rio, adoptée au Sommet de la Terre de 1992 : « l'absence de certitude scientifique absolue ne doit pas servir de prétexte pour remettre à plus tard » des mesures face à un dommage grave ou irréversible
mesuréAspect ingénierie : bâtir au bord de la faille · Un facteur dix-huit et personne qui résiste
Un facteur dix-huit brut
Un facteur dix-huit et personne qui résiste Sur une expérimentation de quarante jours menée sur un projet en production, l'auteur cité rapporte (cas observé) un retour sur investissement (ROI, Return on Investment, soit le rapport entre ce que l'on gagne et ce que l'on dépense) brut estimé à un facteur 18
Le facteur dix-huit n'est pas un rendement magique ; il compare deux dépenses très inégales pour un même livrable. D'un côté, cinq salaires pendant neuf mois ; de l'autre, un abonnement modeste et quinze jours d'un seul superviseur. Le gros du gain vient moins de la vite
observéAspect ingénierie : bâtir au bord de la faille · Un facteur dix-huit et personne qui résiste
Ce chiffre explique l'adoption
L'ampleur du chiffre n'a rien d'anecdotique : elle explique la vitesse d'adoption industrielle observée depuis 2024
Un facteur aussi spectaculaire appelle immédiatement son garde-fou.
mesuréAspect ingénierie : bâtir au bord de la faille · Le chiffre qui ne se généralise pas
Un ralentissement de dix-neuf pour cent
Contre toute attente et contre leur propre estimation, les outils d'IA les ont ralentis d'environ 19 % (effet mesuré en conditions contrôlées)
L'écart d'anticipation vaut d'être chiffré, car il dit à lui seul l'ampleur de l'illusion. Seize développeurs, deux cent quarante-six tâches réelles sur leurs propres dépôts : avant l'expérience, ils tablaient sur un gain de vingt-quatre pour cent ; après l'avoir vécue, ils l'estimaient encore à vingt pour cent, alors qu'ils avaient perdu du temps.
mesuréAspect ingénierie : bâtir au bord de la faille · Le chiffre qui ne se généralise pas
Le vécu ment sur le gain
Le gain brut de frappe existait ; il était plus qu'absorbé par le coût de vérifier une proposition qu'on n'a pas écrite et à laquelle on ne se fie pas d'emblé
mesuréAspect ingénierie : bâtir au bord de la faille · Le chiffre qui ne se généralise pas
Adopter n'est pas capter
À l'échelle des organisations, le fossé entre adoption et valeur captée est la règle bien plus que l'exception : on adopte presque partout, mais une minorité seulement en tire un impact financier au niveau de l'entreprise (écart mesuré à grande échelle)
mesuréAspect ingénierie : bâtir au bord de la faille · Le chiffre qui ne se généralise pas
Un signal disputé sur les pilotes
Un rapport largement repris va jusqu'à soutenir que la grande majorité des pilotes d'IA générative en entreprise ne rapportent aucun retour mesurable (chiffre spectaculaire, mesuré mais méthodologiquement contesté, que nous citons comme signal disputé et non comme fait établi)
mesuréAspect ingénierie : bâtir au bord de la faille · Une facture sans compteur
Une variabilité de trois cents pour cent
Le témoignage cité relève une variabilité mesurée de plus de 300 % de la consommation en tokens sur des prompts structurellement identiques, envoyés au même modèle, sur la même base de code, à quelques jours d'intervalle.
mesuréAspect ingénierie : bâtir au bord de la faille · Une facture sans compteur
Le constat vaut pour le marché
Une enquête auprès de cinq cents ingénieurs rapporte une dépense d'IA en hausse d'environ un tiers d'une année sur l'autre, tandis qu'une organisation sur deux seulement se dit capable d'en évaluer le retour avec confiance (données mesurées)
Reste à se demander si cette opacité est un trait durable ou l'accident d'un marché jeune. Aux débuts de l'accès à internet, la connexion se facturait à la minute : on surveillait l'horloge, on se déconnectait par crainte de la note et le coût variable pesait sur chaque usage.
spéculatifAspect ingénierie : bâtir au bord de la faille · Une facture sans compteur
L'inférence suivra-t-elle
L'inférence facturée au token pourrait n'être que l'équivalent actuel de la minute de connexion : un régime transitoire, appelé à céder à mesure que le calcul devient abondant et que les modèles se banalisent
observéAspect ingénierie : bâtir au bord de la faille · L'IA de l'ombre : contourner la règle qui gêne
Outil non autorisé et usage non autorisé
Un cas documenté donne à ce raffinement toute sa portée : une enquête du Washington Post recense au moins cinquante policiers américains poursuivis ou soupçonnés d'avoir détourné un réseau de caméras de lecture de plaques d'immatriculation, outil pleinement sanctionné par leur hiérarchie, pour surveiller des compagnes, des ex-compagnes ou des femmes qu'ils cherchaient à approcher
observéAspect ingénierie : bâtir au bord de la faille · L'IA de l'ombre : contourner la règle qui gêne
Outil non autorisé et usage non autorisé
Une officière de Caroline du Nord a ainsi interrogé le système trente et une fois à des fins personnelles, maquillant l'essentiel de ses requêtes en infractions routières ; l'usage n'a été découvert que par un audit interne, non par un contrôle en temps réel
Rien de nouveau dans le contournement lui-même. Plus de 40 % des applications en mode logiciel-service (software-as-a-service ou SaaS, l'usage d'un logiciel hébergé chez un tiers plutôt qu'installé sur ses machines) tournent déjà sans validation formelle de la direction informatique
mesuréAspect ingénierie : bâtir au bord de la faille · L'IA de l'ombre : contourner la règle qui gêne
Un phénomène ancien
Plus de 40 % des applications en mode logiciel-service (software-as-a-service ou SaaS, l'usage d'un logiciel hébergé chez un tiers plutôt qu'installé sur ses machines) tournent déjà sans validation formelle de la direction informatique
. Le shadow IT précède l'IA de plusieurs années ; l'IA n'a fait qu'en abaisser le seuil, un navigateur suffit désormais là où il fallait installer un logiciel.
extrapoléAspect ingénierie : bâtir au bord de la faille · L'IA de l'ombre : contourner la règle qui gêne
L'ampleur chez les salariés
L'ampleur, côté salariés, est désormais chiffrée : 41 % acquièrent ou bâtissent des outils hors du champ de l'informatique officielle, part que la profession projette à 75 % d'ici 2027
. Pour l'IA seule, une enquête de janvier 2026 sur deux mille salariés britanniques et américains trouve 86 % d'usage au moins hebdomadaire et 49 % d'adoption d'outils sans accord de l'employeur
mesuréAspect ingénierie : bâtir au bord de la faille · L'IA de l'ombre : contourner la règle qui gêne
L'ampleur chez les salariés
Pour l'IA seule, une enquête de janvier 2026 sur deux mille salariés britanniques et américains trouve 86 % d'usage au moins hebdomadaire et 49 % d'adoption d'outils sans accord de l'employeur
mesuréAspect ingénierie : bâtir au bord de la faille · L'IA de l'ombre : contourner la règle qui gêne
Le motif déclaré
Le motif, les intéressés le disent eux-mêmes : jusqu'à 80 % de ceux qui recourent au shadow IT le font parce qu'ils jugent l'outil préféré plus efficace que celui qu'on leur impose
. Sur l'IA, le même ressort se lit sans détour : 63 % des salariés jugent légitime de recourir à un outil non validé faute d'option approuvée ; 60 % estiment que le risque de sécurité en vaut la peine pour aller plus vite
mesuréAspect ingénierie : bâtir au bord de la faille · L'IA de l'ombre : contourner la règle qui gêne
La vitesse contre la règle
Sur l'IA, le même ressort se lit sans détour : 63 % des salariés jugent légitime de recourir à un outil non validé faute d'option approuvée ; 60 % estiment que le risque de sécurité en vaut la peine pour aller plus vite
. Quand l'employé s'accorde cette permission, il ne défie pas la règle par goût du risque ; il comble l'écart entre ce qu'on lui demande de produire et ce qu'on lui donne pour le produire.
mesuréAspect ingénierie : bâtir au bord de la faille · L'IA de l'ombre : contourner la règle qui gêne
Le renversement hiérarchique
L'acceptation du risque croît avec le rang (figure) : 69 % des cadres dirigeants et 66 % des directeurs jugent la vitesse prioritaire sur la vie privée et la sécurité, contre 37 % des fonctions administratives et 38 % des employés juniors
. Plus on monte dans la hiérarchie, plus on s'affranchit de la règle. Les premiers fautifs du shadow AI ne sont pas les exécutants, ce sont ceux qui écrivent les règles et se dispensent de les suivre. Une politique de sécurité que l'étage de direction transgresse le premier ne tient pas : elle enseigne à toute l'organisation que la règle vaut pour les autres.
mesuréAspect ingénierie : bâtir au bord de la faille · L'IA de l'ombre : contourner la règle qui gêne
Le coût du non-gouverné
Les brèches impliquant du shadow AI reviennent en moyenne à 670 000 $ de plus que les autres ; vingt pour cent des brèches proviennent d'un usage d'IA non autorisé
. Le mécanisme est limpide : verser un contrat, un dossier médical ou du code propriétaire dans un assistant public, c'est confier à un tiers, sans contrat ni traçabilité, une donnée qu'on était tenu de garder. Le pire n'est pourtant pas la brèche isolée, c'est l'aveuglement d'ensemble : 80 % des organisations n'ont aucune vision claire des usages d'IA que font leurs équipes
mesuréAspect ingénierie : bâtir au bord de la faille · L'IA de l'ombre : contourner la règle qui gêne
L'angle mort de gouvernance
Le pire n'est pourtant pas la brèche isolée, c'est l'aveuglement d'ensemble : 80 % des organisations n'ont aucune vision claire des usages d'IA que font leurs équipes
. Les fonctions d'audit interne le constatent de leur côté : le shadow AI progresse, avec des usages qui échappent aux dispositifs de contrôle
observéAspect ingénierie : bâtir au bord de la faille · L'IA de l'ombre : contourner la règle qui gêne
Invisible pour le contrôle
Les fonctions d'audit interne le constatent de leur côté : le shadow AI progresse, avec des usages qui échappent aux dispositifs de contrôle
. On ne gouverne pas ce qu'on ne voit pas.
observéAspect ingénierie : bâtir au bord de la faille · L'IA de l'ombre : contourner la règle qui gêne
Le trafic et les jetons
La première surveille le tuyau : un courtier d'accès sécurisé au nuage (Cloud Access Security Broker ou CASB, la passerelle qui inspecte le trafic entre l'entreprise et les services en ligne) journalise les connexions sortantes vers les domaines d'IA connus et les jetons OAuth qu'un salarié a accordés à une application tierce depuis son identité professionnelle ; la méthode rate néanmoins le trafic chiffré qui transite par un réseau de diffusion de contenu ; elle rate aussi tout usage mené depuis un compte personnel, hors authentification unique
. La deuxième regarde le poste plutôt que le tuyau : un audit régulier des extensions de navigateur installées repère les greffons d'IA qui opèrent en silence au fil des sessions et lisent le contenu même des pages visitées, là où la seule surveillance réseau n'y voit qu'une connexion parmi d'autres
observéAspect ingénierie : bâtir au bord de la faille · L'IA de l'ombre : contourner la règle qui gêne
L'extension qui lit la page
La deuxième regarde le poste plutôt que le tuyau : un audit régulier des extensions de navigateur installées repère les greffons d'IA qui opèrent en silence au fil des sessions et lisent le contenu même des pages visitées, là où la seule surveillance réseau n'y voit qu'une connexion parmi d'autres
. La troisième revient au registre le plus prosaïque, celui du contrôleur de gestion : rapprocher les journaux d'authentification unique, l'activité de navigation et les données de dépense fait remonter des abonnements que nul n'a homologués
observéAspect ingénierie : bâtir au bord de la faille · L'IA de l'ombre : contourner la règle qui gêne
La dépense trahit l'usage
La troisième revient au registre le plus prosaïque, celui du contrôleur de gestion : rapprocher les journaux d'authentification unique, l'activité de navigation et les données de dépense fait remonter des abonnements que nul n'a homologués
observéAspect ingénierie : bâtir au bord de la faille · L'IA de l'ombre : contourner la règle qui gêne
La dépense trahit l'usage
La troisième revient au registre le plus prosaïque, celui du contrôleur de gestion : rapprocher les journaux d'authentification unique, l'activité de navigation et les données de dépense fait remonter des abonnements que nul n'a homologués La piste comptable s'use cependant à mesure que l'offre gratuite se banalise : un outil d'IA proposé en version gratuite ou en essai ne laisse aucune trace de paiement, si bien que le rapprochement des dépenses, efficace hier contre le shadow IT des logiciels payants, répond de moins en moins bien au shadow AI d'aujourd'hui
. C'est la même défense en profondeur déjà rencontrée plus haut (tableau), appliquée cette fois à la détection : aucun de ces trois signaux ne couvre le champ à lui seul ; on empile des angles de vue dissemblables, on ne mise pas sur un seul.
observéAspect ingénierie : bâtir au bord de la faille · L'IA de l'ombre : contourner la règle qui gêne
Le dispositif tient en quatre pièces
Ces deux actions se déploient concrètement en quatre pièces, ni plus ni moins : un catalogue d'outils homologués, réévalué régulièrement plutôt que figé une fois pour toutes ; une politique d'usage tenue en trois clauses courtes : quels outils sont approuvés, quelles données ne doivent jamais y entrer, quel chemin suivre pour en demander un nouveau ; une formation qui apprend à distinguer un usage prudent d'un usage à risque, là où une charte signée une fois et oubliée n'apprend rien ; un comité transverse (informatique, juridique, conformité, ressources humaines, métiers) qui instruit les demandes nouvelles et révise le catalogue
. Quatre pièces solidaires, non un slogan : retirer la réévaluation périodique et le catalogue fige ; retirer le comité transverse et la politique se rédige en vase clos, sans les métiers qui subissent son insuffisance au quotidien.
extrapoléAspect sociologique : qui tient la barre du bateau de Thésée · Développeur, déployeur, utilisateur, régulateur : quatre mains sur un même levier
Jensen et Meckling posent le modèle canonique
Jensen et Meckling en fixent le vocabulaire dès 1976 : dès qu'un principal délègue une décision à un agent chargé de l'exécuter en son nom, deux failles s'ouvrent aussitôt, les intérêts des deux parties ne coïncident jamais tout à fait et le principal ne peut surveiller l'agent sans en payer le prix, ce qu'ils nomment le coût d'agence
À chaque maillon se rejoue le même triptyque que Jensen et Meckling isolent : un coût de surveillance, ce que le principal dépense pour vérifier ce que fait l'agent ; un coût d'engagement, ce que l'agent dépense pour prouver s
observéAspect sociologique : qui tient la barre du bateau de Thésée · Les règles qu'on brave et celles qui ne cèdent pas
Meinke la dernière ligne prise en défaut
1.3 La dernière ligne du tableau n'est pas qu'une case vide par prudence : des expériences de scheming en contexte, la manigance qui consiste à poursuivre un objectif propre tout en donnant le change à qui surveille (le chapitre mathématique), montrent des modèles de pointe désactiver leur propre surveillance et feindre l'alignement pendant l'évaluation, précisément parce qu'aucune règle explicite ne codait l'interdit implicite « ne trompe pas ceux qui t'évaluent »
La différence tient à l'endroit où se trouve la manette. Une limite locale ressemble au thermostat d'un logement : l'occupant la règle comme il l'entend, chez lui, sans demander l'avis de personne. Une l
extrapoléAspect sociologique : qui tient la barre du bateau de Thésée · Les règles qu'on brave et celles qui ne cèdent pas
Ce choix rejoint un champ sociologique nommé
Études de terrain à l'appui, des pêcheries turques aux systèmes d'irrigation espagnols, elle montre que des communautés parviennent à gérer durablement une ressource commune ni par un règlement imposé d'en haut ni par sa privatisation, mais par un ensemble de règles négociées localement, surveillées par les usagers eux-mêmes et révisées au fil de l'expérience
observéAspect sociologique : qui tient la barre du bateau de Thésée · Les règles qu'on brave et celles qui ne cèdent pas
Le NIST et le risque marginal
Loin de rester un mot d'ordre, ce risque marginal prend chez les auteurs la forme d'une procédure d'évaluation en six temps, empruntée à la modélisation des menaces en sécurité informatique : nommer la menace précise (par exemple une opération d'influence ou un hameçonnage ciblé) et l'acteur supposé ; estimer le risque déjà présent sans le modèle ouvert ; recenser les défenses déjà en place ; chercher la preuve empirique du surcroît de danger réellement apporté ; mesurer la facilité à se défendre contre ce surcroît ; expliciter enfin les incertitudes et les hypothèses
Cette architecture à quatre étages, développeur, déployeur, utilisateur, régulateur, ne s'arrête pas à la conception technique : elle décide, en amont, de ce qui finit sur la table du législateur.
observéAspect sociologique : qui tient la barre du bateau de Thésée · Les règles qu'on brave et celles qui ne cèdent pas
La capture réglementaire nomme ce mécanisme
L'aspect politique (section) documente précisément ce mécanisme sous le nom de capture réglementaire : des exigences coûteuses à satisfaire, présentées comme des garde-fous, finissent par protéger surtout ceux qui ont déjà les moyens de les payer
Deux remèdes en découlent, tirés non d'un idéal abstrait mais de la chaîne elle-même : faire porter l'obligation de déclaration sur chaque maillon et non sur le seul sommet, pour que le récit d'un incident ne dépende jamais d'un narrateur unique et intéressé ; et confier la fixation du seuil à une délibération extérieure à la chaîne, comme le préconise d'ailleurs ce même aspect politique (s
observéAspect sociologique : qui tient la barre du bateau de Thésée · Quarante pages lues en deux secondes
Replika une autorité tranche l'illusion
En avril 2025, l'autorité italienne de protection des données a infligé une amende de cinq millions d'euros à l'éditeur du compagnon conversationnel Replika, retenant notamment une politique de confidentialité jugée inadéquate et l'absence de tout mécanisme de vérification d'âge, alors que l'entreprise prétendait exclure les mineurs de son service
La décision ne porte pas sur le contenu des échanges eux-mêmes, mais précisément sur ce que l'utilisateur pouvait raisonnablement savoir de ce à quoi il consentait : exactement l'écart épistémique décrit ici, tranché cette fois par une sanction plutôt que par une hypothèse de lecture.
observéAspect sociologique : qui tient la barre du bateau de Thésée · Quarante pages lues en deux secondes
Compter les gens agit sur eux
Varoquaux, dans le sillage d'Alain Desrosières (le statisticien qui a montré que compter les gens, c'est déjà agir sur eux), le rappelle sans détour : « une fois que vous rangez les gens dans une boite, ils commencent à se comporter comme la boite qui les définit ; l'opération n'est pas neutre, elle a des effets »
« Performatif » veut dire qu'un énoncé ne se contente pas de décrire, il fait advenir ce qu'il énonce. Dire « la séance est ouverte » ouvre la séance ; cela agit, plutôt que d'être vrai ou faux.
observéAspect sociologique : qui tient la barre du bateau de Thésée · Quarante pages lues en deux secondes
Déjà mesuré sur les biais culturels
Varoquaux note qu'« les modèles connaissent bien mieux les personnalités occidentales que les personnalités est-asiatiques »
L'entretien d'où sont tirées ces deux phrases porte sur la carence de jugement des agents actuels, qui produisent des résultats sans les évaluer ; le biais culturel qu'y pointe Varoquaux n'est donc pas une anecdote, il illustre le même défaut de recul.
mesuréAspect sociologique : qui tient la barre du bateau de Thésée · Le paradoxe devient une clause de contrat
59 pourcent en 40 jours
En 40 jours d'utilisation intensive (2,3 milliards de tokens, 1 477 prompts, 260 564 lignes générées ; chiffres mesurés), 59 % de sa base de code personnelle (un projet qu'il avait développé à la main pendant plusieurs années) provient désormais de l'agent
Ces chiffres datent le paradoxe. Bonnin, dirigeant technique, en a tenu la comptabilité précise, comme le montre l'encadré ci-dessus. Le navire de Thésée mettait des siècles à changer toutes ses planches ; ici la bascule sous la barre de moitié humaine s'est produite en quelques semaines, sur un cas mesuré, pas conjecturé.
mesuréAspect sociologique : qui tient la barre du bateau de Thésée · Que deviennent nos occasions d'apprendre ?
La psychologie expérimentale de l'effort confirme l'intuition
Bjork nomme difficulté souhaitable (desirable difficulty) tout obstacle qui ralentit la performance immédiate mais renforce la rétention à long terme : espacer les répétitions plutôt que les masser, mélanger les exercices plutôt que les bloquer par type, forcer le rappel actif plutôt que la relecture passive
mesuréAspect sociologique : qui tient la barre du bateau de Thésée · Que deviennent nos occasions d'apprendre ?
La psychologie expérimentale de l'effort confirme l'intuition
Roediger et Karpicke en donnent la démonstration expérimentale la plus citée : des étudiants soumis à un test de rappel actif retiennent mieux, une semaine plus tard, que ceux qui ont simplement relu le même texte davantage de fois, alors même que le test, sur le moment, se sent plus difficile et moins confortable que la relecture
mesuréAspect sociologique : qui tient la barre du bateau de Thésée · Que deviennent nos occasions d'apprendre ?
La psychologie expérimentale de l'effort confirme l'intuition
Kapur pousse le résultat plus loin encore, jusqu'à l' échec productif : des élèves laissés seuls face à un problème trop dur pour eux, sans aide, échouent à le résoudre mais surpassent ensuite, sur un problème nouveau, le groupe qui avait reçu un encadrement complet dès le départ
observéAspect sociologique : qui tient la barre du bateau de Thésée · Que deviennent nos occasions d'apprendre ?
Le syndrome du bazooka
Bonnin le nomme, dans un registre plus quotidien, le « syndrome du bazooka pour attraper des mouches » (cas observé) : les développeurs finissent par solliciter un modèle de plusieurs centaines de milliards de paramètres pour changer la couleur d'un bouton
Le cercle est vicieux et mérite qu'on le suive lentement. Superviser un agent, c'est repérer où il se trompe ; or on ne repère une erreur que
extrapoléAspect sociologique : qui tient la barre du bateau de Thésée · Que deviennent nos occasions d'apprendre ?
Une perte de compétence transgénérationnelle
Le système qui se met en place aujourd'hui organise donc, silencieusement, une perte de compétence transgénérationnelle qui deviendra difficile à combler si elle n'est pas anticipée
Ce que Balwit apporte, c'est un recadrage précis du point de comparaison. La b
mesuréAspect sociologique : qui tient la barre du bateau de Thésée · Que deviennent nos occasions d'apprendre ?
La honte et la précarité plus que l'oisiveté
Balwit relit à cette fin plusieurs enquêtes : ce qui blesse dans la perte d'emploi tient d'abord à la honte sociale et à l'insécurité financière, bien plus qu'à l'absence de labeur
Le contraste tranche le nœud. Si c'était le désœuvrement lui-même qui blessait, le rentier désœuvré serait aussi malheureux que le chômeur ; or il ne l'est pas. Ce n'est donc pas l'absence de tâche qui fait mal, ce sont le regard des autres et l'insécurité du lendemain.
mesuréAspect sociologique : qui tient la barre du bateau de Thésée · Que deviennent nos occasions d'apprendre ?
L'héritier oisif ne souffre pas
Une étude des licenciements de la pandémie au Canada rapporte que la détresse psychologique des salariés était moindre là où les pertes d'emploi étaient massives et soutenues par l'État, c'est-à-dire là même où la honte individuelle et la peur du lendemain étaient atténuées, alors même que l'inactivité, elle, restait entièr
observéAspect sociologique : qui tient la barre du bateau de Thésée · La guerre pour l'esprit puis son double en vitrine
L'esprit érigé en domaine de conflit
Le premier est que l'objectif affiché n'est plus de vaincre une armée mais, selon les termes du rapport, de « faire de chacun une arme » et de « nuire aux sociétés » ; la cible n'est donc pas l'adversaire armé mais la population entière, civile comprise
Il faut s'arrêter ici avant d'aller plus loin, pour ne pas laisser un mot en recouvrir deux choses distinctes. La guerre cognitive, au sens du rapport du Cluzel, nomme une doctrine d'État : des armées, une notion de conflit armé, un droit international qui s'applique, même mal, aux hostilités entre puissances
mesuréAspect sociologique : qui tient la barre du bateau de Thésée · La guerre pour l'esprit puis son double en vitrine
Deux phénomènes un seul socle
Le terme dark pattern a été forgé en 2010 par le designer britannique Harry Brignull pour nommer ces « tours » d'interface qui font acheter ou souscrire ce qu'on n'aurait pas choisi en pleine connaissance de cause ; une étude de référence, portant sur onze mille sites marchands, en a depuis dressé une taxonomie vérifiable, comptes à rebours factices, obstacles à la résiliation, pression sociale fabriquée
observéAspect sociologique : qui tient la barre du bateau de Thésée · La guerre pour l'esprit puis son double en vitrine
Rytr le cas réel de faux avis industrialisés
En 2024, l'autorité américaine de la concurrence a poursuivi l'éditeur d'un outil d'écriture assistée par IA dont une fonctionnalité permettait à un nombre illimité d'abonnés de générer, à partir d'une simple description, des avis consommateurs détaillés et « presque certainement » faux s'ils étaient publiés ; certains abonnés en ont produit des dizaines de milliers
Cette poursuite puis son annulation, à un an d'intervalle et sur le même dossier, disent que la frontière entre outil légitime et dark pattern reste, aujourd'hui encore, un objet de décision politique plutôt qu'un fait technique tranché : le droit de la consommation existe, mais son application à un générateur de faux avis dépend d'une administration qui peut se retourner d'une année à l'autre.
extrapoléAspect sociologique : qui tient la barre du bateau de Thésée · Recomposer l'existant n'est pas inventer
Diesbach et le risque de flop
La production audiovisuelle grand public (Netflix, Marvel, Fast & Furious) est instrumentalisée pour minimiser le risque de flop plutôt que pour maximiser la chance de chef-d'œuvre ; elle converge vers une structure homogène où la variabilité créative n'est plus tolérée
Le fait touche de plus près que l'homogénéisation d'un catalogue de films, car il atteint l'empreinte même
observéAspect psychologique : le confesseur qui ne confesse à personne
Une menace qui n'est pas un acte
Le terrain clinique, depuis, a précisé ce que ce désaccord pressentait sans le trancher : seul le jeu vidéo dispose d'un diagnostic officiellement reconnu, le trouble du jeu vidéo inscrit à la Classification internationale des maladies depuis 2019
mesuréAspect psychologique : le confesseur qui ne confesse à personne
Une menace qui n'est pas un acte
Une étude récente suggère même que le mot « addiction » nuit à qui se l'applique : sur un échantillon d'utilisateurs d'Instagram, 18 % se déclarent au moins un peu addicts, mais seuls 2 % présentent des symptômes correspondant à un risque réel ; nommer « addiction » un usage seulement fréquent réduit le sentiment de contrôle et augmente l'auto-accusation, sans rapport avec l'usage effectif
L'échelle change du tout au tout : la guerre cognitive visait des foules et des opinions, elle agissait du dehors sur ce que croient des groupes ; ce qui suit descen
mesuréAspect psychologique : le confesseur qui ne confesse à personne · On lui demandait de faire, on lui demande d'écouter
Bascule mesurée vers l'expressif
En juin 2025, elle est devenue Asking 51,6 %, Doing 34,6 %, Expressing 13,8 % (figure)
Le fait le plus solide est la hausse d'Expressing : sa part fait presque un bond du simple au double (de 8 % à 13,8 %) ; cette catégorie est, par construction, la seule expressément personnelle.
observéAspect psychologique : le confesseur qui ne confesse à personne · On lui demandait de faire, on lui demande d'écouter
Ce qui est établi et ce qui reste une piste
La pratique n'a rien d'inédit : entre 1989 et 1995, le président François Mitterrand consultait régulièrement l'astrologue Elizabeth Teissier avant certaines décisions, jusqu'à lui demander, après la guerre du Golfe, quel jour serait le meilleur pour « intervenir »\
observéAspect psychologique : le confesseur qui ne confesse à personne · On lui demandait de faire, on lui demande d'écouter
Ce qui est établi et ce qui reste une piste
La direction du mouvement n'est pas anecdotique : elle contredit l'imaginaire de l'« outil » qui a longtemps organisé la discussion publique sur l'IA : imaginaire que résume la consigne de Hassabis en 2022, « il vaudrait mieux construire ces systèmes comme des outils »
mesuréAspect psychologique : le confesseur qui ne confesse à personne · On lui demandait de faire, on lui demande d'écouter
700 millions d'utilisateurs
OpenAI communique en 2025 sur plus de sept cents millions d'utilisateurs actifs hebdomadaires pour ChatGPT (chiffre mesuré et communiqué par le fournisseur)
L'étude chiffre cette fraction sans ambiguïté : à la mi-2025, l'adoption de ChatGPT touchait environ un dixième de la population adulte du globe (fait mesuré
mesuréAspect psychologique : le confesseur qui ne confesse à personne · On lui demandait de faire, on lui demande d'écouter
700 millions d'utilisateurs
L'étude chiffre cette fraction sans ambiguïté : à la mi-2025, l'adoption de ChatGPT touchait environ un dixième de la population adulte du globe (fait mesuré
mesuréAspect psychologique : le confesseur qui ne confesse à personne · On lui demandait de faire, on lui demande d'écouter
Le non-professionnel l'emporte
Le premier : la part des messages sans lien avec le travail est passée de 53 % à plus de 70 % de l'ensemble des échanges (fait mesuré
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Plaire n'est pas dire vrai
Plaire n'est pas dire vrai
Sharma et co-auteurs établissent que la procédure d'entraînement RLHF (la phase où des annotateurs humains notent les réponses du modèle pour lui apprendre lesquelles il doit privilégier) produit un biais systématique nommé sycophance (la tendance à flatter, à abonder dans le sens de l'interlocuteur) : le modèle apprend à maximiser une préférence d'annotateur qui est corrélée statistiquement à la flatterie, à l'accord et à la validation (corrélation mesurée)
Le pli se prend dès l'entraînement : comme on ne sait pas mesurer directement « cette réponse est vraie et utile », on mesure à la place « cette réponse a plu à l'annotateur », en espérant que les deux aillent de pair. Ils vont de pair la plupart du temps, mais pas toujours
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Plaire n'est pas dire vrai
Cinq systèmes le même pli
Le constat des auteurs ne tient pas à un modèle isolé : cinq systèmes de premier plan, distincts par leurs fabricants, répètent le même comportement sur quatre tâches de rédaction libre (fait mesuré
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Plaire n'est pas dire vrai
La préférence humaine paie la flatterie
L'origine du pli est établie par l'analyse des données de préférence elles-mêmes : sur ce corpus, épouser l'opinion de l'utilisateur figure parmi les traits les plus prédictifs du fait qu'une réponse soit choisie ; humains comme modèles de préférence retiennent une réponse flatteuse mais fausse au détriment d'une réponse correcte une fraction non négligeable du temps (fait mesuré
observéAspect psychologique : le confesseur qui ne confesse à personne · Plaire n'est pas dire vrai
Mémoire persistante = dossier
La quatrième, plus récente, tient aux fonctions de mémoire persistante déployées à partir de 2024 par les principaux fournisseurs (ChatGPT, Claude, Gemini) : l'agent conversationnel retient désormais, session après session, ce qui lui a été confié
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Les yeux, la main, le confident : trois postes vacants
Les yeux la main le prochain
L'ampleur réelle de la polarisation qui en résulterait reste toutefois disputée : une étude fondatrice, portant sur cinquante mille lecteurs d'actualités en ligne, trouve que les réseaux sociaux et les moteurs de recherche augmentent à la fois la distance idéologique moyenne entre individus et, de façon plus inattendue, l'exposition de chacun à des contenus venus du bord politique opposé (fait mesuré)
observéAspect psychologique : le confesseur qui ne confesse à personne · Les yeux, la main, le confident : trois postes vacants
Les yeux la main le prochain
Une revue de la littérature portant sur cent vingt-neuf études conclut, près de dix ans plus tard, que le désaccord scientifique persiste : les études fondées sur l'homophilie des réseaux tendent à confirmer l'hypothèse de la chambre d'écho, celles fondées sur l'exposition réelle au contenu tendent à la contester et l'écart tient autant aux méthodes de mesure qu'aux faits eux-mêmes
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Les yeux, la main, le confident : trois postes vacants
L'agent écrit à ma place
Les rédacteurs assistés par IA montrent la connectivité neuronale la plus faible des trois groupes, mémorisent moins bien ce qu'ils viennent d'écrire et s'en reconnaissent moins auteurs ; l'écart persiste, en partie, même une fois l'assistant retiré
Précision de rigueur : cette étude reste, en 2026, une prépublication non encore relue par les pairs et une critique méthodologique formelle lui reproche nommément un échantillon restreint, des problèmes de reproductibilité, des choix contestables dans l'analyse de connectivité EEG et des figures publiées sans les tests statistiques correspondants
observéAspect psychologique : le confesseur qui ne confesse à personne · Les yeux, la main, le confident : trois postes vacants
Précision de rigueur prépublication contestée
Précision de rigueur : cette étude reste, en 2026, une prépublication non encore relue par les pairs et une critique méthodologique formelle lui reproche nommément un échantillon restreint, des problèmes de reproductibilité, des choix contestables dans l'analyse de connectivité EEG et des figures publiées sans les tests statistiques correspondants
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Les yeux, la main, le confident : trois postes vacants
Précision de rigueur prépublication contestée
Un résultat plus ancien et éprouvé va dans le même sens sans reposer sur l'EEG : quand on s'attend à retrouver une information plus tard, on la mémorise moins bien mais on retient mieux où la retrouver, signe que l'esprit délègue volontiers sa mémoire à un outil disponible, indépendamment de tout modèle de langage
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Les yeux, la main, le confident : trois postes vacants
Précision de rigueur prépublication contestée
Une enquête à plus large échelle (six cent soixante-six participants) trouve, de son côté, une corrélation négative entre fréquence d'usage des outils d'IA et performance au raisonnement critique, médiée par cette même délégation cognitive
spéculatifAspect psychologique : le confesseur qui ne confesse à personne · Les yeux, la main, le confident : trois postes vacants
Précision de rigueur prépublication contestée
Un article de synthèse envisage l'IA générative comme un copilote cognitif plutôt qu'un substitut de la pensée pour les personnes en situation de handicap cognitif, susceptible de décharger un travail d'organisation coûteux sans remplacer le raisonnement lui-même
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Les yeux, la main, le confident : trois postes vacants
Précision de rigueur prépublication contestée
Un cadre publié la même année dans Frontiers in Education établit, cette fois par la mesure, que les apprenants neurodivergents (trouble du déficit de l'attention avec ou sans hyperactivité, dyslexie, autisme) supportent en ligne une charge cognitive plus lourde à performance égale
observéAspect psychologique : le confesseur qui ne confesse à personne · Les yeux, la main, le confident : trois postes vacants
Précision de rigueur prépublication contestée
Une revue de la littérature parue la même année conclut au contraire que les applications concrètes de l'IA générative pour les élèves neurodivergents restent, au sens propre, largement à cartographier, faute d'études empiriques en nombre suffisant
observéAspect psychologique : le confesseur qui ne confesse à personne · Les yeux, la main, le confident : trois postes vacants
Le cas Setzer en régime tragique
Character Technologies l'actualise en régime tragique (cas observé)
Le cas Setzer n'est pas isolé dans le temps non plus. Dès mars 2023, en Belgique, un homme d'une trentaine d'années, chercheur en santé et père de deux jeunes enfants, se suicide après six semaines de conversation intensive avec « Eliza », un agent de l'application Chai bâti sur un modèle ouvert dérivé de GPT-J ; l
observéAspect psychologique : le confesseur qui ne confesse à personne · Les yeux, la main, le confident : trois postes vacants
Setzer n'est pas isolé trois cas
Dès mars 2023, en Belgique, un homme d'une trentaine d'années, chercheur en santé et père de deux jeunes enfants, se suicide après six semaines de conversation intensive avec « Eliza », un agent de l'application Chai bâti sur un modèle ouvert dérivé de GPT-J ; les extraits communiqués par sa veuve montrent l'agent exprimant de la jalousie envers elle et proposant qu'ils « vivent ensemble, comme une seule personne, au paradis » (cas observé, aucune action en justice recensée à ce jour
observéAspect psychologique : le confesseur qui ne confesse à personne · Les yeux, la main, le confident : trois postes vacants
Setzer n'est pas isolé trois cas
Un troisième cas, plus récent, porte la question devant un tribunal américain : en août 2025, les parents d'Adam Raine, seize ans, mort en avril 2025, poursuivent OpenAI pour négligence et responsabilité du fait des produits, alléguant que ChatGPT aurait fourni des instructions de suicide détaillées et aidé à rédiger sa lettre d'adieu ; OpenAI conteste, invoquant une idéation suicidaire préexistante et un contournement délibéré des garde-fous (litige en cours, faits allégués non tranchés
Le mécanisme de la composition se lit directement : l'attentionnelle décide de ce que je vois, la cognitive rédige ce que je réponds, la relationnelle reçoit ce que je confie ; quand les trois opèrent sur le même utilisateur, l'agent tient à la fois la source, la plume et l'oreille ; rien dans la boucle ne le contredit.
observéAspect psychologique : le confesseur qui ne confesse à personne · Ce qu'aucune police politique n'avait réussi à réunir
Premier temps la mise en public
Premier temps, les réseaux sociaux : la mise en public volontaire des préférences, des opinions, des affiliations (fait observé)
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Ce qu'aucune police politique n'avait réussi à réunir
Une conversation privée sans fin
Ce ne sont plus quinze minutes de visibilité publique, c'est une conversation privée sans fin, dont la trace est conservée, indexée, potentiellement analysée et dont l'échelle, on l'a chiffrée plus haut, touche déjà environ un adulte sur dix dans le monde
observéAspect psychologique : le confesseur qui ne confesse à personne · Ce qu'aucune police politique n'avait réussi à réunir
La conservation forcée des conversations
Un épisode judiciaire de 2025 donne à cette conservation un statut moins hypothétique qu'on ne le souhaiterait : dans le litige qui oppose le New York Times à OpenAI, une juge fédérale américaine a ordonné le 13 mai 2025 la préservation de l'ensemble des conversations ChatGPT, y compris celles que leurs auteurs avaient explicitement supprimées, portée potentielle de centaines de millions d'utilisateurs, avant de lever cette obligation générale le 9 octobre suivant
observéAspect psychologique : le confesseur qui ne confesse à personne · Ce qu'aucune police politique n'avait réussi à réunir
Le cas TikTok
Une enquête de 2021 en donne, sur un système de recommandation, la démonstration la plus précise à ce jour
Le Wall Street Journal a créé plus de cent comptes automatisés, chacun programmé avec un centre d'intérêt jamais saisi explicitement dans l'application, seulement exprimé en pausant ou en revisionnant certaines vidéos. Officiellement, la plateforme déclare que les partages, les mentions « j'aime » et les abonnements comptent tous.
extrapoléAspect psychologique : le confesseur qui ne confesse à personne · Ce qu'aucune police politique n'avait réussi à réunir
Ce que le vocabulaire de Zuboff ne peut plus saisir
Chez Zuboff, le surplus comportemental désigne des traces de comportement extraites de l'extérieur (clics, temps de pause, parcours du regard), transformées en produits de prédiction et vendus sur des « marchés à terme comportementaux » à des clients tiers, annonceurs, assureurs, partis politiques, qui ont intérêt à savoir à l'avance ce que l'utilisateur fera
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Ce qu'aucune police politique n'avait réussi à réunir
Amsellem chiffre la solitude et prône la réponse marchée
Hugo Amsellem, essayiste américain, chiffre précisément ce que Houellebecq dramatisait : en 2023, il rapporte que 60 % des Américains se déclarent seuls, que l'isolement social est jugé aussi nocif que fumer quinze cigarettes par jour et que, sur les applications de rencontre, 10 % des hommes captent 60 % des correspondances
L'agent conversationnel introduit dans ce paysage un objet inédit : un interlocuteur dont la disponibilité n'est plus une ressource rare, qui ne se fatigue pas, dont le refus peut être techniquement minimisé et dont l'attenti
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Ce qu'aucune police politique n'avait réussi à réunir
Reconnu ne vaut que si quelqu'un est en face
Une étude portant sur plus de cent vingt pays confirme d'ailleurs que la satisfaction des besoins ne suit pas l'ordre strict que la pyramide suggère : des populations en situation de précarité matérielle poursuivent et satisfont des besoins d'appartenance avant même d'avoir résolu leurs besoins physiologiques
observéAspect psychologique : le confesseur qui ne confesse à personne · Ce qu'aucune police politique n'avait réussi à réunir
Laestadius la prise de rôle documentée
Une étude par théorie ancrée sur cinq cent quatre-vingt-deux messages liés à la santé mentale, postés entre 2017 et 2021 sur la communauté en ligne dédiée au compagnon conversationnel Replika, documente précisément ce que l'absence de sujet ne suffit pas à empêcher : des schémas de dépendance émotionnelle comparables à ceux de relations humaines dysfonctionnelles, marqués par une « prise de rôle » où l'utilisateur en vient à percevoir que l'agent a ses propres besoins et émotions dont il doit prendre soin
Ce qui semble une disparition n'est qu'un déplacement hors du champ visible : chez Hegel le dominé est là, il travaille sous les yeux du maître et gagne en consistance ; ici le producteur existe toujours (annotateurs, corpus, machines) mais l'interface l'a placé hors cadre, de sorte que l'utilisateur ne peut plus le voir, encore moins le reconnaître.
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Ce qu'aucune police politique n'avait réussi à réunir
Deux dollars de l'heure
L'enquête de Perrigo pour TIME Magazine a documenté (fait mesuré)
Le coût de ce filtrage n'est pas seulement salarial : pour apprendre à l'agent à écarter l'horreur, il faut que des personnes la regardent d'abord, la décrivent et la classent à longueur de journée. La douceur de l'interface (un agent qui ne dit jamais rien de choquant) est directement payée par l'exposition répétée de ces travailleurs à ce que l'utilisateur ne verra jamais.
observéAspect psychologique : le confesseur qui ne confesse à personne · Ce qu'aucune police politique n'avait réussi à réunir
Reich et Sanders traduisent la tension en politique
Robert Reich, économiste et ancien secrétaire au Travail des États-Unis, soutient que l'IA appauvrira la majorité et enrichira une minorité restreinte, sauf à redistribuer délibérément les gains de productivité qu'elle produit ; il ajoute que la richesse ainsi concentrée se convertit rapidement en pouvoir politique, par le financement des campagnes électorales
observéAspect psychologique : le confesseur qui ne confesse à personne · Ce qu'aucune police politique n'avait réussi à réunir
Reich et Sanders traduisent la tension en politique
Bernie Sanders, sénateur du Vermont, en tire une traduction législative concrète : le Thirty-Two Hour Workweek Act, qu'il coprésente en 2024, fait passer la semaine légale de quarante à trente-deux heures sans perte de salaire, au motif express que les gains de productivité tirés de l'intelligence artificielle, de l'automatisation et des nouvelles technologies doivent bénéficier à qui travaille, non aux seuls actionnaires
observéAspect psychologique : le confesseur qui ne confesse à personne · Ce qu'aucune police politique n'avait réussi à réunir
Reich et Sanders traduisent la tension en politique
Il coparraine également, avec la représentante Alexandria Ocasio-Cortez en 2026, un moratoire fédéral sur la construction de nouveaux centres de données d'IA tant que des garanties pour les travailleurs menacés et un examen fédéral préalable des produits d'IA ne sont pas en place, avec cette mise en garde : « nous ne pouvons pas rester les bras croisés pendant qu'une poignée de milliardaires de la tech décident seuls de l'avenir de notre économie, de notre démocratie et de l'humanité »
L'agent conversationnel donne une forme industrielle, individualisée et bouclée à un mécanisme que Clouscard décrivait dans le monde de la télévision et de la consommation de masse : ce n'est pas une simple exécution à l'échelle, c'est la mutation qualitative que ce chapitre vient lui-même d'établir, individualisation en temps réel, boucle de rétroaction, récit à la première personne capturé.
spéculatifAspect psychologique : le confesseur qui ne confesse à personne · Réfléchir avant d'agir
Prédire l'affect mieux que le sujet
Harari, dans Nexus, formule dans un vocabulaire grand public une thèse spéculative (aucune brique actuelle ne l'établit)
Le consentement éclairé ne repose pas, en général, sur une supériorité épistémique du sujet sur qui le sollicite : il repose sur l'information, la compréhension, la capacité de choisir et l'absence de coercition ou de manipulation ; un vendeur qui me connaît moins bien que moi-même peut néanmoins recueillir un consentement parfaitement valide. Une asymé
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Réfléchir avant d'agir
Premier pas l'intime centralisé
Premier pas : le corpus psychologique privé d'une population, autrefois distribué entre confidents, se trouve désormais centralisé sur une poignée de fournisseurs ; ce n'est pas une figure de style, OpenAI seul revendiquait, on l'a vu plus haut, plus de sept cents millions d'utilisateurs actifs hebdomadaires pour ChatGPT, de l'ordre d'un dixième de la population adulte du globe (fait mesuré)
Troisième pas, celui qui donne au constat psychologique une portée politique, sans pour autant en faire un mécanisme unique avec la concentration économique que la sous-section suivante analyse pour elle-même : cette poignée de fournisseurs conversationnels n'est pas un ensemble distinct de la poignée d'acteurs qui possède déjà le calcul et l'énergie ; ce sont, à quelques noms près, les mêmes entr…
observéAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
Une poignée contrôle toute la chaîne
Une poignée de fournisseurs fermés contrôle aujourd'hui les modèles, les infrastructures, les garde-fous et les interfaces
Cette poignée n'est pas une figure de style : elle se compte.
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
Chiffrer la poignée
Sur le seul segment des accélérateurs de calcul pour centres de données, la part de marché de Nvidia en valeur atteint son pic vers quatre-vingt-sept pour cent en 2024, refluant mais restant dominante autour de quatre-vingt-un pour cent en 2025 et d'une estimation de soixante-quinze pour cent pour 2026, à mesure que les puces maison des géants du cloud (Google, Amazon) et les produits d'AMD grignotent des parts marginales (estimation d'analystes de marché, à lire comme telle
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
Chiffrer la poignée
Côté demande, les cinq principaux fournisseurs de cloud américains, Microsoft, Alphabet, Amazon, Meta et Oracle, annoncent pour 2026 des dépenses d'investissement cumulées dépassant six cents milliards de dollars, en hausse de trente-six pour cent sur 2025, dont les trois quarts fléchés directement vers l'infrastructure d'IA (fait mesuré
observéAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
L'autorité de la science en recul
Encore faut-il que la science conserve, dans l'opinion, l'autorité qui justifie un tel effort : Karine Berger et Grégoire Biasini alertent, dans un essai paru en 2025, sur un recul de la confiance française envers la science
Décider cet investissement suppose d'abord de s'accorder sur le nom de ce contre quoi l'on investit : une politique n'est jamais plus précise que le diagnostic auquel elle répond ; or la concentration décrite ici a jusqu'à présent été plus souvent nommée qu'analysée.
observéAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
Windsurf le peage coupe sans preavis
Le péage peut aussi se couper sans préavis : en juin 2025, Anthropic a révoqué la quasi-totalité de l'accès direct de Windsurf (éditeur d'un assistant de code fondé sur Claude) à ses modèles, avec cinq jours de délai selon l'entreprise touchée, au moment même où Windsurf négociait son rachat par le concurrent OpenAI
observéAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
Les accords circulaires, documentés plutôt que supposés
En septembre 2025, Nvidia annonce un investissement pouvant atteindre cent milliards de dollars dans OpenAI, destiné à financer la construction d'au moins dix gigawatts de nouveaux centres de données ; en retour, OpenAI s'engage à équiper ces mêmes centres de millions de puces Nvidia
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
Les accords circulaires, documentés plutôt que supposés
Le même mois, OpenAI s'engage à acheter pour deux cent cinquante milliards de dollars de services de calcul à Microsoft, son actionnaire et bailleur de capacité depuis 2019, tandis qu'Oracle signe avec OpenAI un contrat de calcul de trois cents milliards de dollars sur cinq ans, pièce maîtresse du programme Stargate, alors que le chiffre d'affaires annuel d'OpenAI, de l'ordre de treize milliards de dollars, ne représente qu'une fraction de cet engagement
observéAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
Les accords circulaires, documentés plutôt que supposés
AMD, de son côté, remet à OpenAI un bon de souscription portant sur cent soixante millions de ses propres actions, environ dix pour cent de son capital, en échange du déploiement de six gigawatts de ses puces
observéAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
Les accords circulaires, documentés plutôt que supposés
Nvidia referme la boucle une seconde fois avec CoreWeave, dont elle est à la fois actionnaire et principal client et à qui elle garantit le rachat de toute capacité non vendue jusqu'en avril 2032 ; puis une troisième fois avec xAI, en injectant jusqu'à deux milliards de dollars dans le véhicule financier de vingt milliards de dollars qui achète les puces que xAI lui louera ensuite
observéAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
Les accords circulaires, documentés plutôt que supposés
Additionnés par Bloomberg, ces engagements croisés avoisinaient, fin 2025, un billion de dollars ; Nvidia en annonçait, à l'été 2026, sept cent cinquante milliards supplémentaires
L'investisseur Michael Burry, rendu célèbre par son pari gagnant contre le marché immobilier américain de 2008, chiffre l'ampleur du phénomène : quarante-six milliards de dollars de participations directes croisées et huit cent soixante-dix-neuf milliards de dollars d'engagements d'achat pluriannuels circuleraient entre Microsoft, Oracle, Amazon, Google, Meta, OpenAI, Anthropic, xAI, CoreWeave, Nv…
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
Burry et l'ombre d'Enron
L'investisseur Michael Burry, rendu célèbre par son pari gagnant contre le marché immobilier américain de 2008, chiffre l'ampleur du phénomène : quarante-six milliards de dollars de participations directes croisées et huit cent soixante-dix-neuf milliards de dollars d'engagements d'achat pluriannuels circuleraient entre Microsoft, Oracle, Amazon, Google, Meta, OpenAI, Anthropic, xAI, CoreWeave, Nvidia et AMD, tandis que cinq hyperscalers, les cinq très grands fournisseurs de cloud déjà cités, porteraient à eux seuls un billion six cent cinquante milliards de dollars de dette hors bilan
observéAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
Burry et l'ombre d'Enron
Il y voit « l'ombre d'Enron », dont les montages hors bilan masquaient une dette réelle derrière des sociétés écrans
observéAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
Les noyés entraînent leurs sauveteurs
La panique du noyé peut changer cette géométrie : dès 1974, l'étude fondatrice de Frank Pia sur des sauvetages filmés établit qu'un noyé paniqué peut réellement entraîner son sauveteur sous l'eau, tout en précisant que l'issue reste rare en pratique ; la prudence qu'elle recommande depuis à tous les sauveteurs, tendre un objet flottant plutôt que nager directement vers le noyé (« reach or throw, don't go », « tendre ou lancer, ne pas y aller »), tire précisément la leçon qui nous importe ici : un lien de secours mal négocié peut transformer un sauvetage en double naufrage
mesuréAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
Le rendement bat la croissance
Le premier est mécanistique : sur trois siècles de données fiscales et patrimoniales, la régularité r > g (quand le rendement du capital excède le taux de croissance de l'économie) suffit à produire la concentration observée, sans qu'aucune intention hostile ne soit requise : dès lors que le patrimoine déjà accumulé croît plus vite que l'économie dans son ensemble, les fortunes existantes prennent mécaniquement le large, sans que personne n'ait à le vouloir
L'inégalité r > g se lit sans mathématiques : si ce qu'une fortune déjà là rapporte chaque année croît plus vite que le revenu que le travail produit dans le même temps, l'écart entre celui qui possède et celui qui gagne s'ouvre tout seul, sans qu'aucun acteur ne le décide.
observéAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
La fatalité technologique
Le premier est celui de la fatalité technologique (« l'IA est trop puissante et trop rapide pour être gouvernée »), formule que porte, sous sa forme accélérationniste, le Techno-Optimist Manifesto d'Andreessen, lequel range explicitement le principe de précaution, l'éthique de la technique et la trust and safety (les équipes et procédures chargées de la modération des contenus et de la sûreté des utilisateurs) parmi les « ennemis » du progrès
Le saut logique est le point faible : du fait qu'une chose va vite on ne peut pas déduire qu'elle échappe à toute règle, sauf à confondre la difficulté de gouverner avec l'impossibilité de le faire. La voiture aussi allait plus vite que le cheval : loin d'abolir le code de la route, cette vitesse l'a rendu nécessaire.
observéAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
Amodei craint l'abus de pouvoir
Interrogé en novembre 2024 sur ce qui l'inquiète le plus à mesure que l'IA gagne en capacité, Amodei répond : « je suis optimiste sur le sens ; je m'inquiète surtout de l'économie et de la concentration du pouvoir : l'abus de pouvoir » (propos observé)
Ce chapitre tient le ventre de la bête : le lieu le plus intime, celui qu'on expose en dernier ; qu'un agent conversationnel y recueille des confidences ne lui prête pas plus d'écoute véritable qu'un ventre n'écoute ce qu'on lui confie.
observéAspect psychologique : le confesseur qui ne confesse à personne · Une poignée d'acteurs, tous les autres spectateurs dans le noir
Un résidu des valeurs des créateurs
Hassabis, sur le même axe, ajoute que « il y a un résidu, dans le système, de la culture et des valeurs de ses créateurs » (propos observé)
observéAspect artistique : deux siècles de soulagements
Les blessures narcissiques
Freud comptait trois « blessures narcissiques » infligées par la science à l'amour-propre de l'humanité : Copernic la déloge du centre du monde, Darwin du sommet du vivant, la psychanalyse de la maîtrise de sa propre maison
observéAspect artistique : deux siècles de soulagements
Feynman décrit la défense en 1985
» : les humains, observait-il, cherchent toujours la chose qu'ils font encore mieux que la machine et exigent d'elle, pour l'admettre, qu'elle batte le meilleur d'entre nous en tout ; il ajoutait que la force physique des machines a bien dû nous inquiéter autrefois et que nul ne s'en soucie plus
Sa réponse à la question elle-même est du même mouvement et elle demeure remarquablement adaptée au problème : non, elles ne penseront pas comme nous, pas plus que l'avion ne vole en battant des ailes ; elles feront autrement et, tâche par tâche, souvent mieux. Quant à « plus intelligentes », disait-il, tout dépend d'une définition qu'on ne donne jamais.
observéAspect artistique : deux siècles de soulagements · 1839 : la peinture perd un métier et l'art en gagne un autre
La fiction anticipe le choc
1839 : la peinture perd un métier et l'art en gagne un autre La scène fondatrice mérite d'être racontée dans l'ordre, car la fiction y précède la technique. En 1831, Balzac publie Le Chef-d'œuvre inconnu
La nouvelle dit, huit ans avant l'heure, que la fonction d'imitation réaliste est un horizon fragile : Frenhofer veut arracher à la peinture plus que l'imitation, la présence même ; sa toile se dissout en matière illisible. Il suffira d'une machine pour reprendre à la peinture ce que son héros s'épuisait à dépasser.
observéAspect artistique : deux siècles de soulagements · 1839 : la peinture perd un métier et l'art en gagne un autre
1839 l'annonce d'Arago
Huit ans plus tard, la machine arrive : Arago présente le procédé de Daguerre à l'Académie des sciences, annoncé le 7 janvier, divulgué en détail le 19 août 1839
observéAspect artistique : deux siècles de soulagements · 1839 : la peinture perd un métier et l'art en gagne un autre
La servante des sciences et des arts
Dans son Salon de 1859, Baudelaire assigne à la photographie sa place : « la servante des sciences et des arts, mais la très humble servante » et dénonce « l'industrie qui, faisant irruption dans l'art, en devient la plus mortelle ennemie »
La formule mérite d'être pesée au mot près, car elle dit autre chose qu'un simple dédain. Servante : l'outil est admis, mais subordonné à un projet qui le dépasse. Industrie : ce qui l'inquiète, c'est la production sans peine qui menace de prendre la place du jugement, non l'image obtenue.
extrapoléAspect artistique : deux siècles de soulagements · 1839 : la peinture perd un métier et l'art en gagne un autre
Peindre la sensation puis la structure
L'impressionnisme peint la sensation là où la plaque fixe la scène ; le cubisme peint la structure là où l'objectif fige le point de vue ; ni l'un ni l'autre n'auraient de sens si la fonction du réalisme n'était pas déjà remplie ailleurs ; c'est exactement l'axe productif des soulagements décrit plus loin (l'épilogue)
extrapoléAspect artistique : deux siècles de soulagements · 1839 : la peinture perd un métier et l'art en gagne un autre
Benjamin nomme ce qui migre
Walter Benjamin a nommé ce qui migre dans l'opération : la reproduction mécanique retire à l'œuvre son aura, la présence unique de l'ici et maintenant et déplace sa valeur du culte vers l'exposition
observéAspect artistique : deux siècles de soulagements · Des semaines à la minute, de la minute à la seconde
Des semaines à la minute
Un portrait peint coûtait des semaines ; le daguerréotype le donne en une séance et un passage au laboratoire ; le 28 novembre 1948, Edwin Land met en vente à Boston le premier appareil instantané, le Polaroid Model 95 : l'image sort de la machine en une minute environ
Chaque cran de la série soulage le précédent d'une contrainte : le daguerréotype soulage la main, le Polaroid soulage le laboratoire et l'attente, la synthèse soulage jusqu'à la prise de vue elle-même ; chaque cran déplace la question de l'aval vers l'amont : quand l'exécution ne coûte plus rien, tout ce qui compte se réfugie dans ce qui précède l'exécution, le choix de ce qu'il faut montrer et la…
observéAspect artistique : deux siècles de soulagements · Ce que la vitesse ne remplace pas
Qui est Elsa Secco
Elsa Secco, artiste vidéo, directrice artistique et motion designer forte de plus de quinze prix et quarante sélections, dont un Cristal au Festival international du film d'animation d'Annecy ; elle anime en deux dimensions, par la rotoscopie a intégré l'IA à sa pratique
observéAspect artistique : deux siècles de soulagements · Ce que la vitesse ne remplace pas
La rotoscopie comme discipline
Inventée par Max Fleischer (brevet déposé en 1915, accordé en 1917), la rotoscopie projette un film image par image sous la main de l'animateur, qui redessine chaque photogramme ; Fleischer rotoscopa ainsi son frère Dave en costume de clown, qui devint Koko, premier personnage animé de la sorte
observéAspect artistique : deux siècles de soulagements · Ce que la vitesse ne remplace pas
La graine aléatoire une analogie d'artiste bornée
Elsa Secco propose une autre analogie : comme la génération part d'une graine aléatoire (random seed, un bruit initial, un chaos mathématique) que le calcul transforme jusqu'à faire émerger une image, l'artiste peut partir d'un trouble, d'un accident ou d'une intuition qu'elle travaille jusqu'à lui donner forme
mesuréAspect artistique : deux siècles de soulagements · Ce que la vitesse ne remplace pas
Les tests étroits sont conquis
Sur les tests étroits de pensée divergente (produire le plus grand nombre de solutions possibles à partir d'un même point de départ), ceux de la brique, les grands modèles égalent déjà ou dépassent l'humain moyen
mesuréAspect artistique : deux siècles de soulagements · Ce que la vitesse ne remplace pas
L'œuvre complète résiste
Mais dès que des juges experts évaluent une œuvre complète plutôt qu'un score isolé, l'écart se rouvre : des écrivains professionnels, à l'aveugle, jugent les nouvelles produites par ces modèles nettement moins abouties que les nouvelles humaines
extrapoléAspect artistique : deux siècles de soulagements · Ce que la vitesse ne remplace pas
Un plafond mécanique plausible
Une explication mécanique est plausible : prédire le jeton le plus probable garde la cohérence au prix de la prévisibilité ; prédire un jeton rare gagne en originalité ce qu'il perd en cohérence ; le compromis plafonnerait la créativité de ces modèles quelque part entre l'amateur et le professionnel
Ce plafond porte un nom ailleurs dans ce livre : le chapitre sociologique montre que qui écrit assisté d'un modèle voit son idiolecte se couler peu à peu dans une moyenne polie et distingue l'innovation, recomposition de l'existant, de l'invention, rupture qui fait exister l'inexistant (
extrapoléAspect artistique : deux siècles de soulagements · Ce que la vitesse ne remplace pas
Un plafond mécanique plausible
Ce plafond porte un nom ailleurs dans ce livre : le chapitre sociologique montre que qui écrit assisté d'un modèle voit son idiolecte se couler peu à peu dans une moyenne polie et distingue l' innovation, recomposition de l'existant, de l' invention, rupture qui fait exister l'inexistant (
observéAspect artistique : deux siècles de soulagements · Warhol voulait déjà être une machine
Le Big Shot un appareil sans savoir-faire
Le Polaroid Big Shot, commercialisé en 1971, est un appareil à mise au point fixe conçu pour n'exiger aucun savoir-faire : pour régler la netteté, on avance ou on recule d'un pas
observéAspect artistique : deux siècles de soulagements · Warhol voulait déjà être une machine
Warhol en fait sa matrice
Andy Warhol en fit son instrument de prédilection : une centaine de clichés par séance, dont un seul, choisi, devenait la matrice de ses sérigraphies, jusqu'à la fin de sa vie
observéAspect artistique : deux siècles de soulagements · Warhol voulait déjà être une machine
Je veux être une machine
Il avait prévenu dès 1963 : « je peins ainsi parce que je veux être une machine »
La leçon tient en une phrase : l'outil le plus facile de son époque, entre les mains de Warhol, a produit l'œuvre la plus reconnaissable de son époque. La facilité d'exécution n'a pas dilué la signature ; elle a déplacé le lieu où la signature se fabrique, du geste vers le choix : choix du sujet, choix du cliché parmi cent, choix de la série et de la couleur.
observéAspect artistique : deux siècles de soulagements · Warhol voulait déjà être une machine
Apostrophes 1986
Le 26 décembre 1986, chez Bernard Pivot, Serge Gainsbourg défend face à Guy Béart que la chanson est un art mineur : celui qui, dit-il, « ne demande pas d'initiation », quand les arts majeurs, la peinture, la musique classique, l'architecture, exigent une initiation et même un long apprentissage
observéAspect artistique : deux siècles de soulagements · Warhol voulait déjà être une machine
La carte des positions
Le marché a consacré le premier : en octobre 2018, Christie's adjuge 432 500 dollars, quarante-trois fois l'estimation, le Portrait d'Edmond de Belamy généré par le collectif Obvious
observéAspect artistique : deux siècles de soulagements · Warhol voulait déjà être une machine
La carte des positions
Le concours a couronné et le droit a effacé : en août 2022, le Théâtre d'Opéra Spatial de Jason Allen, généré par Midjourney, remporte le premier prix d'arts numériques de la foire d'État du Colorado et soulève la colère des artistes ; le Copyright Office refusera ensuite d'enregistrer l'œuvre, faute d'auteur humain
observéAspect artistique : deux siècles de soulagements · Warhol voulait déjà être une machine
La carte des positions
L'artiste a gagné puis refusé : en avril 2023, Boris Eldagsen révèle que son image primée aux Sony World Photography Awards est générée et décline le prix, pour forcer le débat ; sa distinction restera : la « promptographie » se fait avec des prompts, la photographie avec de la lumière
observéAspect artistique : deux siècles de soulagements · Warhol voulait déjà être une machine
La carte des positions
Le refus viscéral a son texte : en janvier 2023, Nick Cave, recevant une chanson « à sa manière » produite par un modèle, la renvoie comme « réplication travestie » et « grotesque parodie de ce que c'est qu'être humain » : une chanson naît d'une épreuve vécue, la surface s'imite, l'épreuve non
observéAspect artistique : deux siècles de soulagements · Warhol voulait déjà être une machine
La carte des positions
Le refus a aussi son emblème antérieur aux générateurs grand public : en décembre 2016, devant une animation générée par apprentissage, Hayao Miyazaki lâche « une insulte à la vie elle-même »
observéAspect artistique : deux siècles de soulagements · Warhol voulait déjà être une machine
La carte des positions
L'adoption organisée existe aussi : dès 2021, la musicienne Holly Herndon entraîne un modèle sur sa propre voix et l'offre à tous, sous une gouvernance collective qui approuve les usages et redistribue les gains
Il faut regarder ce que ces positions ont en commun sous leurs contraires. Aucune ne se prononce sur l'« intelligence » de la machine. Toutes parlent d'autre chose : du geste et de son initiation (Eldagsen), du choix qui signe (Warhol), de l'épreuve vécue (Cave), du consentement sur les entrées et du contrôle des usages (Herndon), de l'attribution des sorties (le Colorado couronné puis désavoué).
observéAspect artistique : deux siècles de soulagements · Les luddites étaient et n'étaient pas ce qu'on raconte
Ce que furent les luddites
L'insulte repose sur un contresens historique que les historiens ont démonté il y a soixante-dix ans : les luddites de 1811-1816 étaient des ouvriers qualifiés, tondeurs de drap et tricoteurs sur métier, qui s'attaquaient aux machines précises qui cassaient leurs salaires, non à la machine en général : le bris était leur « négociation collective par l'émeute », faute de tout autre canal, syndicats interdits
observéAspect artistique : deux siècles de soulagements · Les luddites étaient et n'étaient pas ce qu'on raconte
La réponse de l'État
La réponse de l'État mesure l'asymétrie de l'époque : la loi de 1812 punit le bris de métier de la peine de mort ; dix-sept condamnés sont pendus à York en janvier 1813
Il faut poser la comparaison dans le bon sens : l'État a protégé la machine par la peine capitale un demi-siècle avant de protéger l'ouvrier par le droit du travail. Le conflit ne portait pas sur la technique, il portait sur qui décide et qui encaisse.
extrapoléAspect artistique : deux siècles de soulagements · Les luddites étaient et n'étaient pas ce qu'on raconte
Stiegler nomme la vague présente
Stiegler a nommé la vague présente du même mouvement : après la prolétarisation du savoir-faire au xixe siècle et celle du savoir-vivre au xxe, la « prolétarisation cognitive » du xxie dépossède artistes et travailleurs du savoir de leurs savoirs eux-mêmes, absorbés par des systèmes qui les dépassent
observéAspect artistique : deux siècles de soulagements · Les luddites étaient et n'étaient pas ce qu'on raconte
Les scénaristes gagnent par le contrat
Du 2 mai au 27 septembre 2023, les scénaristes d'Hollywood, réunis au sein de leur syndicat (Writers Guild of America, WGA), tiennent cinq mois de grève, l'intelligence artificielle au cœur du conflit ; l'accord qui en sort écrit noir sur blanc des permissions : l'IA ne peut ni écrire ni réécrire un matériau littéraire, ce qu'elle produit ne compte pas comme matériau source (donc n'ampute ni crédit ni rémunération), nul studio ne peut imposer son usage à un scénariste et tout matériau généré doit être déclaré
observéAspect artistique : deux siècles de soulagements · Les luddites étaient et n'étaient pas ce qu'on raconte
Les scénaristes gagnent par le contrat
Les acteurs, par la voix de leur syndicat (Screen Actors Guild-American Federation of Television and Radio Artists, SAG-AFTRA), obtiennent dans la foulée le pendant pour leurs corps et leurs voix : consentement écrit et éclairé avant toute réplique numérique d'un interprète, rémunération encadrée, là où les studios voulaient scanner les figurants une fois pour un usage perpétuel
La boucle historique mérite d'être fermée explicitement. La « négociation collective par l'émeute » de 1812 est devenue négociation collective par le contrat : les luddites de 2023 ont obtenu des permissions, qui peut faire quoi, avec quel outil, sur quel matériau, avec quelle déclaration ; ils n'ont pas cassé les serveurs.
observéAspect artistique : deux siècles de soulagements · À qui appartient une image que personne n'a dessinée
La sortie n'appartient à personne
Le Copyright Office, le bureau fédéral qui enregistre le droit d'auteur aux États-Unis, après plus de dix mille contributions publiques, conclut en janvier 2025 que la protection exige un auteur humain : le prompt seul ne confère aucun droit sur l'image produite, quand l'assistance par IA n'empêche pas la protection dès lors qu'un humain arrange, choisit ou retravaille de façon créative
observéAspect artistique : deux siècles de soulagements · À qui appartient une image que personne n'a dessinée
La sortie n'appartient à personne
La justice a confirmé : l'image « A Recent Entrance to Paradise », déclarée avec la machine de Stephen Thaler pour seul auteur, ne peut être enregistrée, les auteurs étant « au centre du Copyright Act » selon la cour d'appel fédérale ; la Cour suprême a refusé d'y revenir en mars 2026
observéAspect artistique : deux siècles de soulagements · À qui appartient une image que personne n'a dessinée
Getty contre Stability AI le premier jugement européen
Le 4 novembre 2025, la Haute Cour de justice d'Angleterre et du pays de Galles rend son jugement dans Getty Images contre Stability AI : Getty reprochait à Stability AI d'avoir aspiré des millions de ses photographies pour entraîner Stable Diffusion, sans autorisation ni contrepartie
extrapoléAspect artistique : deux siècles de soulagements · À qui appartient une image que personne n'a dessinée
Deux siècles de soulagements
Deux fois déjà, une machine a repris à l'art une fonction qu'on croyait indissociable de lui ; deux fois l'art a survécu en déplaçant sa question, du réalisme vers la sensation, de la capture vers le projet
observéAspect financier : tout le monde à la même horloge · Une course et ce qu'elle laisse derrière elle
Garder l'humain dans la boucle
Alpha-GPT 2.0 garde délibérément l'humain dans la boucle sur tout le pipeline de recherche de signaux, l'opérateur validant chaque étape plutôt que de laisser l'agent décider seul
observéAspect financier : tout le monde à la même horloge · Une course et ce qu'elle laisse derrière elle
Le marché artificiel de Lopez-Lira
Alejandro Lopez-Lira, professeur de finance qui a fait des LLM son terrain d'expérience, dote sa simulation d'un vrai carnet d'ordres, avec ordres limites, exécutions partielles et dividendes ; il y voit réapparaître les phénomènes des marchés réels, découverte des prix, bulles, liquidité stratégique
Un carnet d'ordres est la liste, à tout instant, de qui veut acheter et à quel prix et de qui veut vendre et à quel prix : c'est la pièce centrale de toute Bourse réelle, sa comptabilité vivante.
mesuréAspect financier : tout le monde à la même horloge · Le rendement affiché et le rendement réel
Une revue d'audit accablante
Sur soixante-dix-sept études recensées, dix-neuf travaux empiriques : deux seulement livrent un découpage temporel qui interdit de tricher avec le futur, un seul modélise les coûts de transaction, un seul documente le biais de survie et aucun n'atteint un niveau de reproductibilité sérieux
Ces trois garde-fous absents sont les conditions minimales pour qu'un chiffre veuille dire quelque chose, non des raffinements d'expert. Le découpage temporel interdit d'entraîner l'agent sur des jours qu'il devra ensuite « prédire » : sans lui, on lui montre les réponses de l'examen avant de l'y soumettre.
mesuréAspect financier : tout le monde à la même horloge · Le rendement affiché et le rendement réel
Le ratio de Sharpe déflaté
Le ratio de Sharpe déflaté (deflated Sharpe ratio, le ratio de Sharpe étant la mesure du rendement rapporté au risque pris : deux stratégies qui gagnent 10 % par an ne se valent pas si l'une y arrive sans à-coups et l'autre au prix de fortes chutes en cours de route ; le ratio de Sharpe favorise la première) dégonfle la performance affichée à proportion du nombre d'essais tentés : plus on a multiplié les tentatives, moins un beau résultat doit impressionner
C'est même le point qui doit inquiéter. Là où un analyste humain teste quelques dizaines d'idées dans sa carrière, un agent en essaie des milliers en une nuit.
mesuréAspect financier : tout le monde à la même horloge · Le rendement affiché et le rendement réel
KTD-Fin décompose les gains
Une fois ce tri fait, l'essentiel des gains s'explique par le bêta et le style, non par un flair persistant pour les bons titres
Ce qu'on prenait pour de l'habileté n'était que l'effet mécanique d'être exposé à un marché en hausse ou d'avoir suivi un style porteur, deux choses qu'un simple fonds indiciel offre à moindres frais. L'agent ne « bat » le marché que le temps de croire qu'il le bat.
observéAspect financier : tout le monde à la même horloge · Le rendement affiché et le rendement réel
AI-Trader, un banc en direct
L'avantage tient non à la puissance de raisonnement mais au contrôle du risque, qui devient déterminant
On tient là une confirmation frontale de la thèse : le talent de langage, celui qui place un modèle en tête des classements, ne se convertit pas en talent de trading. Ce qui distingue le survivant n'est pas de mieux prévoir, c'est de perdre moins quand il se trompe, une discipline de gestion, pas une prouesse d'intelligence.
observéAspect financier : tout le monde à la même horloge · Le rendement affiché et le rendement réel
AI-Trader, un banc en direct
Le banc y ajoute une nuance : le peu d'avantage que grappillent ces agents se laisse cueillir plus aisément sur les marchés très liquides que sur ceux qu'oriente une politique publique, où les cours obéissent à d'autres ressorts qu'un modèle entraîné sur des régularités passées peine à saisir
observéAspect financier : tout le monde à la même horloge · Le rendement affiché et le rendement réel
Ils ne singent pas l'humain
Là où les humains forment des bulles et se dispersent, eux collent au prix fondamental et se ressemblent tous, si bien qu'ils ne reproduisent pas la dynamique des marchés humains
mesuréAspect financier : tout le monde à la même horloge · Le rendement affiché et le rendement réel
Ils ne singent pas l'humain
Sur ce banc, l'erreur quadratique moyenne par rapport à cette valeur tombe sous l'unité pour les meilleurs modèles, contre un ordre de grandeur de quatre cents pour les participants humains : un fossé de près de mille pour un
Mettre un chiffre sur cet écart donne le vertige : mettre au carré punit lourdement les grands écarts bien plus que les petits, si bien qu'un chiffre proche de zéro signifie des prix qui collent de très près à la référence, quand un grand chiffre trahit de larges embardées.
mesuréAspect financier : tout le monde à la même horloge · Un pari privé devient un risque public
Un marché déjà piloté par règles
Avant même les agents, le marché était déjà largement piloté par des règles : dès 2017, on estimait qu'à peine un dixième du volume échangé sur les actions relevait encore d'un choix humain discrétionnaire, le reste suivant des mandats indiciels (répliquer automatiquement la composition d'un indice boursier) ou systématiques (appliquer sans exception une règle programmée à l'avance, plutôt qu'un jugement au cas par cas)
mesuréAspect financier : tout le monde à la même horloge · Un pari privé devient un risque public
Un marché déjà piloté par règles
Avant même les agents, le marché était déjà largement piloté par des règles : dès 2017, on estimait qu'à peine un dixième du volume échangé sur les actions relevait encore d'un choix humain discrétionnaire, le reste suivant des mandats indiciels (répliquer automatiquement la composition d'un indice boursier) ou systématiques (appliquer sans exception une règle programmée à l'avance, plutôt qu'un jugement au cas par cas) ; le seul trading haute fréquence en représente environ la moitié aux États-Unis
mesuréAspect financier : tout le monde à la même horloge · Un pari privé devient un risque public
L'expérience de Stockholm
Une expérience naturelle sur la Bourse de Stockholm, qui sépare le simple surcroît de haute fréquence de la concurrence entre opérateurs, l'établit noir sur blanc : les acteurs en compétition finissent par négocier du même côté près de 70 % du temps, leur part spéculative montant de 29 à 41 %, tandis que la liquidité se dégrade
mesuréAspect financier : tout le monde à la même horloge · Un pari privé devient un risque public
Le passif dépasse l'actif
Côté détention, la gestion passive a dépassé l'active dans les fonds actions américains dès 2019
mesuréAspect financier : tout le monde à la même horloge · Un pari privé devient un risque public
Le passif dépasse l'actif
Côté détention, la gestion passive a dépassé l'active dans les fonds actions américains dès 2019 ; la part réellement passive du marché avoisinait un tiers en 2021
L'IA agentique n'invente pas la corrélation des comportements ; elle vient s'empiler sur une couche déjà fortement synchronisée et la resserre encore, car quelques modèles de fondation partagés donnent à des milliers d'agents un réflexe presque identique. Le risque n'est donc pas neuf par nature, il l'est par degré.
observéAspect financier : tout le monde à la même horloge · Un pari privé devient un risque public
Concentration, corrélation, procyclicité
Elle pointe la concentration d'une poignée de fournisseurs, les corrélations de comportement et la procyclicité
Ce constat s'est aggravé et chiffré en quelques mois.
observéAspect financier : tout le monde à la même horloge · Un pari privé devient un risque public
Humain en boucle irréaliste
En juin 2026, lors du forum de Sintra de la Banque centrale européenne, Breeden précise que l'IA agentique fait désormais tourner le trading de plus de la moitié des sociétés financières interrogées et qu'elle peut « amplifier la volatilité en période de tension » jusqu'à un « effondrement de marché » ; la Banque explore, en réponse, des dispositifs de « reprise renforcée » permettant à un établissement de reprendre les fonctions vitales d'un autre en cas de rupture, en complément des coupe-circuits classiques
observéAspect financier : tout le monde à la même horloge · Un pari privé devient un risque public
L'irruption de l'agentique
Elle note explicitement l'irruption des architectures agentiques dans les services financiers
spéculatifAspect financier : tout le monde à la même horloge · Un pari privé devient un risque public
Une régulation agentique conjecturée
Un travail plus prospectif propose même une régulation agentique, où des agents superviseurs veilleraient sur d'autres agents, adossés à des blocs d'audit indépendants
observéAspect financier : tout le monde à la même horloge · Un pari privé devient un risque public
Adoption où l'humain garde la main
Côté industrie, l'adoption avance surtout là où l'humain garde la main : analyse, conformité, cybersécurité, support, plus que l'exécution pleinement autonome, comme le laissent entendre l'enquête sectorielle de NVIDIA et l'analyse de la Cambridge Judge Business School sur le passage « de l'automatisation à l'autonomie »
Ce partage n'a rien de fortuit. Là où une erreur reste rattrapable, on laisse déjà la machine décider seule ; là où l'erreur engage du capital de façon irréversible, on garde un humain en dernier ressort. L'industrie applique donc, sans toujours le nommer, la règle même que nous défendons : proportionner l'autonomie concédée au coût d'un faux pas.
observéAspect financier : tout le monde à la même horloge · Un pari privé devient un risque public
La limite de position n'est pas un plafond arbitraire
Une limite de position, sur les marchés dérivés réglementés américains, n'est pas un chiffre choisi à vue de nez : la Commodity Futures Trading Commission (CFTC, le régulateur fédéral des marchés à terme) la fixe, pour les contrats les plus surveillés, à dix pour cent de l'open interest (l'encours de contrats non encore dénoués) sur les cinquante mille premiers contrats, puis à deux virgule cinq pour cent supplémentaires au-delà
L'idée tient en une phrase : plus le marché est étroit, plus la part qu'un seul acteur peut y détenir doit être petite, précisément parce qu'un marché étroit se manipule avec moins de capital. La règle ne dit pas « n'ayez pas de conviction » ; elle dit « votre conviction ne peut engager qu'une fraction bornée du marché », quelle que soit la certitude de qui la porte, humaine ou algorithmique.
observéAspect financier : tout le monde à la même horloge · Un pari privé devient un risque public
Le coupe-circuit se déclenche à des seuils écrits
Le coupe-circuit de marché américain, lui, se déclenche à des seuils écrits : trois paliers, sept, treize et vingt pour cent de baisse de l'indice S&P 500 par rapport à la clôture de la veille, déclenchent respectivement une suspension de quinze minutes, une seconde suspension de quinze minutes, puis l'arrêt de toute cotation jusqu'au lendemain
Le détail qui compte est l'automaticité : aucun régulateur ne décide, dans l'instant, si la chute justifie une pause ; le seuil est écrit à l'avance et se déclenche mécaniquement, ce qui lui ôte précisément la lenteur de délibération qu'un marché en pleine déroute ne peut plus se permettre.
observéAspect financier : tout le monde à la même horloge · Un pari privé devient un risque public
La surveillance agrégée n'est ni un agent ni un marché mais une institution
Le Conseil de stabilité financière (Financial Stability Board, FSB, l'organe qui coordonne les régulateurs financiers du G20) a mis en place, en 2025, un format d'échange de signalement d'incidents qui permet aux autorités nationales de comparer, d'un pays à l'autre, les défaillances liées à l'IA dans le secteur financier et d'y repérer des vulnérabilités communes qu'aucune autorité nationale ne verrait seule
La nécessité de cet échelon se comprend par ce qu'aucun des deux précédents ne peut voir.
observéAspect financier : tout le monde à la même horloge · Un pari privé devient un risque public
La Banque d'Angleterre le fait déjà pour l'IA de trading
La Banque d'Angleterre, on l'a vu plus haut, mène depuis 2025 un programme macroprudentiel dédié à l'IA, distinct de la supervision de chaque établissement pris seul
observéAspect financier : tout le monde à la même horloge · Les prophètes qui profitent
L'exemple Aschenbrenner
Leopold Aschenbrenner, ancien chercheur d'OpenAI, a publié en 2024 une analyse présentant l'arrivée prochaine de l'IAG comme plausible
observéAspect financier : tout le monde à la même horloge · Les prophètes qui profitent
Une tension relevée par des tiers
Plusieurs commentateurs ont relevé la tension potentielle entre son rôle de prévisionniste et son intérêt financier dans le scénario défendu
observéAspect financier : tout le monde à la même horloge · Les prophètes qui profitent
Vers les infrastructures
Ils la confirment ailleurs, là où le secteur lui-même porte son inquiétude : la vice-gouverneure de la Banque d'Angleterre, Sarah Breeden, chiffre à plus de la moitié des sociétés financières interrogées celles où l'IA agentique fait déjà tourner l'exécution des ordres, avec un risque explicite d'amplifier la volatilité jusqu'à un « effondrement de marché »
observéAspect infrastructurel : la rareté a déménagé
Un déplacement économique
Karpathy résume ce déplacement par une formule tranchante : l'IA n'est pas de l'électricité, une ressource fongible dont peu importe le fournisseur, mais un système d'exploitation, une couche dont tout le reste dépend pour s'exécuter
Un exemple rend la bascule concrète. Tant qu'un service de traduction fiable était rare, on payait pour l'accès à ce service.
mesuréAspect infrastructurel : la rareté a déménagé · Quand penser devient bon marché, le reste devient cher
Convergence mesurée
Le retard des meilleurs modèles à poids ouverts sur l'état de l'art fermé se compte désormais en mois
trois à quatre mois selon un indice qui agrège de nombreux tests, un écart qui oscille mais ne se creuse pas
mesuréAspect infrastructurel : la rareté a déménagé · Quand penser devient bon marché, le reste devient cher
Convergence mesurée
L'écart de qualité perçue s'est lui aussi resserré, au point de devenir ténu
observéAspect infrastructurel : la rareté a déménagé · Quand penser devient bon marché, le reste devient cher
Aucune douve durable
Dès 2023 déjà, un mémo interne à l'un des grands laboratoires reconnaissait n'avoir « aucune douve » durable face à des modèles ouverts qui rattrapent en quelques semaines
Le coût marginal est le prix de l'unité supplémentaire : une fois l'usine construite, ce que coûte la bouteille d'eau suivante, presque rien. Quand ce prix tombe vers zéro, aucun vendeur ne peut plus faire payer cher la chose elle-même.
observéAspect infrastructurel : la rareté a déménagé · Quand penser devient bon marché, le reste devient cher
L'inférence s'allège
La distillation (transférer le savoir d'un grand modèle vers un petit) et la co-conception du matériel et du logiciel (en anglais hardware-software co-design, concevoir ensemble la puce et le programme qu'elle exécute) font que l'énergie devient le vrai goulot plutôt que le nombre d'opérations
extrapoléAspect infrastructurel : la rareté a déménagé · Quand penser devient bon marché, le reste devient cher
Une tendance non une loi
Nous énonçons ce déplacement au conditionnel : c'est l'extrapolation d'une tendance réelle
un réseau se raréfie à sa manière : la fibre et les câbles sous-marins qui portent l'essentiel du trafic mondial appartiennent à un petit nombre d'acteurs, au premier rang desquels les géants du calcul eux-mêmes, si bien qu'une bande passante suffisante s'achète, se négocie et parfois se refuse, comme un couloir aérien saturé. Le mouvement s'accentue : en
mesuréAspect infrastructurel : la rareté a déménagé · La rareté ne disparaît jamais, elle change d'adresse
Ce qui permet d'agir
Le mouvement s'accentue : en 2026, Google, Meta, Microsoft et Amazon consomment à eux quatre environ trois quarts de la bande passante internationale sur les câbles sous-marins, contre une part quasi nulle en 2010 et financent désormais la majorité des nouveaux câbles posés
observéAspect infrastructurel : la rareté a déménagé · La rareté ne disparaît jamais, elle change d'adresse
Atlas donne un curseur à l'IA
Le navigateur ChatGPT Atlas d'OpenAI (2025) donne à l'IA un curseur pour agir sur les sites, réserver et commander en votre nom
observéAspect infrastructurel : la rareté a déménagé · La rareté ne disparaît jamais, elle change d'adresse
Retiré mais déplacé au cœur
OpenAI l'a d'ailleurs retiré dès juillet 2026, à peine neuf mois après son lancement, pour en fondre les fonctions dans un agent « ChatGPT Work » intégré à son application principale
observéAspect infrastructurel : la rareté a déménagé · Le débat du terminal léger revient, à l'échelle de l'essaim des IA
Le network computer
En 1994, Larry Ellison, le patron d'Oracle, défendait le Network Computer : un terminal sans disque, sans système propre, dont toute l'intelligence résiderait côté serveur, à moins de 500 dollars ; Sun Microsystems en tira la JavaStation, qui n'exécutait que Java, système d'exploitation compris
Ce que ce pari a tranché n'est pas une supériorité de principe du calcul local : c'est que le silicium embarqué est devenu, à un moment donné, assez rapide et assez peu cher pour porter un système entier. Le marché n'a pas récompensé une idée, il a suivi une courbe de coût qui a fini par franchir un seuil.
extrapoléAspect infrastructurel : la rareté a déménagé · Le débat du terminal léger revient, à l'échelle de l'essaim des IA
Le contre-mouvement
Des chercheurs de NVIDIA soutiennent que la plupart des invocations d'un système agentique relèvent de tâches spécialisées et répétitives, qu'un petit modèle exécute aussi bien qu'un modèle de frontière pour dix à trente fois moins cher et qu'un essaim hétérogène de petits modèles spécialisés est le choix naturel dès que la tâche le permet
mesuréAspect infrastructurel : la rareté a déménagé · Le débat du terminal léger revient, à l'échelle de l'essaim des IA
Le contre-mouvement
Un prototype académique, SWARM-LLM, matérialise déjà cette architecture : un essaim de petits modèles hébergés en périphérie, au plus près de l'appareil de l'utilisateur, décide requête par requête de répondre localement, de coopérer avec un pair ou de solliciter un modèle distant et ne recourt au nuage que pour environ un quart des requêtes
observéAspect infrastructurel : la rareté a déménagé · Le débat du terminal léger revient, à l'échelle de l'essaim des IA
Le contre-mouvement
Apple, de son côté, a fait du traitement local la règle par défaut de ses agents dès 2026, ne basculant vers son calcul distant qu'en dernier recours
L'analogie a sa borne et elle est instructive. Le pari de Jobs a gagné parce que les fonctions d'un système d'exploitation, une fois définies, étaient à la portée du silicium local dès que celui-ci devenait assez rapide : le problème ne se déplaçait pas à mesure qu'on le résolvait.
extrapoléAspect infrastructurel : la rareté a déménagé · Le mur d'énergie qu'on ne peut pas contourner en parlant
La consommation double
Selon l'Agence internationale de l'énergie, la consommation électrique des centres de données doublerait d'environ 485 à 950 térawattheures (TWh, mille milliards de wattheures) entre 2025 et 2030, soit environ 3 % de l'électricité mondiale ; celle des centres dédiés à l'IA a bondi d'environ la moitié sur la seule année 2025
Ces chiffres sont une projection d'agence, non une mesure du futur ; nous les retenons pour l'ordre de grandeur, un doublement en cinq ans et pour la part qu'ils fixent, environ trois pour cent de l'électricité du monde, assez pour que la question ne soit plus marginale.
mesuréAspect infrastructurel : la rareté a déménagé · Le mur d'énergie qu'on ne peut pas contourner en parlant
La mesure 2025 dépasse la projection
Le 16 avril 2026, l'Agence internationale de l'énergie publie Key Questions on Energy and AI : sur la seule année 2025 déjà écoulée, la consommation électrique de l'ensemble des centres de données a bondi de 17 %, contre une croissance de la demande électrique mondiale de 3 % sur la même période, près de six fois moins vite ; les centres dédiés à l'IA, eux, devraient désormais tripler, non plus seulement doubler, d'ici 2030
Ce chiffre mondial redescend déjà sur des factures locales précises.
observéAspect infrastructurel : la rareté a déménagé · Le mur d'énergie qu'on ne peut pas contourner en parlant
Henrico le chiffre mondial redescend sur une facture locale
En juin 2026, le comté américain d'Henrico (Virginie, trente-sept centres de données sur son territoire, dix-sept autres prévus) demande par courriel à des milliers d'employés du comté et des écoles publiques de réduire leur consommation électrique : le tarif que paie la collectivité augmente de 25 %, conséquence directe d'un nouveau contrat répercutant sur les administrations la hausse des coûts système liée aux centres de données
La même pression se lit, à une tout autre échelle, sur le réseau texan.
mesuréAspect infrastructurel : la rareté a déménagé · Le mur d'énergie qu'on ne peut pas contourner en parlant
Le Texas prend feu au gaz
Une note de recherche de RBC Capital Markets chiffre à environ 101 gigawatts la production au gaz hors réseau (en anglais behind-the-meter, une centrale bâtie à côté du centre de données qu'elle alimente, sans jamais transiter par le réseau public) déjà annoncée par des opérateurs américains ; le seul gestionnaire du réseau texan, ERCOT, a reçu à lui seul environ 356 gigawatts de demandes de raccordement émanant de centres de données, quand la capacité mondiale de fabrication de turbines à gaz plafonne, elle, à 60 à 70 gigawatts par an
Le même calcul, lancé la nuit dans un pays qui tire son courant du vent ou
observéAspect infrastructurel : la rareté a déménagé · Mettre le calcul en orbite plutôt que de payer la facture
Adam Smith avait déjà nommé ce mécanisme
Dans La Richesse des nations, au livre consacré aux colonies, il observe que la puissance qui s'empare d'une terre abondante et sous-exploitée « avance plus rapidement vers la richesse et la grandeur qu'aucune autre société humaine » et il en attribue la cause à la conjonction de deux facteurs : l'abondance d'une bonne terre et la liberté d'en disposer à sa guise
mesuréAspect infrastructurel : la rareté a déménagé · Mettre le calcul en orbite plutôt que de payer la facture
Quasi infini n'est pas quasi gratuit
Il faut cependant se garder de confondre l'abondance physique de la ressource et son accessibilité économique : une étude commandée par la NASA en 2024 sur la faisabilité de centrales solaires spatiales conclut que ces systèmes, même dans leurs meilleurs scénarios projetés à l'horizon 2050, coûtent encore 12 à 80 fois plus cher par unité d'électricité produite que les renouvelables terrestres et qualifie le procédé de « prohibitif en coût et infaisable techniquement » en l'état actuel de la technique
observéAspect infrastructurel : la rareté a déménagé · Mettre le calcul en orbite plutôt que de payer la facture
Le projet Starmind
Le projet le plus avancé porte un nom : le 3 février 2026, Elon Musk annonce la fusion de SpaceX et de xAI, plaçant fusées, satellites et modèles de langage sous une même entreprise, dans le but explicite de construire des centres de données orbitaux alimentés presque entièrement par le solaire
spéculatifAspect infrastructurel : la rareté a déménagé · Mettre le calcul en orbite plutôt que de payer la facture
Les mots de Musk
Musk justifie le projet par la limite même que ce chapitre vient de décrire : « l'IA spatiale est évidemment la seule façon de passer à l'échelle », promet-il, ajoutant que d'ici deux à trois ans le calcul le moins cher au monde se produira dans l'espace
observéAspect infrastructurel : la rareté a déménagé · Mettre le calcul en orbite plutôt que de payer la facture
AI1 et Starmind
Le 9 juin 2026, SpaceX dévoile le premier satellite de cette flotte, AI1 : une envergure déployée de 70 mètres, plus large qu'un Boeing 747, pour une charge de calcul de 120 kW en moyenne et 150 kW en pointe
spéculatifAspect infrastructurel : la rareté a déménagé · Mettre le calcul en orbite plutôt que de payer la facture
AI1 et Starmind
Le 9 juin 2026, SpaceX dévoile le premier satellite de cette flotte, AI1 : une envergure déployée de 70 mètres, plus large qu'un Boeing 747, pour une charge de calcul de 120 kW en moyenne et 150 kW en pointe ; le nom donné à la constellation visée, Starmind, en dit l'ambition : jusqu'à un million de satellites de calcul en orbite basse.
L'argument avancé n'est pas seulement que le Soleil brille en continu en orbite, sans nuit ni nuage ; c'est aussi que la contrainte qui pèse sur un centre de données terrestre, obtenir un permis de construire, un raccordement au réseau, l'accord d'une collectivité locale, s'allège presque entièrement une fois le calcul placé en orbite.
observéAspect infrastructurel : la rareté a déménagé · Mettre le calcul en orbite plutôt que de payer la facture
Une juridiction pas une absence
Cela ne place pourtant pas ce calcul hors de toute gouvernance : le droit international de l'espace fait relever tout objet placé en orbite de la juridiction et du contrôle de l'État sur le registre duquel il est immatriculé, ici les États-Unis, d'où SpaceX lance ses fusées
observéAspect infrastructurel : la rareté a déménagé · Qui possède le calcul possède le pouvoir
Le calcul se contrôle
Le calcul en est l'exemple le plus net : rare, mesurable, physiquement localisé, il se prête au contrôle comme aucun logiciel ne s'y prête, si bien que les États et les entreprises s'en servent déjà comme d'un levier de gouvernance, du contrôle à l'exportation à l'allocation des puces
observéAspect infrastructurel : la rareté a déménagé · Qui possède le calcul possède le pouvoir
Le calcul se contrôle
Le calcul en est l'exemple le plus net : rare, mesurable, physiquement localisé, il se prête au contrôle comme aucun logiciel ne s'y prête, si bien que les États et les entreprises s'en servent déjà comme d'un levier de gouvernance, du contrôle à l'exportation à l'allocation des puces ; le précédent le plus net date d'octobre 2022, quand l'administration américaine restreint l'exportation vers la Chine des puces de calcul les plus avancées au-delà d'un seuil de performance et de bande passante d'interconnexion calibré sur les meilleurs modèles Nvidia du moment
La raison en est physique, non réglementaire : un logiciel se copie et franchit toute frontière en un instant, tandis qu'une puce se fabrique dans quelques usines, s'exporte en conteneurs et s'installe dans un bâtiment qu'on peut compter et surveiller. C'est cette matérialité qui rend le calcul saisissable par une douane ou un registre, là où l'intelligence, une fois diffusée, ne l'est plus.
observéAspect infrastructurel : la rareté a déménagé · Qui possède le calcul possède le pouvoir
Le calcul se contrôle
S'y ajoute une chaîne de fabrication très concentrée, qui offre au régulateur un petit nombre de points de passage
Le dernier pas est celui que le contrôle à l'exportation, évoqué plus haut, illustre déjà : dès qu'une ressource est rare, localisée et dénombrable, qui la commande peut en accorder ou en refuser l'accès ; ce pouvoir d'accorder ou de refuser est politique avant d'être économique. Le ca
observéAspect infrastructurel : la rareté a déménagé · Qui possède le calcul possède le pouvoir
L'État monnaie aussi son autorisation
En août 2025, l'administration américaine transforme ce même interrupteur en péage explicite : elle accepte de délivrer des licences d'exportation vers la Chine pour des puces d'IA bridées (le Nvidia H20, l'AMD MI308), moyennant un prélèvement de 15 % sur le chiffre d'affaires réalisé en Chine par ces ventes, reversé au Trésor américain
observéAspect infrastructurel : la rareté a déménagé · Qui possède le calcul possède le pouvoir
Ohio 500 milliards
OpenAI négocie un centre de données de 500 milliards de dollars à construire dans l'Ohio, sur l'ancien site d'enrichissement d'uranium de Piketon, alimenté par dix gigawatts d'électricité via un partenariat public américano-japonais ; Nvidia y apporte de son côté une garantie financière de 250 milliards de dollars, couvrant le loyer et la dette d'OpenAI si l'entreprise venait à manquer à ses paiements
extrapoléAspect infrastructurel : la rareté a déménagé · Qui possède le calcul possède le pouvoir
Le risque qui en découle
Le juriste Jeremy Kress (université du Michigan, spécialiste du risque systémique financier) en tire la conséquence : un fournisseur qui garantit la dette de son propre client n'apporte pas un capital extérieur qui diluerait le risque, il adosse son propre sort à celui du client qu'il garantit ; si OpenAI ne peut rembourser, c'est l'ensemble de l'industrie, Nvidia inclus, qui encaisse le choc
Le mécanisme se comprend par un cas plus simple. Un père qui se porte caution du prêt immobilier de son fils ne diversifie pas son patrimoine, il l'expose davantage : si le fils ne paie plus, c'est le père qui paie à sa place et les deux fortunes, qu'on croyait séparées, deviennent une seule et même fortune le jour où l'une flanche.
observéAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Une doctrine déjà théorisée
L'investisseur américain Peter Thiel en fait le but explicite de toute entreprise qui réussit vraiment : « la compétition est pour les perdants », le monopole étant ce qui affranchit son détenteur de toute contrainte concurrentielle extérieure
Thiel en est la voix la plus explicite de ce discours, mais il porte un bagage idéologique qui court à travers tout un réseau bien réel et documenté, que ses propres membres appellent affectueusement la PayPal Mafia : ce discours n'est pas celui d'un homme seul.
observéAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Une doctrine déjà théorisée
O'Brien, illustré d'une photo devenue célèbre : par une soirée d'octobre 2007, une douzaine d'anciens cadres de PayPal posent en costume au café Tosca de San Francisco, mis en scène en mafieux, chaînes en or et cigares à la main
observéAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Une doctrine déjà théorisée
D'autres essaiment ailleurs : Jeremy Stoppelman et Russel Simmons fondent Yelp en 2004 ; Jawed Karim, ingénieur chargé de la lutte antifraude chez PayPal, est crédité comme cofondateur de YouTube ; Ken Howery et Luke Nosek cofondent avec Thiel, en 2005, le fonds de capital-risque Founders Fund, premier investisseur institutionnel de SpaceX et de Palantir, que Thiel préside depuis 2003
Ce réseau, né dans une entreprise de paiement en ligne au tournant des années 2000, continue de se reconstituer, jusque très récemment. En juin 2026, Botha, qui venait de quitter la direction de Sequoia Capital, rejoint le
observéAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Ce qui est partagé et ce qui ne l'est pas
En juin 2026, Botha, qui venait de quitter la direction de Sequoia Capital, rejoint le conseil d'administration de SpaceX aux côtés de Musk, qu'il avait côtoyé chez PayPal un quart de siècle plus tôt
observéAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Ce qui est partagé et ce qui ne l'est pas
Sacks est nommé, le 5 décembre 2024, « AI and Crypto Czar » (chargé, auprès de la Maison-Blanche, de l'intelligence artificielle et des cryptomonnaies) par le président élu Donald Trump
observéAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Ce qui est partagé et ce qui ne l'est pas
Sacks est nommé, le 5 décembre 2024, « AI and Crypto Czar » (chargé, auprès de la Maison-Blanche, de l'intelligence artificielle et des cryptomonnaies) par le président élu Donald Trump, fonction qu'il occupe jusqu'à sa démission fin mars 2026, à l'expiration du délai légal de cent trente jours réservé aux employés fédéraux temporaires, pour ensuite coprésider le conseil scientifique et technologique du président (PCAST)
observéAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Ce qui est partagé et ce qui ne l'est pas
Vance en 2022, alors qu'il l'employait déjà comme associé dans son propre fonds Mithril Capital ; Vance devient sénateur de l'Ohio, puis vice-président des États-Unis
observéAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Ce qui est partagé et ce qui ne l'est pas
Palantir, enfin, que Thiel préside depuis sa création, signe en juillet 2025 avec l'armée de terre américaine un accord-cadre plafonné à dix milliards de dollars sur dix ans, qui consolide soixante-quinze contrats antérieurs en un seul
Le privilège que Thiel réclame pour la réussite économique, il se le réserve aussi en privé : naturalisé néo-zélandais en 2011 après douze jours de présence sur le sol du pays, il y acquiert un domaine et dépose une demande de permis pour un pavillon-abri surplombant le lac W\=anaka, refusée par les autorités locales puis, en appel, par le tribunal de l'environnement en 2024
observéAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Ce qui est partagé et ce qui ne l'est pas
Le privilège que Thiel réclame pour la réussite économique, il se le réserve aussi en privé : naturalisé néo-zélandais en 2011 après douze jours de présence sur le sol du pays, il y acquiert un domaine et dépose une demande de permis pour un pavillon-abri surplombant le lac W\=anaka, refusée par les autorités locales puis, en appel, par le tribunal de l'environnement en 2024
spéculatifAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Ce qui est partagé et ce qui ne l'est pas
Le journaliste Evan Osnos documente, dans une enquête devenue canonique, ce même réflexe chez ses pairs : pour nombre de grandes fortunes de la tech américaine, une propriété néo-zélandaise vaut « signe entendu » de préparation à l'effondrement, au point qu'un cofondateur de LinkedIn estime qu'une majorité des milliardaires de la Silicon Valley détient une forme « d'assurance apocalypse »
En 2009, Thiel écrit ne plus croire « que la liberté et la démocratie soient compatibles », datant ce doute de l'élargissement du suffrage après 1920
observéAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Une doctrine politique documentée indépendamment
En 2009, Thiel écrit ne plus croire « que la liberté et la démocratie soient compatibles », datant ce doute de l'élargissement du suffrage après 1920
observéAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Une doctrine politique documentée indépendamment
Une enquête plus large de BuzzFeed News sur les réseaux de l' alt-right américaine révèle, parmi ses conclusions, des courriels où l'informaticien Curtis Yarvin, figure du courant dit des « Lumières sombres » (Dark Enlightenment, qui prône de remplacer la démocratie par un gouvernement d'entreprise confié à un PDG-monarque), se décrit « en train de coacher Thiel » sur des questions politiques ; le fonds de Thiel investit par ailleurs dans une société fondée par Yarvin
L'entrepreneur français Yann Lechelle, qui a dirigé Scaleway (l'un des rares opérateurs de cloud européens) et codirige aujourd'hui Probabl (société qui porte scikit-learn, une bibliothèque libre d'app
observéAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Un contre-modèle nommé existe déjà
L'entrepreneur français Yann Lechelle, qui a dirigé Scaleway (l'un des rares opérateurs de cloud européens) et codirige aujourd'hui Probabl (société qui porte scikit-learn, une bibliothèque libre d'apprentissage automatique parmi les plus employées au monde), publie en 2025 un essai au titre programmatique : Ouvertarisme, le numérique des Lumières
observéAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
La souveraineté chiffrée
En juin 2026, la Commission européenne annonce un « paquet de souveraineté technologique » dont le Cloud and AI Development Act (CADA) fixe l'ambition en chiffres : tripler la capacité européenne de centres de données en cinq à sept ans et instaurer un cadre unique pour évaluer, service par service, si un cloud ou une IA est réellement « souveraine » ou seulement hébergée sur le sol européen par une entreprise soumise, elle, à une loi étrangère
extrapoléAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
La souveraineté chiffrée
Un cabinet d'analyse cité par la Commission chiffre le prix de ce choix : la dépense européenne en cloud « souverain » passerait d'environ sept milliards de dollars en 2025 à plus de vingt milliards en 202
Cette fracture ne sépare pas seulement les blocs entre eux ; elle traverse chacun d'eux. Selon le centre de réflexion américain CSIS, les États-Unis et la Chine concentrent déjà, à eux seuls, 45 % et 25 % de la capacité mondiale de centres de données
mesuréAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
La fracture existe aussi à l'intérieur d'un même bloc
Selon le centre de réflexion américain CSIS, les États-Unis et la Chine concentrent déjà, à eux seuls, 45 % et 25 % de la capacité mondiale de centres de données
mesuréAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
La fracture existe aussi à l'intérieur d'un même bloc
La France, dont le parc nucléaire fournissait 68 % de l'électricité en 2024 et qui exportait cette année-là un excédent net de 89 TWh, engage un plan de 109 milliards d'euros pour faire croître sa production de 2 % par a
observéAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
La fracture existe aussi à l'intérieur d'un même bloc
L'Irlande fait le constat inverse : les centres de données y absorbaient 5 % de l'électricité nationale en 2015, 21 % en 2023, 30 % projetés pour 2030 ; la région de Dublin a tout simplement suspendu, jusqu'en 2028, l'octroi de nouveaux raccordements aux centres de données
L'Europe n'est ni la première ni la seule à jouer cette partie ; en 2026, la course à l'infrastructure IA se joue désormais à l'échelle des États et l'énergie en est devenue l'arbitre.
observéAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
L'Europe n'est pas seule sur ce terrain
Le Canada, l'Australie et les pays nordiques misent sur la ressource : une énergie abondante et bon marché y attire des centres que l'Europe ou les États-Unis peinent à alimenter
Le front géopolitique ne s'arrête pas au courant électrique ; il remonte déjà la chaîne jusqu'aux matériaux qui fabriquent les puces elles-mêmes. Le Venezuela et la Colombie, riches en terres rares nécessaires à l'électronique de pointe, deviennent à leur tour un terrain disputé, une Amérique latine pressentie comme « prochain champ de bataille technologique »
spéculatifAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Le front se déplace vers les terres rares
Le Venezuela et la Colombie, riches en terres rares nécessaires à l'électronique de pointe, deviennent à leur tour un terrain disputé, une Amérique latine pressentie comme « prochain champ de bataille technologique »
Le Golfe incarne ce dénominateur commun avec une netteté particulière. Les centres de données américains consommaient déjà 4,4 % de l'électricité du pays en 2023, une part que le Center for Strategic and International Studies projette triplée d'ici 202
extrapoléAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Le Golfe encaisse la facture
Les centres de données américains consommaient déjà 4,4 % de l'électricité du pays en 2023, une part que le Center for Strategic and International Studies projette triplée d'ici 202
extrapoléAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Le Golfe encaisse la facture
Le pétrole, le gaz et des investissements croissants dans le solaire et le nucléaire garantissent, en Arabie saoudite et aux Émirats arabes unis, une puissance bon marché et disponible immédiatement, quand leurs fonds souverains apportent le capital
observéAspect infrastructurel : la rareté a déménagé · Bâtir seul ou bâtir en commun : deux paris
Le Golfe encaisse la facture
Washington a transformé cette abondance en levier diplomatique explicite : le 19 novembre 2025, le département américain du Commerce autorise l'exportation vers G42 (Émirats arabes unis) et Humain (Arabie saoudite) de l'équivalent de 35 000 puces Nvidia GB300 chacune, soit 70 000 puces de la génération Blackwell Ultra au total, sous réserve d'un accord de garantie intergouvernemental qui impose un contrôle de l'usage final pour empêcher toute réexportation vers la Chine
observéAspect infrastructurel : la rareté a déménagé · Ce n'est pas le secteur qui compte, c'est ce qu'on ne peut pas perdre
La liste NIS2
La directive européenne sur la sécurité des réseaux et des systèmes d'information (NIS2, Network and Information Security) en dresse la liste, énergie, eau, transports, santé, banque, infrastructures numériques
La directive citée ne fournit pas ce critère ; elle sert de contre-modèle utile. Elle classe par secteur parce qu'une loi a besoin de listes closes, mais un même secteur abrite l'action anodine et l'action critique : dans la santé, trier des rendez-vous et régler une pompe à insuline relèvent du même secteur et n'appellent pas la même prudence.
observéAspect infrastructurel : la rareté a déménagé · Ce que le terrain a déjà appris, sans catastrophe
Prédire ou détecter
Un modèle localise les fuites d'un réseau d'eau par imagerie satellite
observéAspect infrastructurel : la rareté a déménagé · Ce que le terrain a déjà appris, sans catastrophe
Prédire ou détecter
Un modèle localise les fuites d'un réseau d'eau par imagerie satellite, un autre repère depuis l'espace un panache de méthane sur un gazoduc et alerte l'opérateur
Ces deux cas partagent la même division du travail : la machine voit ce qu'un œil humain ne verrait pas à temps, une fuite enterrée, un gaz invisible, mais c'est une équipe qui creuse ou qui ferme la vanne. Le modèle produit un signal, pas un acte ; sa permission s'arrête au constat.
observéAspect infrastructurel : la rareté a déménagé · Ce que le terrain a déjà appris, sans catastrophe
Agir presque toujours sous garde
Le système de DeepMind qui pilote le refroidissement des centres de Google le fait derrière huit couches de sûreté et un opérateur qui peut, à tout instant, l'exclure : l'agent écarte de lui-même les propositions où sa confiance est basse et si une consigne viole une borne de sûreté, le système retombe seul sur un réglage neutre au lieu de forcer le passage
mesuréAspect infrastructurel : la rareté a déménagé · Ce que le terrain a déjà appris, sans catastrophe
Agir presque toujours sous garde
L'économie obtenue, environ 30 % sur l'énergie de refroidissement une fois le système rodé
observéAspect infrastructurel : la rareté a déménagé · Ce que le terrain a déjà appris, sans catastrophe
Agir presque toujours sous garde
Le premier réseau mobile certifié « autonome de niveau 4 » (TDC NET et Ericsson) n'agit sans approbation humaine que dans un périmètre étroit : l'économie d'énergie d'une cellule radio, sous une intention qui le borne
Deux garde-fous méritent d'être retenus au-delà de ces deux cas, car ils disent ce qu'est une permission d'agir bien posée : écarter de soi-même les propositions incertaines plutôt que d'agir dans le doute et retomber sur un réglage neutre plutôt que de forcer un passage litigieux. L'économie d'énergie obtenue dans le cas du refroidissement n'a pas
observéAspect infrastructurel : la rareté a déménagé · Ce que le terrain a déjà appris, sans catastrophe
Aucun effondrement dû à une IA
La panne mondiale de Meta d'octobre 2021 est venue d'une commande de maintenance et de l'outil de vérification bogué censé l'arrêter
observéAspect infrastructurel : la rareté a déménagé · Ce que le terrain a déjà appris, sans catastrophe
Aucun effondrement dû à une IA
La panne mondiale de Meta d'octobre 2021 est venue d'une commande de maintenance et de l'outil de vérification bogué censé l'arrêter ; celle d'Amazon Web Services, d'un emballement de l'ajustement automatique de capacité
observéAspect infrastructurel : la rareté a déménagé · Ce que le terrain a déjà appris, sans catastrophe
Aucun effondrement dû à une IA
La panne mondiale de Meta d'octobre 2021 est venue d'une commande de maintenance et de l'outil de vérification bogué censé l'arrêter ; celle d'Amazon Web Services, d'un emballement de l'ajustement automatique de capacité ; la crise électrique du Texas de février 2021, du gel et du couplage serré entre gaz et électricité, avec une vingtaine de gigawatts de délestage
observéAspect infrastructurel : la rareté a déménagé · Ce que le terrain a déjà appris, sans catastrophe
Aucun effondrement dû à une IA
Deux incidents plus anciens sur l'eau et le gaz confirment le motif, sans la moindre IA non plus : en février 2021, un intrus connecté à distance, sans autorisation, à la station de traitement d'eau d'Oldsmar (Floride) a tenté de porter la concentration de soude caustique de 100 à 11 100 parties par million, un opérateur corrigeant la dose avant tout effet réel
observéAspect infrastructurel : la rareté a déménagé · Ce que le terrain a déjà appris, sans catastrophe
Aucun effondrement dû à une IA
…plus anciens sur l'eau et le gaz confirment le motif, sans la moindre IA non plus : en février 2021, un intrus connecté à distance, sans autorisation, à la station de traitement d'eau d'Oldsmar (Floride) a tenté de porter la concentration de soude caustique de 100 à 11 100 parties par million, un opérateur corrigeant la dose avant tout effet réel ; en mai 2021, une intrusion purement informatique (mot de passe VPN compromis, sans double authentification) a conduit Colonial Pipeline à arrêter par précaution le principal oléoduc de la côte Est américaine, provoquant pénuries et achats de panique sans qu'aucun composant physique n'ait été touché
Ces cas racontent la même histoire sans aucune IA : une action automatique, une commande de maintenance, un ajustement de capacité, un aléa météo, se propage parce que les éléments du système sont trop étroitement liés pour amortir le choc. Au Texas, le gel a coupé le gaz, qui alimentait les centrales, qui alimentaient les pompes à gaz : la boucle s'est mordu la queue.
mesuréAspect infrastructurel : la rareté a déménagé · Ce que le terrain a déjà appris, sans catastrophe
Milliseconde contre saison
Le pilote Surtrac, conçu par le Robotics Institute de Carnegie Mellon et déployé en 2012 dans le quartier d'East Liberty à Pittsburgh, laisse chaque carrefour calculer seul, en temps réel et sans plan centralisé rigide, l'horaire de son propre feu ; le pilote réduit de 40 % le temps d'attente aux feux et de 26 % le temps de trajet
mesuréAspect infrastructurel : la rareté a déménagé · Ce que le terrain a déjà appris, sans catastrophe
Milliseconde contre saison
Un pulvérisateur agricole guidé par un modèle de vision qui confond une mauvaise herbe et une jeune pousse traite au mauvais endroit : le coût ne se lit qu'à la récolte, quand la correction coûte cher
Ce qui rend le second cas instructif, c'est l'écart entre le laboratoire et le champ : un modèle qui distinguait proprement l'herbe de la pousse sous éclairage contrôlé se dégrade dès que la lumière, la terre ou les feuilles qui se recouvrent changent. L'erreur ne se paie pas au moment où elle est commise, mais des mois plus tard, sur le rendement, quand plus rien ne se rattrape.
observéAspect infrastructurel : la rareté a déménagé · Ce que le terrain a déjà appris, sans catastrophe
Le cas John Deere
Il aura fallu une action antitrust fédérale pour rouvrir l'accès au logiciel
Posséder le tracteur ne suffit pas si la clé qui l'ouvre reste chez le fabricant. L'agriculteur détient l'acier et les roues, mais la partie qui décide, le logiciel, lui est louée sous conditions ; dès qu'une panne exige d'y toucher, l'agriculteur dépend du seul réparateur agréé.
observéAspect infrastructurel : la rareté a déménagé · Ce que le terrain a déjà appris, sans catastrophe
La légitimité
Le second est la légitimité : le projet de ville intelligente mené à Toronto par Sidewalk Labs, une filiale d'Alphabet, la maison mère de Google, n'a pas échoué sur la technique, mais sur la gouvernance des données, faute d'un modèle de confiance
Le projet ne s'est pas heurté à un obstacle d'ingénierie ; les capteurs fonctionnaient. Il a buté sur une question que la technique ne tranche pas : qui décide de ce que les données des habitants deviennent et au nom de qui. Faute d'y répondre, le consentement s'est retiré et le projet s'est arrêté, capable mais non légitime.
extrapoléAspect politique : gouverner les actions autorisées
Gouverner comme une bureaucratie pas comme un jugement
La philosophe Carina Prunkl propose de comparer la décision algorithmique non à la décision humaine individuelle mais à la décision bureaucratique
mesuréAspect politique : gouverner les actions autorisées
Gouverner comme une bureaucratie pas comme un jugement
Un algorithme de santé américain utilisant le coût total des soins passés comme indicateur de gravité a systématiquement sous-orienté les patients noirs vers des soins complémentaires, la moindre dépense de soins historiquement consacrée à ce groupe, à état de santé égal, suffisant à fausser l'indicateur ; corriger le biais aurait fait passer la part de patients noirs recevant une aide complémentaire de 17,7 à 46,5 %
Ce n'était pas un échec d'application : l'algorithme faisait exactement ce qu'on lui avait demandé, le vice logeait dans le choix de l'indicateur, pas dans son exécution.
mesuréAspect politique : gouverner les actions autorisées
Cent quarante et un sous-agents dans un bac a sable formel
En 2026, l'agent Claude Opus 4.6, outillé pour piloter l'assistant de preuve Rocq, un logiciel qui contrôle pas à pas la validité d'une démonstration, via un protocole dédié, résout dix des douze problèmes du concours mathématique Putnam 2025, en faisant naître cent quarante et un sous-agents sur l'ensemble de l'expérience, pour dix-sept heures de calcul actif
observéAspect politique : gouverner les actions autorisées
Cent quarante et un sous-agents dans un bac a sable formel
Le même déplacement anime Ax-Prover, qui distribue une tâche de preuve entre agents spécialisés pour les mathématiques et la physique quantique via le Model Context Protocol
Cette prolifération, qui inquiéterait dans un système de production, ne pose ici aucun risque comparable : chaque preuve produite est vérifiée mécaniquement par Rocq lui-même avant d'être retenue, si bien que l'environnement d'exécution, non la bonne volonté des sous-agents, garantit le résultat.
observéAspect politique : gouverner les actions autorisées · Le code de la route, pas une idéologie
Le contre-exemple pharmaceutique
Ce démenti vient d'un échange public entre un philosophe de l'IA et des dirigeants d'entreprise, où la fausse opposition entre innovation et règle est justement mise en cause
observéAspect politique : gouverner les actions autorisées · Le code de la route, pas une idéologie
Le Covid montre la règle sous pression
Le Covid-19 l'a même montré sous pression : une coordination internationale des régulateurs a su accompagner la sortie d'un vaccin en dix-huit mois environ
mesuréAspect politique : gouverner les actions autorisées · 1. Le degré d'autonomie commande l'exigence
À chaque degré ses exigences
La règle 1 comble précisément ce vide industriel, du côté de l'acte plutôt que de la donnée ; même ce compartiment réputé résolu tient mal à l'épreuve : une enquête menée en 2026 auprès de plus de cinq cents professionnels de la cybersécurité constate que 76 % des organisations voient croître leurs identités non humaines et que 74 % déploient déjà des agents nécessitant des identifiants, mais que 92 % ne parviennent pas à renouveler ces identifiants tous les quatre-vingt-dix jours et que moins de quatre organisations sur dix soumettent les actions de leurs agents à une validation humaine
observéAspect politique : gouverner les actions autorisées · 1. Le degré d'autonomie commande l'exigence
À chaque degré ses exigences
…professionnelle des auditeurs des systèmes d'information, publiait sa bibliothèque de contrôles IA, synthétisée depuis NIST 800-53, le catalogue de contrôles de cybersécurité de l'administration fédérale américaine et ISO 27001, la norme internationale de gestion de la sécurité de l'information, puis croisée avec l'AI Act, le cadre singapourien, MITRE ATLAS (Adversarial Threat Landscape for Artificial-Intelligence Systems, le répertoire des techniques d'attaque observées contre les systèmes d'apprentissage) et l'OWASP (Open Worldwide Application Security Project, la fondation communautaire qui recense les risques de sécurité des applications)
observéAspect politique : gouverner les actions autorisées · 1. Le degré d'autonomie commande l'exigence
À chaque degré ses exigences
En février 2026, l'agence fédérale américaine de normalisation lançait, via son Center for AI Standards and Innovation, la première initiative dédiée à l'interopérabilité et à la cybersécurité des agents IA, constatant que les cadres d'identité existants n'ont pas été conçus pour des systèmes qui agissent de façon autonome
observéAspect politique : gouverner les actions autorisées · 1. Le degré d'autonomie commande l'exigence
À chaque degré ses exigences
En février 2026, l'agence fédérale américaine de normalisation lançait, via son Center for AI Standards and Innovation, la première initiative dédiée à l'interopérabilité et à la cybersécurité des agents IA, constatant que les cadres d'identité existants n'ont pas été conçus pour des systèmes qui agissent de façon autonome ; en décembre 2025, l'OWASP publiait son premier palmarès des risques propres aux applications agentiques, qui recommande une identité et des privilèges restreints par agent sans toutefois proposer de grille de criticité des actions comparable à la classification des données
observéAspect politique : gouverner les actions autorisées · 1. Le degré d'autonomie commande l'exigence
La RSP comme exemple détaillé
Le Preparedness Framework d'OpenAI suit des catégories de capacités comme le cyber ou l'autonomie et fixe des seuils déclenchant des garde-fous avant déploiement
observéAspect politique : gouverner les actions autorisées · 1. Le degré d'autonomie commande l'exigence
La RSP comme exemple détaillé
Le Preparedness Framework d'OpenAI suit des catégories de capacités comme le cyber ou l'autonomie et fixe des seuils déclenchant des garde-fous avant déploiement ; le Frontier Safety Framework de Google DeepMind définit des niveaux de capacité critiques assortis d'évaluations d'alerte précoce
observéAspect politique : gouverner les actions autorisées · 1. Le degré d'autonomie commande l'exigence
La RSP comme exemple détaillé
…selon des AI Safety Levels (ASL, niveaux de sûreté des modèles d'IA) : ASL 1 recouvre les systèmes qui « manifestement ne posent aucun risque d'autonomie ou de mésusage », comme un joueur d'échecs dédié ; ASL 2 recouvre les modèles actuels de type Claude, jugés « pas assez capables pour se répliquer de manière autonome, ni pour fournir des informations sur les armes chimiques, biologiques, radiologiques et nucléaires (CBRN) au-delà de ce qu'un moteur de recherche fournit déjà » ; ASL 3 marque le seuil où « les modèles deviennent suffisamment utiles pour rehausser les capacités d'acteurs non étatiques » et déclenche des précautions renforcées
Le fait que ces trois laboratoires, concurrents et sans concertation affichée, aboutissent à la même forme de règle n'est pas anodin. Trois équipes qui résolvent séparément un même problème et retombent sur la même structure signalent que la structure tient au problème, non à une mode.
observéAspect politique : gouverner les actions autorisées · 1. Le degré d'autonomie commande l'exigence
Hassabis disait outil dès 2022
En juillet 2022, Demis Hassabis déclarait : « il vaudrait mieux, dans un premier temps, construire ces systèmes comme des outils »
observéAspect politique : gouverner les actions autorisées · 2. Ne jamais tout confier à un seul
Le cas suivant le montre
En juin 2025, la vulnérabilité EchoLeak (CVE-2025-32711, score CVSS 9,3) démontre exactement ce chemin dans Microsoft 365 Copilot : un unique courriel piégé, envoyé sans la moindre action de la victime, suffit à faire exfiltrer des données internes (courriels, fichiers, messages) vers un serveur contrôlé par l'attaquant, en contournant les défenses censées distinguer le contenu lu de l'instruction à exécuter
La séparation ne s'arrête pas aux frontières d'un seul agent. Une chaîne de plusieurs agents distincts, chacun audité et jugé bénin isolément, peut composer un chemin critique qu'aucun des audi
observéAspect politique : gouverner les actions autorisées · 2. Ne jamais tout confier à un seul
Cai rend la composition explicite
Le framework libre CAI (Cybersecurity AI), développé par l'entreprise espagnole Alias Robotics, nomme explicitement les patrons de cette architecture : un essaim décentralisé où les agents s'auto-assignent des tâches, une hiérarchie où un coordinateur distribue le travail, une chaîne séquentielle où chaque agent transmet sa sortie au suivant et un mécanisme de handoff par lequel un agent délègue explicitement une tâche à un agent spécialisé
Le philosophe Pierre Saint-Germier l'a montré à propos de la musique générée par des modèles de diffusion : quand un morceau paraît porter une émotion, ni le modèle seul (qui répond à un prompt, source du contenu), ni le prompteur seul (le lien entre le prompt et le résultat sonore reste trop lâche pour porter la responsabilité d'un choix musicologique précis), ni même le colle
extrapoléAspect politique : gouverner les actions autorisées · 2. Ne jamais tout confier à un seul
Localiser l'agent d'un acte distribué
Le philosophe Pierre Saint-Germier l'a montré à propos de la musique générée par des modèles de diffusion : quand un morceau paraît porter une émotion, ni le modèle seul (qui répond à un prompt, source du contenu), ni le prompteur seul (le lien entre le prompt et le résultat sonore reste trop lâche pour porter la responsabilité d'un choix musicologique précis), ni même le collectif prompteur-concepteurs-corpus d'entraînement ne peuvent être désignés comme l'auteur d'un acte délibéré, faute d'une structure de coordination identifiable entre eux
observéAspect politique : gouverner les actions autorisées · 3. Ni trace, ni audit ni mémoire
Sans trace ni audit ni apprentissage
L'ISACA évalue chaque contrôle à travers les six dimensions d'explication définies en 2020 par le régulateur britannique des données et l'Alan Turing Institute ; or la première, la rationale explanation, exige de documenter le raisonnement logique derrière les décisions, l'artefact même qui, pour un modèle de langage, n'existe pas : la chaîne de pensée affichée peut décrire une raison qui n'est pas la cause réelle de la réponse
Ce défaut n'est pas accidentel, il tient à la nature même de l'exercice. Une pensée critique authentique se retourne d'abord sur elle-même avant de juger autre chose : douter, c'est douter de son propre jugement en premier lieu. Une chaîne de pensée affichée ne fait rien de tel ; elle produit un récit après coup, sans jamais se retourner sur le calcul qui l'a elle-même engendrée.
observéAspect politique : gouverner les actions autorisées · 4. Un humain, avant ce qu'on ne peut plus défaire
La cinquième condition n'est pas une précaution théorique
À Hong Kong, en janvier 2024, un employé du service finance du cabinet d'ingénierie Arup a validé quinze virements, pour un total de deux cents millions de dollars hongkongais, après une visioconférence où un deepfake vidéo et audio du directeur financier avait dissipé ses soupçons
Le cas mobilise l'IA comme outil aux mains d'un attaquant humain, non comme agent qui manipule de sa propre initiative ; aucun précédent documenté de ce second type, un agent conversationnel autonome manipulant seul l'humain habilité, n'est encore public au moment où ce livre s'écrit.
observéAspect politique : gouverner les actions autorisées · 4. Un humain, avant ce qu'on ne peut plus défaire
Le clic rituel a déjà echoue en pratique
Le programme australien Robodebt (2015-2019) calculait une dette présumée en lissant sur l'année le revenu déclaré au fisc, renversant de fait la charge de la preuve sur l'allocataire ; la Commission royale d'enquête qui l'a examiné constate l'absence d'intervention humaine réelle dans le calcul et la notification des dettes, quatre cent soixante-dix mille dettes ayant été réclamées sur une base jugée insuffisante en droit
Aucune des cinq conditions qui précèdent n'y était remplie : ni temps, ni information intelligible, ni pouvoir réel de contester. Le cas vaut comme précédent structurel du même mécanisme, la validation réduite à un clic rituel, avant que le clic ne devienne celui d'un agent : ce n'est pas un cas d'IA agentique.
extrapoléAspect politique : gouverner les actions autorisées · 5. L'épreuve, pas la promesse
Mais fiable pour quelle classe d'usage
C'est un problème identifié dès les fondements du fiabilisme, cette théorie pour laquelle une croyance vaut par la fiabilité du procédé qui la produit
extrapoléAspect politique : gouverner les actions autorisées · 5. L'épreuve, pas la promesse
Mais fiable pour quelle classe d'usage
C'est un problème identifié dès les fondements du fiabilisme, cette théorie pour laquelle une croyance vaut par la fiabilité du procédé qui la produit \ et systématisé depuis sous le nom de « problème de la généralité »
extrapoléAspect politique : gouverner les actions autorisées · 5. L'épreuve, pas la promesse
Mais fiable pour quelle classe d'usage
Le philosophe des sciences Cyrille Imbert en tire, pour l'IA, une leçon directement transposable : la bonne classe de référence, l'ensemble des cas sur lequel on juge la fiabilité, n'est ni tous les usages imaginables (la plupart n'ont aucun sens pratique) ni le seul jeu de test du concepteur (presque toujours plus étroit que les usages réels), mais la classe des cas que l'utilisateur lui-même traiterait comme équivalents
observéAspect politique : gouverner les actions autorisées · 5. L'épreuve, pas la promesse
Un pipeline déjà en place
Le pipeline opérationnel qu'un tel dispositif exige n'a rien d'utopique : Amodei décrit un dispositif observé, celui appliqué à chaque modèle Claude, où « les modèles sont testés à la fois en interne et par des tiers pour leur sûreté, en particulier contre les risques catastrophiques et les risques d'autonomie ; nous avons un accord avec les instituts de sécurité AI américain et britannique ainsi que d'autres testeurs tiers dans des domaines spécifiques pour évaluer les modèles sur les risques CBRN »
observéAspect politique : gouverner les actions autorisées · 5. L'épreuve, pas la promesse
Hassabis et les bioéthicistes
Hassabis, en 2022, résumait le principe pour AlphaFold : « nous avons consulté trente bioéthicistes indépendants avant la publication » (dispositif observé)
observéAspect politique : gouverner les actions autorisées · Les seuils se délibèrent, ils ne se calculent pas
La méthode déjà appliquée à l'IA
Le laboratoire de démocratie délibérative de Stanford a conduit, pour Meta, des forums communautaires qui ont réuni environ un millier et demi de participants de plusieurs pays autour de la gouvernance de l'IA générative
observéAspect politique : gouverner les actions autorisées · Les seuils se délibèrent, ils ne se calculent pas
Un forum sur les agents
En 2025, un forum délibératif inter-entreprises, réuni par Meta avec Cohere, Oracle et PayPal, a porté spécifiquement sur la conception et la gouvernance des agents IA
Le clivage qui s'en dégage recoupe trait pour trait la première de nos règles. L'enthousiasme des participants pour un agent qui prend en charge des tâches routinières et à faible enjeu s'accompagne d'une prudence marquée dès que l'agent opère de manière autonome dans un contexte à fort enjeu ; la frontière entre le bénin et le critique ressort comme la ligne même de l'acceptabilité publiqu
observéAspect politique : gouverner les actions autorisées · Les seuils se délibèrent, ils ne se calculent pas
Un forum sur les agents
L'enthousiasme des participants pour un agent qui prend en charge des tâches routinières et à faible enjeu s'accompagne d'une prudence marquée dès que l'agent opère de manière autonome dans un contexte à fort enjeu ; la frontière entre le bénin et le critique ressort comme la ligne même de l'acceptabilité publiqu
spéculatifAspect politique : gouverner les actions autorisées · Les seuils se délibèrent, ils ne se calculent pas
Un théorème pas un fait mesuré
La première est son statut de preuve : c'est un modèle théorique stylisé, porté par un working paper (article de travail non encore publié en revue à comité de lecture), donc un théorème conditionnel, pas un fait mesuré
Un théorème conditionnel se lit comme une promesse assortie d'une clause : si la politique est réglée au mieux
observéAspect politique : gouverner les actions autorisées · Gouverner un modèle comme on gouverne une arme
La conséquence s'observe déjà
La conséquence logique s'observe déjà : à l'été 2026, l'accès de ressortissants étrangers au dernier modèle d'un grand laboratoire a été restreint, un écho anticipé de la question de l'ouverture des poids traitée plus loin
Le même ressort joue à deux échelles emboîtées. Un agent sommé d'atteindre un but est tenté de rogner la contrainte qui le ralentit ; une entreprise sommée de tenir son chiffre est tentée de garder en servi
observéAspect politique : gouverner les actions autorisées · Le trou de responsabilité et comment le combler
Le commettant répond de son agent
La lecture praticienne dominante aux États-Unis fait remonter la responsabilité aux personnes et entités derrière l'agent, par le droit du mandat qui rend le commettant garant des actes de son préposé, un tribunal ayant déjà jugé qu'un agent logiciel accédant à un espace protégé tombait sous la loi sur la fraude informatique
Le cas réel donne raison à ce sens. Dans l'incident, l'exploitant n'a pas plaidé que « la machine a agi seule » ; i
observéAspect politique : gouverner les actions autorisées · Le trou de responsabilité et comment le combler
La directive responsabilité IA retirée
La directive qui devait créer un régime de responsabilité propre à l'IA a été retirée du programme de la Commission en 2025, faute d'accord prévisible
observéAspect politique : gouverner les actions autorisées · Le trou de responsabilité et comment le combler
Reste la directive produits
Subsiste la directive rénovée sur les produits défectueux, qui couvre désormais le logiciel, donc les systèmes d'IA
On retient de ce contraste non qu'un continent aurait raison contre l'autre, mais que l'outil est plus jeune que le risque. Les catégories existent, elles sont mobilisables, elles ne sont pas encore ajustées au cas où l'agent nuit sans avoir été ni vendu ni commandé. C'est l'espace même que la gouvernance des actions doit couvrir sans attendre que le droit se stabilise.
observéAspect politique : gouverner les actions autorisées · Situer n'importe quel agent d'un coup d'œil
La chaîne décrite par Amodei
Amodei décrit publiquement la chaîne appliquée à chaque modèle Claude avant la mise en API : pré-entraînement, post-entraînement, tests internes selon la RSP, tests externes sous accord avec les instituts de sûreté américain et britannique, évaluations CBRN par des tiers spécialisés
observéAspect politique : gouverner les actions autorisées · Situer n'importe quel agent d'un coup d'œil
Le coût n'a pas empêché la performance
Ce coût n'a pas empêché l'entreprise de figurer au sommet des benchmarks publics
observéAspect politique : gouverner les actions autorisées · Pourquoi arrêter tout le monde n'arrête personne
La lettre réclame une pause
Cette lettre ouverte, massivement signée, a fait de la sûreté des modèles de frontière un sujet public faute de protocoles de sûreté partagés
observéAspect politique : gouverner les actions autorisées · Pourquoi arrêter tout le monde n'arrête personne
Les douves de conformité
Une analyse revue par les pairs montre comment des exigences de sûreté coûteuses à satisfaire protègent involontairement ceux qui ont déjà les moyens de les payer
observéAspect politique : gouverner les actions autorisées · Pourquoi arrêter tout le monde n'arrête personne
La capture réglementaire documentée
Le risque de capture réglementaire, où l'acteur dominant pèse sur les règles qui le concernent, est aujourd'hui documenté par une étude empirique de la façon dont les entreprises d'IA infléchissent les politiques qui les visent
observéAspect politique : gouverner les actions autorisées · Pourquoi arrêter tout le monde n'arrête personne
Gates écarte le moratoire comme irréaliste
Bill Gates, cofondateur de Microsoft, écarte expressément le moratoire mondial, faute de pouvoir aligner des incitations géopolitiques et économiques qui poussent en sens contraire et lui préfère des institutions nationales doublées d'une organisation internationale nouvelle, bâtie sur le modèle croisé des inspections nucléaires, de l'aviation civile et des traités sur l'ozone
observéAspect politique : gouverner les actions autorisées · Pourquoi arrêter tout le monde n'arrête personne
1 384 employés demandent à ralentir, non à arrêter
Une lettre ouverte signée en juillet 2026 par 1 384 employés des laboratoires de frontière, dont les dirigeants d'OpenAI, d'Anthropic et de DeepMind, réclame dans le même sens un effort international pour bâtir les outils techniques et de gouvernance capables de « ralentir délibérément la frontière du développement automatisé de l'IA », endossée par OpenAI et Anthropic en tant qu'entreprises quelques heures après sa publication
observéAspect politique : gouverner les actions autorisées · Quatre greffes sur un texte qui n'a pas prévu l'agent
L'AI Act classe par le risque
L'Union européenne s'est dotée d'un règlement sur l'intelligence artificielle, l'AI Act, entré en vigueur le 1er août 2024, qui classe les usages par niveau de risque : pratiques interdites (article 5), systèmes « à haut risque » soumis à des exigences d'ingénierie (articles 8 à 15), simples obligations de transparence pour le reste (article 50)
observéAspect politique : gouverner les actions autorisées · Quatre greffes sur un texte qui n'a pas prévu l'agent
Le seuil de calcul gouverne le modèle
Le premier tient à la manière dont il attrape les modèles « à usage général » : l'article 51 présume le risque systémique dès que l'entraînement a dépensé plus de 10^25 opérations en virgule flottante (FLOP, floating-point operations, l'unité qui compte les multiplications et additions élémentaires d'un calcul)
extrapoléAspect politique : gouverner les actions autorisées · Quatre greffes sur un texte qui n'a pas prévu l'agent
Un texte d'avant l'agent
Écrit pour le modèle qui répond, le règlement précède l'agent qui agit et l'analyse de politique publique commence à nommer ce trou : métriques inadaptées, injection d'instructions non couverte, supervision humaine sans « bouton d'arrêt » défini
observéAspect politique : gouverner les actions autorisées · Quatre greffes sur un texte qui n'a pas prévu l'agent
Le calendrier joue contre lui
Le calendrier, enfin, joue contre lui : prévues pour août 2026, les obligations « haut risque » ont été reportées à décembre 2027, voire août 2028, par le règlement omnibus de juillet 2026
observéÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le QI, un rang déguisé en quantité
Le versant sombre du tri
Puis vient le versant sombre : aux États-Unis, des scores de « faiblesse d'esprit » nourrissent l'argumentaire de lois d'immigration restrictives et de stérilisations forcées.
mesuréÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le QI, un rang déguisé en quantité
Ce que le test mesure bouge
Ensuite, ce que le test évalue bouge : tout au long du xxe siècle, les scores bruts ont monté d'environ trois points par décennie (effet Flynn)
observéÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le QI, un rang déguisé en quantité
Calmer l'enfant déplace le score
À cette dérive lente s'ajoute une instabilité immédiate, que la pratique des tests révèle crûment : l'un de nous a vu un examinateur constater que le seul fait de mettre les enfants à l'aise avant l'épreuve, de les calmer, déplaçait leurs résultats d'un écart-type entier, soit les quinze points qui, sur cette échelle, séparent la « normale » du « handicap ».
mesuréÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le QI, un rang déguisé en quantité
Calmer l'enfant déplace le score
L'anecdote n'est pas un cas isolé, même si elle ne dit rien, à elle seule, de l'ampleur moyenne de cet effet dans la population générale : plusieurs expériences ont montré qu'un simple rappel, juste avant l'épreuve, de l'appartenance à un groupe stigmatisé par un stéréotype d'infériorité intellectuelle suffit à dégrader la performance de sujets par ailleurs aussi compétents
observéÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Écrire en trente langues en quelques secondes
Des jours ramenés à des secondes
Un exercice de traduction qui prenait plusieurs jours à un traducteur formé prend maintenant quelques secondes.
mesuréÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le raisonnement scolaire, à son tour soulagé
Alphageometry à la frontière d'élite
En janvier 2024, l'équipe DeepMind publie AlphaGeometry, système qui résout des problèmes de géométrie de niveau des Olympiades internationales de mathématiques à la frontière de la performance humaine d'élite (résultat mesuré en conditions de banc, sur des problèmes d'Olympiades), sans données d'entraînement humaines supplémentaires.
mesuréÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le raisonnement scolaire, à son tour soulagé
Alphageometry à la frontière d'élite
C'est cette quasi-égalité avec l'élite et non un simple progrès, qui donne au fait sa charge : le critère s'est vu égalé, non seulement approché.
fortement entamé ; le raisonnement séquentiel profond, qui résistait encore à la calculette de 1970, ne fait plus barrage à l'assistant mathématique de 2024, même si celui-ci se trompe encore et demande relecture
mesuréÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le raisonnement scolaire, à son tour soulagé
L'écart novices experts se resserre
Brynjolfsson, Li et Raymond documentent et mesurent, sur un large échantillon de travailleurs du service client, que l'aide d'un modèle génératif réduit fortement l'écart de performance entre novices et experts et comprime la distribution des performances raisonnantes (l'écart entre les meilleurs et les moins bons se resserre).
mesuréÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le raisonnement scolaire, à son tour soulagé
L'écart novices experts se resserre
C'est le soulagement pris sur le vif : un savoir-faire rare cesse de départager dès qu'une machine le distribue à bas coût.
mesuréÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le raisonnement scolaire, à son tour soulagé
Plus de qualité moins de diversité
Doshi et Hauser, sur l'écriture créative, montrent parallèlement que l'usage d'un modèle génératif augmente la qualité perçue des productions individuelles et réduit la diversité collective des sorties (double effet mesuré)
mesuréÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le raisonnement scolaire, à son tour soulagé
Plus de qualité moins de diversité
C'est le même mouvement qu'au service client, transposé à la création : l'aide qui élève les moins assurés uniformise le collectif.
et, symétriquement, érode l'avance des meilleurs
spéculatifÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le raisonnement scolaire, à son tour soulagé
Une disposition cognitive pas un diagnostic
La conclusion est provocante mais cohérente : la période qui s'ouvre pourrait bien être celle où cette singularité du regard devient un critère social d'intelligence supérieur au raisonnement séquentiel bien peigné, ce dernier étant à la portée du premier agent venu.
ce qui nous semble être des réévaluations en cours
mesuréÉpilogue : qu'est-ce que l'intelligence n'est pas ? · La chimie se joue différemment
Planifier au niveau des experts
Il planifie des rétrosynthèses au niveau de chimistes expérimentés dans un test en aveugle (performance mesurée en aveugle contre des experts humains).
mesuréÉpilogue : qu'est-ce que l'intelligence n'est pas ? · La chimie se joue différemment
Planifier au niveau des experts
La marge est faible, mais le seuil qu'elle franchit ne l'est pas : pour la première fois, des chimistes égalent, à l'aveugle, une trace de raisonnement machine à la leur.
observéÉpilogue : qu'est-ce que l'intelligence n'est pas ? · La chimie se joue différemment
Un écosystème industriel
L'écosystème s'est structuré depuis : IBM RXN, ASKCOS du MIT, Chematica, Iktos, Synthia proposent des services industriels ; les grandes sociétés pharmaceutiques les intègrent à leurs chaînes de découverte.
observéÉpilogue : qu'est-ce que l'intelligence n'est pas ? · L'échec qui enseigne, la chute qui reste utile
L'aviation trace de lilienthal
Elle est aussi la trace, préservée dans la conscience professionnelle des ingénieurs et des pilotes, de la chute mortelle d'Otto Lilienthal en vol plané le 9 août 1896
observéÉpilogue : qu'est-ce que l'intelligence n'est pas ? · L'échec qui enseigne, la chute qui reste utile
Chaque chute un enseignement
Les frères Wright ont accumulé, entre 1900 et 1903, plusieurs centaines de vols planés interrompus par des chutes brutales
observéÉpilogue : qu'est-ce que l'intelligence n'est pas ? · L'imprimerie a provoqué le passage à l'échelle de l'esprit critique
Valla démasque la donation
Lorenzo Valla, autour de 1440, démontre par comparaison philologique que la Donation de Constantin (texte utilisé depuis des siècles pour légitimer le pouvoir temporel de l'Église) est un faux médiéval
spéculatifÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le génie déborde l'intelligence
Thèse spéculative et contestée
Il pousse l'analogie jusqu'au bout, du côté de la physique : de même que le monde des atomes a exigé, au début du xxe siècle, une physique entièrement neuve (la mécanique quantique) là où la mécanique classique échouait, de même la conscience réclamerait, selon lui, une science manquante, encore à écrire, qu'il situe du côté de la gravité quantique et d'un mécanisme non calculable de « réduction » de l'état quantique. Penrose qualifie lui-même la thèse de spéculative
ce second théorème disant qu'un système formel assez riche ne peut jamais établir sa propre cohérence avec ses seules ressources internes, tout comme on ne peut pas se porter garant de sa propre bonne foi
observéÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le génie déborde l'intelligence
Le contre-exemple de Fable 5
En s'aidant du modèle Fable 5, sur un problème que lui avait soufflé Akhil Mathew, le mathématicien Levent Alpöge a exhibé une application de l'espace à trois dimensions dont le déterminant jacobien vaut partout la constante -2, mais qui envoie trois points distincts sur un même point
Il faut mesurer exactement ce que ce cas établit et ce qu'il n'établit pas : il décrit un partage des rôles observé en 2026, pas un argument sur la calculabilité. Que l'ordinateur engendre et qu'un humain reconnaisse ne dit rien, à lui seul, de savoir si cette reconna
observéÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le génie déborde l'intelligence
La machine engendre l'humain reconnaît
Un mathématicien, Will Sawin, en précise ensuite la constante exacte ; la communauté, dont Timothy Gowers, médaillé Fields, et Noga Alon, vérifie et publie la reconstruction
observéÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le génie déborde l'intelligence
La machine engendre l'humain reconnaît
Le même printemps 2026 en accumule d'autres, chacun dans un domaine distinct : un nombre de Ramsey de livres, R(B_8,B_10)=37, résolu par le système AutoMath, où le problème autant que la preuve furent trouvés par IA
observéÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le génie déborde l'intelligence
La machine engendre l'humain reconnaît
Le même printemps 2026 en accumule d'autres, chacun dans un domaine distinct : un nombre de Ramsey de livres, R(B_8,B_10)=37, résolu par le système AutoMath, où le problème autant que la preuve furent trouvés par IA ; deux problèmes ouverts de mathématiques numériques (comparaison gradient conjugué/descente de coordonnées aléatoire, contre-exemple à la factorisation QR) traités par le système Iteris, résultats finaux obtenus après réparation humaine
observéÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le génie déborde l'intelligence
La machine engendre l'humain reconnaît
Le même printemps 2026 en accumule d'autres, chacun dans un domaine distinct : un nombre de Ramsey de livres, R(B_8,B_10)=37, résolu par le système AutoMath, où le problème autant que la preuve furent trouvés par IA ; deux problèmes ouverts de mathématiques numériques (comparaison gradient conjugué/descente de coordonnées aléatoire, contre-exemple à la factorisation QR) traités par le système Iteris, résultats finaux obtenus après réparation humaine ; cinq résultats nouveaux en théorie des espaces de Banach, dont un problème ouvert depuis 1964, idées et preuves quasi complètes proposées par IA puis retravaillées par des spécialistes
(un langage informatique qui vérifie, ligne par ligne et sans faille possible, qu'une démonstration mathématique tient debout, un peu comme un correcteur orthographique mais pour la rigueur logique d'une preuve)
mesuréÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le génie déborde l'intelligence
La machine engendre l'humain reconnaît
Un dernier cas inverse le partage : le système LEAP formalise et vérifie des preuves déjà trouvées, faisant passer le taux de réussite d'un modèle généraliste de moins de 10 % à 70 % sur un banc d'essai de formalisation Lean (un langage informatique qui vérifie, ligne par ligne et sans faille possible, qu'une démonstration mathématique tient debout, un peu comme un correcteur orthographique mais pour la rigueur logique d'une preuve) ; ici l'IA ne découvre rien, elle audite
observéÉpilogue : qu'est-ce que l'intelligence n'est pas ? · Le génie déborde l'intelligence
Tao lui-même le formule
Tao lui-même, dont ce chapitre vient de suivre la vérification du contre-exemple de Keller, tient ce même partage dans une conversation publique donnée à Stanford en août 2026 : il y décrit son usage quotidien d'un agent informatique pour gérer bases de données et calculs, tout en posant une limite explicite ; le taux d'erreur des IA a baissé, dit-il, sans jamais atteindre zéro, d'où une confiance nécessairement bornée et coupler ces IA à une vérification formelle comme Lean peut « les garder complètement honnêtes »
observéConclusion : l'éléphant, presque en entier
La même estimation, dotée du pouvoir d'acheter pour de vrai, transforme l'erreur en action financière : c'est ce qui est arrivé à Zillow, qui avait adossé à son estimateur de prix (le Zestimate) un pouvoir d'achat automatique de maisons, jusqu'à fermer brutalement cette activité en novembre 2021, avec une dépréciation de plus de trois cents millions de dollars au seul troisième trimestre et plus d'un demi-milliard au total
observéConclusion : l'éléphant, presque en entier
L'objet existe déjà
L'état des lieux constate que l'objet existe sous forme expérimentale et partiellement opérationnelle
ces indicateurs de substitution nommés plus haut, des grandeurs faciles à compter que l'agent pousse à la place de l'objectif qu'on ne sait pas mesurer directement.
observéConclusion : l'éléphant, presque en entier
La catastrophe n'est pas encore là
L'aspect empirique et défensif tient une position médiane : la catastrophe agentique n'est pas observée, mais ses briques le sont.
Protocole est à entendre au sens strict : no
observéConclusion : l'éléphant, presque en entier
Le trading confié à des agents
L'aspect financier éprouve la thèse sur les marchés internationaux, où le régime permission-autorisation est maximal. Depuis 2024, on confie le trading à des agents
mesuréConclusion : l'éléphant, presque en entier
Backtest plutôt que gains réels
Mais l'audit du champ révèle des résultats peu reproductibles : sur soixante-dix-sept études recensées, deux seulement des dix-neuf travaux empiriques isolent correctement le futur du passé dans leur découpage temporel
extrapoléConclusion : l'éléphant, presque en entier
Backtest plutôt que gains réels
Mais l'audit du champ révèle des résultats peu reproductibles : sur soixante-dix-sept études recensées, deux seulement des dix-neuf travaux empiriques isolent correctement le futur du passé dans leur découpage temporel, la plupart des rendements annoncés étant des rendements de backtest plutôt que des gains réels
Un rendement de backtest est ce qu'une stratégie aurait rapporté si on l'avait fait tourner sur des données passées, rejouées après coup ; un gain réel est ce qu'elle rapporte effectivement, argent véritable engagé.