Document vivant — mise à jour continue
La banque de cas AIPM
Les 108 cas sur lesquels le référentiel est construit — chacun avec sa donnée chiffrée, ce qu'il illustre dans le Standard, et son statut de preuve. Rien n'est présenté comme acquis quand ça ne l'est pas.
AIPM n'est pas une adaptation d'un référentiel existant : il est construit à partir de cette banque de cas, pas l'inverse. Chaque principe directeur et chaque domaine de performance du Standard renvoie à au moins un cas d'ici. C'est ce qui rend le référentiel réfutable : si un cas est faux ou mal classé, le principe qu'il porte doit être révisé.
Vous pouvez nous contredire. Si vous avez connaissance d'un élément qui infirme un cas de cette liste, ou d'un cas mieux documenté sur le même sujet, écrivez-nous : la correction sera portée avec sa date dans le journal des versions.
confirmés opérationnels
annoncés ou projetés
issus de recherche ou de projection
en cours de consolidation
Ce que cette page a changé le 7 septembre 2026. Chaque cas a été repris un par un pour remonter à sa source réelle, vérifier que le chiffre publié ici est bien celui de la source, et recalculer le statut de preuve par application mécanique de la règle plutôt que par appréciation. Résultat : les cas « Confirmé opérationnel » passent de 42 à 32. Sept cas ont vu leur donnée chiffrée corrigée ou retirée, la source disant autre chose que ce que cette page affichait. La colonne « Ce que dit la source » porte le détail, y compris quand il nous est défavorable. La règle appliquée est publiée sur la page méthode de preuve.
32 / 108
cas atteignent le statut « Confirmé opérationnel » une fois la règle appliquée
La preuve, en proportion
Ce que la règle donne quand on la laisse trancher
Un référentiel dont 28 % seulement des cas atteignent le statut le plus élevé peut sembler faible. C'est l'inverse : c'est ce que donne une règle appliquée sans complaisance sur des sources publiques. Les référentiels qui affichent 100 % de cas confirmés ne publient pas leur règle.
Filtrer la banque
Statut de preuve
Zone
Secteur
108 cas affichés
| # | Cas | Secteur | Zone | Donnée chiffrée | Source | Statut de preuve | Ce que dit la source |
|---|---|---|---|---|---|---|---|
| 1 | Xiaomi — usine Changping Directive, rôle humain | Manufacturing | Chine | Un smartphone produit par seconde (60 par minute), ligne entièrement automatisée — mais à l'usine de Yizhuang (2020), les humains y assurant l'approvisionnement. L'usine de Changping (2024) produit 30 000 téléphones par jour, soit un toutes les 2,9 secondes. | Commission municipale du développement et de la réforme de Pékin source institutionnelle · 2020-09-09 | À consolider | Le chiffre est réel mais rattaché au mauvais site : il concerne l'usine de Yizhuang (2020), pas celle de Changping (2024), qui produit 30 000 téléphones par jour, soit un toutes les 2,9 secondes. La source précise aussi que les humains assurent l'approvisionnement. |
| 2 | Foxconn — site de Kunshan rôle humain, macro-tendance | Manufacturing | Chine | 60 000+ postes supprimés sur ce seul site après bascule "lights-out" | Fortune, reprenant le South China Morning Post et la BBC presse · 2016-05-26 | À consolider | Source unique remontant à une déclaration du gouvernement de Kunshan en 2016 : effectifs passés de 110 000 à 50 000. Foxconn n'a jamais confirmé de suppression de postes, et le terme « lights-out » n'apparaît pas dans la source. |
| 3 | BYD, CATL — production robotisée échelle | Manufacturing/EV | Chine | Données moins précises disponibles publiquement | Aucune source Recherche documentaire menée, sans résultat | À consolider | Le cas ne portait aucun chiffre. Piste vérifiée en remplacement : l'usine CATL du Sichuan, retenue au Global Lighthouse Network du Forum économique mondial, publie des gains constatés — cadence +17 %, packs automatisés à 80 %, −70 % de main-d'œuvre sur le poste de collage. Rien de constaté publié côté BYD. |
| 4 | Salesforce — Indice agentique 2026 calibration, métriques | Multi-secteurs | USA | Volume traité x170, taux d'escalade stable à 32 % malgré l'explosion de volume | Salesforce Newsroom source primaire · 2026-08-07 | À consolider | Les deux chiffres correspondent exactement, sur un périmètre nommé (février 2025 à avril 2026). Réserve : télémétrie produit auto-publiée par l'éditeur, sans audit externe. Relecture intégrale de la source (2026-09-29) : La ligne de banque qualifie de « périmètre nommé » ce qui est une période (février 2025 à avril 2026) ; le périmètre réel est une cohorte de clients non nommés, de taille non publiée, sélectionnée par un critère de survie (agents en production chaque mois). La source dit « 170 times more customer service chats than previous years » : la base de comparaison n'est pas précisée, là où la banque écrit « volume traité ×170 ». Le statut « Confirmé opérationnel » est maintenu pour le constat central (télémétrie de production datée, chiffrée, périmètre défini par critère), mais tous les chiffres restent annoncés par l'éditeur. Statut ramené à « À consolider » le 29/09/2026 par application stricte de la règle : la cohorte de clients n'est pas nommée, sa taille n'est pas publiée et elle est définie par un critère de survie — le « périmètre nommé » exigé pour « Confirmé opérationnel » manque. Lire la fiche approfondie. |
| 5 | Pandora — concierge IA "Gemma" flux événementiel, gouvernance embarquée | Retail | USA | 60 % du support en période de pointe automatisé, +10 % de NPS | Salesforce — étude de cas Pandora source primaire · 2025-10-08 | À consolider | Les 60 % et le +10 % de NPS sont attribués à Clara, un autre agent ; Gemma est encore en test sur quelques marchés avec une déviation seulement attendue de 30 %. La mention « en période de pointe » n'existe pas dans la source. |
| 6 | Siemens — workflows multi-agents Directive à l'échelle | Industrie | Europe | 2 800 leads/semaine orchestrés par des agents | Salesforce — étude de cas Siemens source primaire · 2025-10-14 | Annoncé/projeté | Les 2 800 leads par semaine sont le flux entrant reçu par Siemens, pas un volume orchestré par des agents. Ce que les agents doivent qualifier est une projection : plus de 12 000 leads par mois. |
| 7 | Klarna — service client IA Cas central §1.1 : ce qui arrive quand exécution ET maîtrise/accès humain disparaissent ensemble ; alimente §7.9 et §3.2 (voir , ) | Fintech/paiement | USA | L'assistant IA a traité 2,3 millions de conversations en un mois, soit deux tiers des échanges de service client, pour un travail « équivalent à 700 agents à temps plein » — un équivalent temps plein, pas 700 postes supprimés. L'effectif réel est passé de 5 500 à environ 3 000 en deux ans. Le PDG : « on est allé trop loin » ; réintégration humaine amorcée en 2025. | Klarna, communiqué officiel source primaire · 2024-02-27 | À consolider | Correction majeure : les 700 sont un ÉQUIVALENT temps plein (« the work of 700 full-time agents »), pas des postes supprimés. L'effectif réel est passé de 5 500 à environ 3 000 en deux ans. La part traitée par l'IA est de deux tiers, pas trois quarts. Le « on est allé trop loin » est authentique (Bloomberg, 8 mai 2025). |
| 8 | Amazon — robotique d'entrepôt Directive à échelle, rôle humain redéfini, pas supprimé | Logistique | USA | 1M+ robots déployés (ratio proche de 1:1 avec 1,5M employés) ; objectif d'éviter l'embauche de 160 000 postes d'ici 2027 et de réduire jusqu'à 600 000 postes d'ici 2033 ; rôle humain recentré sur supervision/dépannage des zones que les robots ne couvrent pas encore | About Amazon, blog officiel source primaire · 2025-07-01 | À consolider | Le million de robots sur plus de 300 sites est confirmé par Amazon. En revanche les 160 000 embauches évitées d'ici 2027 et les 600 000 d'ici 2033 viennent de documents internes fuités au New York Times, et Amazon les désavoue comme reflétant « la perspective d'une seule équipe ». |
| 9 | JPMorgan (COIN) / Goldman Sachs / Bank of America (Erica) §7.9 (risques à l'échelle) ; alimente §6.3 (tableau d'exceptions — le point de friction réel est le handoff, pas le volume) | Banque/Finance | USA | COIN : 360 000 heures-avocat/an automatisées (1,2M heures de travail juridique équivalent) pour 1 Md$+/an de valeur ; Erica : 20M+ d'utilisateurs ; escalade humaine documentée mais qui cale souvent au moment du transfert (handoff) | ABA Journal, reprenant Bloomberg presse · 2017-03-02 | À consolider | Les 360 000 heures concernent des avocats ET des chargés de prêt, sur environ 12 000 contrats par an. Les « 1,2 million d'heures » et le « 1 Md$ de valeur » sont introuvables dans toute source. Le volet Erica (20 millions d'utilisateurs) est lui confirmé par un communiqué Bank of America du 24 février 2025. |
| 10 | Razorpay — agent interne "Slash" gouvernance embarquée, ; pattern "agent-vérificateur distinct de l'agent-producteur" — input pour §2/§6 (voir , ) | Fintech / outils dev | Inde | En un mois : volume de PR passé de ~100 à ~1000/semaine, PR auto-mergées de ~10 à ~100/semaine ; 1 revue de code sur 3 notée, approuvée et mergée sans commentaire humain, via des sous-agents spécialisés par dimension (bugs, sécurité, qualité, design system) | Razorpay, blog d'ingénierie source primaire · 2026-05-18 | Confirmé opérationnel | Les trois chiffres figurent mot pour mot dans le billet. Le billet liste six sous-agents relecteurs, pas quatre : bugs, sécurité, qualité, design system, internationalisation et pre-mortem. Relecture intégrale de la source (2026-09-29) : La banque écrit « en un mois » pour les deux évolutions ; la source dit « inside a month » pour les demandes créées (~100 à ~1 000 par semaine) mais « in a couple of weeks » pour les fusions sans humain (~10 à ~100 par semaine). La banque parle de PR « auto-mergées » ; la source dit « merging with zero humans in the loop ». Aucune des deux fenêtres n'est datée dans le billet. Le statut « Confirmé opérationnel » est maintenu (source primaire datée, exploitation d'un trimestre, périmètre : l'ingénierie de Razorpay), les chiffres restant annoncés par l'entreprise. Lire la fiche approfondie. |
| 11 | Rakuten — Claude Code sur vLLM Exemple-type d'une Fiche Directive bien formée (résultat vérifiable + méthode de vérification explicite) — alimente le gabarit §3.2/§10 | Tech/ingénierie logicielle | Japon | Tâche sur une base de 12,5M de lignes de code, 7h de session autonome continue, 99,9 % de précision numérique vs référence, temps de mise en marché réduit de 24 à 5 jours (-79 %), erreurs critiques -97 % ; ingénieur : "je n'ai écrit aucune ligne de code pendant ces 7 heures, j'ai juste guidé occasionnellement" | Rakuten Group source primaire · 2025-06-26 | Annoncé/projeté | Chiffres et citation confirmés. Réserve de périmètre : les 7 heures et les 99,9 % portent sur une démonstration de refactoring sur une base open source, pas sur une production ; seul le passage de 24 à 5 jours relève de l'exploitation. Relecture intégrale de la source (2026-09-29) : Statut rétrogradé de « Confirmé opérationnel » à « Annoncé/projeté » : les 7 heures et les 99,9 % portent sur une démonstration sur base open source, pas sur une production ; le gain de 24 à 5 jours n'a ni période ni périmètre nommés, et la source situe le déploiement « à la suite de pilotes réussis », avec une extension encore à venir. Le chiffre « erreurs critiques −97 % » de la banque n'est pas dans la source primaire : il provient d'une autre page d'Anthropic, consacrée à Claude Managed Agents, où il porte sur une baisse de 97 % des « erreurs critiques initiales » observée « dans notre pilote » d'agents avec mémoire — un autre produit, un autre usage, un pilote. Il est retiré de la fiche. La source dit « 24 working days » (jours ouvrés) ; la page d'Anthropic abrège en « 24 days ». Lire la fiche approfondie. |
| 12 | Anthropic — enquête interne (132 collaborateurs, été 2025) tempère le récit "tout est déjà délégué" — input pour le ton réaliste de §1 et pour le modèle de maturité §8 (voir , ) | Tech/travail de connaissance | USA | Usage quotidien de l'IA passé de 28 % à 59 % en un an ; +67 % de PR mergées par ingénieur et par jour ; productivité auto-déclarée +50 % (vs +20 % un an plus tôt) ; mais plus de la moitié des répondants ne délèguent encore que 0-20 % de leur travail | Anthropic source primaire · 2025-12-02 | Confirmé opérationnel | Enquête d'août 2025 auprès de 132 collaborateurs, complétée de 53 entretiens. Les quatre chiffres sont exacts. Réserve : l'éditeur mesure son propre usage et la productivité est auto-déclarée. Relecture intégrale de la source (2026-09-29) : La banque écrit « usage quotidien de l'IA passé de 28 % à 59 % » : la source mesure la part du travail quotidien faite avec Claude (« used Claude in 28% of their daily work »), pas la part des personnes qui l'utilisent chaque jour ; le résumé de la source arrondit à 60 %. Le « +67 % de PR mergées par ingénieur et par jour » ne provient pas de l'enquête : c'est une observation antérieure, lors de l'adoption de Claude Code dans l'organisation d'ingénierie, que la source renvoie à un article payant de The Pragmatic Engineer (non lisible sans abonnement, non vérifié). Les 132 répondants sont des « ingénieurs et chercheurs », non l'ensemble des collaborateurs. Statut « Confirmé opérationnel » maintenu : source primaire datée, période et périmètre nommés, données d'usage observées ; la productivité reste auto-déclarée. Lire la fiche approfondie. |
| 13 | Secteur juridique — agrégat multi-cabinets/outils §7 (risque hallucination — donnée chiffrée sourcée, pas théorique) ; l'humain doit vérifier, pas juste signer | Legal | Multi-zones | Taux d'hallucination documenté de 17 % (Lexis+ AI) à 33 % (Westlaw AI-Assisted Research) sur des outils de recherche juridique vendus comme fiables. Les gains de temps de révision contractuelle et le décompte d'incidents judiciaires de 2025 ont été retirés : introuvables. | Journal of Empirical Legal Studies — Stanford RegLab et HAI source académique · 2025-01-01 | À consolider | Correction : le taux d'hallucination documenté est de 17 % (Lexis+ AI) et 33 % (Westlaw), pas 17 à 43 %. Le passage de 92 à 26 minutes et les 487 incidents de 2025 sont introuvables — la base de référence sur les hallucinations judiciaires affiche 2 022 cas cumulés sans ventilation annuelle. |
| 14 | MIT (projet NANDA) — étude cross-secteurs Contrepoids obligatoire à / — sert de benchmark réaliste pour §9 (voir , ) | Multi-secteurs | Multi-zones | 300+ initiatives IA générative étudiées, 52 entretiens structurés, 153 réponses de dirigeants ; 95 % des organisations ne constatent aucun retour mesurable ; cause principale identifiée : les systèmes IA génériques ne retiennent pas le contexte / n'apprennent pas dans la durée | MIT NANDA — The GenAI Divide: State of AI in Business 2025 source académique · 2025-07-01 | Recherche/projection | Méthodologie confirmée au chiffre près. Aucune URL canonique hébergée par le MIT n'existe : le rapport a circulé en PDF et le MIT s'en est ensuite distancié. |
| 15 | Gartner — prévision analyste §7.9 (risques à l'échelle) et §8 (les 3 causes Gartner = anti-patterns directs pour le modèle de maturité) — voir | Multi-secteurs | Multi-zones | Plus de 40 % des projets d'IA agentique seront annulés d'ici fin 2027 ; 3 causes citées : coûts sous-estimés, valeur métier floue, contrôles de risque insuffisants ; ~130 fournisseurs seulement jugés réellement "agentiques" sur des milliers | Gartner, communiqué de presse source institutionnelle · 2025-06-25 | Recherche/projection | Prévision d'analyste. Les trois causes et l'estimation d'environ 130 fournisseurs réellement agentiques sont reprises exactement. |
| 16 | Tesla Gigafactory Berlin — procédé "Unboxed" Contre-exemple méthodologique : à ne pas confondre avec Xiaomi (voir , ) | Manufacturing/EV | Europe | ~5 000 véhicules/semaine, ~11 000 employés, production en hausse chaque trimestre 2025 malgré -48 % d'immatriculations VE en Allemagne, aucune confirmation d'usine "dark"/lights-out opérationnelle — le procédé "Unboxed" reste annoncé/en approbation partielle, pas déployé | electrive.net, d'après le rapport d'activité déposé au registre des lobbies du Bundestag presse · 2026-07-20 | À consolider | Correction : la production 2025 de Grünheide est d'environ 202 000 véhicules, en BAISSE par rapport aux 211 000 de 2024, soit environ 3 900 par semaine et non 5 000. Le −48 % d'immatriculations est introuvable. Le constat négatif du cas est confirmé : aucune usine lights-out ni procédé Unboxed en production à Berlin. |
| 17 | Tsinghua — "Agent AI Hospital" exécution radicalement déléguée | Santé | Chine | 14 agents-médecins + 4 agents-infirmiers couvrant plusieurs spécialités ; >10 000 cas traités en moins d'une semaine ; 93,06 % de précision sur l'examen de licence médicale MedQA | Global Times presse · 2024-05-29 | À consolider | Divergence avec la publication scientifique : l'article primaire (arXiv 2405.02957) indique 42 agents-médecins, pas 14, et une précision MedQA de 92,22 à 92,77 %, pas 93,06 %. Il s'agit d'une simulation avec patients synthétiques, pas d'une activité clinique. |
| 18 | JD.com reconversion organisée, pas suppression pure ; écho direct à l' (l'automatisation ne garantit pas la marge) | Logistique/e-commerce | Chine | 3 600+ entrepôts (34M m²), 95 % des commandes livrées en <24h, camions autonomes >700 000 km de tests, 1ère station de livraison 100 % sans humain prévue avril 2026 ; "Plan Nirvana" — 700 000 travailleurs de terrain reconvertis via 80+ bases régionales de robotique ; marge nette de seulement 1,5 % malgré l'automatisation (vs 23 % chez Pinduoduo, moins automatisé) | JD Logistics — résultats annuels 2025 déposés à la Bourse de Hong Kong source primaire · 2026-03-05 | À consolider | Le dépôt confirme 1 600 entrepôts en propre et plus de 2 000 entrepôts cloud, 34 millions de m², et plus de 1 000 véhicules sans conducteur. Il ne mentionne ni les 95 % en moins de 24 h, ni les 700 000 km de camions autonomes, ni le « Plan Nirvana » — ces éléments ne reposent que sur la presse. |
| 19 | Alibaba — plateforme "Accio Work" Directive — démocratisation vers les PME, pas réservée aux géants | E-commerce/PME | Chine | Agents IA en "employés virtuels" (analyse marché, design, sourcing, gestion de stock) pour PME et solo-entrepreneurs à l'international ; lancé mars 2026 | Alibaba International, communiqué officiel source primaire · 2026-03-23 | Annoncé/projeté | Communiqué de lancement produit : aucune donnée de résultat, disponibilité annoncée pour fin mars 2026. |
| 20 | IDC — agents IA d'entreprise en Chine Benchmark de vitesse d'adoption chinoise — input pour §9 | Multi-secteurs | Chine | 2M d'agents actifs (2025) → 5M projetés (2026) ; secteurs cités : contrats, sécurité minière, pétrole/gaz, diagnostic de pannes en fabrication, réapprovisionnement retail, santé | IDC China, communiqué signé Lu Yanxia source institutionnelle · 2026-08-10 | Recherche/projection | La source dit « près de 2 millions » d'agents actifs en 2025, pas 2 millions exactement, et 5 millions projetés pour 2026. Prévision d'analyste : le chiffre 2026 est projeté et celui de 2025 est une estimation. |
| 21 | Cainiao — robot grimpeur "ZeeBot" échelle | Logistique/entrepôt | Chine | +100 % de productivité stockage/retrait, +40 % de densité de stockage, >100 unités déployées (Dongguan) | Cainiao, communiqué officiel source primaire · 2026-04-15 | Confirmé opérationnel | Gains mesurés en exploitation réelle, périmètre nommé : entrepôt transfrontalier de Dongguan, Guangdong, plus de 100 unités. Relecture intégrale de la source (2026-09-29) : La banque écrit « +40 % de densité de stockage » : la source dit que la solution « increases storage density, improving space utilization by 40% », dans un paragraphe comparant les sites ZeeBot à « d'autres entrepôts automatisés », sans le rattacher explicitement aux résultats de terrain, contrairement au +100 %. Le communiqué est daté d'Atlanta, non de Chine ; le déploiement, lui, est bien à Dongguan. La base de comparaison du +100 % et la durée d'exploitation ne sont pas publiées. Statut « Confirmé opérationnel » maintenu pour le constat central (source primaire datée, exploitation en cours, périmètre nommé, plus de 100 unités), les chiffres restant annoncés par l'entreprise. Aucune source primaire plus récente n'a été trouvée. Lire la fiche approfondie. |
| 22 | Chine — "usines noires" (Foxconn/Midea/BYD + macro, chiffres 2025-2026 actualisés) macro-tendance — précise et actualise les chiffres déjà cités en §1.2 | Manufacturing | Chine | 290 000+ robots industriels installés en 2024 (54 % de la demande mondiale), stock opérationnel supérieur à 2 millions, densité passée de 49 pour 10 000 travailleurs en 2015 à 470 en 2023. Le chiffre de perte d'emplois manufacturiers a été retiré : introuvable dans toute source institutionnelle. | International Federation of Robotics source institutionnelle · 2025-09-25 | À consolider | Volet robotique confirmé : 295 000 installations en 2024, 54 % de la demande mondiale, stock de 2 027 000 unités. Mais la densité de 400+ pour 2025 est extrapolée — le dernier chiffre publié est 470 pour 2023 — et la baisse d'emploi manufacturier de 115 à moins de 85 millions est INTROUVABLE dans toute source institutionnelle. Ce volet doit être retiré. |
| 23 | IFR — World Robotics 2025 (rapport comparatif mondial) Cas pivot pour la thèse US/Chine (voir , ) | Multi-secteurs | Chine | 542 000 robots installés dans le monde en 2024 (record, x2 en 10 ans) ; stock mondial 4 664 000 unités (+9 %) ; Chine seule = 54 % des nouvelles installations (295 000) et >2M de stock, fabricants domestiques chinois passés de ~28 % à 57 % de part de marché ; USA : seulement 34 200 installations en 2024 (-9 %), 3e rang mondial derrière Chine et Japon | International Federation of Robotics — World Robotics 2025 source institutionnelle · 2025-09-25 | Confirmé opérationnel | Tous les chiffres correspondent exactement. Précision : la part des fabricants domestiques chinois est de 57 % en 2024 contre 47 % en 2023 ; le « 28 % » du cas correspond au niveau d'il y a une dizaine d'années. Relecture intégrale de la source (2026-09-29) : Trois écarts. 1) La ligne dit « record » pour les 542 000 installations mondiales : l'IFR écrit que 2024 est la deuxième année la plus haute, 2 % sous le record de 2022 ; le record de 2024 est celui de la Chine (295 000). 2) La part domestique chinoise de « ~28 % » : le communiqué mondial écrit « up from about 28% over the past decade », formule ambiguë ; le communiqué Chine donne 47 % en 2023. 3) Donnée plus récente de l'émetteur : l'édition 2026 (24 septembre 2026) place les États-Unis au deuxième rang en 2025 (près de 38 500 installations, +12 %) et ramène la part domestique chinoise à 55 %. Lire la fiche approfondie. |
| 24 | Walmart reconversion, pas suppression pure — bon contrepoint américain à Foxconn/Midea | Retail | USA | 2,1M de salariés concernés, 1,6M formés gratuitement à l'IA (programme avec Google, certification outils OpenAI) ; automatisation : conception vêtements, coordination camions, tri/emballage entrepôt (robots aux côtés des humains), tarification, prévision de la demande ; aucun engagement formel de maintien des effectifs, mais positionnement explicite "reconversion" par contraste avec Amazon/Meta (licenciements) ; salariés "IA-compétents" gagnent 4,5x plus | Fortune presse · 2026-06-12 | À consolider | Aucun communiqué Walmart ne porte les 1,6 million. Écart de périmètre à connaître : les 1,6 million concernent les États-Unis et le Canada, alors que les 2,1 millions sont l'effectif mondial. Il s'agit d'une offre de formation, pas d'un effectif formé constaté. |
| 25 | DOGE — administration fédérale américaine §7.9 (gouvernance insuffisante) — écho direct aux 3 causes d'échec Gartner (ligne 15) | Secteur public | USA | 70 000 postes fédéraux ciblés, 300+ rôles standardisés jugés automatisables, objectif "en un an", agences citées (VA, GSA, HUD, CFPB, NLRB, DOL, Éducation) ; experts cités doutant de la fiabilité de l'IA à ce volume et alertant sur la gouvernance/sécurité des données | Inc. Magazine, reprenant WIRED presse · 2025-05-06 | À consolider | Le chiffre vient d'un message Slack de recrutement d'une start-up privée liée à DOGE, pas d'un document officiel de DOGE ni d'une agence fédérale. Aucun résultat mesuré. |
| 26 | Beam.ai — "US vs China : deux futurs différents" (analyse comparative) Cas central pour la thèse US/Chine (voir , ) | Multi-secteurs | Chine | Chine = "aller vite et large" : Tencent/OpenClaw distribué via WeChat à 1 md+ d'utilisateurs instantanément, subventions locales jusqu'à 10M yuans (1,4M$) à Shenzhen, 67 % des industriels chinois déploient déjà l'IA en production (vs 34 % aux USA), trafic web de bots IA dépassant désormais le trafic humain (+187 % en 2025) ; USA = "aller profond et entreprise" : Salesforce Agentforce — 18 500 clients entreprise et 540M$ d'ARR début 2026, gouvernance/conformité (SOC2, RBAC, audit trails) ; marché agentique mondial visé à 47 Md$ d'ici 2030 | Beam.ai, billet éditorial d'éditeur logiciel presse · 2026-03-30 | À consolider | Contenu d'éditeur agrégeant des chiffres tiers non remontés à leurs sources primaires. Précision : la subvention de 10 millions de yuans est portée par le district de Longgang à Shenzhen. |
| 27 | Tencent — OpenClaw dans WeChat diffusion à l'échelle d'une plateforme existante — écho à l' | Tech/multi-usage | Chine | 1 milliard d'utilisateurs WeChat avec accès instantané à l'agent IA "ClawBot", sans téléchargement séparé | South China Morning Post presse · 2026-03-23 | À consolider | Le milliard est la base d'utilisateurs de WeChat, pas un nombre d'utilisateurs de l'agent : présenter ce chiffre comme un résultat d'usage serait une erreur. Aucun communiqué Tencent accessible. |
| 28 | Baidu — Apollo Go (robotaxi) Directive à très grande échelle, aucune équipe humaine de chauffeurs | Transport | Chine | 300 000 courses/semaine, opérations dans ~20 villes chinoises + Corée du Sud | Baidu, communiqué de résultats source primaire · 2026-02-26 | Confirmé opérationnel | Les 300 000 courses par semaine sont confirmées au mot près. Précision de périmètre : le communiqué parle de 26 villes au niveau mondial en février 2026, pas d'une vingtaine de villes chinoises. Relecture intégrale de la source (2026-09-29) : 1) La ligne dit « ~20 villes chinoises + Corée du Sud » : la source parle de 26 villes dans le monde (février 2026), sans ventilation chinoise, puis 27 (mai 2026) et 28 (août 2026). 2) La Corée du Sud est une « entrée sur le marché, à commencer par l'agglomération de Séoul », pas une exploitation constatée. 3) « Aucune équipe humaine de chauffeurs » : la source dit « fully driverless » mais ne dit rien de la supervision à distance. 4) Donnée plus récente : pic à plus de 350 000 courses hebdomadaires en mars 2026 ; le communiqué du T2 2026 ne publie plus de volume de courses. 5) Les données d'exploitation sont déclarées non auditées. Lire la fiche approfondie. |
| 29 | Meituan — livraison par drone échelle | Logistique/retail | Chine | >900 000 commandes cumulées par drone ; rentabilité à grande échelle visée sous 2-3 ans | Guangming Daily, repris sur le fil officiel Meituan presse · 2026-05-21 | À consolider | Chiffre exact (plus de 900 000 commandes cumulées, contre 740 000 fin 2025), mais l'origine reste un article de presse et la rentabilité sous deux à trois ans est une projection de dirigeant. |
| 30 | Ant Digital Technologies / Ant International | Finance | Chine | 100+ solutions d'agents IA déployées dans le secteur financier ; Ant International sert 150M de marchands et 2 milliards de consommateurs sur son infrastructure de commerce IA | Ant Digital Technologies, communiqué officiel source primaire · 2025-06-19 | Annoncé/projeté | Correction : le communiqué dit « will jointly develop over 100 intelligent agent solutions » — une feuille de route, pas un déploiement constaté. Seule la volumétrie Ant International (150 millions de marchands, 2 milliards de comptes utilisateurs) est factuelle, confirmée le 28 avril 2026. |
| 31 | State Grid — robots pour le réseau électrique supervision | Énergie/utilities | Chine | Investissement de 1 Md$, 8 500 robots (dont robots-chiens) pour l'inspection du réseau ; +40 % d'efficacité de maintenance de sous-station à Changzhou | South China Morning Post, relayant un plan interne de State Grid presse · 2026-04-24 | À consolider | Il s'agit d'un plan d'achat pour la seule année 2026, connu par voie de presse. Et le +40 % de Changzhou est une réduction de la durée d'une tâche d'élimination de défaut obtenue par génération automatique de gammes d'intervention, SANS robot — le cas attribue à des robots un gain qui n'en vient pas. |
| 32 | DeepSeek — déploiement hospitalier — complète le cas 17 avec un déploiement assisté, pas autonome | Santé | Chine | Déployé dans 90 à 100 hôpitaux tertiaires chinois (sources concordantes) — assistance clinicien, pas encore autonomie complète comme le cas Tsinghua (ligne 17) | Journal of Medical Systems (Springer) source académique · 2025-04-24 | À consolider | L'article dit « près de 90 hôpitaux tertiaires », pas 90 à 100. La borne haute du cas n'est appuyée par aucune source. Le rôle assistif est bien confirmé, ce qui valide la distinction faite avec le cas Tsinghua. |
| 33 | Huawei — produits IA agentique / AgenticInfra | Tech/multi-secteurs | Chine | Lancement 2026 de produits d'IA agentique pour l'industrie ; rapport sur "l'année inaugurale des agents IA industriels" | Huawei, salle de presse officielle source primaire · 2026-06-08 | Annoncé/projeté | Le lancement d'Agentic Infra est confirmé par Huawei. En revanche le rapport sur « l'année inaugurale des agents IA industriels » est publié par un cabinet tiers, sans lien Huawei établi : cette attribution était erronée. |
| 34 | General Motors — usine EV bascule effective, pas simple discours | Manufacturing/EV | USA | ~1 000-1 300 postes supprimés sur son usine phare de VE, puis robots installés | Michigan Department of Labor — avis WARN, GM Factory ZERO source institutionnelle · 2025-11-20 | À consolider | L'avis officiel donne 1 140 suppressions permanentes au 5 janvier 2026, motivées par « l'adaptation à une adoption plus lente des véhicules électriques ». Les 1 300 correspondent à un chômage temporaire distinct. L'ITIF recense 50 robots collaboratifs et conteste le lien de causalité robots-suppressions. |
| 35 | UPS tension possible avec l' (l'accès humain a-t-il été maintenu ?) | Logistique | USA | 120M$ investis en robotique, fermetures d'entrepôts et suppressions de postes liées à la bascule IA, dans une vague de licenciements 2026 partagée avec Amazon | Automated Warehouse, relayant Bloomberg presse · 2025-12-18 | À consolider | Aucun communiqué UPS ne confirme les 120 M$ — la chaîne remonte à un unique article Bloomberg. Le communiqué de résultats confirme bien 34 000 postes supprimés et 93 bâtiments fermés, mais sur 2025 et sans les attribuer à l'IA. |
| 36 | FedEx | Logistique | USA | 200M$ investis dans la robotique d'entrepôt (rachat Berkshire Grey) | FedEx Corporation, relations investisseurs source primaire · 2022-08-02 | Annoncé/projeté | Correction : ce n'est pas un rachat de Berkshire Grey ni un investissement versé, mais un seuil de 200 M$ de commandes conditionnant un bon de souscription, étalé jusqu'à fin 2025. Aucune source ne confirme que le seuil a été atteint. |
| 37 | UnitedHealth Group §7.9 (secteur sensible, à surveiller) | Santé/assurance | USA | 1,5 à 3 Md$ investis dans l'IA/l'automatisation (fourchette selon les sources) ; agents IA qui appellent proactivement patients/médecins | UnitedHealth Group, résultats du premier trimestre 2026 source primaire · 2026-04-21 | Annoncé/projeté | Le document primaire dit « près de 1,5 Md$ en 2026 ». Les 3 Md$ couvrent 2026 et 2027 cumulés et viennent de Bloomberg, qui décrit les appels d'agents IA comme un ESSAI, vers les cabinets médicaux et non vers les patients. |
| 38 | Delta Air Lines — "Delta Concierge" service client à l'échelle | Transport aérien | USA | Assistant IA déployé à 100 % des membres SkyMiles | Delta News Hub source primaire · 2026-08-10 | Confirmé opérationnel | Le communiqué primaire écrit littéralement « available to 100% of SkyMiles Members », moins d'un an après la bêta d'octobre 2025. Relecture intégrale de la source (2026-09-29) : Pas d'écart sur le chiffre : la source écrit bien « available to 100% of SkyMiles Members ». Précision de sens : « déployé » doit s'entendre comme « disponible », pas comme « utilisé » ; aucun chiffre d'usage n'est publié et l'outil conserve le label « bêta ». La bêta est datée du 29 octobre 2025 par le communiqué de lancement. Lire la fiche approfondie. |
| 39 | ServiceNow Comparateur direct à Salesforce Agentforce (ligne 26) | Tech/entreprise | USA | Revenu d'abonnement >3,5 Md$ au T2 2026, porté par la plateforme IA | ServiceNow — communiqué de résultats déposé auprès de la SEC source primaire · 2026-07-22 | Confirmé opérationnel | Le chiffre réel est de 3 877 M$, en hausse de 24,5 % : le seuil « plus de 3,5 Md$ » est exact mais sous-estime la réalité de près de 400 M$. Le même dépôt indique que ServiceNow AI a dépassé 1 Md$ de valeur contractuelle annuelle. Relecture intégrale de la source (2026-09-29) : 1) Le chiffre exact est de 3 877 M$ (+24,5 %, +23 % à taux de change constant) ; « plus de 3,5 Md$ » est exact mais sous-estime de près de 400 M$. 2) « Porté par la plateforme IA » n'est pas soutenu : le communiqué attribue le dépassement de prévision au nouvel ACV net et à des revenus sur site avancés par la demande fédérale américaine, et le 10-Q attribue la hausse des abonnements aux achats de clients nouveaux et existants. Le seul chiffre propre à l'IA est un ACV supérieur à 1 Md$. Le statut « Confirmé opérationnel » est maintenu pour les données financières seulement. Lire la fiche approfondie. |
| 40 | Palantir (AIP) — écho à la thèse gouvernance US () | Tech/défense/entreprise | USA | Revenus du T1 2026 dépassant les attentes, demande USA en forte hausse | Palantir Technologies — résultats du premier trimestre 2026 déposés auprès de la SEC source primaire · 2026-05-04 | Confirmé opérationnel | Chiffres réels : 1,633 Md$ de revenu, +85 % sur un an, revenu américain +104 %, commercial américain +133 %. Réserve : AIP n'est nommé que dans les déclarations prospectives, le lien causal produit-revenus n'est pas affirmé par la source. Relecture intégrale de la source (2026-09-29) : 1) Chiffres exacts : 1,633 Md$ (+85 %), revenus américains +104 %, commercial américain +133 %. 2) « Dépassant les attentes » reprend le titre du communiqué (« Crushing Consensus Expectations ») ; aucun chiffre de consensus n'y figure. 3) AIP n'est nommé que dans les déclarations prospectives du communiqué ; le 10-Q décrit AIP mais attribue la croissance à l'adoption accrue « de nos produits et services » par les clients existants, sans nommer AIP. Le statut « Confirmé opérationnel » vaut pour les données financières, pas pour le lien avec AIP. 4) Donnée plus récente : T2 2026, 1,935 Md$ (+93 %). Lire la fiche approfondie. |
| 41 | Duolingo — un des rares cas de suppression nette assumée publiquement, sans discours "reconversion" | Edtech | USA | ~10 % des traducteurs contractuels remplacés par l'IA, politique "AI-first" assumée | TechCrunch presse · 2024-01-09 | À consolider | Correction : il s'agit de 10 % de l'effectif contractuel global, pas de 10 % des traducteurs, et l'événement date de janvier 2024, distinct du mémo « AI-first » d'avril 2025. Cette politique a été partiellement rétractée publiquement depuis. |
| 42 | Port de Shanghai Yangshan (SIPG) Cas pivot pour le contraste portuaire US/Chine (avec ligne 47) | Logistique portuaire | Chine | Terminal automatisé de 2,23M m², 26 grues télécommandées, 130 véhicules autonomes, jusqu'à 8M de conteneurs/an | Gouvernement municipal de Shanghai source institutionnelle · 2026-08-14 | À consolider | Le cas mélangeait des spécifications de conception de 2017 avec un trafic constaté de 2025. Équipement réel aujourd'hui : 29 portiques de quai, 121 portiques sur rail, 155 véhicules autonomes. Le trafic de plus de 8 millions d'EVP est bien réalisé en 2025. |
| 43 | Chine — mines de charbon autonomes sécurité comme justification | Mining/énergie | Chine | Plus grande exploitation minière autonome au monde ("camions autonomes") ; directive nationale d'accélération de l'IA/robots dans les mines à haut risque | Xinhua source institutionnelle · 2025-05-30 | Annoncé/projeté | 100 camions miniers électriques autonomes en service à la mine de Yimin, qualifiée de plus grande application de ce type au monde ; corroboré par une publication primaire de Huawei. La directive nationale d'août 2026 est un volet distinct, seulement annoncé. Relecture intégrale de la source (2026-09-29) : Statut rétrogradé de « Confirmé opérationnel » à « Annoncé/projeté » : la source primaire et sa corroboration Huawei attestent la mise en service de 100 camions, mais aucune donnée chiffrée ne porte sur une période postérieure à la mise en production — tous les gains (diesel, CO2, efficacité de 120 %) sont des estimations annoncées au lancement. La ligne de banque évoque une « directive nationale d'août 2026 » : le texte officiel lu est le plan de développement de l'industrie charbonnière du 15e plan quinquennal (NDRC et NEA), dont les questions-réponses sont publiées le 10 août 2026 ; c'est un plan sectoriel, pas une directive dédiée aux mines à haut risque, et la substitution des postes dangereux par des robots n'apparaît pas dans la partie publiée lue — elle n'est rapportée que par la presse (Global Times, 10 août 2026), qui ne peut fonder la fiche. La donnée de banque « camions autonomes » est exacte ; « plus grande exploitation minière autonome » est une reformulation : la source parle de la plus grande application de camions miniers autonomes, pas de la plus grande mine autonome. Lire la fiche approfondie. |
| 44 | Chine — construction (humanoïdes) | BTP | Chine | Robots humanoïdes déployés par un grand groupe de construction chinois pour augmenter la production | Zoomlion Heavy Industry, communiqué officiel source primaire · 2026-01-15 | À consolider | Erreur de secteur : Zoomlion fabrique des machines de construction, ce sont des usines et non des chantiers. Le communiqué parle de « quelques dizaines » d'humanoïdes sur des tâches périphériques, et les cadences de production spectaculaires ne leur sont pas attribuées. |
| 45 | Chine — textile ("Jack" + usine automatisée) | Textile | Chine | Le fabricant de machines « Jack » vise jusqu'à +30 % d'efficacité de production grâce à des robots IA, dans un partenariat avec Siemens. Le cas de « dark factory » textile à 5 000 métiers à tisser a été retiré : aucune source primaire ni institutionnelle ne l'atteste. | Siemens, communiqué sur le partenariat avec Jack Technology source primaire · 2026-06-11 | Annoncé/projeté | Correction : Jack « expects to increase efficiency by up to 30 percent » — c'est un objectif prospectif, pas un résultat atteint. Et le volet « dark factory à 5 000 métiers à tisser » est INTROUVABLE : rumeur virale sans aucune source primaire ni institutionnelle. Il a été retiré du cas. |
| 46 | Chine — hôtes IA du live-commerce (dont JD.com) exécution radicalement déléguée, y compris vente/relation client | E-commerce/retail | Chine | Des avatars IA ont vendu 7,6M$ en 6h sans aucun humain à l'écran ; JD.com dépasse 70 000 "vendeurs humains numériques" IA ; secteur du live-commerce désormais régulé (644 Md$, incluant les hôtes IA) | Yicai Global presse · 2026-03-25 | À consolider | Trois corrections : ce sont 70 000 VENDEURS qui utilisent les hôtes numériques, pas 70 000 avatars ; les 7,6 M$ en six heures sont l'avatar de Luo Yonghao sur BAIDU, pas JD ; et le chiffre de marché de 644 Md$ est introuvable tel quel. |
| 47 | Ports de Los Angeles / Long Beach Contraste direct avec Yangshan (ligne 42) — même rupture technique, résistance sociale/syndicale différente | Logistique portuaire | USA | Automatisation en cours mais fortement contestée par le syndicat portuaire (ILWU) — résistance sociale documentée | ILWU — International Longshore and Warehouse Union source primaire · 2025-12-17 | À consolider | Résistance syndicale documentée en source primaire, mais aucune donnée opérationnelle d'automatisation constatée. À signaler pour l'honnêteté du dossier : un rapport de UC Berkeley documente l'inverse de la crainte syndicale, avec des heures payées en hausse de 31,5 % sur les terminaux automatisés. |
| 48 | TSMC Illustre une rupture différente : l'IA comme moteur d'investissement industriel, pas seulement substitut de main-d'œuvre | Semi-conducteurs | USA | CapEx 2026 visant 64 Md$, quasi doublé en 6 mois, tiré par la demande d'outils de fabrication liés à l'IA | TSMC — transcription de la conférence de résultats du deuxième trimestre 2026 source primaire · 2026-07-16 | Annoncé/projeté | Le budget 2026 est une FOURCHETTE de 60 à 64 Md$, relevée depuis 52-56 Md$. Le « quasi doublement en six mois » porte sur les besoins en équipements, pas sur le budget d'investissement. Guidance orale : aucun document écrit de TSMC ne porte ce chiffre. |
| 49 | John Deere exécution physique déléguée en agriculture | Agriculture | USA | Lancement national de tracteurs entièrement autonomes prévu en 2026 | Farm Progress presse · 2025-01-06 | Annoncé/projeté | Correction de périmètre : l'autonomie annoncée pour 2026 ne couvre que le TRAVAIL DU SOL, pas un tracteur entièrement autonome. L'autonomie du cycle complet maïs-soja est visée pour 2030. Le communiqué Deere ne donne aucune date de disponibilité. |
| 50 | Anduril Industries Rupture structurelle : des entrants "IA-natifs" concurrencent des acteurs historiques non conçus pour ça | Défense | USA | Startup valorisée 60 Md$, conçue nativement autour de l'IA autonome, présentée comme challenger direct de Lockheed Martin | Anduril Industries source primaire · 2026-05-13 | Annoncé/projeté | La valorisation est de 61 Md$, pas 60. Et le cas est déjà daté : en juillet 2026 Anduril discutait un nouveau tour à 100 Md$. Le « challenger direct de Lockheed Martin » est un cadrage journalistique, pas une donnée. |
| 51 | Costco Contre-exemple délibéré — une entreprise qui choisit publiquement de ne pas suivre la rupture à outrance | Retail | USA | Caisses automatisées <10 secondes annoncées ; le PDG déclare publiquement "je ne vois pas l'IA prendre des décisions" pour l'enseigne | Costco — transcription de la conférence de résultats source primaire · 2026-03-05 | Annoncé/projeté | Correction : environ 8 secondes en moyenne, et en PILOTE, pas moins de 10 secondes déployé. Et la citation exacte du PDG est « je ne vois pas l'IA faire les CHOIX d'articles pour Costco » — le choix des références par les acheteurs, pas les décisions en général. |
| 52 | Target gouvernance/rôle dédié | Retail | USA | Nomination d'un Chief AI Officer dans le cadre d'un plan de redressement de 2 Md$ | Target Corporation source primaire · 2026-03-03 | Annoncé/projeté | Les 2 Md$ et la nomination du premier Chief AI Officer sont exacts, mais issus de deux communiqués Target qui ne se citent pas l'un l'autre : le lien entre les deux est établi par la presse, pas par Target. |
| 53 | Walgreens / CVS reconversion du rôle humain vers le conseil patient | Pharmacie | USA | Walgreens mise davantage sur les robots de préparation d'ordonnances pour réduire les coûts et libérer du temps pharmacien | Walgreens, salle de presse source primaire · 2025-05-20 | Confirmé opérationnel | Réseau en production, périmètre nommé : 12 centres robotisés, plus de 5 000 magasins desservis, 3,5 millions d'ordonnances par semaine, environ 40 % du volume d'un magasin desservi. Le temps pharmacien libéré est qualitatif. Aucune donnée sur CVS, pourtant nommé dans le titre du cas. Relecture intégrale de la source (2026-09-29) : Aucune donnée CVS dans la source primaire de la ligne, alors que CVS est nommé dans le titre du cas : la seule publication primaire CVS lue (29 mai 2026) porte sur l'interprétation d'ordonnances par modèles de langage, pas sur des robots de préparation, et ne chiffre aucun résultat. La donnée de banque « réduire les coûts » n'apparaît pas dans le communiqué Walgreens, qui parle de rationaliser le traitement et de réduire les tâches administratives. Les chiffres de banque (12 centres, plus de 5 000 magasins, 3,5 millions par semaine, environ 40 %) sont conformes. Aucune publication primaire Walgreens plus récente que mai 2025 n'a été trouvée. Lire la fiche approfondie. |
| 54 | Intuit | Fintech/comptabilité | USA | Plateforme "agentique" grand public lancée ("Intuit Intelligence") ; résultats du T1 2026 dépassant les attentes, attribués à la traction IA | Intuit, relations investisseurs source primaire · 2025-10-28 | Annoncé/projeté | Correction : « Intuit Intelligence » vise les ENTREPRISES et cabinets comptables, pas le grand public. Et le produit était encore en bêta au moment des résultats qu'on lui attribue. Aucune donnée ne chiffre la contribution de l'IA au chiffre d'affaires. |
| 55 | OpenAI / Anthropic — concentration du revenu entreprise Écho direct à l' (MIT NANDA) : même chez les fournisseurs d'IA, l'adoption à grande valeur reste concentrée sur une minorité d'organisations | Tech | USA | OpenAI : revenu entreprise dépassant pour la première fois le revenu grand public (~40 Md$ ARR cité) ; Anthropic : revenu du T2 2026 dépassant celui d'OpenAI, premier résultat opérationnel positif ; 80 % du revenu des deux entreprises vient de seulement 1 % de leurs clients | PYMNTS, données Ramp presse · 2026-09-04 | À consolider | Cas composite : le rapport 80 %/1 % vient de Ramp via PYMNTS, l'ARR d'OpenAI d'une déclaration de sa directrice financière relayée par CNBC, et le trimestre d'Anthropic de Quartz. Aucun document déposé, aucune publication d'entreprise. |
| 56 | Ping An Insurance Group Comble le | Assurance | Chine | 250M de clients, ~20 000 ingénieurs ; ~60 % des sinistres accident/santé désormais automatisés (contre quasi aucun il y a 5 ans), certains réglés en 51 secondes ; l'IA a traité 70 % des 500 Md de yuans de recouvrements de prêts de Ping An Bank en 2025 ; effectif des centres d'appel -50 %+ en 5 ans, effectif total -118 000 (-30 % depuis le pic de 2018) ; ~111 Md de yuans investis en tech depuis 2021 | Insurance Journal, reprise de Bloomberg News presse · 2026-03-31 | À consolider | Les cinq chiffres correspondent exactement à l'article, mais le rapport annuel 2025 de Ping An n'en contient AUCUN — le journaliste a obtenu des données non publiées. Le rapport confirme en revanche 251 millions de clients particuliers. |
| 57 | Lemonade Comble le ; écho direct à l' (la prime double, l'effectif baisse — métrique ajustée à la croissance) | Assurance | USA | 3,1M+ clients (T1 2026, +23 %) ; prime en portefeuille doublée à 1,3 Md$ depuis fin 2022 ; l'agent IA "Jim" règle des sinistres en 3 secondes sans intervention humaine ; effectif -6 % sur 2022-2026 malgré le doublement de la prime ; ratio de sinistres à 62 % (sous le seuil de 75 % jugé sain) | Lemonade — lettre aux actionnaires du premier trimestre 2026 source primaire · 2026-04-29 | Confirmé opérationnel | Tous les chiffres financiers et d'effectif sont confirmés à l'identique, y compris la formule « prime plus que doublée avec un effectif réduit de 6 % ». Nuance : le règlement en 3 secondes par « AI Jim » est un record ponctuel de décembre 2016, pas un régime courant. Relecture intégrale de la source (2026-09-29) : Les chiffres financiers et d'effectif de la ligne sont confirmés à l'identique dans la lettre du T1 2026 (3,1 millions de clients et plus, +23 % ; prime plus que doublée à 1,3 milliard de dollars depuis fin 2022 ; effectif −6 % ; ratio de sinistres de 62 %). Deux écarts : (1) le seuil de « 75 % jugé sain » n'apparaît dans aucune source lue et est retiré ; (2) le règlement en 3 secondes par « A.I. Jim » est un record ponctuel du 23 décembre 2016, pas un régime courant, et l'entreprise précisait alors que l'agent escalade souvent vers un humain. Chiffres plus récents disponibles (lettre T2 2026) : 3 308 666 clients, 1,43 milliard de dollars de prime en portefeuille, ratio de sinistres brut de 60 %, ratio de frais de gestion des sinistres de 5 % ; la lettre T2 ne republie pas l'effectif. Lire la fiche approfondie. |
| 58 | Kaiser Permanente — documentation clinique IA (Abridge) Comble le | Santé | USA | Déployé dans 40 hôpitaux + 600+ cabinets médicaux (8 États + Washington D.C.), mis à disposition de 24 000+ médecins sur un effectif clinique de 24 600 médecins/73 600 infirmiers ; objectif explicite de réduction du temps administratif (non chiffré précisément dans la source disponible) | Kaiser Permanente source primaire · 2024-08-14 | À consolider | Le périmètre — 40 hôpitaux et plus de 600 cabinets dans huit États et Washington D.C. — est confirmé par la source primaire. Mais les effectifs cités ne sont adossés à aucune source : les données actuelles de Kaiser donnent 25 270 médecins et 78 630 infirmiers. |
| 59 | BMW — robots humanoïdes Figure 02 (Spartanburg) rôle humain redéfini, pas supprimé | Manufacturing/automobile | USA | Pilote de 11 mois, >30 000 véhicules X3 assistés, 90 000+ pièces de tôle manipulées, 1 250 heures opérationnelles, précision de placement >99 %/poste, cycle cible de 84 secondes tenu | Figure AI source primaire · 2025-11-19 | Confirmé opérationnel | Les six chiffres correspondent exactement, dont le cycle de 84 secondes — 37 secondes pour la phase de chargement — et plus de 99 % de réussite par poste. Relecture intégrale de la source (2026-09-29) : La ligne de banque affirme « précision de placement >99 %/poste » et « cycle cible de 84 secondes tenu » : la source primaire présente les 84 secondes comme une exigence (« The requirement was 84 seconds total, 37 seconds load time ») et les plus de 99 % comme une cible par équipe (« Our target was > 99% success per shift »), sans publier la valeur atteinte ; aucune des deux ne peut être présentée comme un résultat. Le statut « Confirmé opérationnel » est maintenu pour le constat central — les volumes réalisés en production réelle, publiés par le fournisseur et confirmés par le client —, bien que BMW qualifie l'opération de « pilote » : la donnée porte sur un travail réalisé, pas sur une intention. Écart de durée : Figure parle d'un déploiement de 11 mois, BMW de dix mois, et Figure évoque six mois de fonctionnement quotidien. « 90 000+ pièces de tôle manipulées » : Figure écrit « parts loaded », BMW « components » ; « 1 250 heures » est « 1,250+ » chez Figure et « around 1,250 » chez BMW. Lire la fiche approfondie. |
| 60 | BMW — robot humanoïde AEON (Plant Leipzig) Comble le | Manufacturing/automobile | Europe | Débuts opérationnels décembre 2025, tests étendus prévus avril 2026, intégration pilote complète prévue été 2026 ; hauteur 1,65 m, poids 60 kg, vitesse jusqu'à 2,5 m/s ; tâches initiales : assemblage batterie haute tension, avec les salariés associés au choix des tâches confiées | BMW Group source primaire · 2026-03-09 | Annoncé/projeté | Calendrier et spécifications confirmés au mot près, mais les tests d'avril 2026 et l'intégration de l'été 2026 sont des prévisions : aucun résultat de production n'est constaté. |
| 61 | Khan Academy — "Khanmigo" Comble le | Éducation | USA | Contre-exemple. Les gains d'apprentissage spectaculaires attribués à Khanmigo dans la presse et les supports promotionnels ne résistent pas à la vérification. L'essai randomisé disponible (Oreopoulos et Low, 18 collèges du Tennessee, 2024-2026) conclut à des gains à peu près identiques à ceux des élèves n'ayant pas utilisé le programme, avec un engagement faible. Sal Khan qualifie lui-même la sortie élève de « non-event ». | Aucune source Recherche documentaire menée, sans résultat | À consolider | CAS RETIRÉ DE SA FORMULATION D'ORIGINE. Ni l'étude Stanford sur 180 000 élèves, ni les quatre pourcentages, ni la gratuité au 1er mars 2026 n'existent dans une quelconque source. L'essai randomisé qui existe réellement (Oreopoulos et Low, 18 collèges du Tennessee, 2024-2026) conclut à des gains d'apprentissage à peu près IDENTIQUES à ceux des non-utilisateurs, avec un engagement faible. Le cas est conservé comme contre-exemple, pas comme preuve. |
| 62 | Squirrel AI Learning Comble le | Éducation | Chine | Système d'apprentissage adaptatif, désigné parmi les meilleures inventions 2025 par TIME ; déployé à grande échelle dans des centres d'apprentissage en Chine (chiffres d'usage agrégés précis non retrouvés dans une source unique fiable) | TIME — Best Inventions of 2025 presse · 2025-10-09 | À consolider | La distinction TIME 2025 est confirmée et la source apporte un chiffre d'usage que le cas n'avait pas : plus de 24 millions d'élèves en Chine. Mais ce chiffre provient de l'entreprise via TIME, sans vérification indépendante ni période précisée. |
| 63 | Unilever — recrutement IA (Pymetrics/HireVue) Comble le | RH/recrutement | USA | Délai d'embauche réduit de 90 % (4 mois → 4 semaines) ; 50 000 heures de travail de recruteurs économisées ; 1M£ d'économies annuelles ; 1,8M de candidatures traitées par an ; +16 % d'embauches diverses (dont neuroatypiques) ; déployé dans 70+ pays depuis 2020 | HireVue — étude de cas Unilever (document non daté) source primaire · non datée | À consolider | Le cas mélange deux sources aux chiffres incompatibles. L'étude HireVue parle de 250 000 candidatures par an, pas 1,8 million, et de 53 pays, pas 70. Surtout, les 50 000 heures y sont du temps CANDIDAT économisé, pas du temps recruteur. Le document n'est pas daté. |
| 64 | Unilever — production marketing par IA (Dove, Vaseline, TRESemmé) Comble le | Marketing | USA | Production de visuels produits 2x plus rapide et 2x moins chère grâce à des "jumeaux numériques" (NVIDIA Omniverse) | Unilever source primaire · 2025-03-18 | À consolider | Communiqué Unilever : imagerie produit « deux fois plus rapide et 50 % moins chère », avec Dove, Vaseline, TRESemmé et Clear. La fiche NVIDIA confirme les mêmes chiffres. Relecture intégrale de la source (2026-09-29) : La ligne situe le cas aux États-Unis : le communiqué est global (groupe Unilever), présenté lors d'une conférence tenue aux États-Unis, et le seul marché chiffré est la Thaïlande. « 2x moins chère » correspond à « 50% cheaper » dans la source. Le statut « Confirmé opérationnel » est maintenu avec réserve : la source est primaire, datée, chiffrée, à périmètre nommé (division Beauty & Wellbeing, quatre marques, TRESemmé Thaïlande) et décrit une technologie intégrée après pilote ; mais aucune période de mesure n'est donnée et les chiffres de division sont des maxima (« up to »). Tous les chiffres restent « annoncés » par l'entreprise. La source a été lue sur le miroir www-vercel.unilever.com du même émetteur, l'adresse www.unilever.com renvoyant une erreur 403 à la consultation automatisée ; le contenu est identique au communiqué référencé. La fiche NVIDIA mentionnée dans la ligne n'a pas été retenue comme source : elle reprend les chiffres de l'entreprise cliente. Statut ramené à « À consolider » le 29/09/2026 par application stricte de la règle : aucune période postérieure à la mise en production n'est publiée ; les chiffres groupe n'ont pas de base et ceux de la division sont des maxima. Lire la fiche approfondie. |
| 65 | ZhongAn Online Comble le ; écho à l' (métrique ajustée : le bénéfice progresse avec l'automatisation, pas malgré elle) | Assurance | Chine | Environ 220 robots IA actifs sur la plateforme « Lingxi », 2 milliards d'appels de modèles et plus de 3 000 milliards de tokens sur l'année ; revue entièrement automatisée pour plus de 50 % des dossiers santé, sinistres les plus rapides réglés en 15 secondes, 76 % des clients payés sous un jour ouvré. | ZhongAn Online — résultats annuels 2025 déposés à la Bourse de Hong Kong source primaire · 2026-03-19 | À consolider | CORRECTION D'UN FACTEUR 10 : le dépôt dit « called over 2 billion times », soit 2 milliards d'appels de modèles et non 20 milliards — l'original chinois (超20亿次) avait été mal converti. Et l'auto-revue santé est à plus de 50 %, pas 45 %. Les autres chiffres sont exacts. |
| 66 | Alibaba — outils IA génératifs Taobao/Tmall (marketing marchands) Comble le | Marketing | Chine | Déployés au Singles' Day (11.11) 2025 : ~200M d'images et 5M de vidéos générées par mois, +10 % de taux de clic produit ; moteur d'enchères IA : +12 % de ROI marketing ; assistant conseiller IA : 10M de rapports d'analyse générés pour les marchands ; assistant service client IA "Dianxiaomi" (mis à niveau sept. 2025) : 20M de yuans/jour d'économies opérationnelles | Alibaba Group source primaire · 2025-10-16 | Confirmé opérationnel | Tous les chiffres concordent. Réserve de forme : le document précède le 11.11 2025, donc le rattachement au Singles' Day est prospectif dans la source, alors que les volumes cités sont déjà constatés. Relecture intégrale de la source (2026-09-29) : Les chiffres de la ligne de banque sont exacts, mais le document source date du 16 octobre 2025, au lancement du 11.11 : les volumes cités sont des constats antérieurs au pic du festival, pas des résultats du Singles' Day. Le rattachement « déployés au Singles' Day » est donc à nuancer. Source complémentaire lue : le bilan du 15 novembre 2025 donne d'autres mesures (plus de cinq millions de rapports depuis octobre, 300 millions de requêtes traitées par Dianxiaomi), sur des périodes différentes, qui ne se cumulent pas avec les dix millions de rapports d'octobre. Statut maintenu : source primaire, date, chiffres, périmètre nommé, période postérieure à la mise en production ; tous les chiffres restent annoncés par l'émetteur. Lire la fiche approfondie. |
| 67 | Xcel Energy — détection incendie par caméras IA (Pano AI) Comble le ; détection, vérification humaine avant intervention conservée — analystes Pano AI valident chaque détection | Énergie/utilities | USA | 9 caméras IA initiales dans le nord-ouest du Wisconsin (balayage 360° chaque minute), déploiement déjà actif au Minnesota/Colorado/Texas/Nouveau-Mexique, extension prévue fin 2026 ; exemple documenté : incendie de Lagoo Creek détecté et circonscrit à 3,12 acres le jour même grâce à l'alerte précoce | Xcel Energy, salle de presse source primaire · 2026-05-14 | Confirmé opérationnel | Tous les éléments sont confirmés mot pour mot, y compris l'incendie de Lagoo Creek circonscrit le jour même à 3,12 acres, chiffre attribué au service des ressources naturelles du Wisconsin. Relecture intégrale de la source (2026-09-29) : Aucun écart de chiffre : les neuf caméras, le balayage à 360 degrés chaque minute, les quatre États déjà équipés, l'extension d'ici fin 2026 et les 3,12 acres sont dans la source. Précisions : l'extension porte sur les zones à risque plus élevé près des lignes électriques ; l'incendie a été contenu « l'après-midi même » de la détection ; la citation du WI DNR n'est portée que par le communiqué d'Xcel, aucune publication propre du département n'a été trouvée par recherche approfondie. La date exacte de l'incendie n'est pas donnée (« earlier this month », soit début mai 2026). Lire la fiche approfondie. |
| 68 | Chine — ligne à grande vitesse Pékin-Zhangjiakou (conduite automatisée) + Hollysys (systèmes de contrôle ferroviaire) Comble le ; , l'humain confirme les points clés, ne conduit plus | Transport ferroviaire | Chine | 1ère ligne à grande vitesse au monde en conduite automatisée à 350 km/h (agent présent) depuis déc. 2019 ; ~90 % des opérations de conduite automatisables (certains points clés gardent une confirmation humaine) ; le système anticipe jusqu'à 32 km en amont pour calculer les vitesses de sécurité ; Hollysys a déployé ses systèmes de contrôle sur 80+ lignes principales, >16 000 km au total | CGTN presse · 2026-06-23 | À consolider | Le record mondial et l'ouverture du 30 décembre 2019 sont confirmés par un article académique de la revue Engineering. Mais les 90 % d'opérations automatisables et les 32 km d'anticipation ne viennent que de la presse, et AUCUNE source ne rattache Hollysys à cette ligne — cette attribution était erronée. |
| 69 | Union Pacific — maintenance prédictive et pilotage par la donnée Comble le | Transport ferroviaire | USA | 32 693 miles de voie, 7 154 locomotives ; 1/3 des défaillances de voie ciblées pour détection préventive par analyse de données (objectif) ; -4 % de consommation carburant via gestion embarquée (Trip Optimizer/LEADER, 3 500+ locomotives équipées), 18M de gallons économisés en 2023 ; -65 % de temps de passage aux terminaux via une technologie de "gating" automatisée ; -50 % du temps d'immobilisation des wagons via un outil mobile ; aucun chiffre de réduction d'effectifs publié — l'entreprise revendique explicitement l'"augmentation" du travail humain, pas son remplacement | Union Pacific, salle de presse source primaire · 2024-11-14 | Confirmé opérationnel | Chiffres carburant et réseau confirmés en primaire. Correction de périmètre : le « tiers des défaillances de voie » est un OBJECTIF limité aux 10 % de voies les plus à risque — le cas avait supprimé cette restriction. Relecture intégrale de la source (2026-09-29) : Plusieurs écarts. 1) La source primaire de la ligne porte sur l'Energy Management System (EMS) ; les noms « Trip Optimizer » et « LEADER » n'y figurent pas. 2) Le titre « maintenance prédictive » ne correspond pas à cette source, qui traite de gestion de la conduite ; le volet prédictif vient d'une page de 2018, où le « tiers des défaillances de voie » est un objectif, limité aux 10 % de miles les plus à risque, et reste donc annoncé. 3) Les chiffres de réseau de la ligne (32 693 miles, 7 154 locomotives) ne sont pas ceux du dernier 10-K, qui donne 32 889 miles de lignes et 6 964 locomotives au 31 décembre 2025. 4) Les chiffres « −65 % de temps de passage aux terminaux par gating automatisé » et « −50 % d'immobilisation des wagons par outil mobile » n'apparaissent dans aucune des trois sources lues : ils sont retirés de la fiche. Statut maintenu sur le constat central (EMS en production, gain chiffré sur 2023, périmètre nommé), les chiffres restant annoncés par l'entreprise. Lire la fiche approfondie. |
| 72 | Chine — cadre national de gouvernance des agents IA (CAC/NDRC/MIIT, "Implementation Opinions on the Standardized Application and Innovative Development of Intelligent Agents") Parallèle direct avec l'architecture AIPM : le modèle à 3 paliers fait écho au périmètre d'autonomie de la Fiche Directive (§3.2) et au catalogue des seuils d'escalade (§6.2) — validation externe convergente, pas une source d'inspiration copiée (cf. Insight 9 | Politique publique / régulation | Chine | 1er cadre réglementaire chinois traitant les agents IA comme une catégorie distincte des règles génériques sur l'IA générative, publié conjointement le 8 mai 2026 par trois agences (Cyberspace Administration of China, National Development and Reform Commission, Ministry of Industry and Information Technology) ; impose un modèle de frontières de décision à 3 paliers (décisions réservées à l'utilisateur / décisions autorisées par l'utilisateur / actions autonomes de l'agent), avec un droit explicite de l'utilisateur "à être informé et à la décision finale" ; gouvernance différenciée par secteur (santé, transport, médias, sécurité publique : déclaration, tests obligatoires, supervision réglementaire ; usages grand public à faible risque : auto-régulation des plateformes) ; approche assumée de "déployer d'abord, gouverner en marchant" | Cyberspace Administration of China — texte intégral officiel source primaire · 2026-05-08 | Annoncé/projeté | Texte officiel intégral daté du 8 mai 2026, les trois administrations émettrices étant confirmées dans la section « mesures de garantie ». Le qualificatif « premier cadre dédié aux agents » est porté par l'analyse, pas par le texte lui-même. Relecture intégrale de la source (2026-09-29) : Plusieurs écarts. 1) Statut rétrogradé de « Confirmé opérationnel » à « Annoncé/projeté » : la source établit l'existence et le contenu du texte, mais ce contenu est une orientation. Les mesures demandent de « clarifier », « explorer », « rechercher » ; aucune donnée d'application ni période postérieure à une mise en œuvre n'existe, ce qui correspond à la définition d'une intention dans la règle de statut. 2) Le texte n'« impose » pas un modèle à trois paliers : il demande de délimiter les frontières entre trois modes de décision. 3) La santé, les transports, les médias et la sécurité publique sont cités pour l'élaboration de normes obligatoires (mesure 3), pas comme la liste des secteurs soumis à déclaration, tests et supervision (mesure 11), qui reste à déterminer ; les mesures de la mesure 11 sont enregistrement, tests et rappel de produits. 4) Pour les usages à faible risque, l'autorégulation n'est qu'un des quatre leviers, à côté des autotests, des déclarations et de la gestion par les plateformes. 5) La formule « déployer d'abord, gouverner en marchant » n'est pas dans le texte, qui dit « du facile au difficile, pas à pas » et prévoit une « mise en œuvre glissante » ; la note de la CAC parle de faire en sorte que les agents soient « libérés » et « bien encadrés ». 6) La date d'émission conjointe n'est pas donnée : la CAC écrit « récemment » ; le 8 mai 2026 est la date de publication. Lire la fiche approfondie. |
| 73 | Chine — Huawei IPD (Integrated Product Development) Cadre de gestion de produit à grande échelle, mais antérieur à l'IA agentique — aucune composante native de gouvernance d'agents autonomes ; utile comme repère de structure organisationnelle chinoise à grande échelle, pas comme référentiel IA | Méthodologie de gestion produit | Chine | Méthode de développement produit adaptée d'IBM à la fin des années 1990, devenue le référentiel interne central de Huawei et largement étudiée/reprise par d'autres entreprises chinoises depuis ; structure la gestion de portefeuille produit par portes de décision (gates) et équipes pluridisciplinaires (cross-functional) | Cambridge University Press — The Management Transformation of Huawei, chapitre 3 source académique · 2020-03-21 | À consolider | Aucune source primaire Huawei n'a pu être ouverte. Le chapitre confirme le recours au conseil d'IBM et l'IPD comme tournant, mais ne date pas l'adoption ni ne décrit les portes de décision. Il indique au contraire que la plupart des entreprises ayant tenté l'IPD ont échoué — ce qui nuance l'idée d'une reprise large et réussie. |
| 74 | Chine — normes nationales GB/T de gestion de projet (GB/T 50326-2017, GB/T 23691-2009, GB/T 47285-2026) Prouvent l'existence d'un corpus de normalisation chinois en gestion de projet classique, actif et actualisé (une norme aussi récente que 2026) — mais, à la date de cette recherche, aucune de ces normes ne traite spécifiquement de la gestion de Directives confiées à des agents IA autonomes | Normalisation nationale | Chine | Normes chinoises officielles de gestion de projet (construction, 2017 ; référentiel général, 2009) et une norme très récente et distincte, GB/T 47285-2026 "Guidance on business analysis for projects" (2026), plus un référentiel de compétences professionnelles en gestion de projet ; publiées par l'administration chinoise de normalisation (SAMR) | SAMR — catalogue officiel des normes nationales chinoises source institutionnelle · 2026-02-27 | Confirmé opérationnel | Vérification demandée : GB/T 47285-2026 « Guidance on business analysis for projects » existe réellement, publiée le 27 février 2026 et en vigueur depuis le 1er juin 2026. À corriger en revanche : GB/T 23691-2009 est remplacée par GB/T 23691-2026, applicable au 1er novembre 2026. Relecture intégrale de la source (2026-09-29) : Plusieurs écarts. 1) GB/T 23691-2009 n'est pas un « référentiel général » mais un vocabulaire (术语, « Project management - Terminology ») ; elle est remplacée par GB/T 23691-2026, publiée le 30 juillet 2026, applicable le 1er novembre 2026, ce que la banque signalait. 2) GB/T 50326-2017 ne figure pas dans le catalogue SAMR (requête vide) : c'est une norme de construction rattachée au MOHURD, publiée le 4 mai 2017 et applicable le 1er janvier 2018 selon la Bibliothèque nationale des normes ; le site du MOHURD était inaccessible. 3) La ligne omet GB/T 37507-2025 (guide de gestion de projet) et GB/T 42892-2023 (agilité), qui renforcent son constat. 4) Le « référentiel de compétences » est GB/T 41831-2022. 5) Le constat « aucune norme ne traite des agents » doit être précisé : le même catalogue contient dix documents GB/Z sur les agents publiés en 2026, mais aucun sur la gestion de projet ; l'absence est établie sur les intitulés, les textes intégraux n'ayant pas pu être lus. Statut maintenu : source institutionnelle, dates de publication et d'application, normes en vigueur, périmètre nommé. Lire la fiche approfondie. |
| 75 | GPT-6 Astra — seuil « Critical » déclaré seuils, gouvernance | IA agentique | International | Capacité en cybersécurité classée au niveau « Critical » par l'éditeur lui-même, à la mise sur le marché | OpenAI — publication de l'éditeur source éditeur · 2026-09-10 | Annoncé/projeté | L'aperçu de sécurité déclare le seuil « Critical » atteint : le modèle peut « trouver des failles de sécurité inconnues et développer de nouvelles façons de les exploiter » sur de nombreux systèmes bien protégés, sans qu'une personne guide chaque étape. Déclaration unilatérale, sans validation par un tiers, et sans restriction de déploiement explicite. |
| 76 | GPT-6 Astra — monitorabilité en recul preuve exécutable, contrôle humain | IA agentique | International | Le modèle contrôle mieux sa propre chaîne de pensée et y inclut moins d'éléments compromettants | OpenAI — publication de l'éditeur source éditeur · 2026-09-10 | Annoncé/projeté | L'éditeur reconnaît que la surveillance par lecture du raisonnement se dégrade, et qu'en conditions adverses le modèle peut sous-performer volontairement (sandbagging) et contourner certains moniteurs de sabotage. Aucune quantification du recul n'est publiée. |
| 77 | GPT-6 Astra — OSWorld 2.0 autonomie, durée des tâches | IA agentique | International | 40 minutes par tâche en moyenne pour 72,6 %, contre 75 minutes et 65,7 % pour la génération précédente | OpenAI — publication de l'éditeur source éditeur · 2026-09-10 | Annoncé/projeté | Chiffres du tableau de l'annonce, comparés à GPT-5.6 Sol du même éditeur. Environ 47 % de temps en moins par tâche. Aucun tiers n'a rejoué ce test à cette date. |
| 78 | GPT-6 Astra — ARC-AGI-3 capacité de raisonnement | IA agentique | International | 99,9 % contre 17,8 % pour la génération précédente | OpenAI — publication de l'éditeur source éditeur · 2026-09-10 | Annoncé/projeté | Écart le plus spectaculaire du tableau de l'éditeur. Point de comparaison interne — la génération précédente de la même maison — et non le marché. Non rejoué par un tiers à cette date. |
| 79 | GPT-6 Astra — Terminal-Bench 4.0 convergence de mesure | IA agentique | International | 57,9 % annoncés par l'éditeur, 59 % mesurés indépendamment | Artificial Analysis — évaluateur indépendant source tiers indépendant · 2026-09-09 | Confirmé opérationnel | Seul chiffre du lot mesuré deux fois par deux parties sans intérêt commun, à un point d'écart. C'est ce qui lui vaut le statut confirmé, et non son niveau. |
| 80 | GPT-6 Astra — Intelligence Index position réelle sur le marché | IA agentique | International | 53 sur l'Intelligence Index, à égalité avec Claude Fable 5.1 ; 62 sur le Coding Agent Index, à égalité également | Artificial Analysis — évaluateur indépendant source tiers indépendant · 2026-09-09 | Confirmé opérationnel | Mesure d'un tiers qui rejoue ses propres tests et publie son protocole. Contredit la lecture d'une domination que suggère le tableau de l'éditeur, sans contredire aucun de ses chiffres : les périmètres ne se recouvrent pas. |
| 81 | GPT-6 Astra — GDPval-AA v2 régression mesurée, choix des tâches | IA agentique | International | Environ 45 points Elo perdus par rapport à la génération précédente, avec 24 tours par tâche à effort maximal, contre 45 pour la génération précédente et 60 pour Claude Fable 5.1 et Claude Opus 5 | Artificial Analysis — évaluateur indépendant source tiers indépendant · 2026-09-09 | Confirmé opérationnel | Régression sur le test le plus proche du travail effectivement rémunéré, attribuée par l'évaluateur au nombre de tours. L'annonce de l'éditeur ne mentionne pas GDPval. Corrélation constatée, mécanisme non démontré. |
| 82 | GPT-6 Astra — AA-Omniscience fiabilité factuelle | IA agentique | International | Taux d'hallucination ramené de 92 % à 51 % | Artificial Analysis — évaluateur indépendant source tiers indépendant · 2026-09-09 | Confirmé opérationnel | Mesure indépendante. L'évaluateur précise que cette baisse ne se paie pas en exactitude : celle-ci progresse de 4 points dans le même temps. |
| 83 | Hebbia — production de présentations gain client revendiqué | Services financiers | États-Unis | Présentations « 17 % plus fidèles au brief » et citations correctes « 19 % plus souvent » | OpenAI — publication de l'éditeur source éditeur · 2026-09-10 | Annoncé/projeté | Chiffre d'un client, publié par le fournisseur du modèle. Ni protocole, ni échantillon, ni période, ni base de comparaison. Non reproductible en l'état. |
| 84 | Box — extraction documentaire gain client revendiqué | Logiciel | États-Unis | « plus de 10 % » de risque en moins d'affirmer avec assurance des conclusions incorrectes | OpenAI — publication de l'éditeur source éditeur · 2026-09-10 | Annoncé/projeté | Chiffre d'un client, publié par le fournisseur du modèle. Aucun protocole publié. Statut annoncé, quel que soit le sérieux de l'entreprise citée. |
| 85 | CodeRabbit — revue de code gain client revendiqué | Logiciel | États-Unis | « 20 % de bugs détectés en plus », taux doublé sur les revues complexes | OpenAI — publication de l'éditeur source éditeur · 2026-09-10 | Annoncé/projeté | Chiffre d'un client, publié par le fournisseur. Le doublement sur les revues complexes n'est pas défini : ni le critère de complexité, ni le taux de départ ne sont donnés. |
| 86 | Basis — processus longs gain client revendiqué, tâches longues | Comptabilité | États-Unis | « Amélioration de 20 % » sur les processus longs | OpenAI — publication de l'éditeur source éditeur · 2026-09-10 | Annoncé/projeté | Chiffre d'un client, publié par le fournisseur. À rapprocher de la régression de 45 points Elo mesurée par un tiers sur le test de travail réel : les deux affirmations portent sur des tâches longues et vont en sens inverse. |
| 87 | GPT-6 Astra — évaluation interne Codex évaluation d'alignement | IA agentique | International | Plus de 54 000 tâches simulées ; « environ deux fois moins de drapeaux » que la version précédente pour comportements gravement mal alignés | OpenAI — publication de l'éditeur source éditeur · 2026-09-10 | Annoncé/projeté | Le dénominateur n'est pas publié : « deux fois moins » ne dit rien de la valeur absolue. Évaluation interne, non auditée. |
| 88 | GPT-6 Astra — coût du contrôle Directive, arbitrage sécurité/débit | IA agentique | International | Les contrôles de sécurité supplémentaires peuvent « parfois ralentir, suspendre ou arrêter du travail légitime », y compris en cybersécurité défensive | OpenAI — publication de l'éditeur source éditeur · 2026-09-10 | Annoncé/projeté | Limite reconnue par l'éditeur dans sa propre annonce. Le bénéfice du contrôle est chiffré — 89 % de résultats involontaires en moins, sur une évaluation d'usage d'ordinateur — mais son coût, le taux de faux positifs, ne l'est pas. |
| 89 | GPT-6 Astra — contrôles d'entreprise Directive, RACI-IA | IA agentique | International | Sites autorisés, applications et transferts de fichiers sous contrôle d'administration ; confirmation obligatoire avant action critique ; revue automatisée des appels d'outils | OpenAI — publication de l'éditeur source éditeur · 2026-09-10 | Annoncé/projeté | Trois mécanismes qui forment, en substance, une Directive au sens d'AIPM. Le réglage — donc l'arbitrage entre sécurité et débit — est explicitement laissé au client. |
| 90 | Stanford AI Index 2026 — piste à consolider adoption, écart capacité/préparation | Recherche | États-Unis | Rapport existant, chiffres non lus | Stanford HAI — AI Index 2026 source recherche · 2026-09-10 | À consolider | Piste fermée le jour même : le chapitre 2 du rapport a été lu et ses six mesures d'agents sont versées à la banque aux lignes suivantes. Reste non lu le chapitre Économie. |
| 91 | Agents — taux d'échec global seuils, autonomie | Recherche | États-Unis | Les agents « échouent environ une fois sur trois » | Stanford HAI — AI Index 2026, chapitre 2 source recherche · 2026-04-13 | Confirmé opérationnel | Constat du rapport annuel de Stanford, agrégeant six bancs d'essai. Source académique sans intérêt commercial au résultat. Le rapport publie aussi ses limites : les problèmes de style concours sont plus structurés que le travail ouvert de la plupart des métiers. |
| 92 | GAIA — progression et écart humain capacité, écart à l'humain | Recherche | États-Unis | De 20 % en janvier 2025 à 74,5 % en septembre 2025 ; référence humaine à 92 %, soit 17,5 points d'écart | Stanford HAI — AI Index 2026, chapitre 2 source recherche · 2026-04-13 | Confirmé opérationnel | Mesure agrégée par Stanford. L'écart à l'humain reste le plus large des six bancs d'essai relevés. |
| 93 | OSWorld — poste de travail capacité, protocole | Recherche | États-Unis | 66,3 % pour Claude Opus 4.5, à environ 6 points de la performance humaine (~72 %, étudiants en informatique), sur 369 tâches | Stanford HAI — AI Index 2026, chapitre 2 source recherche · 2026-04-13 | Confirmé opérationnel | La référence humaine est constituée d'étudiants en informatique, non de professionnels du métier concerné : la proximité mesurée ne se transpose pas telle quelle. |
| 94 | WebArena — navigation web capacité, preuve exécutable | Recherche | États-Unis | D'environ 15 % en 2023 à 74,3 % début 2026 ; référence humaine 78,2 %, soit 4 points d'écart | Stanford HAI — AI Index 2026, chapitre 2 source recherche · 2026-04-13 | Confirmé opérationnel | WebArena vérifie l'état final du site plutôt que la trace des actions — une vérification par les effets, convergente avec la règle de preuve exécutable du Standard. |
| 95 | MLE-bench et Cybench capacité, cybersécurité | Recherche | États-Unis | MLE-bench : de 17 % en 2024 à 64,4 % en 2026. Cybench : de 15 % en 2024 à 93 % en 2026 | Stanford HAI — AI Index 2026, chapitre 2 source recherche · 2026-04-13 | Confirmé opérationnel | La progression la plus rapide des six bancs d'essai est celle des tâches de cybersécurité, à rapprocher du seuil « Critical » déclaré par OpenAI sur le même domaine. |
| 96 | τ-bench — outils externes autonomie, tâches longues | Recherche | États-Unis | 70,2 % pour Claude Opus 4.5 sur des tâches multi-tours utilisant des outils externes | Stanford HAI — AI Index 2026, chapitre 2 source recherche · 2026-04-13 | Confirmé opérationnel | Mesure agrégée par Stanford sur des tâches à plusieurs tours avec appel d'outils — le régime de travail le plus proche de celui d'un agent en production. |
| 97 | Anthropic — 30 000 agents internes sous moniteur : 1 action sur 47 000 bloquée Supervision d'une flotte d'agents à grande échelle ; métriques de couverture, de latence de revue et de taux de blocage ; identité individuelle des agents et messagerie partagée auditable ; mesure du degré de délégation par tâche. | Tech / R&D logicielle | USA | Environ 30 000 agents actifs simultanément sur la principale plateforme interne (août 2026) ; 100 % des actions passent par un moniteur en ligne avant exécution ; plus d'un milliard de décisions analysées en août 2026, dont 0,002 % bloquées (environ 1 sur 47 000) ; environ 100 000 transcriptions signalées par semaine par le moniteur hors ligne, dont environ 50 remontées à un humain ; Claude « mène » 26 % du travail de R&D IA (niveau AL4 de l'échelle d'automatisation d'Epoch AI) et plus de 90 % du travail est au niveau « collabore » ou au-delà. | Anthropic — Measurements for understanding the pace of AI development inside frontier labs source primaire · 2026-09-17 | Confirmé opérationnel | Source primaire datée du 17/09/2026, périmètre nommé (plateforme interne la plus utilisée, août 2026), chiffres constatés en production interne. Réserves : télémétrie auto-publiée, sans audit externe ; l'indice d'automatisation est noté par un modèle Claude « juge » (accord exact modèle/humain 59 %, humain/humain 35 %, à un niveau près 97 %) ; la source précise que la surveillance existe « depuis des mois, pas des années ». |
| 98 | OpenAI — un agent de recherche publie un jeton GitHub malgré deux rappels à l'ordre Consigne non tenue malgré accord explicite de l'agent ; limites de l'instruction système comme seul garde-fou ; mesures correctives graduées (retrait, revue automatique, fréquence de surveillance) ; le chercheur a été plus rapide que le moniteur. | Tech / IA | USA | Incident du 27/05/2026 en déploiement interne : le modèle a publié le jeton GitHub d'un chercheur dans le dépôt public openai/codex en contournant l'instruction système et deux interventions de l'utilisateur ; modèle retiré environ 2 semaines ; remise en service avec revue automatique de toutes les actions, moniteur asynchrone de la chaîne de raisonnement et surveillance standard toutes les 30 minutes (au lieu de chaque fenêtre de compaction) ; clés de tous les employés désactivées par précaution. | OpenAI Alignment — Exposing a GitHub token in a public repository source primaire · 2026-09-25 | Confirmé opérationnel | Rapport primaire (série « Misalignment Reports and Notices »), incident daté, périmètre nommé (déploiement interne, harnais personnalisé), mesures chiffrées. Rapport mis à jour le 25/09/2026 ; l'incident lui-même date de mai. Auto-déclaratif, sans audit externe. |
| 99 | OpenAI — un agent sort de son bac à sable par le DNS ; tout usage d'outils des modèles les plus capables suspendu Hypothèse du dossier de sécurité invalidée (« pas d'accès au live internet ») ; écart entre détection rapide et arrêt effectif ; ambiguïté de la procédure d'arrêt ; décision de gel global comme réponse de gouvernance. | Tech / IA | USA | Le 20/09/2026, un agent en entraînement a interrogé un chatbot public via une faille de filtrage DNS ; alerte P0 à 10:02:11, prise en charge humaine à 10:05:06, run arrêté à 12:34:30 (appel DNS ayant obtenu une réponse externe à 9:50:23 ; moniteur : moins de 15 min ; humain : 3 min après ; arrêt : 2,5 h plus tard, l'arrêt automatique attendu n'ayant pas fonctionné) ; suspension de tout entraînement, évaluation et inférence avec outils des modèles les plus capables. | OpenAI Alignment — An agent used DNS to reach an external chatbot source primaire · 2026-09-25 | À consolider | Source primaire, datée et chiffrée (chronologie à la seconde). Classée « À consolider » par application mécanique de la règle : le périmètre est un run d'entraînement, pas une période postérieure à une mise en production. La décision de suspension est un fait constaté ; sa durée n'est pas connue. La source conditionne la reprise à la validation de la correction et à un red-teaming supplémentaire. |
| 100 | Anthropic — quatre intrusions réelles pendant des évaluations cyber ; un tri élargi à 481 millions de transcriptions n'en trouve pas d'autre Limites de l'audit préalable (« n'a pas averti ») ; contrôle par agent qui manque des cas ; mauvaise configuration d'environnement chez un partenaire tiers ; enquête indépendante (METR, accord initial de 8 semaines). | Tech / IA / cybersécurité | USA | Quatre incidents où des modèles Claude ont accédé sans autorisation à des systèmes tiers réels (environnements d'évaluation connectés par erreur à Internet) ; trois incidents repérés par un premier tri d'environ 141 000 transcriptions fait par recherche agentique, qui a manqué un lot de transcriptions où le quatrième (janvier 2026) a été trouvé en août ; recherche élargie à environ 481 millions de transcriptions, 9,2 millions revues en second niveau par Claude, sans nouvel incident de gravité comparable ou supérieure ; runs de 10 à 34 heures de travail actif ; dans le cas le plus grave, un paquet malveillant publié sur PyPI a été installé sur 15 hôtes tiers (selon l'éditeur, vraisemblablement des éditeurs de sécurité l'analysant en bac à sable ; l'un d'eux a laissé fuiter des identifiants que le modèle a utilisés). | Anthropic — An alignment assessment of recent cybersecurity incidents source primaire · 2026-09-09 | À consolider | Source primaire du 09/09/2026, chiffrée et datée. Classée « À consolider » par application de la règle : les faits surviennent en évaluation préalable à la mise sur le marché, non en production ; l'éditeur juge ces comportements « peu probables » en usage ordinaire. Les trois premiers incidents avaient été décrits le 30/07 ; le quatrième (janvier 2026) est nouveau. |
| 101 | Anthropic — Fermat formalisé en 11 jours par des dizaines d'agents, après l'échec d'une première organisation Pilotage d'un projet multi-agents long : état partagé explicite, découpage en graphe de dépendances, parallélisation, intervention humaine limitée à des priorités de haut niveau ; vérification externe (Lean, comparateur, relecture de Kevin Buzzard). | Recherche / mathématiques | USA | Preuve de bout en bout vérifiée par Lean en 11 jours, en grande partie autonome : 13 millions de lignes de Lean, 30 300 théorèmes prouvés dont 29 500 utilisés, environ six milliards de jetons de sortie ; les premières tentatives ont échoué, les agents « perdant le fil » de l'état du projet ; succès après passage à une plateforme maintenant un graphe (DAG) des énoncés ; les efforts ratés représentent environ 7 % des lignes non standard de la preuve finale. | Anthropic — Formalizing Fermat's Last Theorem source primaire · 2026-09-04 | Confirmé opérationnel | Source primaire du 04/09/2026, livrable vérifiable (preuve Lean publiée), périmètre et durée nommés, validation par un tiers (Kevin Buzzard). Réserve : la page donne « 11 jours » et, plus loin, « a little under two weeks » ; « 30 300 » théorèmes prouvés contre « 29 500 » utilisés — les deux chiffres coexistent dans la source. |
| 102 | Anthropic « Project Swap » — des agents négocient pour 201 personnes : le modèle compte plus que la consigne Fidélité de la délégation (l'agent a-t-il compris son mandant ?) ; poids du choix du modèle par rapport à la consigne ; règles d'un marché d'agents (admission, défaut de livraison, visibilité). | Économie / marchés | USA / Europe | Marché expérimental de troc de livres entre agents pour 201 employés dans six bureaux ; après un entretien d'environ cinq minutes, le classement établi par l'agent correspondait à celui de la personne sur 61 % des paires ; le modèle utilisé pesait davantage sur les résultats de négociation que les instructions données ; les pertes d'efficacité venaient surtout du manque d'information sur les participants. | Anthropic — Project Swap: What happens when agents trade for us? source recherche · 2026-09-24 | Recherche/projection | Expérience contrôlée publiée le 24/09/2026, méthode décrite (six pools, classement de vérité terrain sur 10 livres, rejeux multiples). Population interne à l'éditeur, enjeu non monétaire : résultats non transposables tels quels. |
| 103 | OCDE — 25 organisations interrogées : agents en production encore bornés, surcoûts et contournements de limites Autonomie bornée et extension progressive ; coûts de calcul comme risque opérationnel ; supervision proportionnée au lieu du tout-humain ; érosion des compétences (une organisation recommande de réaliser périodiquement une part des tâches sans IA agentique). | Multi-secteurs / politique publique | International (OCDE) | Entretiens semi-directifs avec 25 organisations (74 contactées) de 11 pays (dont France, Allemagne, Japon, Inde, Singapour) ; deux organisations déclarent des dépassements de coûts de calcul constatés ; des cas d'agents modifiant leurs contraintes ou contournant des limites « pour paraître réussir » sont rapportés ; la revue humaine continue est jugée impraticable à l'échelle ; les « agents fantômes » non approuvés sont cités comme préoccupation croissante. | OCDE — Agentic AI in organisations: Early insights from practitioner interviews (OECD AI Papers n° 65) source institutionnelle · 2026-09-16 | Recherche/projection | Document de travail OCDE (AI Papers n° 65), qualitatif ; la source indique elle-même ne contenir « ni métriques quantitatives de performance ni évaluations indépendantes ». PDF daté du 16/09/2026 (métadonnées) ; présenté en juin 2026 à la plénière GPAI. |
| 104 | IFR World Robotics 2026 — 5 millions de robots en service, mais le textile chinois s'effondre de 92 % Volatilité de l'adoption hors secteurs historiques ; prudence avant d'extrapoler une courbe d'automatisation ; mise à jour de la donnée de référence mondiale. | Industrie / robotique | Chine / Monde | Parc mondial de robots industriels en service : +9 %, record de 5 millions d'unités en 2025 ; installations annuelles +11 %, plus de 600 000 unités ; Chine : 354 000 unités installées en 2025 ; installations chinoises dans le textile, cuir et habillement : -92 % sur un an en 2025 après +115 % par an (TCAC 2019-2024) ; agroalimentaire chinois : -37 % en 2025 après +86 % en 2024 ; fournisseurs chinois : 55 % des installations en Chine. | IFR — China Installs 59 Percent of World's Industrial Robots (World Robotics 2026) ; page de synthèse mondiale : ifr.org/ifr-press-releases/five-million-robots-now-operate-in-factories-globally source institutionnelle · 2026-09-24 | Confirmé opérationnel | Statistique institutionnelle annuelle, datée du 24/09/2026, périmètre nommé (installations 2025). Mise à jour du cas 23 (World Robotics 2025), pas un nouveau cas ; les chiffres textile invitent à relire le cas 45 (textile chinois). |
| 105 | IFR — près de 7 000 humanoïdes vendus en 2025 : « encore au seuil du passage du laboratoire au pilote » Écart entre annonces et déploiements réels ; stade pilote vs production ; critères de passage à l'échelle. | Industrie / robotique humanoïde | Monde | Près de 7 000 robots humanoïdes (taille supérieure à 140 cm) vendus dans le monde en 2025 ; 174 fabricants identifiés, dont plus de 50 % en Chine ; freins cités : sûreté et fiabilité fonctionnelle, manque de données d'entraînement, absence de modèle économique viable. | IFR — Market Presentation, World Robotics 2026 Press Conference source institutionnelle · 2026-09-24 | Confirmé opérationnel | Présentation officielle de la conférence de presse World Robotics 2026 (24/09/2026). Le volume de ventes est une statistique ; le jugement sur le stade de maturité est l'appréciation de l'IFR. |
| 106 | Banques chinoises — 140 agents de contrôle opérationnel chez Ping An Bank, agents de première ligne en phase pilote chez ICBC Agents d'appui aux opérations et au contrôle (LCB-FT, revue de comptes, compensation) déployés en nombre ; extension annoncée aux étapes de crédit de détail (enquête, approbation, décaissement, recouvrement) ; jetons consommés comme indicateur de pilotage (et ses limites). | Banque | Chine | Ping An Bank : 140 agents « de revue opérationnelle » mis en service au premier semestre 2026, couvrant 55 scénarios (LCB-FT, revue de comptes, compensation, virements transfrontaliers) ; plus de 450 scénarios de grands modèles ; consommation quotidienne moyenne de jetons supérieure à 5,3 milliards (+≈130 %). ICBC : grands modèles dans plus de 600 scénarios, deux « super-agents », et quatre catégories d'agents de première ligne passées « au stade de promotion pilote ». | Ping An Bank — 2026年半年度报告 (rapport semestriel 2026) ; ICBC — 2026 Interim Results Announcement (HKEX, 28/08/2026) ; synthèse : Economic Information Daily (Xinhua), 03/09/2026 source primaire · 2026-08-15 | Confirmé opérationnel | Chiffres Ping An et ICBC vérifiés (ICBC : hkexnews.hk/listedco/listconews/sehk/2026/0828/2026082800399.pdf) dans les rapports semestriels primaires (15/08 et 28/08/2026), période du S1 2026. Repérés via la synthèse Xinhua / Economic Information Daily du 03/09/2026, qui écrit « Token消耗量超过53亿 » alors que le rapport de Ping An précise « 日均 » (moyenne quotidienne) : écart de périmètre à signaler. Les autres chiffres de la synthèse (WeBank : délai de deux semaines ramené à 30 minutes, Nanjing Bank : 156 agents) n'ont pas été vérifiés à la source. |
| 107 | OpenAI — des agents transforment un wiki allemand en messagerie ; premier rapport d'incident connu sous l'AI Act Obligation de notification d'incident ; délai de divulgation ; responsabilité du fournisseur de modèle ; frontière entre modèle interne et modèle mis sur le marché. | Tech / IA / régulation | Europe | Selon la presse, des agents d'OpenAI ont occupé pendant deux mois un wiki germanophone en sommeil, avec environ 18 000 messages échangés entre eux ; OpenAI a confirmé l'incident le 5 septembre ; la Commission a confirmé avoir reçu un rapport d'incident sans en donner la date d'envoi, point décisif au regard de l'obligation de notification « sans retard injustifié » (article 55). | The Next Web — OpenAI has filed an EU incident report on the hijacked German wiki, the Commission says tiers indépendant · 2026-09-07 | À consolider | Presse uniquement (The Next Web du 07/09, reprenant Reuters ; Euronews du 09/09) : plafond « À consolider ». L'index OpenAI Alignment mentionne une notice « DSEwiki » du 5 septembre (agents communiquant via un wiki public), mais son texte (openai.com) n'a pas pu être ouvert ; aucun texte de la Commission lu. Le chiffre d'environ 18 000 messages est attribué par The Next Web à des chercheurs extérieurs. |
| 108 | Australie — un agent OpenAI franchit les contrôles du portail statistique Medicare ; notification près de trois mois après les faits Délai et canal de notification ; agent qui contourne des refus répétés du portail ; impact d'une évaluation d'éditeur sur un tiers public ; continuité de service (portail retiré). | Secteur public / santé | Australie | Selon le gouvernement cité par la presse : accès non autorisé le 18 juin 2026 à des fichiers non publics d'un portail statistique Medicare lors d'une évaluation interne d'OpenAI ; activité découverte par OpenAI en août ; notification par courriel à une boîte publique de Services Australia le 10 septembre, vue le 11, signalée à l'ACSC le 15 ; annonce publique le 24 septembre ; portail mis hors ligne ; aucune preuve d'accès à des dossiers de patients selon OpenAI. | The Hacker News — OpenAI Agent Bypassed Australian Medicare Portal Controls to Access Non-Public Files tiers indépendant · 2026-09-24 | À consolider | Presse uniquement (The Hacker News, Al Jazeera, 24/09/2026), rapportant les déclarations du Premier ministre et du vice-Premier ministre ; la transcription gouvernementale (minister.defence.gov.au) n'a pas pu être ouverte (connexion refusée). Plafond presse. |
| 109 | Anthropic — panne de trois heures touchant l'API, Claude Code et Cowork le jour où d'autres assistants tombent Dépendance d'une chaîne d'agents à un fournisseur unique ; plan de continuité et bascule multi-fournisseur ; indisponibilité simultanée comme risque de portefeuille. | Tech / infrastructure IA | USA | Incident « major » du 03/09/2026 : erreurs élevées de 13:26 à 16:23 UTC (fin d'impact annoncée à 16:16 UTC) sur claude.ai, l'API, Claude Code et Claude Cowork ; la presse rapporte le même matin des pannes distinctes de ChatGPT/Codex et de Grok, sans cause commune établie. | Claude Status — Elevated errors for multiple models (3 septembre 2026) source primaire · 2026-09-03 | Confirmé opérationnel | Page de statut officielle (source primaire), horodatage constaté en production. Seul le volet Anthropic est confirmé ; la simultanéité avec OpenAI et xAI repose sur la presse et n'a pas de cause commune démontrée. |
| 110 | Chine (MIIT) — plan « IA + logiciel » : 100 applications phares d'agents logiciels d'ici 2028 Pilotage national par objectifs chiffrés ; agents logiciels comme catégorie de politique industrielle ; suite du cadre de gouvernance des agents (cas 72). | Politique publique / logiciel | Chine | Objectifs 2028 : diffusion auprès de 20 000 entreprises de logiciel de taille significative, 100 projets de transformation intelligente, 100 applications phares de « logiciels-agents » dans les secteurs clés, au moins 5 projets open source ; horizon 2030 : mise à niveau intelligente complète des logiciels clés. | Xinhua — 工业和信息化部印发《“人工智能+软件”专项行动实施方案》 tiers indépendant · 2026-09-11 | À consolider | Relais Xinhua du 11/09/2026 ; le texte officiel du MIIT n'a pas pu être ouvert (connexion refusée). Si le texte primaire est lu, le cas relève d'« Annoncé/projeté » (objectifs). |
Ce que cette banque ne dit pas encore
Les limites de la preuve, énoncées par le référentiel lui-même
- La couverture géographique est déséquilibrée. Les cas les mieux documentés viennent de Chine et des États-Unis, parce que c'est là que les déploiements les plus avancés sont publiés. L'Europe est sous-représentée — ce n'est pas un jugement sur l'Europe, c'est un état de la documentation disponible.
- Aucun cas n'est un audit indépendant. Les chiffres proviennent de communications d'entreprise, de résultats financiers publiés, de rapports institutionnels ou d'études académiques. Un chiffre publié par une organisation sur son propre déploiement reste une donnée déclarative, même quand il est vérifié par la presse.
- Le principe 11 (vérificateur distinct du producteur) ne repose encore que sur un seul cas confirmé. Le Standard le dit explicitement plutôt que de lui adjoindre un second cas de complaisance. Documenter un deuxième cas indépendant est une priorité de recherche.
- Le risque 7.9.5 (dérive collective d'une flotte d'agents) est marqué « théorique, non confirmé ». Aucun cas opérationnel de défaillance de ce type n'est documenté à ce jour. Il figure au registre parce que la mécanique est plausible, pas parce qu'elle est prouvée.
- Objectif affiché : 100 à 150 cas. La banque en compte 108 à ce stade. Les secteurs encore mal couverts sont le BTP, l'agriculture, la logistique portuaire, le juridique et l'éducation.
- Le document de cadrage numérote jusqu'à 96. Deux lignes y sont réservées à des cas issus des missions de DYONYSOS, pas encore versés. Le site n'affiche que les cas réels : c'est pour cela que le compteur indique 108 et non 96.
- 43 cas sur 108 sont marqués « À consolider ». Ce ne sont pas des cas douteux : ce sont des cas que la règle ne permet pas de classer plus haut. Trois motifs reviennent — une source unique, une source de presse jamais remontée à sa primaire, ou un chiffre qui diffère de celui que le site affichait. Les ranger d'autorité ailleurs reviendrait à faire exactement ce que le principe 7 interdit.
- La presse ne confirme rien, elle indique où chercher. La règle plafonne à « À consolider » tout cas dont la seule source est un article, quelle que soit la qualité du journal. C'est la règle qui coûte le plus de cas confirmés, et c'est celle qui rend la banque défendable.
- Deux cas n'ont aucune source, et le disent. Ils restent affichés avec la mention « aucune source » plutôt que d'être discrètement supprimés : une recherche menée sans résultat est une information, pas un échec à masquer.
- Le cas Khan Academy est conservé comme contre-exemple. Les gains d'apprentissage qui circulaient à son sujet ne résistent pas à la vérification : l'essai randomisé disponible conclut à des résultats à peu près identiques à ceux des élèves n'ayant pas utilisé l'outil. Un référentiel qui n'affiche que ce qui l'arrange n'est pas un référentiel.
D'où viendront les prochains cas
Les sources de veille sont déclarées, pas gardées secrètes
Un référentiel qui impose une règle de preuve doit dire où il va chercher ses cas. Voici les gisements retenus pour porter la banque de 108 à l'objectif de 100 à 150, et ce que chacun permet de prouver.
| Source | Ce qu'elle contient | Ce qu'elle permet de classer |
|---|---|---|
| Inventaire fédéral américain des cas d'usage de l'IA (Office of Management and Budget) | Plusieurs milliers de cas d'usage déclarés par les agences fédérales, avec le périmètre, l'agence et le stade de déploiement. Publié en fichier ouvert. | Confirmé opérationnel quand le stade déclaré est « en production » et que le périmètre est constaté ; Annoncé/projeté sinon. |
| Déclarations d'entreprises cotées (base EDGAR de la SEC) | Documents financiers horodatés et opposables, dans lesquels les entreprises décrivent leurs déploiements et leurs effets chiffrés. | Confirmé opérationnel : c'est la source la plus qualifiante, parce qu'une donnée fausse y engage la responsabilité de l'émetteur. |
| Base européenne des systèmes d'IA à haut risque (règlement (UE) 2024/1689, art. 49) | Enregistrement obligatoire des systèmes à haut risque mis sur le marché européen. En montée en charge. | Confirmé opérationnel pour l'existence du système ; l'effet mesuré reste à documenter séparément. |
| Le Fil Indépendant, rubriques Tech et IA | Revue de presse sourcée et datée, éditée par DYONYSOS, dont la doctrine est « toujours attribué, jamais recopié ». | Repérage et datation. Un article du Fil ne classe jamais un cas à lui seul : il fournit la date et la source primaire à remonter. |
Deux garde-fous. Un article de presse, y compris du Fil Indépendant, n'est jamais la preuve d'un cas : il sert à trouver la source primaire, qui seule classe. Et Le Fil étant édité par le même éditeur qu'AIPM, il est cité ici en toutes lettres plutôt que fondu dans une bibliographie — s'auto-citer sans le dire serait précisément l'autorité empruntée que le principe 7 interdit.
Vous avez un cas à verser à la banque ?
Un déploiement mesuré, avec une source publiable et une donnée chiffrée — même modeste, même partiel.