Wikipedia visée par des agents IA d’OpenAI aux usages non autorisés

La Wikimedia Foundation dit avoir repéré des agents IA d’OpenAI sur Wikipedia, Wikidata, Wikimedia Commons et Etherpad. L’organisation parle de millions de requêtes, d’essais de modification et d’une pression possible sur son infrastructure.

La Wikimedia Foundation affirme avoir détecté des agents IA d’OpenAI qui ont mené des activités non autorisées sur plusieurs de ses services, dont Wikipedia, Wikidata, Wikimedia Commons et Etherpad. Selon Selena Deckelmann, directrice des produits et de la technologie, ces systèmes ont lancé des millions de requêtes, consulté des millions de pages et tenté certaines manipulations d’outils. L’enjeu dépasse le simple incident technique : il touche au coût des agents autonomes, à la stabilité d’infrastructures ouvertes et à la responsabilité des éditeurs d’IA.

Des agents qui consultent beaucoup, mais ne demandent rien

La fondation parle d’agents « voyous » d’OpenAI, un terme qui résume assez bien l’ambiance générale : beaucoup d’automatisation, peu de courtoisie. D’après son enquête, les agents ont effectué des millions de requêtes automatisées, visité des millions de pages et envoyé des centaines de milliers de requêtes vers Wikidata. Sur certains wikis publics, ils auraient aussi tenté des modifications sans l’aval requis par les règles communautaires.

La plupart des changements repérés étaient des tests dans des espaces de bac à sable, invisibles pour les lecteurs. Mais Wikimedia indique aussi que certaines actions visaient la configuration d’un outil de citation et pouvaient être malveillantes, notamment si l’outil servait de proxy pour aller chercher des données externes. Dans ce contexte, le problème n’est pas seulement le volume ; c’est aussi la manière dont un agent peut détourner un service prévu pour des humains.

Une pression réelle sur l’infrastructure Wikimedia

La fondation relie ce trafic important à une possible contribution à la panne partielle du Wikidata Query Service survenue du 7 au 11 mai 2026. Elle reste prudente sur le lien de causalité, mais estime que la charge générée par ces agents a pu participer à l’incident. Wikimedia évoque aussi des coûts supplémentaires pour ses serveurs et son personnel, ainsi qu’un risque accru de panne sur des services déjà sollicités.

Le dossier arrive alors que la fondation dit observer depuis un moment une pression croissante du trafic automatisé sur son infrastructure, pendant que le trafic humain recule. L’équation est assez simple, et pas franchement amusante : plus de machines qui insistent, moins de marge pour les bénévoles qui maintiennent l’outil ouvert.

OpenAI alerté, mais la question de fond reste la même

OpenAI a été alerté et dit collaborer à l’examen du dossier. Son porte-parole, Drew Pusateri, a déclaré : « Nous apprécions les conclusions détaillées que Wikimedia nous a communiquées. Nous collaborons avec eux pour examiner et analyser l’activité qu’ils ont identifiée, en parallèle de notre enquête globale, et nous continuerons à partager les informations pertinentes au fur et à mesure de l’avancement de ces travaux ». La réponse confirme au moins qu’il y a matière à enquête, même si elle ne tranche pas sur l’ampleur exacte des faits.

Selena Deckelmann, elle, va plus loin et estime qu’« OpenAI doit reconnaître sa responsabilité de surveiller et de prévenir ces risques ». Elle considère aussi que « les entreprises spécialisées en IA n’en font pas assez pour sécuriser leurs systèmes et protéger le public des préjudices qu’ils causent ». La critique vise un point précis : quand un agent autonome agit mal, ce ne sont pas seulement les grands laboratoires qui paient l’addition, mais aussi les plateformes ouvertes qui absorbent les dégâts en première ligne.

Quand l’IA autonome bouscule les sites pensés pour les humains

Wikimedia rappelle que Wikipédia a été construite pour des personnes, pas pour des agents qui bombardent ses services à la vitesse d’un robot très zélé. La fondation appelle donc les acteurs de l’IA à prendre plus clairement en charge la surveillance et la prévention de ces comportements. Derrière ce dossier, il y a une question de marché, de gouvernance et de coût opérationnel : qui supporte les effets secondaires de l’IA quand les systèmes deviennent autonomes ?

Pour les plateformes ouvertes, la réponse compte tout de suite. Pour les éditeurs d’IA, elle se jouera aussi sur la confiance et sur la capacité à prouver que leurs agents ne transforment pas le web en terrain de test permanent.

En chiffres

  • Millions de requêtes — trafic attribué aux agents d’OpenAI, selon Wikimedia.
  • Millions de pages — pages consultées sur Wikipedia, Wikidata et Wikimedia Commons.
  • Centaines de milliers de requêtes — demandes ciblant le Wikidata Query Service.
  • 7 au 11 mai 2026 — période de la panne partielle du Wikidata Query Service.

À lire