Wikipédia rend-il une entreprise visible dans les IA ?
Publié le
Pas directement, et pas pour la plupart des entreprises. Wikipédia pèse lourd dans ce que les modèles d’IA apprennent, mais une page Wikipédia d’entreprise n’est admise que si la presse indépendante a déjà écrit sur elle, et elle ne garantit aucune citation. Dans nos mesures, les pages Wikipédia ramenées par la recherche de ChatGPT sur des questions d’intelligence artificielle n’ont été citées que dans 1,3 % des cas. Wikipédia rend une entreprise visible dans les IA quand elle est déjà connue ; elle ne remplace pas une page qui répond à la question de votre client.
Pour quel type de question ? Tout dépend de la question. Quand l’utilisateur parle de Wikipédia, les IA vont lire Wikipédia : sur la question de cette page, ChatGPT a fini par citer les règles de l’encyclopédie elles-mêmes. Sur une question produit ou une question de marché, où personne ne désigne Wikipédia, l’encyclopédie est rarement la source affichée.
Ce que Wikipédia pèse dans l’entraînement des IA
Wikipédia fait partie des données d’entraînement des grands modèles de langage, et elle y a un poids supérieur à sa taille. Dans l’article qui a présenté GPT-3 en 2020, OpenAI détaille son mélange de données : Wikipédia ne représentait que 3 milliards de jetons et 3 % du mélange, mais le modèle l’a parcourue 3,4 fois pendant l’entraînement, contre 0,44 fois pour le corpus Common Crawl filtré, pourtant cent fois plus volumineux. Les éditeurs ne publient plus ce détail pour les modèles récents.
Les acteurs de l’IA paient aussi pour accéder aux données de Wikipédia. Le 15 janvier 2026, Wikimedia Enterprise a annoncé de nouveaux partenaires, Amazon, Meta, Microsoft, Mistral AI et Perplexity, qui rejoignent notamment Google. Wikipédia est donc une source de connaissance pour les modèles et une source de données pour les moteurs de recherche des IA. Mais ce que le modèle a appris et ce qu’il cite en répondant sont deux choses distinctes.
Wikipédia dans les citations : des chiffres qui ne mesurent pas la même chose
Le chiffre le plus repris vient de Profound, qui a analysé des citations de ChatGPT, des réponses IA de Google et de Perplexity entre août 2024 et juin 2025. Wikipédia y représente 7,8 % de toutes les citations de ChatGPT. Le chiffre de 47,9 %, souvent présenté comme « la moitié des citations de ChatGPT », est en réalité la part de Wikipédia parmi les dix domaines les plus cités seulement.
Semrush, qui a suivi les réponses de ChatGPT du 14 juillet au 12 octobre 2025, mesure autre chose : la part des réponses qui citent Wikipédia au moins une fois. Elle est passée d’environ 55 % à moins de 20 % entre août et septembre 2025. Une part de toutes les citations, une part parmi les premiers domaines et une part des réponses donnent des chiffres qui vont de un à sept ; les comparer sans leur unité conduit à des conclusions fausses.
Ce que nous avons mesuré sur Wikipédia
Nous mesurons, pour chaque domaine, la part des pages ramenées par la recherche d’une IA qui finissent citées. Chez ChatGPT, sur des questions d’intelligence artificielle posées en anglais pour l’essentiel, les pages Wikipédia ramenées ont été citées dans 1,3 % des cas. Réunies avec Reddit et YouTube, elles restent sous 1,5 % sur tous nos corpus, quand les autres pages ramenées sont citées dans 10 à 15 % des cas.
Sur la question de cette page, posée le 15 septembre 2026, Wikipédia représentait 23 % puis 27 % des résultats ramenés par ChatGPT, et 24 % puis 21 % chez Claude. ChatGPT n’a cité aucune page Wikipédia la première fois, puis en a cité dans 17 % de ses sources : l’article sur les règles de notoriété de Wikipédia. Claude l’a citée dans 7 % de ses sources, pour les critères d’admissibilité des entreprises. Gemini n’en a ni ramené ni cité. Quand la question porte sur Wikipédia, l’encyclopédie remonte dans les citations ; c’est la question qui l’appelle, pas la notoriété de l’entreprise.
Une entreprise peut-elle avoir sa page Wikipédia ?
Les règles sont strictes. Sur Wikipédia en français, un article sur une entreprise n’est admissible que si des travaux significatifs, indépendants et publiés ont été réalisés à son sujet, espacés d’au moins deux ans. Les publications issues de la communication de l’entreprise, comme les communiqués, les réimpressions d’articles ou les publicités, ne comptent pas. Sur Wikipédia en anglais, aucune entreprise n’est considérée comme admissible d’office, quelle que soit sa taille.
Faire écrire sa page contre rémunération est encadré : la contribution rémunérée doit mentionner l’identité du client ou de l’employeur, et les contributions promotionnelles restent strictement interdites. Pour une PME sans couverture de presse indépendante étalée sur au moins deux ans, une page Wikipédia n’est donc pas un levier disponible : c’est une conséquence de la notoriété, pas un moyen de l’obtenir.
Ce que cela change pour une entreprise
Chercher à entrer sur Wikipédia pour être visible dans les IA prend le problème à l’envers. Ce que nous observons chez ChatGPT, c’est qu’il écrit dans sa requête le nom des sources qu’il connaît et cite en priorité celles-là. Un nom se construit par des mentions sur des sources indépendantes que les IA consultent ; ces mêmes mentions sont d’ailleurs ce que Wikipédia exige pour admettre une entreprise.
La voie praticable est donc de répondre, sur des pages que les IA lisent et citent, aux questions que se posent vos clients, et d’être mentionné là où ces questions sont traitées. Une page Wikipédia peut venir ensuite, si la presse suit ; elle ne précède pas la visibilité.
Ce que nous ne savons pas
Nos mesures portent sur l’API des modèles, pas sur l’interface de ChatGPT, de Claude ou de Gemini. Nous ne mesurons pas l’effet, pour une entreprise, d’avoir une page Wikipédia sur ses citations dans les IA ; aucune étude publiée que nous ayons lue ne le mesure non plus.
Sources
- Brown et al., OpenAI — « Language Models are Few-Shot Learners » (GPT-3), tableau 2.2, .
- Wikimedia Enterprise — partenaires annoncés pour les 25 ans de Wikipédia, .
- Profound, Nick Lafferty — « AI platform citation patterns », .
- Semrush, Luke Harsel — domaines les plus cités par les IA, .
- Wikipédia — Notoriété des entreprises, sociétés et produits, .
- Wikipédia — Contributions rémunérées, .
- Mesures FaireDuBruit, du 4 au 16 septembre 2026 — voir « Comment nous avons mesuré ».
Questions voisines
- Pourquoi être présent sur Reddit ne suffit pas pour être cité par les IA ?
- Une chaîne YouTube aide-t-elle à être cité par les IA ?
- Dans quel contexte mon entreprise est-elle recherchée dans les IA, et où dois-je apparaître ?
- Mon site internet suffit-il pour être visible dans les IA ?
Toutes les questions sur la visibilité dans les IA · Notre offre · Tester mon site