Une équipe marketing peut réécrire chaque page de son site, ouvrir son robots.txt aux robots d'IA, baliser proprement, et constater six mois plus tard que ChatGPT recommande toujours trois concurrents sans jamais la mentionner. La cause est presque toujours la même, et elle est structurelle : une part importante de ce qu'un moteur génératif dit d'une marque provient de pages que cette marque ne possède pas. Un fil de forum, une fiche de comparateur, un article de presse, une page d'encyclopédie. Le GEO ne s'arrête pas au périmètre de votre nom de domaine, et c'est la partie du travail que l'on découvre en dernier.

Ce que pèsent réellement les sources que vous ne contrôlez pas

Les études publiées depuis fin 2025 convergent sur un ordre de grandeur, même si les méthodologies diffèrent : les sources détenues par les marques et les sources tierces se partagent le terrain à peu près à égalité.

Une analyse d'Otterly.ai publiée en février 2026, portant sur plus d'un million de citations, situe la part des plateformes communautaires à 52,5 % contre 47,5 % pour les domaines de marque, avec un écart considérable selon le moteur : Perplexity ne consacre que 28,9 % de ses citations à des sites de marque, là où les AI Overviews de Google montent à 59,8 %. Une étude Yext d'octobre 2025 découpe autrement le même gâteau et arrive à une conclusion plus encourageante : 44 % de sites de marque et 42 % de fiches et d'annuaires, soit 86 % de sources sur lesquelles une entreprise peut agir, directement ou indirectement. Son périmètre est toutefois plus étroit, centré sur des requêtes à intention locale et commerciale dans quatre secteurs, ce qui explique une part de fiches nettement supérieure à celle qu'on observe sur des questions générales.

Retenez le principe plutôt que la décimale. Environ une citation sur deux échappe à votre site, et parmi celles-ci, une bonne moitié provient de supports où vous pouvez intervenir sans les posséder. C'est très différent d'un facteur subi.

Chaque moteur puise dans un écosystème différent

L'erreur suivante consiste à traiter « les IA » comme un bloc. Les relevés d'Ahrefs Brand Radar publiés en juin 2026 et repris en France par le Blog du Modérateur montrent des profils qui n'ont presque rien en commun.

Moteur Trois domaines les plus cités Ce que cela dit de sa logique
Google AI Overviews YouTube 20,9 %, Reddit 19,6 %, Facebook 11,6 % Forte dépendance à la vidéo et au contenu social
Gemini Reddit 27,5 %, YouTube 13,7 %, Wikipédia 12,7 % Priorité à l'avis vécu et à la discussion
Perplexity YouTube 32,4 %, Reddit 16,6 %, Wikipédia 8,2 % Recherche de démonstration et de tutoriel
Microsoft Copilot Amazon 14,6 %, Walmart 10,2 %, Wikipédia 9,6 % Orientation transactionnelle et catalogue produit
Grok Reddit 16,3 %, YouTube 15,1 %, Facebook 13,9 % Ancrage dans les plateformes sociales

Les têtes de classement ne se ressemblent pas, et l'écart d'amplitude compte autant que l'ordre : le premier domaine de Perplexity capte près d'un tiers de ses citations, celui de Copilot à peine un septième. Élargi aux dix premières places, le relevé ne fait apparaître que trois domaines communs à tous les moteurs, Reddit, YouTube et Wikipédia. Tout le reste diverge. Une marque très présente sur les comparateurs produits sera visible dans Copilot et absente de Gemini ; une marque dont la communauté discute sur les forums vivra l'inverse.

La conséquence pratique est simple : la carte des sources se dresse par moteur, en fonction de celui qui compte pour votre activité. Un éditeur de logiciel B2B dont les acheteurs utilisent ChatGPT ne travaille pas les mêmes supports qu'une marque grand public dont les clients passent par Copilot au moment d'acheter. Notre article sur la manière de mesurer sa visibilité IA détaille comment identifier les moteurs qui pèsent réellement dans votre cas plutôt que de les traiter tous à parité.

Les quatre familles de sources tierces

Les pages de référence

Wikipédia, Wikidata, les bases sectorielles, les registres officiels. Ce sont les sources que les modèles considèrent comme neutres, et elles servent souvent de socle factuel : c'est là que le moteur va chercher ce qu'est votre entreprise, depuis quand elle existe, ce qu'elle vend.

Leur particularité est d'être défensives avant d'être offensives. Une page Wikipédia n'arrive pas parce qu'on la veut : les critères d'admissibilité exigent des sources secondaires indépendantes et suffisamment nombreuses, et une page rédigée par l'entreprise elle-même est signalée pour conflit d'intérêts, puis supprimée si elle ne franchit pas cette barre ou si elle est jugée promotionnelle. En revanche, quand des données publiques existent déjà sur vous, greffe d'entreprise, bases sectorielles, annuaires officiels, vérifier qu'elles sont exactes et à jour est un travail rapide et rentable, parce qu'une erreur y séjourne longtemps et se propage.

Les communautés

Reddit d'abord, mais aussi les forums métier, les espaces de questions-réponses, les groupes professionnels. C'est la famille la plus citée en volume et la plus délicate à aborder.

Ce que les moteurs y cherchent est précisément ce que le marketing ne sait pas produire : un jugement non sollicité, avec ses réserves. Un fil où trois utilisateurs comparent des solutions en signalant les défauts de chacune a plus de valeur, pour un modèle, que dix pages de landing. D'où la tentation, et le piège, que nous traitons plus bas.

L'approche qui fonctionne est lente : la participation réelle de personnes identifiées de l'entreprise, sur des sujets qu'elles maîtrisent, sans lien systématique. Elle produit des mentions au bout de plusieurs mois, pas de semaines.

Les comparateurs, annuaires et places de marché

Fiches de comparateurs sectoriels, plateformes d'avis, annuaires professionnels, catalogues de distributeurs. C'est la famille la plus sous-exploitée en France, alors qu'elle présente deux avantages rares : les fiches sont modifiables par la marque, et leur structure, tableau de caractéristiques, note, catégorie, correspond exactement à ce qu'un moteur sait réutiliser.

C'est ici que se logent les 42 % de « fiches et annuaires » de l'étude Yext. Une fiche incomplète, une catégorie mal choisie ou un tarif obsolète ne sont pas des détails : ils constituent la réponse que le moteur donnera à votre place.

La presse et la vidéo

Les articles de médias, les publications spécialisées, les chaînes YouTube. La vidéo mérite une mention particulière au vu des chiffres ci-dessus : YouTube est le premier domaine cité dans les AI Overviews comme dans Perplexity, ce qui en fait une source majeure très rarement intégrée à un plan GEO français.

Sur la presse, une nuance s'impose. Le relevé de Semrush cité plus bas identifie PRnewswire, Forbes et Medium parmi les domaines dont les citations ont le plus progressé chez ChatGPT sur la période observée. Cela ne fait pas du communiqué de presse en masse une stratégie : cela indique que les moteurs accordent du poids aux supports où une information est datée, attribuée et reprise. Un communiqué qui n'apporte aucun fait nouveau ne sera pas repris parce qu'il est diffusé sur le bon canal.

Ce qui ne marche pas, et pourquoi

Trois raccourcis reviennent dès qu'une équipe comprend le poids des sources tierces.

Poster soi-même sur les forums en se faisant passer pour un utilisateur. Outre le risque réputationnel évident, la mécanique ne tient pas : les communautés détectent et suppriment ces contributions, les comptes sont bannis, et le fil disparaît avec la citation espérée. Une plateforme dont les modérateurs nettoient l'astroturfing produit un contenu périssable.

Acheter des avis. Même problème avec une exposition juridique en plus. En France, la publication de faux avis relève des pratiques commerciales trompeuses et est sanctionnée par le code de la consommation.

Multiplier les fiches sur des annuaires sans audience. Les moteurs ne comptent pas les mentions, ils s'appuient sur des sources qu'ils rencontrent souvent et jugent fiables. Quinze annuaires génériques ne remplacent pas une fiche complète sur le comparateur de référence de votre secteur.

Le point commun de ces trois raccourcis est de traiter la citation comme un volume à produire, alors que les moteurs la traitent comme un signal de convergence : ils reprennent ce que plusieurs sources indépendantes disent de la même façon.

Une exposition instable, à ne pas surinterpréter

Une prudence s'impose avant de bâtir un plan entier sur une plateforme. L'étude de Semrush portant sur 230 000 prompts et plus de 100 millions de citations sur treize semaines a documenté un basculement spectaculaire : en septembre 2025, la part des réponses de ChatGPT citant Reddit est passée d'environ 60 % à près de 10 % en quelques semaines. Wikipédia a subi le même sort sur le même moteur, chutant d'environ 55 % à moins de 20 % des réponses. Ni l'un ni l'autre n'a bougé sur les autres plateformes.

Aucun signal éditorial n'explique cela : c'est un arbitrage interne d'OpenAI, que le responsable de la visibilité IA chez Semrush attribue à une volonté de réduire la sur-citation de certains domaines. La leçon est double. Une marque qui aurait tout misé sur Reddit aurait vu sa visibilité ChatGPT s'effondrer sans avoir rien changé. Et une baisse de citations n'est pas toujours de votre fait, ce qui rend indispensable de suivre l'évolution des domaines cités et pas seulement la vôtre. L'instabilité intrinsèque des relevés, et la façon de la neutraliser, sont détaillées dans notre article sur la mesure de la visibilité IA.

Par où commencer : l'audit des sources concurrentes

La bonne porte d'entrée n'est pas de choisir des plateformes a priori, mais de regarder celles que le moteur utilise déjà sur votre marché.

  • Constituez un panel de questions de catégorie, celles où l'acheteur ne vous connaît pas encore : « quelle solution pour tel besoin », « meilleur prestataire pour tel usage », « alternatives à tel acteur ». Une vingtaine suffit pour démarrer.
  • Posez-les à chaque moteur qui compte pour vous, et relevez les sources citées, pas seulement les marques. C'est la colonne que tout le monde oublie, et c'est la seule qui indique où agir.
  • Classez ces sources dans les quatre familles. La répartition obtenue est votre carte : si 60 % des citations de votre catégorie viennent de deux comparateurs sectoriels, la priorité est écrite.
  • Distinguez ce qui est modifiable de ce qui ne l'est pas. Une fiche de comparateur se corrige dans la semaine ; une présence communautaire se construit en trimestres. Traitez les deux, dans cet ordre.
  • Vérifiez l'exactitude avant l'ampleur. Un tarif obsolète ou une gamme périmée sur une source très citée fait plus de dégâts qu'une absence, parce que le moteur la reprendra avec assurance.

Ce travail hors site ne remplace pas le vôtre. Un moteur qui entend parler de vous ailleurs ira vérifier sur votre site, et il faut qu'il puisse y accéder et y trouver des passages réutilisables : c'est l'objet de nos articles sur les crawlers IA à autoriser et sur les leviers de l'Answer Engine Optimization. Les deux chantiers se renforcent, et l'un sans l'autre plafonne vite.

Ce qu'il faut retenir

Le GEO ressemble davantage à des relations publiques qu'à du référencement technique dès qu'on dépasse les premiers réglages. La moitié du terrain se trouve sur des pages que vous ne publiez pas, réparties en quatre familles dont le poids varie fortement d'un moteur à l'autre, et dont une partie, les fiches et annuaires, est directement modifiable sans rien demander à personne.

Trois principes tiennent l'ensemble. Commencez par l'exactitude de ce qui existe déjà sur vous, avant de chercher à créer des mentions. Choisissez vos supports d'après ce que les moteurs citent réellement sur votre catégorie, pas d'après une liste de bonnes pratiques. Et ne concentrez jamais votre exposition sur une plateforme unique, parce qu'un arbitrage que vous ne contrôlez pas peut la faire disparaître des réponses en six semaines.

Pour la déclinaison par moteur, voyez notre méthode pour être cité par ChatGPT, la logique propre au référencement Perplexity et le fonctionnement des AI Overviews de Google. Si vous cherchez à chiffrer ce type de chantier, nos fourchettes de prix donnent les ordres de grandeur.