Quand un outil de suivi vous annonce que votre site a été « cité » dans une réponse générative, il compte presque toujours une chose précise : votre domaine figurait dans la liste de sources que le moteur a accrochée à sa réponse.
C'est une bonne nouvelle, mais elle vaut moins que ce que le mot laisse croire. Cette liste et le texte de la réponse sont deux objets distincts, et l'un contient beaucoup de pages dont l'autre ne fait rien.
Nous avons voulu chiffrer l'écart. Il est bien plus large que prévu.
Deux listes que l'on confond, celle du bas et celle des renvois
Une réponse de Perplexity se lit sur deux plans. Le texte porte des renvois chiffrés, ces petits numéros entre crochets qui rattachent une affirmation à une page précise. Et sous la réponse s'affiche une liste de sources, plus longue, que l'API renvoie dans un champ dédié.
L'intuition naturelle est que la seconde est la table des matières de la première. Elle ne l'est pas. La liste contient les pages que le moteur a rassemblées pour répondre ; les renvois désignent celles dont il s'est réellement servi pour écrire une phrase.
Fixons le vocabulaire tout de suite, parce que tout le reste de cet article en dépend. Une source est dite attachée quand elle figure dans la liste. Elle est dite citée quand au moins un renvoi du texte pointe vers elle. Une source citée est donc toujours attachée ; l'inverse est faux, et c'est tout le sujet.
Le relevé : douze marchés, une exécution, deux comptages
Nous avons posé douze questions d'achat françaises à Perplexity, une exécution chacune, via l'API DataForSEO sur le modèle sonar-pro avec recherche web active. Les appels se sont succédé entre 06 h 08 et 06 h 11 UTC le 17 septembre 2026, pour 0,1798 $ au total.
Les douze marchés ont été choisis pour ne se ressembler en rien : cuisine équipée, climatisation réversible, traiteur de séminaire, assurance pour animaux, garantie décennale d'une véranda, mobilier de bureau, imprimerie en ligne, coworking lyonnais, abonnement en salle de sport, école de commerce, logiciel de syndic, piscine enterrée. Quatre questions demandent un prestataire, quatre un produit ou une marque, deux un prix, deux un mécanisme.
Pour chaque réponse, nous avons relevé deux grandeurs : le nombre de sources attachées, et le nombre de ces sources portant au moins un renvoi dans le texte.
Un contrôle s'imposait avant tout calcul. Rien ne garantit a priori que le renvoi [14] désigne la quatorzième entrée de la liste. Nous l'avons vérifié sur deux phrases de la réponse sur le coworking, choisies parce qu'elles ne portent chacune qu'un seul renvoi. La première recommande « L'Ellipse Bellecour » pour une équipe de deux à quatre personnes et se termine sur [14] : la quatorzième source attachée est ellipse-lyon.fr/bureau-partage-lyon/, dont le titre affiché commence par « Bureau partagé Lyon Bellecour ». La seconde cite « Webup à 129 €/mois à Lyon 7 » et se termine sur [13] : la treizième source est webup.space, dont le titre affiché est « Espace de coworking à Lyon 7, 129€/mois, 24/7 - tout compris ». Le rang, l'enseigne et jusqu'au prix concordent. La numérotation suit bien l'ordre de la liste.
130 sources sur 238 ne portent aucun renvoi
Voici le relevé complet.
| Question | Sources attachées | Citées | Part citée |
|---|---|---|---|
| Marque de cuisine équipée | 20 | 7 | 35 % |
| Pose d'une climatisation réversible | 18 | 10 | 56 % |
| Traiteur de séminaire à Paris | 20 | 12 | 60 % |
| Assurance pour animaux | 20 | 10 | 50 % |
| Garantie décennale d'une véranda | 20 | 6 | 30 % |
| Mobilier de bureau pour une PME | 20 | 7 | 35 % |
| Imprimerie en ligne | 20 | 7 | 35 % |
| Coworking à Lyon | 20 | 7 | 35 % |
| Prix d'un abonnement en salle de sport | 20 | 11 | 55 % |
| École de commerce après une prépa | 20 | 13 | 65 % |
| Logiciel de gestion de copropriété | 20 | 8 | 40 % |
| Piscine enterrée | 20 | 10 | 50 % |
| Total | 238 | 108 | 45,4 % |
Cent trente pages sur 238 sont affichées sous une réponse sans qu'une seule phrase de cette réponse ne s'appuie sur elles. C'est 54,6 % du relevé, et aucune question ne descend sous 30 % de sources inutilisées.
L'écart entre les questions est lui-même instructif. La question sur les écoles de commerce utilise 13 de ses 20 sources, celle sur la garantie décennale 6. Une question à laquelle le web français répond mal ne produit pas moins de sources attachées : elle en produit autant, et en utilise moins.
Le comptage par hôte donne le même ordre de grandeur. Le relevé fait apparaître 191 hôtes distincts, dont 93 sont cités au moins une fois. Un peu moins d'un sur deux, là encore.
La première place vaut, la suite beaucoup moins
La liste étant ordonnée, on s'attend à ce que le rang prédise la citation. Il le fait, mais beaucoup moins nettement qu'on ne l'imagine.
La première place est la seule vraiment forte : elle est citée dix fois sur douze. Les deux exceptions sont digitiz.fr sur l'imprimerie et lyonsecret.com sur le coworking, deux pages de classement bien construites que le moteur attache en tête et n'utilise jamais.
Après ce premier rang, la pente s'aplatit d'un coup. Les rangs 1 à 10 rassemblent 63 citations sur 120 sources, soit 52 %. Les rangs 11 à 20 en rassemblent 45 sur 118, soit 38 %. Quatorze points d'écart sur dix rangs, c'est peu : le rang 16 est cité sept fois sur douze, le rang 7 quatre fois sur douze. Seuls les deux derniers rangs décrochent franchement, avec 5 citations pour 22 sources.
Autrement dit, la sélection ne se joue pas dans l'ordre de la liste. Elle se joue après, au moment où le modèle rédige, sur des critères que le rang ne reflète pas. C'est cohérent avec ce que nous avions mesuré en comparant le top 10 de Google et les sources d'une réponse IA : le premier résultat est un cas à part, et le reste du classement se comporte comme un stock indifférencié.
Quinze sources attachées n'ont aucun rapport avec la question
Voici la partie que nous n'avions pas anticipée. Parmi les 130 sources jamais citées, quinze ne traitent tout simplement pas du sujet de la question. Elles ont été attachées sur une ressemblance de mot.
Le cas le plus spectaculaire est la question sur la garantie décennale d'une véranda. Ses dix premières sources sont pertinentes : Service-Public, l'ANIL, un assureur de poseurs, un forum de construction. Les dix suivantes décrochent complètement, et sept d'entre elles sont des vidéos YouTube, dont un tutoriel de Planet Zoo, une partie de Sims 4 et une session de No Man's Sky. Le mot « construction » de la question a suffi. Les trois dernières de ce bloc sont une fiche de la librairie ADEME sur le réemploi des matériaux, une statistique ministérielle sur la construction de logements et un article sur le logement social.
Les autres cas sont isolés mais du même ordre. La question sur l'assurance pour animaux attache en vingtième position lacompagniedulit.com, un vendeur de matelas. La question sur le prix d'un abonnement en salle de sport se termine sur un article du Monde consacré au prix des carburants, servi en HTTP 402 derrière son péage. La question sur les logiciels de syndic attache deux publications de l'Astee sur l'assainissement et les eaux pluviales, rattrapées par le mot « gestion ». Et la question sur la piscine enterrée attache une vidéo de l'INA : Georges Brassens chantant « Supplique pour être enterré à la plage de Sète ».
Ces quinze pages existent, nous les avons toutes vérifiées en direct le jour du relevé. Elles ne sont pas des hallucinations, elles sont bien réelles, bien indexées, et elles n'ont rien à faire là. Un seizième cas, un mémento juridique des éditions Francis Lefebvre attaché à la question sur les logiciels de syndic, est trop discutable pour entrer dans le compte : c'est un livre sur la gestion immobilière, donc hors sujet pour qui cherche un logiciel, mais pas absurde.
Aucune de ces quinze pages n'est citée. Le filtre du moteur fonctionne. C'est justement ce qui rend le comptage des sources attachées trompeur : il additionne des pages retenues avec soin et des pages ramassées par accident, sans les distinguer.
Trois éditeurs apportent trois pages chacun et ne sont jamais cités
Un dernier calcul complète le tableau. Sur les 196 couples question-hôte du relevé, 28 apportent plus d'une page à la même réponse. Ces 28 hôtes totalisent 70 pages pour 30 citations, soit 43 %. Les couples à page unique sont à 46 %.
Apporter plusieurs pages ne déplace donc pas le taux de citation d'une page. Onze de ces 28 hôtes ne sont cités sur aucune de leurs pages, et le contraste entre les extrêmes est net. Sur la cuisine équipée, capital.fr fournit trois pages, aucune citée. Sur l'assurance pour animaux, lecomparateurassurance.com fournit trois pages, aucune citée. Sur les salles de sport, fitidia.com fournit trois pages, dont un comparatif millésimé 2026, aucune citée. À l'inverse, lafabriquedunet.fr fournit trois pages à la question sur les logiciels de syndic et les trois sont citées, et etudiant.lefigaro.fr en fournit quatre à la question sur les écoles de commerce, dont trois sont citées.
Détail utile pour qui reproduirait la manipulation : lafabriquedunet.fr répond 403 à une requête curl, derrière un mur applicatif. Le moteur cite pourtant trois de ses pages dans la même réponse. Un code d'erreur relevé en ligne de commande ne prouve rien sur ce que le moteur atteint, réserve que nous avions déjà rencontrée en relevant les fichiers robots.txt d'un secteur.
Ce que ça change dans la lecture d'un rapport de visibilité
Trois conséquences pratiques, dans l'ordre d'importance.
Demandez à votre outil laquelle des deux listes il compte. La plupart des plateformes de suivi lisent les sources attachées, parce que c'est ce que les API renvoient le plus facilement. Si votre rapport affiche une progression du nombre de citations, il peut s'agir d'une progression du nombre de fois où vous avez été ramassé dans un corpus, ce qui n'est pas la même chose et ne se transforme pas mécaniquement en visibilité. Les autres angles morts de ces outils sont détaillés dans notre comparatif des outils GEO.
Ne tirez rien d'une entrée en liste isolée. Sur ce relevé, être attaché à une réponse donne 45 % de chances de servir à une phrase. Une entrée unique, vue une fois, est à peine plus qu'un tirage à pile ou face, et elle se combine avec l'instabilité que nous avions mesurée en posant dix fois la même question. Il faut plusieurs exécutions pour que le chiffre veuille dire quelque chose.
Séparez les deux mesures dans votre suivi. La part de vos pages dans les sources attachées mesure votre présence dans le stock que le moteur rassemble, c'est-à-dire votre accessibilité et votre couverture de sujet. La part de vos pages dans les sources citées mesure votre utilité rédactionnelle, c'est-à-dire la capacité de vos pages à fournir une affirmation reprenable. Ce sont deux chantiers différents, et les confondre fait travailler sur le mauvais. Nous avions décrit la même bascule sous un autre angle en montrant que les moteurs citent rarement une page d'accueil.
Refaire le comptage sur vos propres questions
La manipulation ne demande ni outil ni budget particulier.
Prenez trois questions que vos acheteurs posent vraiment, et posez-les à Perplexity dans son interface. Pour chaque réponse, comptez les sources affichées sous le texte, puis comptez celles dont le numéro apparaît au moins une fois dans le texte. Le rapport des deux est votre taux d'utilisation. S'il ressemble au nôtre, la moitié de ce que le moteur rassemble sur votre marché ne sert à rien.
Cherchez ensuite votre domaine dans chacune des deux listes. Être dans la première et absente de la seconde est une situation fréquente et parfaitement lisible : vos pages sont accessibles et correctement rattachées au sujet, mais elles ne contiennent pas l'affirmation courte que le moteur pourrait reprendre. C'est un problème de rédaction, pas de technique, et il se traite en découpant vos pages en passages autonomes et citables.
Repérez enfin les sources manifestement hors sujet de chaque liste. Leur nombre vous dit à quel point votre marché est mal servi par le web français. Sur nos douze questions, celles qui en comptent le plus sont aussi celles qui utilisent le moins de sources.
Ce qu'il ne faut pas en conclure
Ce relevé porte sur un moteur, une exécution par question et douze marchés. Perplexity affiche ses sources de façon inhabituellement lisible, ce qui rend cette mesure possible ; rien ne dit qu'un autre moteur applique la même sélection, et nous avons déjà constaté que deux moteurs interrogés sur les mêmes questions ne partagent aucune source. Le taux de 45 % est celui de ce panel, pas une constante.
Une source non citée n'est pas forcément une source ignorée. Le modèle a pu la lire, y trouver une confirmation de ce qu'il écrivait par ailleurs, et ne pas juger utile d'y renvoyer. Nous mesurons ce qui est attribué, pas ce qui est lu. La distinction compte, et elle limite ce que l'on peut dire d'une page absente des renvois.
Le comptage des pages hors sujet reste un jugement. Nous avons retenu quinze cas où le décalage est indiscutable, une vidéo de jeu vidéo sur une question d'assurance construction, une chanson sur une question de piscine. Un lecteur plus strict en compterait davantage, en versant par exemple au même panier les articles sur l'électroménager attachés à la question sur les cuisines équipées. Les quinze sont nommés un par un dans cet article pour que chacun puisse refaire le compte à sa main.
Ce qu'il faut retenir
La liste de sources affichée sous une réponse générative et les pages réellement utilisées pour l'écrire sont deux ensembles très différents. Sur douze questions d'achat françaises, Perplexity a attaché 238 sources et n'en a utilisé que 108. La première place de la liste est citée dix fois sur douze ; au-delà, le rang ne prédit presque plus rien. Quinze pages attachées n'avaient aucun rapport avec la question, ramassées sur un mot commun, et aucune n'a été citée. Apporter plusieurs pages à une même réponse ne change pas vos chances : trois éditeurs en ont fourni trois chacun sans obtenir un seul renvoi.
La conséquence tient en une phrase. Entrer dans le corpus d'un moteur est un problème technique, en sortir sous forme de renvoi est un problème d'écriture, et un tableau de bord qui additionne les deux vous laisse sans savoir lequel traiter.
Savoir laquelle des deux listes vous manque sur vos propres requêtes, c'est l'objet d'un audit GEO : vingt à cinquante requêtes d'achat soumises à ChatGPT, Perplexity, Gemini et aux AI Overviews de Google, relevé répété, et la liste des domaines que les modèles citent effectivement sur vos requêtes. Nos fourchettes de prix disent ce que couvre chaque niveau, et à partir de quel moment il se justifie.