Peu de sujets GEO produisent autant de conseils contradictoires que les données structurées. D'un côté, des prestataires vendent du balisage schema.org comme le levier qui fera citer votre marque par ChatGPT. De l'autre, Google écrit noir sur blanc qu'aucun balisage particulier n'est requis pour apparaître dans ses réponses génératives. Les deux camps citent des sources réelles. La question mérite donc mieux qu'un avis : elle mérite qu'on regarde ce que les moteurs déclarent, ce que les mesures montrent, et ce qui reste vrai une fois les deux confrontés.

Ce que les moteurs déclarent, et ce qu'ils taisent

Google est explicite, et va plus loin que la simple neutralité. Sa documentation d'optimisation pour les fonctionnalités génératives, mise à jour le 10 juillet 2026, indique que « les données structurées ne sont pas requises pour la recherche générative, et qu'il n'existe pas de balisage schema.org particulier à ajouter ». Le même document range la « sur-concentration sur les données structurées » parmi les idées reçues à ignorer, aux côtés du fichier llms.txt et du découpage artificiel des contenus en blocs. Difficile d'être plus clair sur l'ordre des priorités.

Le même Google dit pourtant s'en servir en interne. L'ingénieur Ryan Levering, responsable en charge des données structurées, a expliqué au Search Central Live de Toronto en avril 2026 que le balisage est servi aux modèles comme contexte lors des fanouts, ces sous-requêtes que Google génère pour composer une réponse. Il n'y a pas de contradiction : le balisage alimente un pipeline qui fonctionne aussi sans lui, en s'appuyant sur l'extraction faite par le modèle depuis le HTML. Schema.org rend l'extraction plus fiable ; il ne conditionne pas l'éligibilité.

Microsoft tient la position inverse. Chez Bing, Fabrice Canel, qui pilote le crawl chez Bing, a confirmé publiquement que le balisage aide les modèles de Microsoft à comprendre les contenus pour Copilot. Cette divergence n'est pas anecdotique : Bing dispose d'un index plus petit que celui de Google et s'appuie davantage sur les signaux explicites que les éditeurs lui fournissent.

OpenAI, Anthropic et Perplexity, eux, n'ont rien publié sur le sujet. Aucun de ces trois acteurs n'a documenté l'usage qu'il fait, ou ne fait pas, du JSON-LD présent dans les pages qu'il récupère. Toute affirmation catégorique sur « le schema qui fait citer par ChatGPT » relève donc de l'inférence, pas de la source.

L'étude qui manquait au débat

Ahrefs a publié en 2026 la première mesure à grande échelle du phénomène. La méthode mérite d'être décrite, parce qu'elle explique la portée du résultat : 1 885 pages ayant ajouté du JSON-LD entre août 2025 et mars 2026, comparées à 4 000 pages témoins n'ayant rien changé, sur une fenêtre de 30 jours avant et après, en doubles différences pour neutraliser les tendances propres à chaque plateforme.

Surface Évolution des citations après ajout du balisage
Google AI Overviews −4,6 %
Google AI Mode +2,4 %
ChatGPT +2,2 %

Aucun gain. Les deux variations positives sont, de l'aveu même des auteurs, assez faibles pour n'être que du bruit statistique.

Reste à lire ce résultat correctement, car il porte une limite décisive : l'échantillon ne retenait que des pages déjà largement citées, avec plus d'une centaine de citations en AI Overviews au départ. L'étude démontre donc qu'ajouter du balisage à une page déjà reconnue ne la fait pas citer davantage. Elle ne dit rien du cas inverse, celui d'une page qu'aucun moteur n'a encore identifiée, ni d'une marque dont l'entité reste floue. Les auteurs le reconnaissent explicitement.

C'est exactement là que se situe l'intérêt résiduel du balisage.

Trois usages qui tiennent

La précision sur les faits que le modèle extrait mal vient en premier. Un prix, une date d'événement, une durée, une note moyenne, une disponibilité : ce sont les données que l'extraction en langage naturel rate le plus souvent, parce qu'elles sont sensibles au contexte et changent vite. Une page produit affichant « à partir de 49 € » avec trois variantes tarifaires est ambiguë pour un modèle, univoque pour un Offer correctement balisé. Le bénéfice n'est pas d'être cité plus souvent, c'est d'être cité juste. Une IA qui annonce un mauvais prix vous coûte plus cher qu'une IA silencieuse.

La désambiguïsation de l'entité est l'usage le plus sous-estimé. Un bloc Organization posé une fois, avec un @id stable, le nom légal, le logo et surtout les sameAs pointant vers vos profils vérifiables (page Wikipédia ou Wikidata si vous en avez une, LinkedIn, registre officiel, profils sectoriels) dit aux moteurs que ces identités dispersées désignent la même entreprise. Pour une marque au nom générique ou homonyme d'une autre, ce rattachement fait la différence entre être une entité reconnue et n'être qu'une chaîne de caractères. Les moteurs génératifs raisonnent sur des entités : le balisage est le moyen le plus direct de déclarer la vôtre.

L'éligibilité aux surfaces qui en dépendent encore ferme la liste. Copilot d'un côté, les résultats enrichis qui subsistent dans Google de l'autre : produits, avis, événements, recettes, vidéos, fil d'Ariane. Ces affichages n'ont rien de génératif, mais ils occupent la page de résultats et alimentent la notoriété que les modèles finissent par intégrer.

FAQPage : la fin d'une recette

Le balisage FAQPage a longtemps été le premier réflexe des prestations « contenu optimisé IA ». Il faut le dire clairement : cette recette est morte côté Google. La documentation officielle a reçu un avis de dépréciation le 7 mai 2026, les résultats enrichis correspondants ont cessé d'apparaître le même jour, le filtre d'apparence et le rapport dédié ont disparu de la Search Console en juin, et les appels à l'API qui remontaient ces données ont eu jusqu'en août pour être adaptés. HowTo avait suivi le même chemin dès 2023.

Que faire du balisage FAQ déjà en place ? Le laisser. Le type reste valide au sens de schema.org, il ne déclenche aucune pénalité, et rien n'indique que les autres systèmes de récupération cessent de le lire. En revanche, l'ajouter aujourd'hui en espérant un gain de visibilité, dans Google comme ailleurs, n'est appuyé par aucune donnée.

La nuance à retenir tient en une phrase : c'est le format question-réponse qui reste payant, pas la balise qui l'entoure. Une question posée en <h2> avec sa réponse complète dans le paragraphe suivant produit un passage autonome, réutilisable tel quel par un moteur génératif. C'est le mécanisme que nous détaillons dans notre guide de l'Answer Engine Optimization, et il fonctionne sans une ligne de JSON-LD.

Les types qui méritent votre temps

Type Ce qu'il déclare Pourquoi il compte
Organization L'identité de la marque, ses sameAs, son logo, ses coordonnées Le socle de l'entité, à poser une fois pour tout le site
Article + author L'auteur réel, sa fonction, la date de publication et de révision Rattache le contenu à une personne, et date les faits
Product / Offer Prix, devise, disponibilité, variantes Les données que l'extraction rate, et qui engagent votre responsabilité
LocalBusiness Adresse, horaires, zone desservie Indispensable dès qu'une requête a une dimension locale
BreadcrumbList La position de la page dans l'arborescence Aide à situer une page isolée dans un ensemble cohérent

Au-delà de cette liste, le rendement décroît vite. Baliser cinquante types différents sur un site dont aucune page ne répond franchement à une question ne produit rien.

Le socle minimal, en une fois

Voici la structure que nous posons par défaut sur la page d'accueil d'un site, et à laquelle les autres pages se rattachent par leur publisher :

{
  "@context": "https://schema.org",
  "@type": "Organization",
  "@id": "https://exemple.fr/#organization",
  "name": "Exemple",
  "legalName": "Exemple SAS",
  "url": "https://exemple.fr/",
  "logo": "https://exemple.fr/logo.png",
  "description": "Ce que fait l'entreprise, en une phrase factuelle.",
  "foundingDate": "2014",
  "sameAs": [
    "https://fr.wikipedia.org/wiki/Exemple",
    "https://www.wikidata.org/wiki/Q00000",
    "https://www.linkedin.com/company/exemple/"
  ]
}

Trois points de méthode comptent plus que le reste. Le @id doit être une URI stable, jamais modifiée : c'est elle qui permet aux autres blocs de pointer vers la même entité au lieu d'en créer des doublons. Les sameAs ne valent que s'ils mènent à des profils réellement contrôlés et cohérents entre eux ; trois liens vérifiables pèsent plus que quinze liens décoratifs. Et le bloc doit être identique d'une page à l'autre, sans variation de nom ou de logo selon les gabarits.

Les erreurs qui annulent le bénéfice

Quatre situations reviennent dans nos audits.

  • Le balisage injecté par JavaScript seul est le plus coûteux. Googlebot exécute le JS et finira par le voir ; les robots d'index de ChatGPT, de Perplexity et de Claude lisent le HTML servi et repartent. Pour eux, votre JSON-LD n'existe pas. C'est le même angle mort que celui décrit dans notre article sur les crawlers IA et le robots.txt, et il annule la totalité de l'effort hors de Google.
  • Le balisage qui contredit la page visible se retourne contre vous : un prix de 49 € dans le JSON-LD et de 79 € dans le HTML, une date de mise à jour avancée sans modification réelle du texte. Au mieux le moteur ignore le balisage, au pire il l'interprète comme un signal de mauvaise qualité.
  • Les entités dupliquées défont le travail de consolidation. Un Organization légèrement différent sur chaque gabarit, sans @id commun, produit plusieurs entités concurrentes là où vous vouliez n'en déclarer qu'une.
  • La validation oubliée laisse passer l'échec silencieux : un JSON-LD mal formé n'apparaît nulle part et ne provoque aucune alerte. Le test des résultats enrichis de Google et le validateur de schema.org prennent deux minutes, et se relancent après chaque refonte.

Où placer l'effort

Les données structurées sont une infrastructure d'entité, pas un levier de citation. Elles rendent vos faits lisibles sans ambiguïté et rattachent votre marque à une identité que les moteurs peuvent reconnaître ; elles ne compensent aucune des trois choses qui décident réellement d'une citation : l'accès des robots à vos pages, l'existence de passages qui répondent seuls à une question, et la présence de votre marque sur les sources tierces que les modèles recoupent.

L'arbitrage pratique tient donc en peu de mots. Posez le socle Organization et le balisage des faits sensibles : comptez une demi-journée sur un site standard, une fois pour toutes. Puis consacrez le reste du budget à la structure éditoriale et à l'autorité, qui sont les postes où se gagnent les citations, et dont nous détaillons la méthode dans notre page Generative Engine Optimization. Si vous cherchez à chiffrer ces chantiers, nos fourchettes de prix donnent les ordres de grandeur constatés en France.