Données structurées et entités
On lit partout que les données structurées sont « indispensables pour les IA ». Google écrit l'inverse pour ses propres fonctions d'IA, tout en recommandant de continuer à s'en servir. Les deux affirmations se réconcilient dès qu'on comprend ce qu'un balisage fait vraiment.

Parlons de votre projet
Un rappel sous 24 h ouvrées. Sans engagement.

Par Florian BourretGérant de Happiness, consultant SEOmis à jour le 3 octobre 2026
Ce que sont les données structurées
Les données structurées sont des informations ajoutées au code d'une page pour dire explicitement à une machine ce que la page contient : ceci est une entreprise, voici son adresse, ses horaires, son numéro de téléphone ; ceci est un article, écrit par telle personne, publié tel jour.
Le vocabulaire le plus utilisé s'appelle schema.org. Selon son propre site, il a été fondé par Google, Microsoft, Yahoo et Yandex. Google recommande de l'écrire au format JSON-LD, un bloc de code placé dans la page et invisible pour le lecteur. Il accepte aussi deux autres formats, Microdata et RDFa.
Un exemple, en mots plutôt qu'en code : « cette page décrit une entreprise appelée X, de type agence de communication, située à telle adresse à Pau, ouverte du lundi au vendredi de 9 h à 18 h, dont le site officiel est celui-ci et dont la page sur tel réseau est celle-là ».
Rien de ce qui est déclaré n'est nouveau pour un lecteur humain. L'information figure déjà sur la page. Le balisage la rend non ambiguë pour une machine.
Ce qu'est une entité
Le mot revient dans tous les discours sur le GEO, souvent sans définition.
Une entité, c'est une chose identifiable sans ambiguïté : une personne, une entreprise, un lieu, un produit, un événement. « Pau » est une chaîne de caractères ; la ville de Pau, préfecture des Pyrénées-Atlantiques, est une entité, distincte du mot catalan « pau », qui veut dire paix.
Google a formalisé cette approche en mai 2012 avec son Knowledge Graph. Le billet d'annonce, signé Amit Singhal le 16 mai 2012, résumait l'idée par une formule restée célèbre, « things, not strings » : des choses, pas des chaînes de caractères. Le graphe comptait alors plus de 500 millions d'objets et plus de 3,5 milliards de faits et de relations entre eux.
Pour une entreprise, être une entité reconnue veut dire que les systèmes savent relier son nom, son site, son adresse, sa fiche d'établissement et ses mentions ailleurs sur le web à une seule et même chose. C'est ce qui permet à un assistant de répondre « l'entreprise X, à Pau, fait ceci » plutôt que de confondre deux homonymes.
Ce que Google en dit pour ses fonctions d'IA
La position officielle tient en deux phrases, à lire ensemble.
Sur la page « AI features and your website », mise à jour le 10 décembre 2025, Google écrit qu'il n'y a pas de données structurées schema.org spéciales à ajouter pour apparaître dans les AI Overviews ou le mode IA. Son guide « Optimizing your website for generative AI features on Google Search », mis à jour le 10 juillet 2026, le répète : les données structurées ne sont pas requises pour la recherche générative.
Le même guide ajoute aussitôt que c'est une bonne idée de continuer à les utiliser. Et la page sur les fonctions d'IA range parmi les bonnes pratiques le fait de garder des données structurées cohérentes avec le texte visible.
Ma lecture : le balisage n'ouvre aucune porte secrète vers les aperçus IA. Il garde son rôle habituel (résultats enrichis, compréhension des pages) et il réduit le risque de confusion sur qui vous êtes. C'est utile, ce n'est pas magique.
Pour ChatGPT, Perplexity et Copilot, je n'ai trouvé aucune documentation officielle qui dise comment leurs systèmes utilisent les données structurées. Tout ce qui se dit à ce sujet relève de l'observation ou de la supposition. Je préfère l'écrire que de prétendre le contraire.
Les types utiles à une PME
La liste des types schema.org compte des centaines d'entrées. Une petite entreprise en utilise rarement plus de cinq.
| Type | Où le placer | Ce qu'il déclare |
|---|---|---|
| Organization ou LocalBusiness | Page d'accueil, page contact | Nom, adresse, téléphone, horaires, zone desservie, logo, profils officiels |
| Person | Page auteur ou page équipe | Nom, fonction, liens vers ses profils |
| Article | Pages de contenu signées | Titre, auteur, date de publication, date de mise à jour |
| BreadcrumbList | Toutes les pages | La position de la page dans l'arborescence |
| Product et Offer | Fiches produit | Nom, prix, disponibilité |
Deux propriétés méritent une attention particulière pour le GEO.
sameAs liste les autres adresses officielles qui parlent de la même entité : la fiche d'établissement, la page sur un réseau professionnel, une fiche dans un annuaire reconnu. C'est la façon la plus directe de dire « ces pages et ce site, c'est la même entreprise ».
dateModified, sur un article, indique la dernière mise à jour. Un système qui doit choisir entre deux pages sur un sujet qui bouge a une raison de préférer celle qui dit quand elle a été vérifiée. À condition, évidemment, que la date corresponde à une vraie relecture.
Les règles à respecter
Google publie des règles générales pour les données structurées, mises à jour le 10 juillet 2026. Trois points reviennent dans tous les sites que j'ai vus mal balisés.
Ne pas baliser ce que le lecteur ne voit pas. La règle de Google est explicite : si le balisage décrit quelque chose, le corps de la page doit décrire la même chose. Déclarer des avis qui n'apparaissent nulle part, ou une zone de chalandise plus large que celle annoncée dans le texte, entre dans ce cas.
Accepter qu'un balisage correct ne garantit rien. Google écrit qu'il ne garantit pas l'affichage des données structurées dans les résultats, même quand l'outil de test les valide.
Savoir que l'abus se sanctionne. Toujours selon Google, un problème de données structurées peut entraîner une action manuelle, qui fait perdre à la page son éligibilité aux résultats enrichis.
La cohérence compte plus que le code
C'est le point qui m'a le plus surpris quand j'ai commencé à regarder des entreprises du Béarn sous cet angle. Le balisage était parfois impeccable. Ce qui clochait, c'était le reste.
- Une adresse différente sur le site, sur la fiche d'établissement et dans un annuaire, parce que l'entreprise avait déménagé et n'avait corrigé qu'un des trois.
- Un nom commercial sur le site et une raison sociale sur la fiche, sans rien qui relie les deux.
- Des horaires d'été restés en ligne en novembre.
- Une activité décrite comme « agence web » sur une page, « studio graphique » sur une autre, « conseil en communication » sur la fiche.
Un assistant qui croise ces sources a deux options : choisir, ou se tromper. Les données structurées ne corrigent pas cette incohérence, elles la rendent seulement plus visible. La première étape d'un travail sur l'entité d'une entreprise consiste donc à aligner les informations partout où elles apparaissent, avant d'écrire la moindre ligne de JSON-LD.
Comment vérifier son balisage
Deux outils gratuits suffisent.
Le test des résultats enrichis de Google indique si une page est éligible aux résultats enrichis que Google sait afficher, et signale les erreurs bloquantes. Il ne valide que les types que Google utilise.
Le validateur de schema.org vérifie la syntaxe de tous les types du vocabulaire, y compris ceux que Google n'affiche pas. Il dit si le code est correct, pas s'il est utile.
Dans la Search Console, les rapports « Améliorations » listent les types détectés sur le site et les erreurs par page. C'est là qu'on voit qu'un modèle de page a cassé le balisage de deux cents fiches d'un coup.
Ce que je regarde en plus, à la main : que l'adresse, le téléphone et les horaires déclarés soient exactement ceux affichés sur la page, au caractère près.
Ce qui rate
- Ajouter un balisage FAQ ou avis sur des pages qui n'ont ni FAQ ni avis visibles.
- Installer une extension qui génère un balisage automatique, puis ne jamais vérifier ce qu'elle déclare.
- Déclarer la même entreprise avec deux noms ou deux adresses selon les pages.
- Remplir sameAs avec des profils abandonnés ou des annuaires douteux.
- Attendre du balisage qu'il compense une page qui ne dit pas clairement ce que fait l'entreprise.
Où cela se place dans le GEO
Les données structurées servent la troisième des quatre conditions décrites sur la page GEO et visibilité dans les IA : être compris. Elles viennent après l'accès des robots, traité dans référencement IA, assistant par assistant, et avant la qualité des contenus. Elles ne remplacent pas non plus un fichier que certains présentent comme leur équivalent pour les IA, le llms.txt, dont le statut est très différent.
Sources
- Fondateurs de schema.org : schema.org, page « About », consultée le 3 octobre 2026.
- Knowledge Graph, « things, not strings », 500 millions d'objets et 3,5 milliards de faits : blog officiel de Google, billet d'Amit Singhal du 16 mai 2012.
- Absence de balisage spécial pour les fonctions d'IA, cohérence avec le texte visible : Google Search Central, « AI features and your website », mise à jour du 10 décembre 2025.
- Données structurées non requises mais recommandées : Google Search Central, « Optimizing your website for generative AI features on Google Search », mise à jour du 10 juillet 2026.
- Règles générales, formats, absence de garantie, actions manuelles : Google Search Central, règles générales relatives aux données structurées, mise à jour du 10 juillet 2026.
- Volumes de recherche (« données structurées » environ 590 recherches mensuelles, « knowledge graph » 1 600) : mesure propre au projet, DataForSEO, France, 3 octobre 2026.
Dans le même cocon
On remonte à la page mère, puis on passe à la page sœur suivante. Aucun lien direct vers un autre cocon.
Questions fréquentes
Les données structurées sont-elles nécessaires pour apparaître dans les AI Overviews ?
Non, selon Google, qui écrit qu'il n'y a pas de balisage schema.org spécial à ajouter pour ses fonctions d'IA. Le même guide recommande toutefois de continuer à utiliser les données structurées, en les gardant cohérentes avec le texte visible de la page.
Qu'est-ce qu'une entité en SEO ?
C'est une chose identifiable sans ambiguïté, comme une entreprise, une personne ou un lieu. Google a formalisé cette approche en 2012 avec son Knowledge Graph. Pour une entreprise, il s'agit que son nom, son site, son adresse et ses profils soient reliés à une seule et même identité.
Quel format choisir pour les données structurées ?
Google recommande JSON-LD, un bloc de code placé dans la page, et accepte aussi Microdata et RDFa. JSON-LD est le plus simple à maintenir parce qu'il ne se mélange pas au texte de la page.
Les données structurées garantissent-elles un résultat enrichi ?
Non. Google écrit qu'il ne garantit pas l'affichage des données structurées dans les résultats, même quand elles sont valides. Un balisage abusif peut au contraire faire perdre l'éligibilité aux résultats enrichis.
ChatGPT lit-il les données structurées ?
OpenAI ne publie pas de documentation sur ce point, pas plus que Perplexity. Ce qui se dit à ce sujet relève de l'observation. Ce qui est certain, c'est que des informations cohérentes d'une source à l'autre réduisent le risque de confusion.