Docsbook
Aperçu

GEO — Optimisation pour les moteurs génératifs

Docsbook GEO est l’ensemble des signaux au niveau de la page qui aident un moteur génératif — Perplexity, la recherche ChatGPT, les aperçus IA de Google, Claude — à citer votre documentation et à vous attribuer la citation. Activez GEO dans l’onglet d’administration SEO / GEO, ou appelez update_geo via MCP, et chaque page de l’espace de travail les intégrera lors du prochain rendu. Cette fonctionnalité n’est pas limitée par le forfait : tous les forfaits l’incluent.

Le GEO vise à être cité dans une réponse générée. Ses deux voisins couvrent des surfaces différentes : le SEO concerne le classement dans une liste de liens bleus, tandis que l’AEO concerne les encadrés de réponse et les assistants vocaux, qui sont construits à partir des balises FAQPage et HowTo explicites.

Que fait réellement un moteur génératif de votre page ?#

Pas une seule chose : une chaîne de traitement, et chaque étape peut vous éliminer. Un robot d’exploration récupère la page. Un système de récupération évalue des passages, et non des documents entiers : Google décrit son système de classement des passages comme un système qui identifie « des sections individuelles ou “passages” d’une page web afin de mieux comprendre dans quelle mesure une page est pertinente pour une recherche » (Google Search Central, guide des systèmes de classement). Une poignée de sources retenues sont ensuite placées dans une fenêtre de contexte — la configuration de l’article GEO utilise « uniquement les 5 premières sources récupérées depuis le moteur de recherche Google pour chaque requête » (GEO, KDD 2024) — puis un modèle rédige une réponse à partir de celles-ci, en choisissant quoi citer et à qui attribuer le mérite.

Deux conséquences en découlent, et tout ce qui suit en dépend. Tout ce qui vous empêche d’être récupéré ou retrouvé rend la rédaction sans importance. Tout ce qui facilite l’extraction et l’attribution d’un passage récupéré est ce que le GEO peut réellement modifier.

Qu’est-ce que Docsbook ajoute à une page lorsque GEO est activé ?#

Trois éléments, tous visibles dans le code HTML de la page, ainsi que les conteneurs sémantiques qui les entourent.

Un bloc TL;DR après le H1#

Docsbook insère un bref résumé immédiatement après le H1 principal, rendu sous la forme de <aside class="tldr" role="note" aria-label="Summary">. Le texte est choisi dans l’ordre suivant :

  1. Un champ tldr: explicite dans le frontmatter de la page.
  2. Sinon, le premier véritable paragraphe du document. Les titres, citations, éléments de liste, blocs de code délimités et lignes composées uniquement d’images sont ignorés lors de sa recherche.

Quel que soit l’élément retenu, il est nettoyé avant d’être affiché : la syntaxe des liens, le code inline, les marqueurs d’emphase et les balises HTML brutes sont supprimés, et les espaces sont réduits. Le résultat est limité à 280 caractères, tronqué à la dernière limite entre les mots si cette limite se situe au-delà de la moitié, avec suppression de la ponctuation finale et ajout d’une seule ellipse.

Deux comportements méritent d’être connus, car ce sont eux qui empêchent le bloc de devenir inutile :

  • Un premier paragraphe de moins de 40 caractères ne produit aucun TL;DR. Un fragment vaut moins que rien.
  • Lorsque le TL;DR provient du paragraphe introductif, celui-ci est supprimé du corps du document. La même phrase n’apparaît jamais deux fois de suite ; lorsque le TL;DR provient du frontmatter, votre paragraphe d’ouverture reste exactement là où vous l’avez écrit.

Une date de dernière modification visible#

Avec GEO activé, une ligne indiquant Mis à jour le 25 mai 2026 est affichée à la fin de l’article, la date étant encapsulée dans un véritable élément <time dateTime="…"> afin qu’un analyseur obtienne la valeur machine ainsi que la valeur lisible par l’utilisateur. La date est celle du commit de la dernière modification du fichier dans votre dépôt, en prenant à défaut la date de l’auteur. Docsbook met en cache cette recherche pendant une heure et, si GitHub ne répond pas, la ligne est omise plutôt que devinée — une date erronée vaut moins qu’une date absente.

Le même historique des commits renseigne datePublished dans le JSON-LD, à partir du plus ancien des 100 derniers commits ayant modifié le fichier.

Un auteur Person dans le JSON-LD#

Chaque page contient un objet TechArticle. Sans GEO, son author est une référence au Organization de votre espace de travail. Lorsque GEO est activé, il devient une personne :

{
  "@type": "Person",
  "name": "Jane Doe",
  "url": "https://github.com/janedoe",
  "sameAs": ["https://github.com/janedoe"]
}

Le nom provient du frontmatter author: lorsque vous le définissez, sinon de l’auteur du dernier commit de ce fichier. url et sameAs sont renseignés à partir du frontmatter authorUrl: ou du profil GitHub de l’auteur, et sont simplement absents lorsqu’aucun des deux n’existe. S’il n’y a aucun nom provenant de l’une ou l’autre source, l’objet revient à la référence Organization plutôt que d’émettre un Person vide.

Conteneurs sémantiques#

Le corps est rendu à l’intérieur de <article>, et le bloc TL;DR contient role="note" ainsi qu’une étiquette accessible — lue aussi bien par les technologies d’assistance que par les analyseurs. Lorsque l’AEO est également activé, .tldr est le premier sélecteur de la spécification speakable de la page ; ainsi, le bloc qu’un modèle lit en premier est celui qu’un assistant vocal lit à voix haute.

Comment vérifier que GEO fait quelque chose ?#

Demandez à l’outil MCP audit_geo. Il n’exécute aucun modèle — chaque nombre qu’il contient provient d’une récupération — et ne peut donc pas inventer de résultat. En un seul appel, il :

  • lit votre robots.txt et le compare à sept agents assistants nommément désignés (une liste datée, actuellement à jour au 29/08/2026), en distinguant les agents d’indexation de recherche des robots d’exploration destinés à l’entraînement, car bloquer l’entraînement est une décision et bloquer l’agent d’indexation tout en espérant obtenir des citations est généralement accidentel ;
  • récupère chaque page échantillonnée deux fois dans la même minute — une fois comme un navigateur, une fois comme OAI-SearchBot — afin de détecter un CDN qui fournit une page à une personne et un défi à un assistant ;
  • vérifie que le texte principal est présent dans le HTML brut (au moins 200 mots, sans exécution de JavaScript) ;
  • vérifie si la page indique une date, quelle qu’elle soit ;
  • vérifie que /llms.txt, /llms-full.txt et /sitemap.xml existent.

Une sonde qui expire ou rencontre une erreur 404 est enregistrée comme null avec une raison, jamais comme un échec — une vérification inaccessible réduit le nombre de vérifications, pas votre score.

Pourquoi ces signaux et pas d’autres#

Règle Pourquoi le système se comporte ainsi Source
Faire en sorte que chaque section soit autonome La récupération évalue les passages, pas les pages Guide des systèmes de classement de Google
Ajouter des citations, des statistiques et des sources citées Il a été mesuré que cela augmente la part d’une réponse générée attribuée à une source. L’ajout de citations, la citation de sources et l’ajout de statistiques sont les trois meilleures méthodes de l’article, avec « une amélioration relative de 30 à 40 % selon la métrique Position-Adjusted Word Count » sur un benchmark de 10 000 requêtes, la meilleure méthode atteignant 41 % GEO, KDD 2024
Indiquer qui l’a écrit Google demande si les pages « comportent une signature, lorsqu’on pourrait s’y attendre » et « encourage fortement l’ajout d’informations exactes sur l’auteur » Créer du contenu utile
Utiliser Person avec un url qui identifie l’auteur Les recommandations de Google pour les articles indiquent : « Utilisez le type Person pour les personnes » et créez un lien vers « une page Web qui identifie de manière unique l’auteur » Données structurées pour les articles
Ne pas attendre un fichier magique « Il n’existe aucune exigence supplémentaire pour apparaître dans les aperçus IA ou le mode IA, ni aucune autre optimisation spéciale nécessaire » Fonctionnalités d’IA de Google
Ne pas truffer le texte de mots-clés Les mêmes fichiers de benchmark classent le bourrage de mots-clés parmi les méthodes « non performantes », avec un score inférieur à la référence non modifiée — et, sur un moteur actif, « 10 % moins bon que la référence » GEO, KDD 2024

Limites et questions ouvertes#

L’ampleur de ce changement est faible et conditionnelle. Une étude critique de 2026 portant sur 45 études GEO conclut que les gains fondamentaux sont « valables dans leur contexte expérimental, mais conditionnés à la présence préalable d’une source dans un contexte fixe », et qu’« aucune technique évaluée ne montre d’effet causal stable, longitudinal et interplateforme sur la découvrabilité organique ou le comportement en aval » (arXiv 2607.14035, période de novembre 2023 à juillet 2026). Docsbook ne vous indiquera pas de hausse du taux de citation, car aucune n’est établie.

La question reste ouverte : la fraîcheur augmente-t-elle le taux de citation ? Ce qui est vérifiable, c’est que Google utilise « divers systèmes de type “query deserves freshness” » pour le classement dans les résultats de recherche (guide des systèmes de classement), et qu’une page sans date ne donne à un modèle aucun élément auquel attribuer l’actualité. Ce qui n’est pas vérifiable, c’est l’affirmation courante selon laquelle une date visible augmente la fréquence à laquelle un assistant vous cite : aucune source primaire ne le mesure. Considérez la date comme une mesure d’hygiène, et non comme un levier, jusqu’à la publication de résultats.

Les réponses ne sont pas suffisamment stables pour être testées manuellement en A/B. Des audits indépendants résumés dans la même étude : Schulte et al. (2026), sur quatre moteurs et 45 jours, « observent des scores de Jaccard quotidiens au niveau des sources d’environ 0,34–0,42 » ; Kirsten et al. (2026), sur 4 706 requêtes aux États-Unis et en Allemagne, constatent que « le chevauchement des pages sur deux mois est de 18 % pour les AI Overviews, contre 45 % pour Google organique ». Effectuez une vérification plus d’une fois avant de croire à un succès ou à un échec.

Détails dépendants de la version. La date visible s’affiche en anglais américain (25 mai 2026), quelle que soit la langue de la page. datePublished est dérivé d’au plus 100 commits récents ayant modifié le fichier ; ainsi, pour une page très ancienne, il s’agit du commit le plus ancien de cette fenêtre, et non du tout premier. L’auteur extrait de git est la personne qui a modifié le fichier en dernier, ce qui peut être quelqu’un ayant simplement corrigé une faute de frappe — définissez explicitement author: lorsque le nom de l’auteur est important.

Le commutateur GEO n’atteint pas un domaine personnalisé. Les trois signaux de cette page sont émis par le chemin de rendu hébergé par Docsbook. Une page servie sur votre propre domaine n’obtient aucun bloc TL;DR, aucune ligne Updated visible, et un unique nœud TechArticle dont l’auteur est toujours un Person nommé d’après l’identifiant GitHub du propriétaire du dépôt — que GEO soit activé ou non, et indépendamment des métadonnées author:. Activer GEO ne change aujourd’hui rien de ce qu’un lecteur ou un robot d’exploration voit sur un domaine personnalisé. Consultez les limites du SEO pour le reste des différences.

Ce que GEO ne peut pas faire. Il ne permet pas d’indexer une page non indexée, ne débloque pas un robot d’exploration interdit par votre robots.txt, et ne rend pas lisible une page rendue côté client. Ce sont des problèmes de SEO, et audit_geo les signale comme critiques précisément pour cette raison.

L’activer#

  1. Ouvrez le panneau d’administration de votre espace de travail (FloatWidget) → onglet SEO / GEO.
  2. Activez GEO. Aucun verrouillage lié au forfait, aucune configuration page par page (tarifs).
  3. Ajoutez une ligne tldr: aux cinq pages que vous souhaitez le plus voir citées. Ces deux modifications constituent l’intégralité de la première étape.
  • Signaux de citation — les règles de rédaction, chacune accompagnée du comportement de récupération qui la justifie.
  • llms.txt — l’index machine du site, et ce que valent réellement ses éléments probants.
  • SEO — indexation, URL canoniques, sitemap : l’étape préalable avant que tout cela ait de l’importance.
  • AEO — les balises FAQPage, HowTo et speakable.
  • Chat IA — l’assistant qui répond sur votre propre site.
  • Comment Docsbook prouve ce qu’il affirme — la règle selon laquelle ces pages sont rédigées.

Updated

Cette page vous a-t-elle été utile ?