AEO

AEO : comment être cité par ChatGPT, Gemini et Perplexity

Être cité par un moteur de réponse ne relève ni de la magie ni d'une astuce cachée. Voici ce qui compte vraiment, moteur par moteur, et comment le vérifier sur des réponses réelles plutôt que sur des impressions.

  • AEO
  • ChatGPT
  • Gemini
  • Perplexity
  • Claude
  • robots.txt

En bref

Pour être cité par ChatGPT, Gemini ou Perplexity, il faut d'abord que leurs robots puissent lire vos pages, puis que ces pages répondent clairement à de vraies questions, dès la première phrase. Ajoutez une entité sans ambiguïté (un seul nom, des faits cohérents), des sources vérifiables et une présence sur les sites que ces moteurs citent déjà. Enfin, mesurez sur des réponses réelles, répétées dans le temps, et non sur une capture d'écran isolée.

Sur cette page
  1. Ce que fait un moteur de réponse
  2. Les réponses appuyées sur une recherche web
  3. Les réponses tirées des connaissances du modèle
  4. Laisser entrer les bons robots
  5. Écrire des pages qui répondent d'abord
  6. Une entité claire et cohérente
  7. Du contenu qui mérite d'être cité
  8. Être présent là où les moteurs puisent
  9. llms.txt et balisage : ce qu'il faut en attendre
  10. Mesurer sur des réponses réelles
  11. Une méthode en cinq étapes
  12. Questions fréquentes

Ce que fait un moteur de réponse

Un moteur de réponse ne renvoie pas une liste de dix liens : il rédige une réponse. Votre marque y figure — nommée, recommandée, ou citée avec un lien vers votre page — ou elle n'y figure pas. L'Answer Engine Optimization (AEO) regroupe tout ce qui augmente vos chances d'être dans cette réponse. Ce n'est pas une discipline séparée du SEO : c'est le SEO appliqué à une interface qui résume au lieu de lister.

Pour agir au bon endroit, il faut distinguer deux familles de réponses, car elles ne puisent pas leurs informations au même endroit.

Les réponses appuyées sur une recherche web

Certaines réponses s'appuient sur une recherche menée au moment de la question. Perplexity interroge le web et lie ses sources ; les fonctions de recherche de ChatGPT s'appuient sur les pages que lit le robot OAI-SearchBot ; les Aperçus IA et le mode IA de Google s'appuient sur l'index de Google Search. Google décrit deux techniques : la génération augmentée par récupération (RAG), qui retrouve des pages de l'index pour fonder la réponse, et le query fan-out, qui lance plusieurs recherches connexes pour couvrir les sous-thèmes (guide d'optimisation IA de Google).

Pour cette famille, la règle est simple : une page que le moteur ne peut pas lire ou ne classe pas bien ne peut pas être citée. Les fondamentaux du SEO s'appliquent directement.

Les réponses tirées des connaissances du modèle

D'autres réponses viennent de ce que le modèle a appris pendant son entraînement, sans recherche au moment de la question. Votre présence y dépend de ce qui a été publié sur vous, chez vous et ailleurs, avant la date de ses connaissances. Une page publiée hier n'y pèse pas encore. C'est ici que la cohérence de votre entité et votre présence dans des sources tierces comptent le plus.

FamilleD'où vient l'informationLevier principal
Réponse appuyée sur une recherchePages trouvées et lues au moment de la questionAccès des robots, pages bien classées qui répondent
Réponse du modèleCe que le modèle a appris avant sa date de connaissanceEntité cohérente, présence durable dans des sources tierces

Laisser entrer les bons robots

Première vérification, et la plus souvent oubliée : votre robots.txt, votre CDN ou votre pare-feu bloquent-ils les robots des moteurs de réponse ? Les éditeurs publient la liste de leurs agents et leur rôle ; il faut la lire, car chaque agent correspond à une décision distincte.

  • OpenAI distingue OAI-SearchBot, utilisé pour faire apparaître des sites dans les fonctions de recherche de ChatGPT, et GPTBot, qui explore du contenu pouvant servir à l'entraînement de ses modèles. Les deux réglages sont indépendants : on peut autoriser l'un et bloquer l'autre. OpenAI indique qu'un changement de robots.txt peut prendre environ 24 heures à être pris en compte (robots d'OpenAI).
  • Perplexity indique que PerplexityBot sert à faire apparaître et lier des sites dans ses résultats, et qu'il n'est pas utilisé pour entraîner des modèles de fondation. Perplexity-User agit à la demande d'un utilisateur et, pour cette raison, ignore en général les règles du robots.txt (robots de Perplexity).
  • Google : les Aperçus IA et le mode IA passent par Googlebot et l'index de Search. Pour y figurer comme lien, une page doit être indexée et éligible à un extrait ; il n'y a pas d'exigence technique supplémentaire (les fonctions IA et votre site).
# Answer engines that search the web: allowed
User-agent: OAI-SearchBot
Allow: /

User-agent: PerplexityBot
Allow: /

# Training crawler: an independent decision
User-agent: GPTBot
Allow: /

Dans NeoRank, la vue Directives robots lit votre robots.txt en direct pour huit robots d'IA, et le simulateur teste un chemin précis. Le détail est dans la documentation sur l'accès des robots d'IA.

Écrire des pages qui répondent d'abord

Un moteur réutilise plus volontiers un passage qui se suffit à lui-même. Concrètement :

  • La réponse en premier. Une ou deux phrases qui répondent complètement, puis le détail, les nuances et les exceptions.
  • Des intertitres formulés comme les questions de vos clients, avec la réponse juste en dessous.
  • Des listes numérotées pour les procédures, des tableaux pour les comparaisons. La structure rend chaque élément extractible.
  • Des passages autonomes : évitez « comme vu plus haut ». Chaque section doit se comprendre seule.

Google rappelle toutefois qu'il n'est pas nécessaire de découper artificiellement un contenu en petits morceaux ni de réécrire pour l'IA : ses systèmes comprennent une page qui traite plusieurs sujets. La structure sert d'abord le lecteur ; elle aide aussi les moteurs. Les blocs de réponse directe détaillent ce que NeoRank relève sur chaque page explorée.

Une entité claire et cohérente

Un moteur ne peut recommander que ce qu'il identifie sans ambiguïté. Si votre marque s'écrit de trois façons, si votre offre est décrite différemment sur votre site et sur vos profils externes, la réponse le reflétera.

  • Utilisez le même nom partout : titre, données structurées, mentions légales, profils externes.
  • Dites en une phrase ce que vous faites, pour qui et où, sur l'accueil et la page À propos.
  • Décrivez l'organisation en JSON-LD de type Organization, avec sameAs vers vos profils officiels. Notre guide JSON-LD montre comment.

Du contenu qui mérite d'être cité

Google l'écrit sans détour dans son guide d'optimisation pour l'IA : un contenu unique, utile et fondé sur une expérience réelle pèsera probablement davantage sur votre présence dans la recherche générative que toutes ses autres recommandations. Un résumé de ce qui existe déjà n'apporte rien qu'un modèle ne sache produire ; voir aussi son guide du contenu utile, fiable et centré sur les personnes.

  • Appuyez vos affirmations sur des faits datés et des sources nommées.
  • Publiez ce que vous seul savez : méthode, retours d'expérience, conditions, limites.
  • Tenez à jour les faits qui décident : conditions, zones servies, délais, intégrations.

Être présent là où les moteurs puisent

Les moteurs citent aussi des sites tiers : publications, annuaires, comparatifs, forums. Repérer ceux qui sont cités sur vos questions sans votre site vous dit où une mention légitime vous ferait entrer dans la réponse. Mais Google prévient : rechercher des mentions inauthentiques n'est pas aussi utile qu'il y paraît, car ses systèmes privilégient le contenu de qualité et bloquent le spam. Visez de vraies mentions, méritées.

llms.txt et balisage : ce qu'il faut en attendre

Le fichier /llms.txt est une proposition de convention : un fichier Markdown qui présente le site et ses pages clés aux modèles de langage. Google précise que Google Search ne l'utilise pas : il ne nuit ni n'aide au classement, et il n'existe pas de balisage schema.org spécial pour les fonctions IA. Il reste acceptable de le publier pour d'autres services qui le lisent. Traitez-le comme un complément, jamais comme un levier garanti.

Mesurer sur des réponses réelles

La seule mesure honnête consiste à poser de vraies questions aux moteurs, à enregistrer les réponses et à y chercher votre marque. C'est ce que NeoRank appelle une observation : chaque question suivie est posée à chaque moteur vérifié, et chaque réponse est conservée.

  • Mention : votre nom ou votre domaine apparaît dans le texte de la réponse.
  • Citation : une URL de votre domaine est écrite dans la réponse. Elle est rapprochée par domaine, pas vérifiée page par page (mentions et citations).
  • Part de voix : vos mentions divisées par vos mentions plus celles des concurrents suivis, sur les trois dernières exécutions. Sans concurrent suivi, elle vaut 100 dès que vous êtes nommé : elle n'est alors pas comparative (part de voix).

Les Aperçus IA de Google ne sont pas interrogés par NeoRank, faute d'API : leur mesure est détaillée dans notre article sur ce que l'on peut mesurer des Aperçus IA.

Une méthode en cinq étapes

  1. Suivez 10 à 25 questions réelles : marque, catégorie (« quel outil pour… »), comparaisons, objections (suivre une question).
  2. Lancez une observation et notez, pour chaque question, qui est cité à votre place et avec quelle page.
  3. Ouvrez la résolution des questions où vous n'êtes pas cité : la page citée à votre place montre le contenu attendu.
  4. Corrigez : accès des robots, page qui répond, entité, sources tierces.
  5. Relancez une analyse puis une observation, et comparez sur les trois dernières exécutions.

Questions fréquentes

L'AEO remplace-t-il le SEO ?
Non. Les réponses appuyées sur une recherche reposent sur des pages explorées et bien classées, et Google considère l'optimisation pour ses fonctions IA comme du SEO. L'AEO ajoute une attention particulière à la réponse, à l'entité et aux sources tierces.
Faut-il autoriser GPTBot pour apparaître dans ChatGPT ?
Pas nécessairement. Selon OpenAI, les fonctions de recherche de ChatGPT dépendent de OAI-SearchBot, tandis que GPTBot concerne l'entraînement. Les deux réglages sont indépendants et se décident séparément dans le robots.txt.
Un fichier llms.txt suffit-il à être cité ?
Non. C'est une convention proposée que Google Search n'utilise pas. Il peut servir à d'autres services, mais il ne remplace ni des pages qui répondent, ni un accès ouvert aux robots, ni des sources crédibles.
Combien de temps faut-il pour être cité ?
Cela dépend de la famille de réponse. Une réponse appuyée sur une recherche peut refléter une page dès qu'elle est explorée et bien classée ; une réponse tirée du modèle attend une prochaine mise à jour de ses connaissances, sans date garantie.

Voyez où en est votre site

Voyez où en est votre site aujourd'hui, sur Google et dans les réponses des IA : lancez l'analyse gratuite.

Lancer l'analyse gratuite

Sources

  1. OpenAI — Overview of OpenAI crawlers
  2. Perplexity — Perplexity crawlers
  3. Google Search Central — Optimizing your website for generative AI features
  4. Google Search Central — AI features and your website
  5. Google Search Central — Creating helpful, reliable, people-first content
  6. Google Search Central — Introduction to robots.txt
  7. llms.txt — proposal
  8. Schema.org — Organization

Partager