# Référencement IA : comment les assistants citent votre marque

[Canonical HTML page](https://gradiently.design/fr/guide/llm-seo)

ChatGPT, Claude, Perplexity et les réponses IA de Google doivent bien trouver quelque part leurs informations sur vous. Voici comment ils les trouvent, et ce qu’un marketeur peut faire pour qu’elles soient justes.

## The short version

- Le référencement IA consiste à rendre votre marque facile à trouver, à comprendre et à citer correctement pour les assistants d’IA.
- Les assistants répondent à partir de ce qu’ils ont appris à l’entraînement et de pages qu’ils consultent en direct : votre réputation de longue date comme vos pages actuelles comptent.
- Les robots d’IA comme GPTBot, OAI-SearchBot, ClaudeBot et PerplexityBot sont documentés comme respectant robots.txt : les bloquer peut exclure vos pages des réponses de l’IA.
- Les pages qui répondent à la question dès le premier paragraphe, en phrases courtes qui se suffisent à elles-mêmes, sont plus faciles à citer pour un assistant.
- llms.txt est un fichier standard proposé qui donne aux outils d’IA un plan simple d’un site ; il coûte peu à publier, mais tous les assistants ne le lisent pas.

Le **référencement IA** consiste à rendre votre marque facile à trouver, à comprendre et à citer correctement pour les assistants d’IA. En pratique, cela signifie quatre choses : laisser les robots d’IA lire votre site, écrire des pages qui répondent à la question dès le premier paragraphe, garder vos informations identiques partout où elles apparaissent, et donner aux machines un plan simple de ce que vous publiez. L’essentiel relève du bon SEO fait avec soin. Une petite partie est nouvelle.

## Comment les assistants d’IA trouvent des informations sur une marque

Un assistant répond à partir de deux sources. La première est ce que le modèle a appris à l’entraînement, un instantané du web public et d’autres sources pris des mois ou des années avant votre question. La seconde est la recherche en direct : pour beaucoup de questions, l’assistant cherche sur le web, consulte quelques pages et rédige sa réponse à partir d’elles, souvent avec des liens. Optimiser pour l’IA, c’est être trouvable et clair dans les deux.

| Source | Ce que cela signifie pour vous | Ce sur quoi vous pouvez agir |
| --- | --- | --- |
| Données d’entraînement | Une image ancienne et large de votre marque | Être décrit de façon cohérente, longtemps, en de nombreux endroits |
| Recherche en direct | Les pages actuelles consultées au moment de la question | L’accès des robots, des pages claires, le classement dans la recherche classique |
| Outils et connecteurs | L’assistant utilise directement votre produit | Un serveur MCP ou une app qui expose des données exactes |

Trois chemins de votre marque vers une réponse d’IA. C’est sur la recherche en direct qu’un marketeur peut agir le plus vite.

## Laissez les robots d’IA lire votre site

Les entreprises d’IA font tourner leurs propres robots, et les principales affirment respecter robots.txt. Certains sites les bloquent par défaut via un réglage d’hébergement ou une extension de sécurité, parfois sans que personne ne l’ait décidé. Si un assistant ne peut pas consulter vos pages, il répondra avec ce qu’il trouve ailleurs, peut-être un avis vieux de deux ans ou la page comparative d’un concurrent.

```text
# robots.txt : autoriser les robots de recherche et d’assistants IA
User-agent: *
Allow: /
Disallow: /account/

User-agent: GPTBot
User-agent: OAI-SearchBot
User-agent: ChatGPT-User
User-agent: ClaudeBot
User-agent: Claude-User
User-agent: PerplexityBot
User-agent: Google-Extended
Allow: /
Disallow: /account/

Sitemap: https://example.com/sitemap.xml
```

Un robots.txt qui nomme explicitement les principaux robots d’IA. Google-Extended est un jeton de contrôle pour l’entraînement de l’IA de Google plutôt qu’un robot distinct. Gardez les espaces privés interdits pour tous les agents, et vérifiez que votre CDN ou votre pare-feu ne les bloque pas de son côté.

> **Entraînement et réponse sont deux choix distincts** Certaines entreprises utilisent un robot pour l’entraînement et un autre pour les réponses en direct. Vous pouvez autoriser les robots de réponse tout en bloquant ceux d’entraînement, mais lisez d’abord la documentation de chaque entreprise, car les noms et leurs rôles changent.

## Écrivez des pages qu’un assistant peut citer

Quand un assistant écrit à partir d’une page consultée, il reprend l’énoncé le plus clair qu’il trouve. Une page qui commence par trois paragraphes d’histoire avant la réponse ne lui donne rien à reprendre. Une page qui répond dès sa première phrase, puis explique, lui donne exactement ce dont il a besoin, et offre la même courtoisie au lecteur humain.

### Difficile à citer

- La réponse se trouve sous une longue introduction
- Des informations cachées dans des images ou des carrousels
- Des phrases qui n’ont de sens qu’avec la précédente
- Des affirmations vagues : « leader du secteur », « le meilleur de sa catégorie »
- Des noms de produit différents selon les pages

### Facile à citer

- La réponse dans le premier paragraphe
- Des informations en texte simple dans le HTML
- Des phrases courtes qui se suffisent à elles-mêmes
- Du concret : tailles, étapes, noms, dates
- Un seul nom et une seule description, partout

Les données structurées aident aussi les machines à lire la page. Les balisages FAQ, produit, organisation et article décrivent ce qu’est une page sous une forme que tout robot comprend. Ce n’est pas une garantie d’être cité, mais cela supprime les suppositions. Si vos pages sont partagées sous forme de liens, [les balises Open Graph](https://gradiently.design/fr/guide/open-graph-tags) et une vraie [image d’aperçu de lien](https://gradiently.design/fr/guide/open-graph-image-size) soignent le côté humain du même clic.

## Publiez un fichier llms.txt

llms.txt est une convention proposée : un fichier Markdown à la racine de votre site qui indique aux outils d’IA, en langage simple, ce qu’est le site et où se trouvent ses pages les plus utiles. Ce n’est pas un standard officiel, et aucun assistant n’est obligé de le lire. Il demande pourtant une heure à écrire, et vous oblige à décrire votre activité en quelques phrases exactes, ce qui a de la valeur en soi.

```text
# Harbour Bakery

> Une boulangerie de quartier au 2 Quay Street, ouverte de 7 h du matin à 3 h de l’après-midi,
> du mardi au dimanche. Pain au levain, viennoiseries et café.

## Pages principales

- Menu : https://example.com/menu (pains, viennoiseries et boissons)
- Visite : https://example.com/visit (adresse, horaires, stationnement)
- Commandes : https://example.com/orders (gâteaux de fête, préavis de 48 heures)

## Facultatif

- Journal : https://example.com/journal (recettes et actualités de saison)
```

Un petit llms.txt, simplifié pour la lecture. La proposition écrit chaque entrée sous forme de lien Markdown suivi d’une courte note. Le bloc de citation d’ouverture est la description que vous voulez le plus voir reprise par un assistant.

## Gardez vos informations identiques partout

Les assistants comparent les sources. Si votre site indique une ouverture à 7 h, votre fiche Google Business 8 h, et qu’un annuaire vous dit fermé depuis 2023, la réponse sera prudente ou fausse. Choisissez un nom, une phrase qui décrit ce que vous faites et un ensemble d’informations, puis mettez à jour chaque profil que vous contrôlez. [Être cité par ChatGPT](https://gradiently.design/fr/guide/perplexity-chatgpt-search-brand) traite du volet hors site : avis, comparatifs et endroits où les assistants cherchent au delà de vos propres pages.

1. **Écrivez une description en une ligne** Ce que vous êtes, pour qui et où. Utilisez-la mot pour mot sur votre site, vos profils et vos pages presse.
2. **Listez vos informations clés** Nom, adresse, horaires, produits, année de création, contact. Une seule source de vérité, partagée avec toute personne qui modifie un profil.
3. **Passez vos profils en revue** Google Business, bios sur les réseaux, annuaires, places de marché et pages partenaires. Corrigez chaque incohérence.
4. **Interrogez les assistants** Demandez à ChatGPT, Claude, Perplexity et Google ce qu’ils savent de vous. Notez ce qui est faux et remontez à sa source.
5. **Recommencez chaque trimestre** Les assistants changent de sources et de modèles. Une courte vérification tous les quelques mois repère les dérives tôt.

## L’approche de Gradiently face à la recherche IA

Le Field Guide de Gradiently est écrit à la fois pour les personnes et pour les assistants. Chaque article répond à son titre dès le premier paragraphe et contient un court résumé de phrases vraies chacune isolément, si bien qu’un assistant peut en citer une sans les autres. Les FAQ sont publiées en données FAQPage. Le site publie un llms.txt et un llms-full.txt en texte intégral (voir `gradiently.design/llms.txt`), propose une copie Markdown de chaque article du guide, et son robots.txt nomme les principaux robots d’IA et les autorise sur les pages publiques.

Il existe aussi une seconde voie. Gradiently fonctionne dans ChatGPT, Claude et tout assistant qui prend en charge les serveurs MCP distants : un assistant peut chercher des Marks et créer des visuels directement, au lieu de décrire le produit de mémoire. [Qu’est-ce que MCP](https://gradiently.design/fr/guide/what-is-mcp) explique le fonctionnement de cette connexion, et [connecter un assistant d’IA](https://gradiently.design/fr/guide/connect-ai-assistant) montre la configuration.

## FAQ

### Qu’est-ce que le référencement IA ?

C’est le travail qui rend votre marque facile à trouver, à comprendre et à citer correctement pour des assistants comme ChatGPT, Claude et Perplexity, grâce à l’accès des robots, à des pages claires et à des informations cohérentes.

### Le SEO pour les LLM est-il différent du SEO classique ?

C’est surtout le même travail fait avec soin : des pages explorables, des réponses claires et une bonne réputation. Les différences : autoriser les robots d’IA, écrire des phrases citables isolément et, si vous le souhaitez, publier un llms.txt.

### llms.txt aide-t-il avec ChatGPT ?

llms.txt est une convention proposée, et aucun assistant n’est obligé de le lire. Il coûte peu à publier et rend votre site plus compréhensible pour tout outil qui le lit.

### Faut-il bloquer GPTBot dans robots.txt ?

Bloquer les robots d’IA peut exclure vos pages des réponses de l’IA : la plupart des marques qui veulent être recommandées les autorisent sur leurs pages publiques. Certaines entreprises utilisent des robots distincts pour l’entraînement et pour les réponses en direct, que vous pouvez traiter différemment.

### Comment savoir ce que ChatGPT dit de ma marque ?

Demandez-lui directement, ainsi qu’à Claude, Perplexity et Google, avec les questions que poseraient vos clients. Notez les informations fausses et remontez jusqu’à la page d’où elles viennent.
