En bref.Pour être cité par Claude (Anthropic), quatre leviers priment : un site rendu côté serveur (HTML lisible sans JavaScript), des signaux d'auteur forts (page équipe, biographies, JSON-LD Person), une densité analytique élevée (chiffres sourcés, citations externes) et un accès ClaudeBot autorisé dans robots.txt. La méthode complète est détaillée dans le pilier être cité par les IA.

Comment Claude accède-t-il au web ?

Claude est l'assistant conversationnel d'Anthropic. Comme ChatGPT, il combine deux sources d'information : la mémoire entraînée du modèle (collectée par ClaudeBot lors des vagues d'entraînement) et la recherche en temps réel (déclenchée pendant la conversation via Claude-User). La documentation officielle Anthropic décrit chacun de ces User-Agents et leurs comportements.

ClaudeBot : l'entraînement des modèles

ClaudeBotest le robot qui collecte des pages web pour entraîner les futures versions des modèles Claude. Quand Anthropic prépare une nouvelle vague d'entraînement, ClaudeBot visite des sites et collecte du contenu qui peut être intégré au corpus. Une fois entraîné, le modèle « se souvient » de votre contenu sans avoir besoin de le relire à chaque requête.

User-Agent : ClaudeBot. Fréquence de crawl : irrégulière, par vagues. Si votre contenu est publié juste après une vague, il faut attendre la suivante pour être intégré. C'est pour cela que les corrections de fond mettent plusieurs mois à se refléter dans les réponses « hors-search » de Claude.

Claude-User : les actions dans la conversation

Claude-Userintervient lors d'une conversation : quand un utilisateur active la recherche, ou quand Claude décide de visiter une URL pour répondre à la question, ce User-Agent fait la requête HTTP. C'est par ce canal que vous obtenez des citations explicites avec lien cliquable dans l'interface Claude.ai.

User-Agent : Claude-User. Bloquer ce robot revient à empêcher Claude de récupérer le contenu de votre page au moment où un utilisateur la lui demande explicitement.

claude-web : les crawls historiques

claude-web est mentionné comme User-Agent additionnel. Volume marginal pour la majorité des sites, mais à autoriser dans robots.txt par cohérence. Sur les logs, il apparaît rarement, sauf sur de très grands sites.

Pas de dépendance forte à un moteur tiers

Contrairement à ChatGPT search (qui s'appuie sur l'index Bing) ou à Perplexity (mix Google et Bing), Claude ne dépend pas d'un moteur public connu pour arbitrer ses citations. Cela change la stratégie de manière significative : être bien classé sur Bing aide moins pour Claude que pour ChatGPT. Voir le détail dans le cluster être cité par ChatGPT et dans être cité par Perplexity.

Quels critères Claude valorise-t-il vraiment ?

Anthropic n'a pas publié sa pondération interne. ScoreGeo calibre les poids sur la base d'observations empiriques croisées avec les principes Anthropic publics (la « Constitution AI » privilégie sécurité, sourcing et nuance). Vue synthétique des critères les plus sensibles pour Claude spécifiquement.

CritèrePoids ClaudePourquoi
HTML lisible sans JavaScript17ClaudeBot et Claude-User ne rendent pas le JS
Signaux d'auteur (E-E-A-T) explicites16Claude valorise plus fortement l'expertise nommée
Citations et statistiques chiffrées sourcées14+40 % de visibilité selon Aggarwal et al. (2023)
Structure (H2 en questions, listes)11Aide le chunking RAG côté Claude-User
Réponse answer-first en haut de page10Format que Claude recopie volontiers
Données structurées (Article, Person, Organization)9Aide à désambiguïser l'entité auteur
Cohérence factuelle inter-sites8Claude évite les sources isolées non corroborées
Accès ClaudeBot autorisé7Condition binaire : si bloqué, score zéro
Fraîcheur (date de mise à jour visible)5Privilégie les sources récentes sur sujets datés
Vitesse du site3Affecte la complétude du crawl

Pour le détail de chaque pondération et la calibration sur 5 moteurs (ChatGPT, Perplexity, Google AI Overviews, Claude, Copilot), voir la page méthodologie ScoreGeo.

En quoi Claude diffère-t-il de ChatGPT et Perplexity ?

Beaucoup d'éditeurs traitent les trois moteurs comme interchangeables. C'est une erreur. Voici un tableau de synthèse pour fixer les priorités spécifiques par moteur.

CritèreClaudeChatGPTPerplexity
Dépendance à un moteur tiersFaible (récupération propre)Forte (Bing)Mixte (Google + Bing)
Pondération E-E-A-T / auteurÉlevéeMoyenneMoyenne
Pondération fraîcheurMoyenneMoyenneÉlevée
Valeur d'une citation sourcéeTrès élevéeÉlevéeÉlevée
Sensibilité au rendu serveurIndispensableIndispensableIndispensable
Reddit et forums valorisésModéréModéréÉlevé

Conclusion pratique : si vous priorisez Claude, investissez d'abord dans la signature d'auteur, la page équipe et la densité de sources citées. Si vous priorisez Perplexity, investissez d'abord dans la fraîcheur et les mentions Reddit. Voir aussi le pilier qu'est-ce que le GEO pour le cadre méthodologique général.

Quelles actions concrètes pour être cité par Claude ?

Six leviers, classés par impact attendu et coût d'implémentation décroissants. Adoptez-les dans l'ordre.

1. Activer le rendu serveur (SSR)

Premier réflexe : désactiver JavaScript dans votre navigateur (DevTools, Settings, Disable JavaScript) puis recharger votre page. Si tout disparaît, ClaudeBot ne lit rien. Le rendu serveur (Server-Side Rendering, génération du HTML côté serveur avant envoi au navigateur) ou la génération statique est la condition technique numéro un. Sur Next.js, Astro, Nuxt ou Remix : SSR par défaut. Sur React/Vue en SPA pure : prévoir une migration ou ajouter un pré-rendu (Prerender.io, react-snap).

2. Signer chaque article avec une vraie identité

Ajoutez le nom de l'auteur en haut de chaque article, avec ses qualifications, et un lien vers une page équipe détaillée. Déclarez l'auteur en JSON-LD avec le type Person et un sameAsvers LinkedIn, Wikipedia, ORCID si vous en avez un. Google's guide E-E-A-T documente cette logique pour le SEO, et Claude l'applique encore plus strictement.

3. Étoffer le texte avec citations sourcées et statistiques

Insérez 2 à 5 chiffres précis par article, chacun avec un lien externe vers la source officielle (paper, organisme public, documentation officielle). Évitez les chiffres ronds non sourcés. Cette pratique est le levier le plus mesurable : l'étude « GEO: Generative Engine Optimization » mesure jusqu'à +40 % de visibilité dans les réponses IA via ajout de citations et statistiques. Claude, qui valorise la rigueur, en bénéficie particulièrement.

4. Publier le JSON-LD Article + Person + Organization

Sur chaque article, déclarez le triplet Article, Person (auteur) et Organization (éditeur). Validez via le Rich Results Test de Google. Pour le détail des balises prioritaires, consulter le guide Schema.org pour les IA.

5. Autoriser ClaudeBot dans robots.txt

Tapez votre-site.com/robots.txt dans un navigateur. Cherchez les mentions ClaudeBot, Claude-User et claude-web. Si vous voyez Disallow: / sous un de ces User-Agents, Claude est partiellement ou totalement aveugle à votre site.

Le bloc minimal à ajouter pour ouvrir l'accès :

User-agent: ClaudeBot
Allow: /

User-agent: Claude-User
Allow: /

User-agent: claude-web
Allow: /

Attention au piège Cloudflare : la règle « Block AI Scrapers and Crawlers »activable en un clic dans Security > Bots coupe aussi ClaudeBot, même si votre robots.txt est parfait. Vérifiez avec curl -A "ClaudeBot" https://votre-site.com : vous devez obtenir un HTTP 200 avec votre HTML, pas un challenge Cloudflare.

6. Cultiver les mentions externes cohérentes

Claude vérifie volontiers la cohérence factuelle entre sources indépendantes. Si votre marque est décrite de manière identique sur Wikipedia, un annuaire métier, des articles de presse et votre propre site, votre crédibilité monte. Si les versions divergent (date de création, fondateurs, chiffre d'affaires), Claude tend à hésiter ou à ne pas citer. Auditer ses mentions externes au moins deux fois par an est un investissement rentable.

Comment vérifier si ClaudeBot a crawlé son site ?

Trois méthodes complémentaires, du plus simple au plus outillé.

Méthode 1 : logs serveur

Sur un hébergement classique (Apache, nginx), exécutez sur access.log une recherche du User-Agent ClaudeBot, ou Claude-User, ou claude-web. Chaque ligne correspond à un hit. Notez la fréquence et les pages visitées. Une absence totale de hits sur 30 jours indique soit un blocage périmétrique (Cloudflare, WAF), soit un sitemap mal référencé.

Méthode 2 : rapport Bots Cloudflare

Dans le dashboard Cloudflare, section Analytics > Security > Bots, filtrez sur les User-Agents IA. Les hits ClaudeBot apparaissent avec leur volume et leur statut. Si vous voyez des hits avec un statut HTTP 403, vous avez un blocage WAF en amont de robots.txt.

Méthode 3 : audit ScoreGeo

ScoreGeoaudite votre site sur les 10 critères qui comptent pour la citabilité IA : SSR, answer-first, structure, Schema.org, accès robots. L'outil calibre le score par moteur (ChatGPT, Perplexity, Google AI Overviews, Claude, Copilot) et signale spécifiquement les points qui freinent Claude. 10 pages auditées en 15 à 30 secondes, gratuit, sans inscription. Pour la méthodologie détaillée et les sources scientifiques mobilisées, voir la page méthodologie.

Sources et lectures complémentaires

Les affirmations techniques et chiffrées de cet article s'appuient sur les sources officielles suivantes :

  • Anthropic Documentation, Claude bots. Référence officielle sur ClaudeBot, Claude-User et claude-web : User-Agents, plages IP, comportement, règles robots.txt recommandées.
  • Aggarwal P., Murahari V. et al., « GEO: Generative Engine Optimization », Princeton/Georgia Tech, 2023. Mesure de +30 à +40 % de visibilité dans les réponses IA via ajout de citations, statistiques et sources autoritaires.
  • Google, Creating helpful, reliable, people-first content. Cadre E-E-A-T (Experience, Expertise, Authoritativeness, Trustworthiness) largement réutilisé par les IA, dont Claude, pour évaluer une source.
  • Schema.org. Vocabulaire officiel pour les données structurées (Article, Person, Organization, FAQPage, HowTo).
  • Google Rich Results Test. Validateur de JSON-LD utile aussi pour vérifier ce qui sera lu par les IA, dont Claude.
  • llmstxt.org. Spécification du format llms.txt, complément optionnel (non confirmé officiellement par Anthropic à ce jour).

Pour l'intégration de ces leviers dans une feuille de route complète, revenir au pilier comment être cité par les IA : la méthode en 10 étapes y est détaillée moteur par moteur.

Questions fréquentes

Claude bloque-t-il mon site par défaut ?
Non. Par défaut, ClaudeBot, Claude-User et claude-web peuvent visiter votre site. Le blocage est explicite : il faut un Disallow ciblé dans robots.txt, ou une règle Cloudflare anti-bots IA active. Vérifiez votre fichier sur votre-site.com/robots.txt et le rapport Bots de votre CDN avant de conclure.
Combien de temps pour apparaître dans Claude ?
Pour le mode recherche en temps réel (Claude search via Claude-User), quelques heures à quelques jours après publication. Pour la mémoire entraînée du modèle, plusieurs mois jusqu'à la prochaine vague d'entraînement Anthropic. Délai opérationnel typique pour une première citation : 4 à 12 semaines après mise en conformité technique.
Comment savoir si ClaudeBot a crawlé mon site ?
Consultez vos logs serveur ou votre CDN. Cherchez le User-Agent contenant ClaudeBot, Claude-User ou claude-web. Sur Cloudflare, le rapport Bots de la section Security affiche ces hits. Sur un hébergement classique, un filtre "ClaudeBot" sur access.log suffit. La doc officielle Anthropic publie les plages IP associées pour confirmation.
Claude utilise-t-il un moteur de recherche tiers ?
Claude ne dépend pas d'un index public comme Bing ou Google. Pour le mode search, le modèle s'appuie sur ses propres outils de récupération et sur les pages visitées via Claude-User. Conséquence : être bien classé sur Google ou Bing aide moins pour Claude que pour ChatGPT search. Les signaux qui comptent sont la qualité du contenu, l'autorité d'auteur et l'accessibilité technique.
Faut-il un fichier llms.txt pour être cité par Claude ?
Anthropic n'a pas confirmé officiellement le support de llms.txt. Le fichier reste utile comme signal redondant et comme balise de bonne pratique pour les agents IA, mais il n'est pas un prérequis. Investir d'abord dans le rendu serveur, les signaux d'auteur et les citations sourcées rapporte beaucoup plus que d'ajouter un llms.txt.