En bref.Pour être cité par Claude (Anthropic), quatre leviers priment : un site rendu côté serveur (HTML lisible sans JavaScript), des signaux d'auteur forts (page équipe, biographies, JSON-LD Person), une densité analytique élevée (chiffres sourcés, citations externes) et un accès ClaudeBot autorisé dans robots.txt. La méthode complète est détaillée dans le pilier être cité par les IA.
Comment Claude accède-t-il au web ?
Claude est l'assistant conversationnel d'Anthropic. Comme ChatGPT, il combine deux sources d'information : la mémoire entraînée du modèle (collectée par ClaudeBot lors des vagues d'entraînement) et la recherche en temps réel (déclenchée pendant la conversation via Claude-User). La documentation officielle Anthropic décrit chacun de ces User-Agents et leurs comportements.
ClaudeBot : l'entraînement des modèles
ClaudeBotest le robot qui collecte des pages web pour entraîner les futures versions des modèles Claude. Quand Anthropic prépare une nouvelle vague d'entraînement, ClaudeBot visite des sites et collecte du contenu qui peut être intégré au corpus. Une fois entraîné, le modèle « se souvient » de votre contenu sans avoir besoin de le relire à chaque requête.
User-Agent : ClaudeBot. Fréquence de crawl : irrégulière, par vagues. Si votre contenu est publié juste après une vague, il faut attendre la suivante pour être intégré. C'est pour cela que les corrections de fond mettent plusieurs mois à se refléter dans les réponses « hors-search » de Claude.
Claude-User : les actions dans la conversation
Claude-Userintervient lors d'une conversation : quand un utilisateur active la recherche, ou quand Claude décide de visiter une URL pour répondre à la question, ce User-Agent fait la requête HTTP. C'est par ce canal que vous obtenez des citations explicites avec lien cliquable dans l'interface Claude.ai.
User-Agent : Claude-User. Bloquer ce robot revient à empêcher Claude de récupérer le contenu de votre page au moment où un utilisateur la lui demande explicitement.
claude-web : les crawls historiques
claude-web est mentionné comme User-Agent additionnel. Volume marginal pour la majorité des sites, mais à autoriser dans robots.txt par cohérence. Sur les logs, il apparaît rarement, sauf sur de très grands sites.
Pas de dépendance forte à un moteur tiers
Contrairement à ChatGPT search (qui s'appuie sur l'index Bing) ou à Perplexity (mix Google et Bing), Claude ne dépend pas d'un moteur public connu pour arbitrer ses citations. Cela change la stratégie de manière significative : être bien classé sur Bing aide moins pour Claude que pour ChatGPT. Voir le détail dans le cluster être cité par ChatGPT et dans être cité par Perplexity.
Quels critères Claude valorise-t-il vraiment ?
Anthropic n'a pas publié sa pondération interne. ScoreGeo calibre les poids sur la base d'observations empiriques croisées avec les principes Anthropic publics (la « Constitution AI » privilégie sécurité, sourcing et nuance). Vue synthétique des critères les plus sensibles pour Claude spécifiquement.
| Critère | Poids Claude | Pourquoi |
|---|---|---|
| HTML lisible sans JavaScript | 17 | ClaudeBot et Claude-User ne rendent pas le JS |
| Signaux d'auteur (E-E-A-T) explicites | 16 | Claude valorise plus fortement l'expertise nommée |
| Citations et statistiques chiffrées sourcées | 14 | +40 % de visibilité selon Aggarwal et al. (2023) |
| Structure (H2 en questions, listes) | 11 | Aide le chunking RAG côté Claude-User |
| Réponse answer-first en haut de page | 10 | Format que Claude recopie volontiers |
| Données structurées (Article, Person, Organization) | 9 | Aide à désambiguïser l'entité auteur |
| Cohérence factuelle inter-sites | 8 | Claude évite les sources isolées non corroborées |
| Accès ClaudeBot autorisé | 7 | Condition binaire : si bloqué, score zéro |
| Fraîcheur (date de mise à jour visible) | 5 | Privilégie les sources récentes sur sujets datés |
| Vitesse du site | 3 | Affecte la complétude du crawl |
Pour le détail de chaque pondération et la calibration sur 5 moteurs (ChatGPT, Perplexity, Google AI Overviews, Claude, Copilot), voir la page méthodologie ScoreGeo.
En quoi Claude diffère-t-il de ChatGPT et Perplexity ?
Beaucoup d'éditeurs traitent les trois moteurs comme interchangeables. C'est une erreur. Voici un tableau de synthèse pour fixer les priorités spécifiques par moteur.
| Critère | Claude | ChatGPT | Perplexity |
|---|---|---|---|
| Dépendance à un moteur tiers | Faible (récupération propre) | Forte (Bing) | Mixte (Google + Bing) |
| Pondération E-E-A-T / auteur | Élevée | Moyenne | Moyenne |
| Pondération fraîcheur | Moyenne | Moyenne | Élevée |
| Valeur d'une citation sourcée | Très élevée | Élevée | Élevée |
| Sensibilité au rendu serveur | Indispensable | Indispensable | Indispensable |
| Reddit et forums valorisés | Modéré | Modéré | Élevé |
Conclusion pratique : si vous priorisez Claude, investissez d'abord dans la signature d'auteur, la page équipe et la densité de sources citées. Si vous priorisez Perplexity, investissez d'abord dans la fraîcheur et les mentions Reddit. Voir aussi le pilier qu'est-ce que le GEO pour le cadre méthodologique général.
Quelles actions concrètes pour être cité par Claude ?
Six leviers, classés par impact attendu et coût d'implémentation décroissants. Adoptez-les dans l'ordre.
1. Activer le rendu serveur (SSR)
Premier réflexe : désactiver JavaScript dans votre navigateur (DevTools, Settings, Disable JavaScript) puis recharger votre page. Si tout disparaît, ClaudeBot ne lit rien. Le rendu serveur (Server-Side Rendering, génération du HTML côté serveur avant envoi au navigateur) ou la génération statique est la condition technique numéro un. Sur Next.js, Astro, Nuxt ou Remix : SSR par défaut. Sur React/Vue en SPA pure : prévoir une migration ou ajouter un pré-rendu (Prerender.io, react-snap).
2. Signer chaque article avec une vraie identité
Ajoutez le nom de l'auteur en haut de chaque article, avec ses qualifications, et un lien vers une page équipe détaillée. Déclarez l'auteur en JSON-LD avec le type Person et un sameAsvers LinkedIn, Wikipedia, ORCID si vous en avez un. Google's guide E-E-A-T documente cette logique pour le SEO, et Claude l'applique encore plus strictement.
3. Étoffer le texte avec citations sourcées et statistiques
Insérez 2 à 5 chiffres précis par article, chacun avec un lien externe vers la source officielle (paper, organisme public, documentation officielle). Évitez les chiffres ronds non sourcés. Cette pratique est le levier le plus mesurable : l'étude « GEO: Generative Engine Optimization » mesure jusqu'à +40 % de visibilité dans les réponses IA via ajout de citations et statistiques. Claude, qui valorise la rigueur, en bénéficie particulièrement.
4. Publier le JSON-LD Article + Person + Organization
Sur chaque article, déclarez le triplet Article, Person (auteur) et Organization (éditeur). Validez via le Rich Results Test de Google. Pour le détail des balises prioritaires, consulter le guide Schema.org pour les IA.
5. Autoriser ClaudeBot dans robots.txt
Tapez votre-site.com/robots.txt dans un navigateur. Cherchez les mentions ClaudeBot, Claude-User et claude-web. Si vous voyez Disallow: / sous un de ces User-Agents, Claude est partiellement ou totalement aveugle à votre site.
Le bloc minimal à ajouter pour ouvrir l'accès :
User-agent: ClaudeBot
Allow: /
User-agent: Claude-User
Allow: /
User-agent: claude-web
Allow: /Attention au piège Cloudflare : la règle « Block AI Scrapers and Crawlers »activable en un clic dans Security > Bots coupe aussi ClaudeBot, même si votre robots.txt est parfait. Vérifiez avec curl -A "ClaudeBot" https://votre-site.com : vous devez obtenir un HTTP 200 avec votre HTML, pas un challenge Cloudflare.
6. Cultiver les mentions externes cohérentes
Claude vérifie volontiers la cohérence factuelle entre sources indépendantes. Si votre marque est décrite de manière identique sur Wikipedia, un annuaire métier, des articles de presse et votre propre site, votre crédibilité monte. Si les versions divergent (date de création, fondateurs, chiffre d'affaires), Claude tend à hésiter ou à ne pas citer. Auditer ses mentions externes au moins deux fois par an est un investissement rentable.
Comment vérifier si ClaudeBot a crawlé son site ?
Trois méthodes complémentaires, du plus simple au plus outillé.
Méthode 1 : logs serveur
Sur un hébergement classique (Apache, nginx), exécutez sur access.log une recherche du User-Agent ClaudeBot, ou Claude-User, ou claude-web. Chaque ligne correspond à un hit. Notez la fréquence et les pages visitées. Une absence totale de hits sur 30 jours indique soit un blocage périmétrique (Cloudflare, WAF), soit un sitemap mal référencé.
Méthode 2 : rapport Bots Cloudflare
Dans le dashboard Cloudflare, section Analytics > Security > Bots, filtrez sur les User-Agents IA. Les hits ClaudeBot apparaissent avec leur volume et leur statut. Si vous voyez des hits avec un statut HTTP 403, vous avez un blocage WAF en amont de robots.txt.
Méthode 3 : audit ScoreGeo
ScoreGeoaudite votre site sur les 10 critères qui comptent pour la citabilité IA : SSR, answer-first, structure, Schema.org, accès robots. L'outil calibre le score par moteur (ChatGPT, Perplexity, Google AI Overviews, Claude, Copilot) et signale spécifiquement les points qui freinent Claude. 10 pages auditées en 15 à 30 secondes, gratuit, sans inscription. Pour la méthodologie détaillée et les sources scientifiques mobilisées, voir la page méthodologie.
Sources et lectures complémentaires
Les affirmations techniques et chiffrées de cet article s'appuient sur les sources officielles suivantes :
- Anthropic Documentation, Claude bots. Référence officielle sur ClaudeBot, Claude-User et claude-web : User-Agents, plages IP, comportement, règles robots.txt recommandées.
- Aggarwal P., Murahari V. et al., « GEO: Generative Engine Optimization », Princeton/Georgia Tech, 2023. Mesure de +30 à +40 % de visibilité dans les réponses IA via ajout de citations, statistiques et sources autoritaires.
- Google, Creating helpful, reliable, people-first content. Cadre E-E-A-T (Experience, Expertise, Authoritativeness, Trustworthiness) largement réutilisé par les IA, dont Claude, pour évaluer une source.
- Schema.org. Vocabulaire officiel pour les données structurées (Article, Person, Organization, FAQPage, HowTo).
- Google Rich Results Test. Validateur de JSON-LD utile aussi pour vérifier ce qui sera lu par les IA, dont Claude.
- llmstxt.org. Spécification du format llms.txt, complément optionnel (non confirmé officiellement par Anthropic à ce jour).
Pour l'intégration de ces leviers dans une feuille de route complète, revenir au pilier comment être cité par les IA : la méthode en 10 étapes y est détaillée moteur par moteur.