Optimiser un site pour les intelligences artificielles repose sur trois chantiers : le rendre lisible par les robots IA, structurer son contenu pour qu’il soit extractible par fragments, et déclarer explicitement son identité dans les données structurées. Aucun de ces chantiers ne demande de refonte, tous demandent de la rigueur.
Chantier 1 : la lisibilité technique
- Autorisez explicitement les robots IA dans votre robots.txt : GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended, entre autres.
- Vérifiez que votre pare-feu applicatif ou votre CDN ne bloque pas ces agents par défaut.
- Assurez-vous que le contenu principal est présent dans le HTML servi, sans exécution de JavaScript.
- Ramenez les temps de réponse serveur sous 500 millisecondes.
- Sortez vos données des images et des PDF : un tableau en image n’est pas un tableau.
Chantier 2 : la structure extractible
Un modèle ne lit pas votre page entière : il en extrait des fragments. Chaque fragment doit se suffire à lui-même.
- Ouvrez chaque page par une réponse autonome de deux ou trois phrases, compréhensible sans le reste.
- Formulez vos intertitres comme des questions directes.
- Répétez le sujet plutôt que d’employer des pronoms de renvoi lointains.
- Placez chaque chiffre et sa source dans la même phrase.
- Utilisez des tableaux et des listes HTML natifs pour les données comparatives.
Chantier 3 : la déclaration d’identité
Le balisage Schema.org déclare qui vous êtes dans un format sans ambiguïté. Quatre types suffisent à couvrir l’essentiel : Organization, Person pour vos experts, LocalBusiness si vous avez une adresse, Article pour vos contenus datés. La propriété sameAs relie toutes vos présences en une seule entité.
Ajoutez un fichier llms.txt à la racine : il coûte une heure et présente votre entité aux robots IA en clair.
Ce qu’il ne faut pas faire
Aller plus loin
Cette question est traitée en profondeur dans La couche invisible, être lisible par les robots IA. Ressource associée : La grille d’audit en 20 points.
Questions proches
Quelles données structurées utiliser pour le GEO ?
Quatre types Schema.org couvrent l’essentiel : Organization pour déclarer votre entité, Person pour vos experts, LocalBusiness si vous avez une adresse, et Article pour vos contenus datés.
Qu’est-ce qu’un fichier llms.txt et à quoi sert-il ?
Le fichier llms.txt est un fichier texte placé à la racine d’un site qui présente l’entité et ses contenus aux robots des intelligences artificielles.
Faut-il bloquer les robots des IA ?
Pour une entreprise qui cherche à être citée, non : bloquer les robots IA revient à se rendre invisible dans les réponses génératives.