Améliorer la visibilité
Audit de domaine et accessibilité IA
Vérifiez si les robots d’exploration et les agents IA peuvent atteindre, lire et exploiter votre site : robots.txt, sitemaps, llms.txt, arbre d’accessibilité, WebMCP, commerce agentique et Common Crawl, plus une exploration complète d’audit du site.
Un moteur ne peut pas citer une page qu’il ne peut pas récupérer, et un agent ne peut pas utiliser une page qu’il ne peut pas lire. La page Domain audit (Audit → Domain audit) rassemble les contrôles qui déterminent si votre domaine peut être trouvé, jugé fiable et lu par les robots d’exploration et les agents IA. La page Audit du site (Audit → Site audit) va plus loin : elle explore chaque URL de votre sitemap et signale les problèmes techniques ainsi que la façon dont les liens internes répartissent l’autorité.
Lancez d’abord l’audit de domaine quand un domaine a une visibilité nulle ou quand une page que vous voulez voir citée ne l’est jamais. Une seule ligne Disallow pour GPTBot ou une règle CDN qui bloque les robots explique plus de citations manquantes que n’importe quel problème de contenu.
Résumé de la préparation aux agents#
Le haut de la page résume chaque section en une ligne : score llms.txt, score d’accessibilité, accès des robots d’exploration, URL du sitemap, sitemap vs robots, WebMCP, commerce agentique et expiration du domaine. Vos concurrents suivis apparaissent dans des tableaux comparatifs à côté de vous, pour que vous voyiez si un rival est simplement plus facile à lire pour les agents.
robots.txt et sitemaps#
Indique si les principaux robots de recherche et d’IA sont autorisés à lire le site, si les sitemaps sont déclarés dans le robots.txt, et combien d’URL ces sitemaps listent. Les robots vérifiés sont :
GPTBot, OAI-SearchBot, ChatGPT-User, ClaudeBot, Claude-User, Claude-SearchBot, PerplexityBot, Google-Extended, Googlebot, Bingbot, Applebot, Amazonbot, Meta-ExternalAgent et CCBot.
Il signale aussi les conflits entre votre sitemap et votre robots.txt : URL du sitemap que votre propre robots.txt bloque, robots bloqués sur des URL que le sitemap liste, fichiers sitemap eux-mêmes interdits, directives Sitemap: pointant vers un autre hôte, et fichiers sitemap dépassant la limite de 50 000 URL ou de 50 Mo. L’absence totale de robots.txt signifie que tous les robots sont autorisés par défaut.
Revue du llms.txt#
/llms.txt est un fichier Markdown qui donne aux modèles de langage un aperçu organisé de votre site. AmICited récupère le vôtre et le valide selon la proposition llmstxt.org : transport (servi à la racine en HTTPS avec un HTTP 200, un type de contenu texte, pas la coquille HTML de votre application, en UTF-8, sous 128 Ko), structure (un seul H1 en premier, une citation de résumé juste après, des sections H2 qui sont des listes de liens, pas d’intertitres plus profonds) et qualité des liens (URL absolues au format - [Title](URL): description, pas de HTML brut, pas de texte de remplissage).
- Les contrôles Required pèsent 1, les contrôles recommended pèsent 0,5, et les conseils consultatifs pèsent 0 (affichés comme recommandations, jamais pénalisés).
- Chaque contrôle indique s’il est réussi, ce qu’il attend et un exemple.
- Re-check now récupère de nouveau le fichier (0,005 crédit). Re-check competitors recalcule le score de ceux des concurrents.
Exemple chiffré#
Une revue complète exécute 5 contrôles obligatoires et 19 recommandés (plus 4 conseils consultatifs), pour 5 + 9,5 = 14,5 points. Un fichier qui réussit tous les contrôles obligatoires et 15 des recommandés obtient (5 + 7,5) ÷ 14,5 × 100 = 86.
Arbre d’accessibilité#
Les agents IA naviguent sur une page via son arbre d’accessibilité (rôles, noms, structure), pas via ses pixels. AmICited vérifie le HTML de votre page d’accueil, et vous pouvez utiliser Check URL pour toute autre page (0,005 crédit par revue). Les contrôles : page accessible, éléments interactifs nommés, pas d’éléments interactifs masqués, images avec texte alternatif, champs de formulaire étiquetés, un seul H1, ordre des intertitres, un repère main, langue de la page déclarée et titre du document.
WebMCP, commerce agentique et Common Crawl#
- WebMCP. Détecte si votre page d’accueil expose des outils que les agents peuvent appeler directement (recherche, ajout au panier, réservation) au lieu de deviner à partir de la page. Les outils déclaratifs sont listés avec des indicateurs de lecture ou d’écriture ; les outils enregistrés depuis JavaScript sont signalés mais ne peuvent pas être listés depuis du HTML statique.
- Commerce agentique. Détecte si la page d’accueil annonce un protocole permettant aux agents de parcourir, de passer commande et de payer (ACP, UCP), avec un lien vers le manifeste.
- Common Crawl. Si CCBot peut récupérer le site (autorisé, interdit dans le robots.txt, ou bloqué au niveau du CDN), si le domaine figure dans le dernier index, combien d’URL ont été capturées, et votre empreinte dans le temps face aux concurrents. Common Crawl est le corpus à partir duquel la plupart des jeux de données d’entraînement ouverts sont construits ; ce n’est pas ce que récupèrent GPTBot, OAI-SearchBot ou PerplexityBot : lisez-le donc séparément de la recherche IA en direct.
- Enregistrement du domaine et certificat. Nombre de jours avant l’expiration de l’enregistrement du domaine et du certificat TLS, et le registrar.
Audit du site#
L’audit du site explore chaque URL du sitemap du domaine, enregistre les faits techniques et les liens de chaque page, et calcule le graphe des liens internes.
Configurez l’analyse
Allez dans Audit → Site audit et cliquez sur Schedule scan. Définissez le rythme (requêtes par seconde, requêtes simultanées, attente maximale par requête), quand s’arrêter (nombre maximal d’URL, durée maximale, taux d’erreur), quelles URL inclure ou exclure (jusqu’à 20 expressions régulières chacune), s’il faut stocker les liens vers des sites externes, et s’il faut Repeat scan tous les N jours.
Obtenez un prix et confirmez
Cliquez sur Get price. Le devis compte les URL de votre sitemap, applique vos filtres et le plafond de votre offre, et facture l’analyse à 0,002 crédit par URL (1 000 URL = 2 crédits). Le devis est valable une heure, et une analyse ne peut pas démarrer si votre solde ne la couvre pas entièrement.
Lisez le rapport
Onglets : Issues, Pages & links, Outbound domains, Runs, Server response et Crawl log. Vous êtes averti à la fin de l’exécution.
Le robot est courtois par conception : il divise son rythme par deux et fait une pause quand le site répond 429 ou 503, et ralentit quand les temps de réponse doublent. Une analyse arrêtée conserve tout ce qui a déjà été récupéré et ne facture que cela. Chaque page reçoit un PageRank (simple, et pondéré selon l’emplacement du lien : le contenu principal compte plus que la navigation ou le pied de page) à côté de ses clics organiques et de ses clics payants ; les colonnes de trafic nécessitent Search Console ou une plateforme publicitaire connectée.