Melhorar a visibilidade
Auditoria de domínio e acessibilidade para IA
Verifique se rastreadores e agentes de IA conseguem acessar, ler e agir no seu site: robots.txt, sitemaps, llms.txt, árvore de acessibilidade, WebMCP, ecommerce agêntico e Common Crawl, além de um rastreamento completo de auditoria do site.
Um mecanismo não consegue citar uma página que não consegue acessar, e um agente não consegue usar uma página que não consegue ler. A página Domain audit (Auditoria → Domain audit) reúne as verificações que decidem se seu domínio pode ser encontrado, considerado confiável e lido por rastreadores e agentes de IA. A página Auditoria do site (Auditoria → Auditoria do site) vai mais fundo: ela rastreia todas as URLs do seu sitemap e informa problemas técnicos e como os links internos distribuem autoridade.
Execute primeiro a auditoria de domínio quando um domínio tem visibilidade zero ou quando uma página que você espera ver citada nunca é. Uma única linha Disallow para o GPTBot ou uma regra de CDN que bloqueia rastreadores explica mais citações ausentes do que qualquer problema de conteúdo.
Resumo de prontidão para agentes#
O topo da página resume cada seção em uma linha: pontuação do llms.txt, pontuação de acessibilidade, acesso de rastreadores, URLs do sitemap, sitemap vs. robots, WebMCP, ecommerce agêntico e expiração do domínio. Seus concorrentes rastreados aparecem em tabelas de comparação ao seu lado, para você ver se um rival é simplesmente mais fácil de ler para os agentes.
robots.txt e sitemaps#
Mostra se os principais rastreadores de busca e de IA podem ler o site, se os sitemaps estão declarados no robots.txt e quantas URLs esses sitemaps listam. Os rastreadores verificados são:
GPTBot, OAI-SearchBot, ChatGPT-User, ClaudeBot, Claude-User, Claude-SearchBot, PerplexityBot, Google-Extended, Googlebot, Bingbot, Applebot, Amazonbot, Meta-ExternalAgent e CCBot.
Ele também sinaliza conflitos entre seu sitemap e o robots.txt: URLs do sitemap que o seu próprio robots.txt bloqueia, rastreadores bloqueados para URLs que o sitemap lista, arquivos de sitemap que são eles mesmos proibidos, diretivas Sitemap: que apontam para outro host e arquivos de sitemap acima do limite de 50.000 URLs ou 50 MB. A ausência total de robots.txt significa que todo rastreador é permitido por padrão.
Revisão do llms.txt#
O /llms.txt é um arquivo Markdown que dá aos modelos de linguagem uma visão geral curada do seu site. O AmICited busca o seu e o valida contra a proposta do llmstxt.org: transporte (servido na raiz por HTTPS com HTTP 200, um tipo de conteúdo de texto, não o shell HTML do seu app, UTF-8, abaixo de 128 KB), estrutura (um H1 primeiro, uma citação de resumo logo depois dele, seções H2 que são listas de links, sem cabeçalhos mais profundos) e qualidade dos links (URLs absolutas no formato - [Title](URL): description, sem HTML bruto, sem texto de preenchimento).
- As verificações obrigatórias pesam 1, as recomendadas pesam 0,5 e as dicas consultivas pesam 0 (exibidas como orientação, nunca penalizadas).
- Cada verificação mostra se passou, o que espera e um exemplo.
- Re-check now busca o arquivo novamente (0,005 crédito). Re-check competitors reavalia os dos concorrentes.
Exemplo prático#
Uma revisão completa executa 5 verificações obrigatórias e 19 recomendadas (mais 4 dicas consultivas), que valem 5 + 9,5 = 14,5 pontos. Um arquivo que passa em todas as verificações obrigatórias e em 15 das recomendadas pontua (5 + 7,5) ÷ 14,5 × 100 = 86.
Árvore de acessibilidade#
Os agentes de IA navegam por uma página pela sua árvore de acessibilidade (papéis, nomes, estrutura), não pelos seus pixels. O AmICited verifica o HTML da sua página inicial, e você pode usar Check URL em qualquer outra página (0,005 crédito por revisão). As verificações: página acessível, elementos interativos com nome, sem elementos interativos ocultos, imagens com texto alternativo, controles de formulário rotulados, um único H1, ordem dos cabeçalhos, um marco main, idioma da página declarado e um título do documento.
WebMCP, ecommerce agêntico e Common Crawl#
- WebMCP. Detecta se sua página inicial expõe ferramentas que os agentes podem chamar diretamente (buscar, adicionar ao carrinho, reservar) em vez de adivinhar a partir da página. As ferramentas declarativas são listadas com indicadores de leitura ou escrita; as ferramentas registradas por JavaScript são anotadas, mas não podem ser listadas a partir de HTML estático.
- Ecommerce agêntico. Detecta se a página inicial anuncia um protocolo que permite aos agentes navegar, finalizar a compra e pagar (ACP, UCP), com um link para o manifesto.
- Common Crawl. Se o CCBot consegue acessar o site (permitido, proibido no robots.txt ou bloqueado na borda da CDN), se o domínio está no índice mais recente, quantas URLs foram capturadas e sua presença ao longo do tempo em comparação com os concorrentes. O Common Crawl é o corpus a partir do qual a maioria dos conjuntos de treinamento abertos é construída; não é o que o GPTBot, o OAI-SearchBot ou o PerplexityBot acessam, então leia-o separadamente da busca por IA ao vivo.
- Registro do domínio e certificado. Dias até a expiração do registro do domínio e do certificado TLS, e o registrador.
Auditoria do site#
A auditoria do site rastreia todas as URLs do sitemap do domínio, registra os fatos técnicos e os links de cada página e calcula o grafo de links internos.
Configure a varredura
Vá a Auditoria → Auditoria do site e clique em Schedule scan. Defina o ritmo (requisições por segundo, requisições simultâneas, espera máxima por requisição), quando parar (máximo de URLs, duração máxima, taxa de erro), quais URLs incluir ou excluir (até 20 expressões regulares de cada), se os links para sites externos devem ser armazenados e se deve haver Repeat scan a cada N dias.
Obtenha um preço e confirme
Clique em Get price. A cotação conta as URLs do seu sitemap, aplica seus filtros e o limite do plano e precifica a varredura em 0,002 crédito por URL (1.000 URLs = 2 créditos). A cotação vale por uma hora, e uma varredura não pode começar se o seu saldo não cobrir tudo.
Leia o relatório
Abas: Issues, Pages & links, Outbound domains, Runs, Server response e Crawl log. Você é notificado quando a execução termina.
O rastreador é educado por projeto: ele reduz o ritmo à metade e pausa quando o site responde 429 ou 503, e desacelera quando os tempos de resposta dobram. Uma varredura interrompida mantém tudo o que já foi buscado e cobra apenas por isso. Cada página recebe um PageRank (simples e ponderado pelo lugar onde o link está: o conteúdo principal conta mais que a navegação ou o rodapé) ao lado dos seus cliques orgânicos e cliques pagos; as colunas de tráfego exigem o Search Console ou uma plataforma de anúncios conectados.