Dokumentácia

Zlepšenie viditeľnosti

Audit domény a prístupnosť pre AI

Skontrolujte, či AI crawlery a agenti dokážu váš web dosiahnuť, prečítať a konať na ňom: robots.txt, sitemapy, llms.txt, strom prístupnosti, WebMCP, agentic commerce a Common Crawl, plus úplné prehľadanie auditom stránky.

Engine nemôže citovať stránku, ktorú nevie načítať, a agent nemôže použiť stránku, ktorú nevie prečítať. Stránka Domain audit (Audit → Domain audit) zhromažďuje kontroly, ktoré rozhodujú o tom, či vašu doménu dokážu AI crawlery a agenti nájsť, dôverovať jej a prečítať ju. Stránka Audit stránky (Audit → Audit stránky) ide hlbšie: prehľadá každú URL vo vašej sitemape a hlási technické problémy a to, ako interné odkazy rozdeľujú autoritu.

Audit domény spustite ako prvý, keď má doména nulovú viditeľnosť alebo keď stránka, ktorú očakávate ako citovanú, nie je citovaná nikdy. Jeden riadok Disallow pre GPTBot alebo pravidlo CDN, ktoré blokuje crawlery, vysvetlí viac chýbajúcich citácií než akýkoľvek problém s obsahom.

Zhrnutie pripravenosti pre agentov#

Horná časť stránky zhŕňa každú sekciu v jednom riadku: skóre llms.txt, skóre prístupnosti, prístup crawlerov, URL v sitemape, sitemapa vs. robots, WebMCP, agentic commerce a expirácia domény. Vaši sledovaní konkurenti sa zobrazujú v porovnávacích tabuľkách vedľa vás, takže vidíte, či nie je rival jednoducho ľahšie čitateľný pre agentov.

robots.txt a sitemapy#

Ukazuje, či môžu dôležité vyhľadávacie a AI crawlery čítať web, či sú sitemapy deklarované v robots.txt a koľko URL tieto sitemapy uvádzajú. Kontrolované crawlery sú:

GPTBot, OAI-SearchBot, ChatGPT-User, ClaudeBot, Claude-User, Claude-SearchBot, PerplexityBot, Google-Extended, Googlebot, Bingbot, Applebot, Amazonbot, Meta-ExternalAgent a CCBot.

Označuje aj konflikty medzi vašou sitemapou a robots.txt: URL zo sitemapy, ktoré váš vlastný robots.txt blokuje, crawlery blokované z URL, ktoré sitemapa uvádza, samotné súbory sitemáp, ktoré sú zakázané, direktívy Sitemap: smerujúce na iného hostiteľa a súbory sitemáp nad limit 50 000 URL alebo 50 MB. Žiadny robots.txt znamená, že každý crawler je predvolene povolený.

Kontrola llms.txt#

/llms.txt je súbor Markdown, ktorý dáva jazykovým modelom kurátorský prehľad vášho webu. AmICited načíta ten váš a overí ho podľa návrhu llmstxt.org: prenos (poskytovaný v koreni cez HTTPS s HTTP 200, textový typ obsahu, nie shell vašej HTML aplikácie, UTF-8, pod 128 KB), štruktúra (jeden H1 na začiatku, súhrnný citát hneď za ním, sekcie H2, ktoré sú zoznamami odkazov, žiadne hlbšie nadpisy) a kvalita odkazov (absolútne URL v tvare - [Title](URL): description, žiadne surové HTML, žiadny zástupný text).

Skóre llms.txt
vážené splnené kontroly ÷ vážený súčet kontrol × 100
  • Required kontroly majú váhu 1, recommended kontroly 0,5 a poradné tipy 0 (zobrazené ako usmernenie, nikdy sa nepenalizujú).
  • Každá kontrola ukazuje, či prešla, čo očakáva, a príklad.
  • Re-check now načíta súbor znova (0,005 kreditu). Re-check competitors znova ohodnotí súbory konkurentov.

Príklad výpočtu#

Úplná kontrola beží 5 povinných a 19 odporúčaných kontrol (plus 4 poradné tipy), v hodnote 5 + 9,5 = 14,5 bodu. Súbor, ktorý prejde každú povinnú kontrolu a 15 odporúčaných, dosiahne (5 + 7,5) ÷ 14,5 × 100 = 86.

Strom prístupnosti#

AI agenti sa po stránke pohybujú cez jej strom prístupnosti (roly, názvy, štruktúra), nie cez pixely. AmICited kontroluje HTML vašej úvodnej stránky a Check URL môžete použiť pre ktorúkoľvek inú stránku (0,005 kreditu za kontrolu). Kontroly: stránka dosiahnuteľná, interaktívne prvky pomenované, žiadne skryté interaktívne prvky, obrázky majú alt text, ovládacie prvky formulára majú popisky, jediný H1, poradie nadpisov, hlavný landmark, deklarovaný jazyk stránky a titulok dokumentu.

WebMCP, agentic commerce a Common Crawl#

  • WebMCP. Zisťuje, či vaša úvodná stránka vystavuje nástroje, ktoré agenti môžu volať priamo (vyhľadávanie, pridanie do košíka, rezervácia), namiesto hádania zo stránky. Deklaratívne nástroje sú uvedené s príznakmi čítania alebo zápisu; nástroje registrované z JavaScriptu sú poznamenané, ale zo statického HTML sa nedajú vypísať.
  • Agentic commerce. Zisťuje, či úvodná stránka propaguje protokol, ktorý agentom umožňuje prehliadať, dokončiť objednávku a platiť (ACP, UCP), s odkazom na manifest.
  • Common Crawl. Či môže CCBot web načítať (povolené, zakázané v robots.txt alebo zablokované na okraji CDN), či je doména v najnovšom indexe, koľko URL bolo zachytených a vaša stopa v čase oproti konkurentom. Common Crawl je korpus, z ktorého je postavená väčšina otvorených tréningových datasetov; nie je to to, čo načítavajú GPTBot, OAI-SearchBot či PerplexityBot, takže ho čítajte oddelene od živého AI vyhľadávania.
  • Registrácia domény a certifikát. Dni do vypršania registrácie domény a TLS certifikátu a registrátor.

Audit stránky#

Audit stránky prehľadá každú URL v sitemape domény, zaznamená technické fakty a odkazy každej stránky a vypočíta graf interných odkazov.

  1. Nastavte skenovanie

    Prejdite na Audit → Audit stránky a kliknite na Schedule scan. Nastavte tempo (požiadavky za sekundu, súbežné požiadavky, maximálne čakanie na požiadavku), kedy sa zastaviť (maximum URL, maximálna doba, miera chýb), ktoré URL zahrnúť alebo vylúčiť (až 20 regulárnych výrazov každé), či ukladať odkazy na externé weby a či Repeat scan každých N dní.

  2. Získajte cenu a potvrďte

    Kliknite na Get price. Ponuka spočíta URL vo vašej sitemape, uplatní vaše filtre a limit plánu a ocení skenovanie na 0,002 kreditu za URL (1 000 URL = 2 kredity). Ponuka platí jednu hodinu a skenovanie sa nedá spustiť, kým váš zostatok nepokryje celú sumu.

  3. Prečítajte si report

    Karty: Issues, Pages & links, Outbound domains, Runs, Server response a Crawl log. Po skončení behu dostanete upozornenie.

Crawler je zdvorilý už konštrukčne: keď web odpovie 429 alebo 503, zníži tempo na polovicu a pozastaví sa a spomalí, keď sa doby odozvy zdvojnásobia. Zastavené skenovanie zachová všetko už načítané a účtuje len za to. Každá stránka dostane PageRank (obyčajný a vážený podľa toho, kde odkaz sedí: hlavný obsah sa počíta viac než navigácia či pätička) vedľa organických a platených kliknutí; stĺpce návštevnosti vyžadujú pripojenú Search Console alebo reklamnú platformu.

Súvisiace#