Dokumentacja

Poprawa widoczności

Audyt domeny i dostępność dla AI

Sprawdź, czy crawlery i agenci AI mogą dotrzeć do Twojej witryny, odczytać ją i na niej działać: robots.txt, mapy witryny, llms.txt, drzewo dostępności, WebMCP, agentic commerce i Common Crawl, a także pełny crawl audytu strony.

Silnik nie może zacytować strony, której nie może pobrać, a agent nie może użyć strony, której nie może odczytać. Strona Audyt domeny (Audyt → Audyt domeny) zbiera kontrole, które decydują, czy Twoja domena może zostać znaleziona, uznana za wiarygodną i odczytana przez crawlery i agentów AI. Strona Audyt strony (Audyt → Audyt strony) idzie głębiej: wykonuje crawl każdego adresu URL z Twojej mapy witryny i raportuje problemy techniczne oraz to, jak linki wewnętrzne rozdzielają autorytet.

Uruchom najpierw audyt domeny, gdy domena ma zerową widoczność albo gdy strona, której się spodziewasz w cytowaniach, nigdy nie jest cytowana. Jedna linia Disallow dla GPTBot lub reguła CDN blokująca crawlery tłumaczy więcej brakujących cytowań niż jakikolwiek problem z treścią.

Podsumowanie gotowości dla agentów#

Góra strony podsumowuje każdą sekcję w jednym wierszu: wynik llms.txt, wynik dostępności, dostęp crawlerów, adresy URL w mapie witryny, mapa witryny a robots, WebMCP, agentic commerce i wygaśnięcie domeny. Twoi śledzeni konkurenci pojawiają się w tabelach porównawczych obok Ciebie, więc widzisz, czy rywal jest po prostu łatwiejszy do odczytania dla agentów.

robots.txt i mapy witryny#

Pokazuje, czy ważne crawlery wyszukiwarek i AI mają zezwolenie na czytanie witryny, czy mapy witryny są zadeklarowane w robots.txt i ile adresów URL te mapy wymieniają. Sprawdzane crawlery to:

GPTBot, OAI-SearchBot, ChatGPT-User, ClaudeBot, Claude-User, Claude-SearchBot, PerplexityBot, Google-Extended, Googlebot, Bingbot, Applebot, Amazonbot, Meta-ExternalAgent i CCBot.

Sygnalizuje też konflikty między mapą witryny a robots.txt: adresy URL z mapy witryny blokowane przez Twój własny robots.txt, crawlery zablokowane dla adresów URL wymienionych w mapie witryny, pliki map witryn, które same są zablokowane, dyrektywy Sitemap: wskazujące na inny host oraz pliki map witryn przekraczające limit 50 000 adresów URL lub 50 MB. Brak robots.txt w ogóle oznacza, że każdy crawler ma domyślnie zezwolenie.

Przegląd llms.txt#

/llms.txt to plik Markdown, który daje modelom językowym wyselekcjonowany przegląd Twojej witryny. AmICited pobiera Twój i waliduje go względem propozycji llmstxt.org: transport (serwowany w katalogu głównym przez HTTPS z HTTP 200, typ zawartości tekstowy, nie powłoka HTML Twojej aplikacji, UTF-8, poniżej 128 KB), struktura (jeden H1 na początku, cytat podsumowujący zaraz po nim, sekcje H2 będące listami linków, bez głębszych nagłówków) i jakość linków (bezwzględne adresy URL w formie - [Title](URL): description, bez surowego HTML, bez tekstu zastępczego).

Wynik llms.txt
ważone zaliczone kontrole ÷ ważone kontrole łącznie × 100
  • Kontrole Required ważą 1, kontrole recommended ważą 0,5, a wskazówki doradcze ważą 0 (pokazywane jako wskazówki, nigdy nie karane).
  • Każda kontrola pokazuje, czy została zaliczona, czego oczekuje i przykład.
  • Re-check now pobiera plik ponownie (0,005 kredytu). Re-check competitors ponownie ocenia pliki konkurentów.

Przykład obliczeń#

Pełny przegląd wykonuje 5 kontroli required i 19 recommended (plus 4 wskazówki doradcze), wartych 5 + 9,5 = 14,5 punktu. Plik, który zalicza każdą kontrolę required i 15 z recommended, dostaje (5 + 7.5) ÷ 14.5 × 100 = 86.

Drzewo dostępności#

Agenci AI poruszają się po stronie przez jej drzewo dostępności (role, nazwy, struktura), a nie przez piksele. AmICited sprawdza HTML Twojej strony głównej, a dla dowolnej innej strony możesz użyć Check URL (0,005 kredytu za przegląd). Kontrole: strona osiągalna, elementy interaktywne nazwane, brak ukrytych elementów interaktywnych, obrazy mają tekst alternatywny, kontrolki formularzy opisane, pojedynczy H1, kolejność nagłówków, landmark main, zadeklarowany język strony i tytuł dokumentu.

WebMCP, agentic commerce i Common Crawl#

  • WebMCP. Wykrywa, czy Twoja strona główna udostępnia narzędzia, które agenci mogą wywoływać bezpośrednio (wyszukiwanie, dodanie do koszyka, rezerwacja), zamiast zgadywać ze strony. Narzędzia deklaratywne są wymienione ze znacznikami odczytu lub zapisu; narzędzia rejestrowane z JavaScriptu są odnotowane, ale nie da się ich wymienić ze statycznego HTML.
  • Agentic commerce. Wykrywa, czy strona główna ogłasza protokół pozwalający agentom przeglądać, finalizować zakup i płacić (ACP, UCP), z linkiem do manifestu.
  • Common Crawl. Czy CCBot może pobrać witrynę (dozwolone, zabronione w robots.txt lub zablokowane na krawędzi CDN), czy domena jest w najnowszym indeksie, ile adresów URL przechwycono i Twój ślad w czasie na tle konkurentów. Common Crawl to korpus, z którego zbudowana jest większość otwartych zbiorów treningowych; nie jest tym, co pobierają GPTBot, OAI-SearchBot ani PerplexityBot, więc czytaj go osobno od wyszukiwania AI na żywo.
  • Rejestracja domeny i certyfikat. Liczba dni do wygaśnięcia rejestracji domeny i certyfikatu TLS oraz rejestrator.

Audyt strony#

Audyt strony wykonuje crawl każdego adresu URL z mapy witryny domeny, zapisuje fakty techniczne i linki każdej strony oraz oblicza graf linków wewnętrznych.

  1. Skonfiguruj skan

    Przejdź do Audyt → Audyt strony i kliknij Schedule scan. Ustaw tempo (żądania na sekundę, żądania równoległe, maksymalny czas oczekiwania na żądanie), kiedy się zatrzymać (maksymalna liczba adresów URL, maksymalny czas trwania, odsetek błędów), które adresy URL uwzględnić lub wykluczyć (do 20 wyrażeń regularnych każde), czy zapisywać linki do witryn zewnętrznych i czy Repeat scan co N dni.

  2. Sprawdź cenę i potwierdź

    Kliknij Get price. Wycena liczy adresy URL z Twojej mapy witryny, stosuje Twoje filtry i limit planu i wycenia skan po 0,002 kredytu za adres URL (1000 adresów URL = 2 kredyty). Wycena jest ważna przez godzinę, a skan nie może się rozpocząć, jeśli Twoje saldo nie pokrywa go w całości.

  3. Przeczytaj raport

    Karty: Issues, Pages & links, Outbound domains, Runs, Server response i Crawl log. Otrzymasz powiadomienie po zakończeniu uruchomienia.

Crawler jest uprzejmy z założenia: zmniejsza o połowę tempo i robi pauzę, gdy witryna odpowiada 429 lub 503, i zwalnia, gdy czasy odpowiedzi się podwajają. Zatrzymany skan zachowuje wszystko, co już pobrano, i nalicza opłatę tylko za to. Każda strona dostaje PageRank (zwykły oraz ważony miejscem linku: treść główna liczy się bardziej niż nawigacja lub stopka) obok kliknięć organicznych i płatnych; kolumny ruchu wymagają połączonego Search Console lub platformy reklamowej.

Powiązane#