Sichtbarkeit verbessern
Domain-Audit und KI-Zugänglichkeit
Prüfen Sie, ob KI-Crawler und -Agenten Ihre Website erreichen, lesen und darauf agieren können: robots.txt, Sitemaps, llms.txt, Accessibility Tree, WebMCP, Agentic Commerce und Common Crawl, plus ein vollständiger Site-Audit-Crawl.
Eine Engine kann keine Seite zitieren, die sie nicht abrufen kann, und ein Agent kann keine Seite nutzen, die er nicht lesen kann. Die Seite Domain audit (Audit → Domain audit) bündelt die Prüfungen, die entscheiden, ob Ihre Domain von KI-Crawlern und -Agenten gefunden, für vertrauenswürdig gehalten und gelesen werden kann. Die Seite Site-Audit (Audit → Site-Audit) geht tiefer: Sie crawlt jede URL Ihrer Sitemap und berichtet technische Probleme sowie wie interne Links Autorität verteilen.
Führen Sie zuerst das Domain-Audit aus, wenn eine Domain keine Sichtbarkeit hat oder wenn eine Seite, von der Sie Zitierungen erwarten, nie zitiert wird. Eine einzige Disallow-Zeile für GPTBot oder eine CDN-Regel, die Crawler blockiert, erklärt mehr fehlende Zitierungen als jedes Inhaltsproblem.
Zusammenfassung der Agentenbereitschaft#
Der obere Teil der Seite fasst jeden Abschnitt in einer Zeile zusammen: llms.txt-Score, Zugänglichkeits-Score, Crawler-Zugriff, Sitemap-URLs, Sitemap vs. robots, WebMCP, Agentic Commerce und Ablauf der Domain. Ihre getrackten Wettbewerber erscheinen in Vergleichstabellen neben Ihnen, sodass Sie sehen, ob ein Rivale für Agenten schlicht leichter zu lesen ist.
robots.txt und Sitemaps#
Zeigt, ob die wichtigen Such- und KI-Crawler die Website lesen dürfen, ob Sitemaps in der robots.txt deklariert sind und wie viele URLs diese Sitemaps auflisten. Geprüft werden folgende Crawler:
GPTBot, OAI-SearchBot, ChatGPT-User, ClaudeBot, Claude-User, Claude-SearchBot, PerplexityBot, Google-Extended, Googlebot, Bingbot, Applebot, Amazonbot, Meta-ExternalAgent und CCBot.
Außerdem markiert es Konflikte zwischen Ihrer Sitemap und der robots.txt: Sitemap-URLs, die Ihre eigene robots.txt blockiert, Crawler, die von in der Sitemap aufgelisteten URLs ausgesperrt sind, Sitemap-Dateien, die selbst gesperrt sind, Sitemap:-Direktiven, die auf einen anderen Host zeigen, und Sitemap-Dateien über dem Limit von 50.000 URLs oder 50 MB. Gar keine robots.txt bedeutet, dass standardmäßig jeder Crawler erlaubt ist.
llms.txt-Prüfung#
/llms.txt ist eine Markdown-Datei, die Sprachmodellen einen kuratierten Überblick über Ihre Website gibt. AmICited ruft Ihre ab und validiert sie gegen den Vorschlag von llmstxt.org: Transport (im Stammverzeichnis über HTTPS mit HTTP 200 ausgeliefert, ein Text-Content-Type, nicht Ihre HTML-App-Shell, UTF-8, unter 128 KB), Struktur (zuerst eine H1, direkt danach ein Zusammenfassungs-Blockquote, H2-Abschnitte, die Linklisten sind, keine tieferen Überschriften) und Linkqualität (absolute URLs in der Form - [Title](URL): description, kein rohes HTML, kein Platzhaltertext).
- Erforderliche Prüfungen wiegen 1, empfohlene Prüfungen 0,5, und beratende Tipps wiegen 0 (als Hinweis angezeigt, nie bestraft).
- Jede Prüfung zeigt, ob sie bestanden wurde, was sie erwartet, und ein Beispiel.
- Jetzt prüfen ruft die Datei erneut ab (0,005 Credits). Wettbewerber neu prüfen bewertet deren Dateien neu.
Rechenbeispiel#
Eine vollständige Prüfung umfasst 5 erforderliche und 19 empfohlene Prüfungen (plus 4 beratende Tipps), was 5 + 9,5 = 14,5 Punkte ergibt. Eine Datei, die jede erforderliche Prüfung und 15 der empfohlenen besteht, erzielt (5 + 7,5) ÷ 14,5 × 100 = 86.
Accessibility Tree#
KI-Agenten navigieren eine Seite über ihren Accessibility Tree (Rollen, Namen, Struktur), nicht über ihre Pixel. AmICited prüft das HTML Ihrer Startseite, und Sie können mit URL prüfen jede andere Seite prüfen (0,005 Credits pro Prüfung). Die Prüfungen: Seite erreichbar, interaktive Elemente benannt, keine versteckten interaktiven Elemente, Bilder mit Alt-Text, Formularelemente beschriftet, einzelne H1, Überschriftenreihenfolge, ein Main-Landmark, Seitensprache deklariert und ein Dokumenttitel.
WebMCP, Agentic Commerce und Common Crawl#
- WebMCP. Erkennt, ob Ihre Startseite Tools bereitstellt, die Agenten direkt aufrufen können (Suche, In den Warenkorb, Buchen), statt aus der Seite zu raten. Deklarative Tools werden mit Lese- oder Schreib-Flags aufgelistet; aus JavaScript registrierte Tools werden vermerkt, lassen sich aber aus statischem HTML nicht auflisten.
- Agentic Commerce. Erkennt, ob die Startseite ein Protokoll bewirbt, mit dem Agenten stöbern, zur Kasse gehen und bezahlen können (ACP, UCP), mit einem Link zum Manifest.
- Common Crawl. Ob CCBot die Website abrufen kann (erlaubt, in der robots.txt gesperrt oder am CDN-Edge blockiert), ob die Domain im neuesten Index ist, wie viele URLs erfasst wurden und Ihr Fußabdruck im Zeitverlauf gegenüber Wettbewerbern. Common Crawl ist das Korpus, aus dem die meisten offenen Trainingsdatensätze gebaut werden; es ist nicht das, was GPTBot, OAI-SearchBot oder PerplexityBot abrufen, lesen Sie es also getrennt von der Live-KI-Suche.
- Domain-Registrierung und Zertifikat. Tage bis zum Ablauf der Domain-Registrierung und des TLS-Zertifikats sowie der Registrar.
Site-Audit#
Das Site-Audit crawlt jede URL in der Sitemap der Domain, erfasst die technischen Fakten und Links jeder Seite und berechnet den internen Link-Graphen.
Den Scan konfigurieren
Gehen Sie zu Audit → Site-Audit und klicken Sie auf Scan planen. Legen Sie das Tempo fest (Anfragen pro Sekunde, gleichzeitige Anfragen, maximale Wartezeit pro Anfrage), wann gestoppt wird (maximale URLs, maximale Dauer, Fehlerrate), welche URLs ein- oder ausgeschlossen werden (je bis zu 20 reguläre Ausdrücke), ob Links zu externen Websites gespeichert werden und ob der Scan alle N Tage wiederholt wird.
Einen Preis erhalten und bestätigen
Klicken Sie auf Preis anzeigen. Das Angebot zählt Ihre Sitemap-URLs, wendet Ihre Filter und die Obergrenze Ihres Tarifs an und berechnet den Scan mit 0,002 Credits pro URL (1.000 URLs = 2 Credits). Das Angebot gilt eine Stunde, und ein Scan kann nur starten, wenn Ihr Guthaben ihn vollständig deckt.
Den Bericht lesen
Tabs: Probleme, Seiten & Links, Ausgehende Domains, Durchläufe, Serverantwort und Crawl-Protokoll. Sie werden benachrichtigt, wenn der Lauf endet.
Der Crawler ist von Haus aus rücksichtsvoll: Er halbiert seine Rate und pausiert, wenn die Website mit 429 oder 503 antwortet, und verlangsamt, wenn sich die Antwortzeiten verdoppeln. Ein gestoppter Scan behält alles bereits Abgerufene und berechnet nur dafür. Jede Seite erhält einen PageRank (einfach und gewichtet danach, wo der Link sitzt: Hauptinhalt zählt mehr als Navigation oder Footer) neben ihren organischen und bezahlten Klicks; die Traffic-Spalten benötigen eine verbundene Search Console oder Werbeplattform.