SEO Playbook · Post type

Strony llms.txt i manifest agenta: Utrzymywany indeks witryny dla maszyn

Zbuduj i utrzymuj stronę llms.txt, która zapewnia agentom AI dokładny indeks witryny bez ujawniania tajemnic, powielania treści czy wychodzenia z aktualności.

15 min read

Strona llms.txt i manifest agenta to indeks czytelny maszynowo, który informuje systemy AI, co reprezentuje witryna, które publiczne strony są autorytatywne oraz — gdy firma obsługuje działania agentów — które zweryfikowane możliwości i zasady mają zastosowanie. Jest to mapa do utrzymywanych źródeł, a nie ich substytut ani obietnica, że jakikolwiek konkretny crawler ją wykorzysta.

Jej kontrakt to tożsamość → zakres → autorytatywne miejsca docelowe → opcjonalne możliwości → ograniczenia → świeżość. Plik odnosi sukces, gdy maszyna może go pobrać, zinterpretować bez zgadywania, przejść do aktualnych kanonicznych adresów URL i dotrzeć do faktów wciąż zgodnych z rzeczywistością produkcyjną.

Na jakie pytania odpowiada

Podstawowe pytanie brzmi: „Które części tej witryny powinien wykorzystać system AI, aby zrozumieć organizację, jej treść i obsługiwane działania?” Pytania pomocnicze obejmują:

  • Jaka jest kanoniczna nazwa, domena, cel i grupa docelowa witryny?
  • Które strony produktowe, usługowe, dokumentacyjne, cenowe, polityczne i wsparcia są autorytatywne?
  • Które strony powinny być preferowane nad archiwami, stronami kampanii, parametrami lub zduplikowanymi wersjami regionalnymi?
  • Czy witryna udostępnia rzeczywiste możliwości agenta, czy tylko informacje czytelne dla człowieka?
  • Gdzie udokumentowano uwierzytelnianie, limity szybkości, obsługę danych, warunki handlowe i wsparcie?
  • Które stwierdzenia są opisowymi wskazówkami, a nie regułami kontroli dostępu?
  • Kto jest właścicielem pliku, jakie zdarzenie wyzwala aktualizację i jak wykrywane jest odchylenie?

Kiedy stosować ten typ wpisu

Użyj tego typu, gdy witryna ma wystarczająco dużo publicznych, trwałych treści, aby skorzystać z selekcjonowanego indeksu czytelnego maszynowo, i gdy ktoś może przejąć jego utrzymanie. Powodem publikacji jest zmniejszenie niejednoznaczności dla systemów wyszukiwania, a nie tworzenie kolejnego adresu URL dla samego siebie.

Mylny typ wpisuCo organizujePodstawowy odbiorcaWybierz go zamiast, gdy
Strona llms.txt i manifest agentaTożsamość kanoniczna, wartościowe źródła publiczne i opcjonalnie zweryfikowane możliwości agentaSystemy AI, crawlery, agenci i zespoły je walidująceRezultatem jest zwięzła mapa czytelna maszynowo w przewidywalnej lokalizacji
indeks katalogowyZbiór profili, zasobów, lokalizacji lub ofertOsoba przeglądająca i filtrująca zbiórŚcieżki odkrywania, kategorie, opisy i porównanie przez człowieka są głównym doświadczeniem
artykuł dokumentacyjnyJedno zachowanie produktu, pole, limit, konfiguracja lub wersjaIstniejący użytkownik szukający dokładnej odpowiedzi referencyjnejStrona musi wyjaśniać treść docelową, a nie tylko do niej prowadzić
strona politykiAutorytatywne zasady, obowiązki, zakres, wyjątki i daty wejścia w życieOsoby lub systemy decydujące, co jest dozwoloneSama polityka musi być przeczytana, zaakceptowana lub egzekwowana; linkuj do niej z manifestu
strona danych produktowych dla agentówProdukty, identyfikatory, oferty, dostępność i fakty transakcyjneAgenci porównujący lub działający na danych produktowychDane handlowe na poziomie pozycji i działania są głównym ładunkiem, a nie indeksem na poziomie witryny

Nie myl wskazówek z kontrolą. robots.txt wyraża preferencje dostępu crawlera; mapa witryny XML pomaga crawlerom odkrywać adresy URL; uwierzytelnianie i autoryzacja decydują, czy działanie może nastąpić. llms.txt zapewnia selekcjonowany kontekst. Zdanie w llms.txt nie może udzielić dostępu, cofnąć dostępu, chronić tajemnicy ani nadpisać warunków strony docelowej.

Najlepsze dla tych typów firm

  1. SaaS . Najlepsze dopasowanie, ponieważ firma programistyczna zwykle ma odrębne źródła produktu, funkcji, cen, integracji, API, bezpieczeństwa, statusu i dokumentacji. Indeks może rozstrzygać, która strona jest właścicielem którego faktu, podczas gdy oddzielny manifest możliwości może opisywać tylko działania, które produkt rzeczywiście obsługuje.
  2. E-commerce . Mocne dopasowanie, gdy produkty, wysyłka, zwroty, dostępność i polityki obsługi klienta są publiczne i kanoniczne. Przechowuj zmienne dane pozycji w feedach lub API; użyj indeksu, aby wskazywać na te utrzymywane źródła, zamiast kopiować katalog do Markdown.
  3. Marketplace . Wartościowe, gdy polityki kupującego, sprzedającego, dostawcy i platformy różnią się. Oznacz każdą grupę odbiorców i jurysdykcję, aby agent nie stosował zasad sprzedającego do kupującego ani nie wnioskował o stanie magazynowym platformy z jednej oferty.
  4. Usługi B2B . Przydatne do wyjaśnienia możliwości, branż, granic usług, dowodów, materiałów zakupowych i dróg kontaktu. Nie zamieniaj wynegocjowanego zakresu ani obietnicy specyficznej dla klienta w uniwersalne twierdzenie czytelne maszynowo.
  5. Agencje . Przydatne, gdy firma utrzymuje wiele stron usług, metodologii, studium przypadku i wiedzy specjalistycznej. Portale klientów, poświadczenia, prywatne raporty i wewnętrzne playbooki pozostają poza publicznym plikiem.
  6. Producenci i firmy przemysłowe . Przydatne do kierowania systemów do rodzin produktów, specyfikacji, certyfikatów, instrukcji, dystrybutorów i dokumentów bezpieczeństwa. Indeks nigdy nie powinien parafrazować instrukcji krytycznych dla bezpieczeństwa, gdy kontrolowany dokument jest autorytetem.

Małe witryny wizytówkowe z pięcioma stabilnymi stronami mogą zyskać niewiele na kolejnym utrzymywanym artefakcie. Witryny bez jasnego właściciela treści powinny najpierw naprawić kanonikalizację, nawigację i jakość źródeł przed publikacją pliku, który natychmiast zacznie się dezaktualizować.

Intencja wyszukiwania

intencja wyszukiwania to rezultat oczekiwany od zapytania. Ten typ ma dwie grupy odbiorców o różnych intencjach. Maszyna pobiera przewidywalną ścieżkę korzeniową i oczekuje zwięzłego Markdown, stabilnych nagłówków, kanonicznych linków i bez dekoracyjnego szumu. Człowiek szukający zwykle chce wskazówek wdrożeniowych: „przykład llms.txt”, „co powinno znaleźć się w llms.txt” lub „format manifestu agenta”. Publiczna strona wyjaśniająca może odpowiedzieć na te pytania, podczas gdy wdrożony plik /llms.txt pozostaje zoptymalizowany do pobierania maszynowego.

Sam plik nie jest stroną docelową dla słów kluczowych. Nie dodawaj ogólnych definicji, powtarzanych terminów kategorii ani setek linków blogowych, aby „go pozycjonować”. Każda dodatkowa linia pochłania uwagę i tworzy kolejny obowiązek utrzymania. Preferuj dziesięć przemyślanych linków z jasnymi opisami nad zrzut dziesięciu tysięcy adresów URL.

Ponieważ konwencje i wsparcie odbiorców mogą się zmieniać, określ, na czym opiera się Twoja implementacja, i unikaj twierdzenia o powszechnym przyjęciu. Udane pobranie dowodzi tylko, że plik jest dostępny i parsowalny; nie dowodzi, że konkretny produkt AI używa go do pozycjonowania, wyszukiwania, trenowania ani cytowania.

Struktura strony

Widełki słowne to ograniczenia redakcyjne, a nie cele. Wdrożony plik powinien pozostać na tyle zwięzły, aby można go było audytować linia po linii. Notatka implementacyjna dla człowieka może być dłuższa, ale nie może być kopiowana do pliku maszynowego.

SekcjaWidełki słowneCelWymagana?
Nazwa witryny i bezpośredni opis30–70Ustal tożsamość kanoniczną, cel, grupę docelową i zakres przed jakimikolwiek linkami.Wymagana
Notatka o zakresie i interpretacji30–90Wyjaśnij, co obejmuje indeks, i wskaż źródła kontroli dostępu lub zasad.Wymagana, gdy niejednoznaczność jest prawdopodobna
Zasoby podstawowe60–180Linkuj do niewielkiego zestawu stron definiujących organizację, ofertę, dokumentację, ceny i wsparcie.Wymagana
Grupy tematyczne lub produktowe80–300Organizuj dodatkowe zasoby kanoniczne pod prostymi, stabilnymi nagłówkami.Warunkowa; używaj tylko gdy katalog tego wymaga
Możliwości agenta80–250Zidentyfikuj rzeczywiste działania i linkuj do ich czytelnych maszynowo kontraktów, uwierzytelniania, limitów i zasad.Warunkowa; pomiń, gdy nie ma obsługiwanego działania
Zasoby opcjonalne40–150Wymień użyteczne, ale nie niezbędne materiały, takie jak badania lub wybrane studia przypadków.Warunkowa
Rekord utrzymania20–70Podaj datę weryfikacji, rolę właściciela, system źródłowy lub status wygenerowania.Wymagana

Typowy selekcjonowany plik ma około 200–700 słów. Długość nie jest sygnałem jakości: odpowiedni rozmiar to najmniejszy indeks, który ustala tożsamość i kieruje odbiorcę do utrzymywanych źródeł bez ukrywania kluczowych rozróżnień.

Wymagane elementy

Indeks musi być nudny w najlepszym sensie: przewidywalny, jawny i łatwy do porównania. Umieść krytyczną interpretację przed opcjonalnymi linkami, aby częściowe odczytanie nie prowadziło do fałszywego wniosku.

ElementZawsze czy warunkowoPozycjaReguła produkcyjna
blok bezpośredniej odpowiedziZawszePierwsze linie po H1Podaj nazwę organizacji i określ, co zapewnia witryna, w języku, który istnieje samodzielnie.
szybki przegląd i spis treściWarunkowoPo opisieUżyj prostych nagłówków Markdown jako nawigacji, gdy istnieje kilka grup zasobów; nie dodawaj dekoracyjnego spisu treści do surowego pliku.
tabela specyfikacjiWarunkowoStrona implementacyjna dla człowiekaUdokumentuj punkt końcowy, format, właściciela, źródło generowania, walidację i wyzwalacze odświeżania; unikaj tabel HTML w surowym pliku.
ramka notatkiWarunkowoObok wskazówek interpretacyjnychWyjaśnij, że wskazówki indeksowania nie zastępują uprawnień, zasad ani faktów na stronie docelowej.
ramka ostrzeżeniaWarunkowo; obowiązkowa przy ryzyku ujawnieniaPrzed wskazówkami dotyczącymi możliwości lub danych prywatnychNazwij ryzyko i bezpieczne źródło; nigdy nie umieszczaj tajemnic, tokenów, niepublicznych punktów końcowych ani danych klientów w publicznym manifeście.
blok źródełZawsze na stronie implementacyjnejPo specyfikacjiPodaj konwencję, wewnętrzne systemy źródła prawdy i dowody walidacji bez sugerowania nieobsługiwanej standaryzacji.
znacznik świeżościZawszeKoniec surowego indeksu lub blisko góry rekordu implementacyjnegoPodaj datę ostatniej istotnej weryfikacji i rolę właściciela.
dziennik aktualizacjiWarunkowoStrona implementacyjna dla człowiekaRejestruj zmiany zakresu, ważnych miejsc docelowych, możliwości lub reguł generowania — nie zmiany interpunkcji.
blok powiązanych treściZawsze na stronie implementacyjnejPrzed FAQLinkuj do kontroli dostępu, danych strukturalnych, danych produktowych i wskazówek pomiarowych z uzasadnieniem każdego z nich.
struktura FAQZawsze na stronie implementacyjnejPrzed CTAOdpowiadaj na pozostałe pytania dotyczące przyjęcia, zakresu, bezpieczeństwa, powielania i utrzymania.
blok CTAZawsze na stronie implementacyjnejOstatni elementZaproponuj działanie walidacyjne, monitorujące lub wdrożeniowe odpowiednie dla czytelnika na etapie rozważania.

Frontmatter

Postępuj zgodnie ze specyfikacją frontmatter . W tej specyfikacji typu wpisu użyj entity = "post-type-llms-txt-page" i schemaType = "Article". Na stronie implementacyjnej dla człowieka dla konkretnej organizacji użyj stabilnej tożsamości, takiej jak acme-ai-access-index, a nie frazy kampanii lub daty.

Użyj Article, ponieważ strona internetowa wyjaśnia implementację. Znaczniki schematu opisują widoczną treść; nie zamieniają surowego pliku tekstowego w uznany protokół agenta. Nie oznaczaj strony jako SoftwareApplication, Dataset ani HowTo, chyba że jej widoczna treść i szablon spełniają odpowiednie wymagania niezależnie.

Surowe /llms.txt normalnie nie ma frontmatteru, ponieważ frontmatter nie może wyciekać do opublikowanego wyjścia. Przechowuj jego metadane operacyjne w CMS, konfiguracji generatora lub rekordzie repozytorium: domena kanoniczna, zakres locale, właściciel, kolekcja źródłowa, tryb generowania, data ostatniej weryfikacji, zasada następnego przeglądu, wynik walidatora i miejsce docelowe alertów. Jeśli istnieją pliki zlokalizowane, udokumentuj regułę wyboru i przechowuj jeden jednoznaczny kanoniczny korzeń odpowiedzi.

Pełny przykład

Ten fikcyjny plik ilustruje zwięzły indeks dla platformy SaaS. Jego adresy URL, produkt i możliwości są przykładami; wzorzec jest specyfikacją.

# Northstar Analytics

> Northstar Analytics to platforma raportowania dla zespołów operacyjnych. Ten indeks wskazuje publiczne strony definiujące produkt, plany, dokumentację, polityki i obsługiwaną możliwość agenta.

Uprawnienia dostępu są kontrolowane przez robots.txt, uwierzytelnianie i polityki, do których prowadzą linki poniżej. Ten plik nie udziela dostępu ani pozwolenia na ponowne wykorzystanie treści.

## Produkt

- [Przegląd produktu](https://www.northstar.example/product): Aktualny zakres produktu i obsługiwane przepływy raportowania.
- [Plany i ceny](https://www.northstar.example/pricing): Aktualne publiczne plany, uwzględnione funkcje i warunki fakturowania.
- [Integracje](https://www.northstar.example/integrations): Obsługiwane źródła danych i systemy docelowe.

## Dokumentacja

- [Strona główna dokumentacji](https://docs.northstar.example/): Aktualna dokumentacja dla użytkowników i administratorów.
- [Referencja API](https://docs.northstar.example/api/): Publiczne punkty końcowe, schematy, uwierzytelnianie, błędy i limity szybkości.
- [Informacje o wydaniach](https://docs.northstar.example/releases/): Odatowane zmiany w produkcie i zachowaniu API.

## Zaufanie i wsparcie

- [Bezpieczeństwo](https://www.northstar.example/security): Program bezpieczeństwa i aktualne dokumenty zapewnienia.
- [Polityka prywatności](https://www.northstar.example/privacy): Przetwarzanie danych, przechowywanie i prawa użytkowników.
- [Wsparcie](https://www.northstar.example/support): Obsługiwane kanały kontaktu i link do statusu usługi.

## Możliwość agenta

- [Akcja eksportu raportu](https://docs.northstar.example/agents/export-report): Kontrakt uwierzytelnionej akcji, akceptowane dane wejściowe, format wyjściowy, limity szybkości i obsługa błędów. Dostępność zależy od planu i roli użytkownika.

## Opcjonalnie

- [Biblioteka badawcza](https://www.northstar.example/research): Oryginalne raporty porównawcze z metodologiami i datami publikacji.

Zweryfikowano 2026-08-27 przez zespół Documentation Operations. Wygenerowano z kanonicznego rejestru zasobów publicznych; waliduj po zmianach produktu, planu, polityki, API lub adresów URL.

Przykład deklaruje tylko jedną możliwość, ponieważ istnieje rzeczywisty, udokumentowany kontrakt działania. Jeśli produkt nie ma obsługiwanego działania agenta, pomiń tę sekcję. Nigdy nie wnioskuj o możliwości transakcyjnej na podstawie obecności pola wyszukiwania, formularza lub nieudokumentowanego punktu końcowego.

W przypadku manifestu agenta przechowywanego oddzielnie od /llms.txt zachowaj tę samą dyscyplinę. Określ wersjonowany format, kanoniczny identyfikator, produkcyjny punkt końcowy, metodę uwierzytelniania, dozwolone operacje, schemat wejścia i wyjścia, limity szybkości, granice zgody, stany błędów i adresy URL zasad. Waliduj go względem działającego systemu. Syntaktycznie poprawna deklaracja reklamująca wyłączoną akcję wciąż jest błędna.

Galeria projektów

Surowe plik ma z założenia niewielki projekt wizualny. Warianty galerii powinny testować architekturę informacji, kolejność skanowania, czytelność mobilną strony implementacyjnej dla człowieka i dowody operacyjne — a nie dekorację.

Lista kontrolna jakości

Publikuj tylko wtedy, gdy każde mające zastosowanie stwierdzenie jest prawdziwe:

  • Plik jest osiągalny pod docelowym korzeniem URL bez uwierzytelniania, pętli przekierowań, zgód na ciasteczka ani wyrenderowanej powłoki aplikacji.
  • Odpowiedź jest czytelnym tekstem lub Markdown, używa UTF-8 i nie wymaga JavaScript do ujawnienia swojej treści.
  • H1 podaje kanoniczną nazwę organizacji lub witryny, a opis określa cel, grupę docelową i zakres bez sloganów.
  • Każdy linkowany URL jest kanoniczny, publiczny, indeksowalny zgodnie z polityką, osiągalny i należący do organizacji lub wyraźnie oznaczony jako zewnętrzny.
  • Opisy linków mówią, jaki autorytet ma miejsce docelowe; nie powtarzają ogólnego tekstu kotwicy, takiego jak „dowiedz się więcej”.
  • Podstawowe źródła produktowe, cenowe, dokumentacyjne, polityczne i wsparcia są zgodne z indeksem.
  • Strony archiwalne, wyniki wyszukiwania, parametry śledzenia, zduplikowane locale, strony kampanii i strony tagów o niskiej wartości są wykluczone.
  • Deklaracje możliwości są zgodne z działającym, obsługiwanym, uwierzytelnionym kontraktem i zawierają odpowiednie ograniczenia.
  • Żadna tajemnica, token, prywatny punkt końcowy, dane osobowe, dokument klienta, nieopublikowana pozycja roadmapy ani szczegół implementacyjny wrażliwy dla bezpieczeństwa nie pojawia się.
  • Język dostępu, uprawnień, licencjonowania i polityki wskazuje na źródła kontrolne i nie jest zaprzeczany przez indeks.
  • Plik nie gwarantuje pozycji, cytowania, wykluczenia z trenowania ani powszechnego wsparcia odbiorców.
  • Zakres locale i regionalny jest jawny wszędzie tam, gdzie różnią się ceny, polityki, dostępność lub dokumentacja.
  • Właściciel, rejestr źródłowy, proces generowania i metoda walidacji są zapisane poza plikiem lub na jego końcu.
  • Sprawdzenia zepsutych linków, nieoczekiwanych przekierowań, statusu odpowiedzi, skrótu treści i wymaganych sekcji są uruchamiane po odpowiednich wdrożeniach.
  • Data weryfikacji zmienia się tylko po istotnym sprawdzeniu miejsc docelowych, opisów, możliwości i zasad.

Częste błędy

Traktowanie pliku jako mapy witryny. Pełny inwentarz URL niszczy priorytetyzację i jest trudny do przeglądu. Zachowaj mapy XML do wykrywania; selekcjonuj llms.txt wokół autorytatywnych źródeł i znaczących grup.

Traktowanie go jako kontroli dostępu. Prośba w Markdown nie jest warstwą egzekwowania. Wyrażaj zasady przeszukiwania w robots.txt, chroń prywatne zasoby uwierzytelnianiem i umieszczaj wiążące wymagania w odpowiednich politykach i kontrolach systemowych.

Kopiowanie treści docelowej do indeksu. Powielane ceny, specyfikacje produktów i polityki rozjeżdżają się. Podsumuj tylko tyle, aby zidentyfikować autorytet, a następnie linkuj do utrzymywanego źródła.

Publikowanie spekulatywnych możliwości. Nieudokumentowany formularz lub trasa API nie czynią witryny gotową dla agentów. Deklaruj tylko działania obsługiwane produkcyjnie z uwierzytelnianiem, schematami, ograniczeniami, błędami i właścicielem.

Dołączanie wszystkiego „na wszelki wypadek”. Więcej linków tworzy więcej niejednoznaczności i więcej punktów awarii. Treści opcjonalne powinny zasłużyć na włączenie, odpowiadając na prawdopodobną potrzebę wyszukiwania, której podstawowe sekcje nie obejmują.

Ujawnianie prywatnych materiałów. Publiczne pliki czytelne maszynowo są publiczne. Nigdy nie wymieniaj hostów stagingowych, wewnętrznych API, poświadczeń, eksportów klientów, nieopublikowanych dokumentów ani szczegółów bezpieczeństwa, które nie zostały celowo zatwierdzone do publikacji.

Generowanie bez nadzoru. Automatyzacja może szybko reprodukować złe dane źródłowe. Generator potrzebuje zatwierdzonego rejestru źródeł, reguł wykluczania, deterministycznego porządkowania, walidacji, odpowiedzialności za przegląd i alertów wdrożeniowych.

Ręczna edycja wygenerowanego pliku. Następne generowanie nadpisuje poprawkę. Popraw rekord źródłowy lub generator, wygeneruj ponownie i zarejestruj istotną zmianę.

Twierdzenie o nieobsługiwanych rezultatach. „To gwarantuje cytowania AI” zamienia niepewną konwencję wdrożeniową w mylącą obietnicę. Raportuj dowody dostępności i wyszukiwania oddzielnie od wyników widoczności i cytowań.

Aktualizowanie daty bez sprawdzania rzeczywistości. Nowy znacznik czasu nie naprawi martwego adresu URL dokumentacji, zmienionej nazwy planu ani wyłączonej akcji. Weryfikacja oznacza porównanie każdego ważnego oświadczenia z jego źródłem produkcyjnym.

Linkowanie wewnętrzne

Linkuj stronę implementacyjną dla człowieka w górę do typów wpisów SEO , gdy autor musi odróżnić indeks maszynowy od katalogu, strony dokumentacji lub polityki. Linkuj od każdego twierdzenia operacyjnego do jego źródła kontrolnego: zakres produktu do strony produktu, aktualne ceny do cennika, zachowanie do dokumentacji, uprawnienia do kontroli dostępu, a obowiązki do polityki.

Surowe plik powinien używać kanonicznych bezwzględnych adresów URL, ponieważ może być pobierany poza normalną nawigacją witryny. Preferuj jeden autorytatywny cel dla każdego faktu. Jeśli dwie strony nakładają się, rozstrzygnij własność przed wymienieniem obu; indeks powinien ujawniać hierarchię źródeł, a nie upamiętniać wewnętrzną niezgoda.

Używaj krótkich, stabilnych nazw sekcji, takich jak Produkt, Dokumentacja, Polityki i Możliwości agenta. Zachowaj warianty locale w wyraźnie oznaczonych grupach tylko wtedy, gdy różnią się istotnie. Nie linkuj każdego wpisu blogowego; wybierz trwałe badania lub przewodniki tylko wtedy, gdy pomagają systemowi zrozumieć temat i dowody witryny.

Linki przychodzące też mają znaczenie operacyjne. Dokumentacja, portale deweloperskie i wskazówki dostępności AI powinny kierować opiekunów do rekordu implementacyjnego, podczas gdy rekord wskazuje na działający plik i walidator. Tworzy to ścieżkę przeglądu dla ludzi bez zaśmiecania indeksu maszynowego.

Jak mierzyć wyniki

Mierz plik najpierw jako infrastrukturę, a dopiero potem jako wkład w widoczność. Wzrostu cytowań nie można przypisać llms.txt tylko dlatego, że oba wystąpiły po publikacji.

Śledź cztery warstwy:

  • Dostępność: status odpowiedzi korzenia URL, zachowanie przekierowań, typ treści, kodowanie, opóźnienie, niezależność od renderowania i czas działania.
  • Integralność: powodzenie parsowania, wymagane sekcje, zduplikowane adresy URL, zepsute linki, cele przekierowań, niezgodność kanoniczna, nieautoryzowane domeny, ujawnione tajemnice i zmiany skrótu treści.
  • Świeżość: dni od ostatniej istotnej weryfikacji, zmiany miejsc docelowych od weryfikacji, pokrycie rejestru źródeł, potwierdzenie właściciela i czas naprawy odchylenia.
  • Wyniki: pobrania z logów serwera przez identyfikowalnych agentów, tam gdzie jest to prawnie i technicznie odpowiednie, wizyty w indeksowanych miejscach docelowych, cytowania AI preferowanych stron kanonicznych i dokładność odpowiedzi na śledzone pytania o markę lub produkt.

Ustal linię bazową przed wdrożeniem: które adresy URL są cytowane, które fakty są błędnie przedstawiane, czy plik korzeniowy istnieje i które crawlery go żądają. Adnotuj publikację i każdą istotną aktualizację. Porównuj okna obserwacyjne wystarczająco długie, aby uniknąć odczytania pojedynczego pobrania lub cytowania jako trendu, i zachowaj rozróżnienie między korelacją a przyczynowością.

Testuj tryby awarii bezpośrednio. Zmień nazwę kopii stagingowej wymienionego adresu URL i potwierdź, że walidator wychwyci błąd. Zmień mapowanie kanoniczne i potwierdź, że generator aktualizuje indeks. Wyłącz możliwość w kontrolowanym środowisku testowym i potwierdź, że sprawdzenie manifestu nie powiedzie się. Te testy dowodzą systemu utrzymania, a nie zewnętrznego przyjęcia.

Użyj jak mierzymy wyniki , aby oddzielić dostępność techniczną, reprezentację maszynową, wykrywanie, cytowanie, zaangażowanie i wyniki biznesowe. W AmICited przejrzyj działający plik w sekcji Agent Accessibility i użyj raportu Cockpit , aby obserwować cytowane adresy URL i widoczność AI wraz z adnotacjami wdrożeniowymi. Wiarygodne twierdzenie o sukcesie brzmi: „plik jest ważny, aktualny i kieruje systemy do zamierzonych źródeł”; każda zmiana widoczności poniżej wymaga oddzielnego dowodu.

FAQ

Często zadawane pytania

Czym jest strona llms.txt?
Strona llms.txt to zwięzły plik Markdown w katalogu głównym domeny, który opisuje witrynę i selekcjonuje linki do autorytatywnych stron, które system AI powinien zrozumieć w pierwszej kolejności.
Czy llms.txt to to samo co robots.txt lub mapa witryny XML?
Nie. robots.txt komunikuje uprawnienia do przeszukiwania, mapa witryny XML wylicza przeszukiwalne adresy URL, a llms.txt selekcjonuje kontekst i priorytety. Żaden z nich nie zastępuje pozostałych.
Czy publikacja llms.txt poprawia pozycje lub gwarantuje cytowania przez AI?
Nie. Przyjęcie jest różne i nie ma gwarantowanej korzyści w zakresie pozycji ani cytowań. Traktuj plik jako niskokosztowe wskazówki do wyszukiwania, których wartość zależy od dokładnych, użytecznych stron docelowych.
Co powinno znaleźć się w manifeście agenta?
Uwzględnij tylko zweryfikowaną tożsamość, możliwości, punkty końcowe, uwierzytelnianie, dane wejściowe, wyjściowe, politykę i fakty wsparcia potrzebne przez docelowego agenta. Nie reklamuj działania, które system produkcyjny nie może bezpiecznie wykonać.
Czy każda witryna powinna publikować plik llms-full.txt?
Nie. Wariant z pełną treścią zwiększa powielanie, objętość tokenów, nieaktualność i ryzyko licencyjne. Publikuj go tylko wtedy, gdy określony odbiorca go potrzebuje, a ten sam system źródłowy może go synchronizować.
Jak często należy przeglądać llms.txt?
Przeglądaj go po zmianach nawigacji, produktu, cen, dokumentacji, polityki, domeny lub kanonicznych adresów URL oraz w zaplanowanym cyklu opartym na tym, jak szybko te źródła się zmieniają.
Sprawdź, czy Twój indeks czytelny maszynowo jest zgodny z rzeczywistością
Przejrzyj swój plik llms.txt wraz z dostępem crawlera, jakością miejsc docelowych, cytowanymi adresami URL i odpowiedziami AI, które reprezentują Twoją markę.

← All SEO Playbook guides

Gotowy, aby zastosować to w praktyce?

Bezpłatne sprawdzenie · 7-dniowy okres próbny · wymagana karta kredytowa