Strony llms.txt i manifest agenta: Utrzymywany indeks witryny dla maszyn
Zbuduj i utrzymuj stronę llms.txt, która zapewnia agentom AI dokładny indeks witryny bez ujawniania tajemnic, powielania treści czy wychodzenia z aktualności.
Strona llms.txt i manifest agenta to indeks czytelny maszynowo, który informuje systemy AI, co reprezentuje witryna, które publiczne strony są autorytatywne oraz — gdy firma obsługuje działania agentów — które zweryfikowane możliwości i zasady mają zastosowanie. Jest to mapa do utrzymywanych źródeł, a nie ich substytut ani obietnica, że jakikolwiek konkretny crawler ją wykorzysta.
Jej kontrakt to tożsamość → zakres → autorytatywne miejsca docelowe → opcjonalne możliwości → ograniczenia → świeżość. Plik odnosi sukces, gdy maszyna może go pobrać, zinterpretować bez zgadywania, przejść do aktualnych kanonicznych adresów URL i dotrzeć do faktów wciąż zgodnych z rzeczywistością produkcyjną.
Na jakie pytania odpowiada
Podstawowe pytanie brzmi: „Które części tej witryny powinien wykorzystać system AI, aby zrozumieć organizację, jej treść i obsługiwane działania?” Pytania pomocnicze obejmują:
- Jaka jest kanoniczna nazwa, domena, cel i grupa docelowa witryny?
- Które strony produktowe, usługowe, dokumentacyjne, cenowe, polityczne i wsparcia są autorytatywne?
- Które strony powinny być preferowane nad archiwami, stronami kampanii, parametrami lub zduplikowanymi wersjami regionalnymi?
- Czy witryna udostępnia rzeczywiste możliwości agenta, czy tylko informacje czytelne dla człowieka?
- Gdzie udokumentowano uwierzytelnianie, limity szybkości, obsługę danych, warunki handlowe i wsparcie?
- Które stwierdzenia są opisowymi wskazówkami, a nie regułami kontroli dostępu?
- Kto jest właścicielem pliku, jakie zdarzenie wyzwala aktualizację i jak wykrywane jest odchylenie?
Kiedy stosować ten typ wpisu
Użyj tego typu, gdy witryna ma wystarczająco dużo publicznych, trwałych treści, aby skorzystać z selekcjonowanego indeksu czytelnego maszynowo, i gdy ktoś może przejąć jego utrzymanie. Powodem publikacji jest zmniejszenie niejednoznaczności dla systemów wyszukiwania, a nie tworzenie kolejnego adresu URL dla samego siebie.
| Mylny typ wpisu | Co organizuje | Podstawowy odbiorca | Wybierz go zamiast, gdy |
|---|---|---|---|
| Strona llms.txt i manifest agenta | Tożsamość kanoniczna, wartościowe źródła publiczne i opcjonalnie zweryfikowane możliwości agenta | Systemy AI, crawlery, agenci i zespoły je walidujące | Rezultatem jest zwięzła mapa czytelna maszynowo w przewidywalnej lokalizacji |
| indeks katalogowy | Zbiór profili, zasobów, lokalizacji lub ofert | Osoba przeglądająca i filtrująca zbiór | Ścieżki odkrywania, kategorie, opisy i porównanie przez człowieka są głównym doświadczeniem |
| artykuł dokumentacyjny | Jedno zachowanie produktu, pole, limit, konfiguracja lub wersja | Istniejący użytkownik szukający dokładnej odpowiedzi referencyjnej | Strona musi wyjaśniać treść docelową, a nie tylko do niej prowadzić |
| strona polityki | Autorytatywne zasady, obowiązki, zakres, wyjątki i daty wejścia w życie | Osoby lub systemy decydujące, co jest dozwolone | Sama polityka musi być przeczytana, zaakceptowana lub egzekwowana; linkuj do niej z manifestu |
| strona danych produktowych dla agentów | Produkty, identyfikatory, oferty, dostępność i fakty transakcyjne | Agenci porównujący lub działający na danych produktowych | Dane handlowe na poziomie pozycji i działania są głównym ładunkiem, a nie indeksem na poziomie witryny |
Nie myl wskazówek z kontrolą. robots.txt wyraża preferencje dostępu crawlera; mapa witryny XML pomaga crawlerom odkrywać adresy URL; uwierzytelnianie i autoryzacja decydują, czy działanie może nastąpić. llms.txt zapewnia selekcjonowany kontekst. Zdanie w llms.txt nie może udzielić dostępu, cofnąć dostępu, chronić tajemnicy ani nadpisać warunków strony docelowej.
Najlepsze dla tych typów firm
- SaaS . Najlepsze dopasowanie, ponieważ firma programistyczna zwykle ma odrębne źródła produktu, funkcji, cen, integracji, API, bezpieczeństwa, statusu i dokumentacji. Indeks może rozstrzygać, która strona jest właścicielem którego faktu, podczas gdy oddzielny manifest możliwości może opisywać tylko działania, które produkt rzeczywiście obsługuje.
- E-commerce . Mocne dopasowanie, gdy produkty, wysyłka, zwroty, dostępność i polityki obsługi klienta są publiczne i kanoniczne. Przechowuj zmienne dane pozycji w feedach lub API; użyj indeksu, aby wskazywać na te utrzymywane źródła, zamiast kopiować katalog do Markdown.
- Marketplace . Wartościowe, gdy polityki kupującego, sprzedającego, dostawcy i platformy różnią się. Oznacz każdą grupę odbiorców i jurysdykcję, aby agent nie stosował zasad sprzedającego do kupującego ani nie wnioskował o stanie magazynowym platformy z jednej oferty.
- Usługi B2B . Przydatne do wyjaśnienia możliwości, branż, granic usług, dowodów, materiałów zakupowych i dróg kontaktu. Nie zamieniaj wynegocjowanego zakresu ani obietnicy specyficznej dla klienta w uniwersalne twierdzenie czytelne maszynowo.
- Agencje . Przydatne, gdy firma utrzymuje wiele stron usług, metodologii, studium przypadku i wiedzy specjalistycznej. Portale klientów, poświadczenia, prywatne raporty i wewnętrzne playbooki pozostają poza publicznym plikiem.
- Producenci i firmy przemysłowe . Przydatne do kierowania systemów do rodzin produktów, specyfikacji, certyfikatów, instrukcji, dystrybutorów i dokumentów bezpieczeństwa. Indeks nigdy nie powinien parafrazować instrukcji krytycznych dla bezpieczeństwa, gdy kontrolowany dokument jest autorytetem.
Małe witryny wizytówkowe z pięcioma stabilnymi stronami mogą zyskać niewiele na kolejnym utrzymywanym artefakcie. Witryny bez jasnego właściciela treści powinny najpierw naprawić kanonikalizację, nawigację i jakość źródeł przed publikacją pliku, który natychmiast zacznie się dezaktualizować.
Intencja wyszukiwania
intencja wyszukiwania
to rezultat oczekiwany od zapytania. Ten typ ma dwie grupy odbiorców o różnych intencjach. Maszyna pobiera przewidywalną ścieżkę korzeniową i oczekuje zwięzłego Markdown, stabilnych nagłówków, kanonicznych linków i bez dekoracyjnego szumu. Człowiek szukający zwykle chce wskazówek wdrożeniowych: „przykład llms.txt”, „co powinno znaleźć się w llms.txt” lub „format manifestu agenta”. Publiczna strona wyjaśniająca może odpowiedzieć na te pytania, podczas gdy wdrożony plik /llms.txt pozostaje zoptymalizowany do pobierania maszynowego.
Sam plik nie jest stroną docelową dla słów kluczowych. Nie dodawaj ogólnych definicji, powtarzanych terminów kategorii ani setek linków blogowych, aby „go pozycjonować”. Każda dodatkowa linia pochłania uwagę i tworzy kolejny obowiązek utrzymania. Preferuj dziesięć przemyślanych linków z jasnymi opisami nad zrzut dziesięciu tysięcy adresów URL.
Ponieważ konwencje i wsparcie odbiorców mogą się zmieniać, określ, na czym opiera się Twoja implementacja, i unikaj twierdzenia o powszechnym przyjęciu. Udane pobranie dowodzi tylko, że plik jest dostępny i parsowalny; nie dowodzi, że konkretny produkt AI używa go do pozycjonowania, wyszukiwania, trenowania ani cytowania.
Struktura strony
Widełki słowne to ograniczenia redakcyjne, a nie cele. Wdrożony plik powinien pozostać na tyle zwięzły, aby można go było audytować linia po linii. Notatka implementacyjna dla człowieka może być dłuższa, ale nie może być kopiowana do pliku maszynowego.
| Sekcja | Widełki słowne | Cel | Wymagana? | |
|---|---|---|---|---|
| Nazwa witryny i bezpośredni opis | 30–70 | Ustal tożsamość kanoniczną, cel, grupę docelową i zakres przed jakimikolwiek linkami. | Wymagana | |
| Notatka o zakresie i interpretacji | 30–90 | Wyjaśnij, co obejmuje indeks, i wskaż źródła kontroli dostępu lub zasad. | Wymagana, gdy niejednoznaczność jest prawdopodobna | |
| Zasoby podstawowe | 60–180 | Linkuj do niewielkiego zestawu stron definiujących organizację, ofertę, dokumentację, ceny i wsparcie. | Wymagana | |
| Grupy tematyczne lub produktowe | 80–300 | Organizuj dodatkowe zasoby kanoniczne pod prostymi, stabilnymi nagłówkami. | Warunkowa; używaj tylko gdy katalog tego wymaga | |
| Możliwości agenta | 80–250 | Zidentyfikuj rzeczywiste działania i linkuj do ich czytelnych maszynowo kontraktów, uwierzytelniania, limitów i zasad. | Warunkowa; pomiń, gdy nie ma obsługiwanego działania | |
| Zasoby opcjonalne | 40–150 | Wymień użyteczne, ale nie niezbędne materiały, takie jak badania lub wybrane studia przypadków. | Warunkowa | |
| Rekord utrzymania | 20–70 | Podaj datę weryfikacji, rolę właściciela, system źródłowy lub status wygenerowania. | Wymagana |
Typowy selekcjonowany plik ma około 200–700 słów. Długość nie jest sygnałem jakości: odpowiedni rozmiar to najmniejszy indeks, który ustala tożsamość i kieruje odbiorcę do utrzymywanych źródeł bez ukrywania kluczowych rozróżnień.
Wymagane elementy
Indeks musi być nudny w najlepszym sensie: przewidywalny, jawny i łatwy do porównania. Umieść krytyczną interpretację przed opcjonalnymi linkami, aby częściowe odczytanie nie prowadziło do fałszywego wniosku.
| Element | Zawsze czy warunkowo | Pozycja | Reguła produkcyjna |
|---|---|---|---|
| blok bezpośredniej odpowiedzi | Zawsze | Pierwsze linie po H1 | Podaj nazwę organizacji i określ, co zapewnia witryna, w języku, który istnieje samodzielnie. |
| szybki przegląd i spis treści | Warunkowo | Po opisie | Użyj prostych nagłówków Markdown jako nawigacji, gdy istnieje kilka grup zasobów; nie dodawaj dekoracyjnego spisu treści do surowego pliku. |
| tabela specyfikacji | Warunkowo | Strona implementacyjna dla człowieka | Udokumentuj punkt końcowy, format, właściciela, źródło generowania, walidację i wyzwalacze odświeżania; unikaj tabel HTML w surowym pliku. |
| ramka notatki | Warunkowo | Obok wskazówek interpretacyjnych | Wyjaśnij, że wskazówki indeksowania nie zastępują uprawnień, zasad ani faktów na stronie docelowej. |
| ramka ostrzeżenia | Warunkowo; obowiązkowa przy ryzyku ujawnienia | Przed wskazówkami dotyczącymi możliwości lub danych prywatnych | Nazwij ryzyko i bezpieczne źródło; nigdy nie umieszczaj tajemnic, tokenów, niepublicznych punktów końcowych ani danych klientów w publicznym manifeście. |
| blok źródeł | Zawsze na stronie implementacyjnej | Po specyfikacji | Podaj konwencję, wewnętrzne systemy źródła prawdy i dowody walidacji bez sugerowania nieobsługiwanej standaryzacji. |
| znacznik świeżości | Zawsze | Koniec surowego indeksu lub blisko góry rekordu implementacyjnego | Podaj datę ostatniej istotnej weryfikacji i rolę właściciela. |
| dziennik aktualizacji | Warunkowo | Strona implementacyjna dla człowieka | Rejestruj zmiany zakresu, ważnych miejsc docelowych, możliwości lub reguł generowania — nie zmiany interpunkcji. |
| blok powiązanych treści | Zawsze na stronie implementacyjnej | Przed FAQ | Linkuj do kontroli dostępu, danych strukturalnych, danych produktowych i wskazówek pomiarowych z uzasadnieniem każdego z nich. |
| struktura FAQ | Zawsze na stronie implementacyjnej | Przed CTA | Odpowiadaj na pozostałe pytania dotyczące przyjęcia, zakresu, bezpieczeństwa, powielania i utrzymania. |
| blok CTA | Zawsze na stronie implementacyjnej | Ostatni element | Zaproponuj działanie walidacyjne, monitorujące lub wdrożeniowe odpowiednie dla czytelnika na etapie rozważania. |
Frontmatter
Postępuj zgodnie ze specyfikacją frontmatter
. W tej specyfikacji typu wpisu użyj entity = "post-type-llms-txt-page" i schemaType = "Article". Na stronie implementacyjnej dla człowieka dla konkretnej organizacji użyj stabilnej tożsamości, takiej jak acme-ai-access-index, a nie frazy kampanii lub daty.
Użyj Article, ponieważ strona internetowa wyjaśnia implementację. Znaczniki schematu
opisują widoczną treść; nie zamieniają surowego pliku tekstowego w uznany protokół agenta. Nie oznaczaj strony jako SoftwareApplication, Dataset ani HowTo, chyba że jej widoczna treść i szablon spełniają odpowiednie wymagania niezależnie.
Surowe /llms.txt normalnie nie ma frontmatteru, ponieważ frontmatter nie może wyciekać do opublikowanego wyjścia. Przechowuj jego metadane operacyjne w CMS, konfiguracji generatora lub rekordzie repozytorium: domena kanoniczna, zakres locale, właściciel, kolekcja źródłowa, tryb generowania, data ostatniej weryfikacji, zasada następnego przeglądu, wynik walidatora i miejsce docelowe alertów. Jeśli istnieją pliki zlokalizowane, udokumentuj regułę wyboru i przechowuj jeden jednoznaczny kanoniczny korzeń odpowiedzi.
Pełny przykład
Ten fikcyjny plik ilustruje zwięzły indeks dla platformy SaaS. Jego adresy URL, produkt i możliwości są przykładami; wzorzec jest specyfikacją.
# Northstar Analytics
> Northstar Analytics to platforma raportowania dla zespołów operacyjnych. Ten indeks wskazuje publiczne strony definiujące produkt, plany, dokumentację, polityki i obsługiwaną możliwość agenta.
Uprawnienia dostępu są kontrolowane przez robots.txt, uwierzytelnianie i polityki, do których prowadzą linki poniżej. Ten plik nie udziela dostępu ani pozwolenia na ponowne wykorzystanie treści.
## Produkt
- [Przegląd produktu](https://www.northstar.example/product): Aktualny zakres produktu i obsługiwane przepływy raportowania.
- [Plany i ceny](https://www.northstar.example/pricing): Aktualne publiczne plany, uwzględnione funkcje i warunki fakturowania.
- [Integracje](https://www.northstar.example/integrations): Obsługiwane źródła danych i systemy docelowe.
## Dokumentacja
- [Strona główna dokumentacji](https://docs.northstar.example/): Aktualna dokumentacja dla użytkowników i administratorów.
- [Referencja API](https://docs.northstar.example/api/): Publiczne punkty końcowe, schematy, uwierzytelnianie, błędy i limity szybkości.
- [Informacje o wydaniach](https://docs.northstar.example/releases/): Odatowane zmiany w produkcie i zachowaniu API.
## Zaufanie i wsparcie
- [Bezpieczeństwo](https://www.northstar.example/security): Program bezpieczeństwa i aktualne dokumenty zapewnienia.
- [Polityka prywatności](https://www.northstar.example/privacy): Przetwarzanie danych, przechowywanie i prawa użytkowników.
- [Wsparcie](https://www.northstar.example/support): Obsługiwane kanały kontaktu i link do statusu usługi.
## Możliwość agenta
- [Akcja eksportu raportu](https://docs.northstar.example/agents/export-report): Kontrakt uwierzytelnionej akcji, akceptowane dane wejściowe, format wyjściowy, limity szybkości i obsługa błędów. Dostępność zależy od planu i roli użytkownika.
## Opcjonalnie
- [Biblioteka badawcza](https://www.northstar.example/research): Oryginalne raporty porównawcze z metodologiami i datami publikacji.
Zweryfikowano 2026-08-27 przez zespół Documentation Operations. Wygenerowano z kanonicznego rejestru zasobów publicznych; waliduj po zmianach produktu, planu, polityki, API lub adresów URL.
Przykład deklaruje tylko jedną możliwość, ponieważ istnieje rzeczywisty, udokumentowany kontrakt działania. Jeśli produkt nie ma obsługiwanego działania agenta, pomiń tę sekcję. Nigdy nie wnioskuj o możliwości transakcyjnej na podstawie obecności pola wyszukiwania, formularza lub nieudokumentowanego punktu końcowego.
W przypadku manifestu agenta przechowywanego oddzielnie od /llms.txt zachowaj tę samą dyscyplinę. Określ wersjonowany format, kanoniczny identyfikator, produkcyjny punkt końcowy, metodę uwierzytelniania, dozwolone operacje, schemat wejścia i wyjścia, limity szybkości, granice zgody, stany błędów i adresy URL zasad. Waliduj go względem działającego systemu. Syntaktycznie poprawna deklaracja reklamująca wyłączoną akcję wciąż jest błędna.
Galeria projektów
Surowe plik ma z założenia niewielki projekt wizualny. Warianty galerii powinny testować architekturę informacji, kolejność skanowania, czytelność mobilną strony implementacyjnej dla człowieka i dowody operacyjne — a nie dekorację.
Lista kontrolna jakości
Publikuj tylko wtedy, gdy każde mające zastosowanie stwierdzenie jest prawdziwe:
- Plik jest osiągalny pod docelowym korzeniem URL bez uwierzytelniania, pętli przekierowań, zgód na ciasteczka ani wyrenderowanej powłoki aplikacji.
- Odpowiedź jest czytelnym tekstem lub Markdown, używa UTF-8 i nie wymaga JavaScript do ujawnienia swojej treści.
- H1 podaje kanoniczną nazwę organizacji lub witryny, a opis określa cel, grupę docelową i zakres bez sloganów.
- Każdy linkowany URL jest kanoniczny, publiczny, indeksowalny zgodnie z polityką, osiągalny i należący do organizacji lub wyraźnie oznaczony jako zewnętrzny.
- Opisy linków mówią, jaki autorytet ma miejsce docelowe; nie powtarzają ogólnego tekstu kotwicy, takiego jak „dowiedz się więcej”.
- Podstawowe źródła produktowe, cenowe, dokumentacyjne, polityczne i wsparcia są zgodne z indeksem.
- Strony archiwalne, wyniki wyszukiwania, parametry śledzenia, zduplikowane locale, strony kampanii i strony tagów o niskiej wartości są wykluczone.
- Deklaracje możliwości są zgodne z działającym, obsługiwanym, uwierzytelnionym kontraktem i zawierają odpowiednie ograniczenia.
- Żadna tajemnica, token, prywatny punkt końcowy, dane osobowe, dokument klienta, nieopublikowana pozycja roadmapy ani szczegół implementacyjny wrażliwy dla bezpieczeństwa nie pojawia się.
- Język dostępu, uprawnień, licencjonowania i polityki wskazuje na źródła kontrolne i nie jest zaprzeczany przez indeks.
- Plik nie gwarantuje pozycji, cytowania, wykluczenia z trenowania ani powszechnego wsparcia odbiorców.
- Zakres locale i regionalny jest jawny wszędzie tam, gdzie różnią się ceny, polityki, dostępność lub dokumentacja.
- Właściciel, rejestr źródłowy, proces generowania i metoda walidacji są zapisane poza plikiem lub na jego końcu.
- Sprawdzenia zepsutych linków, nieoczekiwanych przekierowań, statusu odpowiedzi, skrótu treści i wymaganych sekcji są uruchamiane po odpowiednich wdrożeniach.
- Data weryfikacji zmienia się tylko po istotnym sprawdzeniu miejsc docelowych, opisów, możliwości i zasad.
Częste błędy
Traktowanie pliku jako mapy witryny. Pełny inwentarz URL niszczy priorytetyzację i jest trudny do przeglądu. Zachowaj mapy XML do wykrywania; selekcjonuj llms.txt wokół autorytatywnych źródeł i znaczących grup.
Traktowanie go jako kontroli dostępu. Prośba w Markdown nie jest warstwą egzekwowania. Wyrażaj zasady przeszukiwania w robots.txt, chroń prywatne zasoby uwierzytelnianiem i umieszczaj wiążące wymagania w odpowiednich politykach i kontrolach systemowych.
Kopiowanie treści docelowej do indeksu. Powielane ceny, specyfikacje produktów i polityki rozjeżdżają się. Podsumuj tylko tyle, aby zidentyfikować autorytet, a następnie linkuj do utrzymywanego źródła.
Publikowanie spekulatywnych możliwości. Nieudokumentowany formularz lub trasa API nie czynią witryny gotową dla agentów. Deklaruj tylko działania obsługiwane produkcyjnie z uwierzytelnianiem, schematami, ograniczeniami, błędami i właścicielem.
Dołączanie wszystkiego „na wszelki wypadek”. Więcej linków tworzy więcej niejednoznaczności i więcej punktów awarii. Treści opcjonalne powinny zasłużyć na włączenie, odpowiadając na prawdopodobną potrzebę wyszukiwania, której podstawowe sekcje nie obejmują.
Ujawnianie prywatnych materiałów. Publiczne pliki czytelne maszynowo są publiczne. Nigdy nie wymieniaj hostów stagingowych, wewnętrznych API, poświadczeń, eksportów klientów, nieopublikowanych dokumentów ani szczegółów bezpieczeństwa, które nie zostały celowo zatwierdzone do publikacji.
Generowanie bez nadzoru. Automatyzacja może szybko reprodukować złe dane źródłowe. Generator potrzebuje zatwierdzonego rejestru źródeł, reguł wykluczania, deterministycznego porządkowania, walidacji, odpowiedzialności za przegląd i alertów wdrożeniowych.
Ręczna edycja wygenerowanego pliku. Następne generowanie nadpisuje poprawkę. Popraw rekord źródłowy lub generator, wygeneruj ponownie i zarejestruj istotną zmianę.
Twierdzenie o nieobsługiwanych rezultatach. „To gwarantuje cytowania AI” zamienia niepewną konwencję wdrożeniową w mylącą obietnicę. Raportuj dowody dostępności i wyszukiwania oddzielnie od wyników widoczności i cytowań.
Aktualizowanie daty bez sprawdzania rzeczywistości. Nowy znacznik czasu nie naprawi martwego adresu URL dokumentacji, zmienionej nazwy planu ani wyłączonej akcji. Weryfikacja oznacza porównanie każdego ważnego oświadczenia z jego źródłem produkcyjnym.
Linkowanie wewnętrzne
Linkuj stronę implementacyjną dla człowieka w górę do typów wpisów SEO , gdy autor musi odróżnić indeks maszynowy od katalogu, strony dokumentacji lub polityki. Linkuj od każdego twierdzenia operacyjnego do jego źródła kontrolnego: zakres produktu do strony produktu, aktualne ceny do cennika, zachowanie do dokumentacji, uprawnienia do kontroli dostępu, a obowiązki do polityki.
Surowe plik powinien używać kanonicznych bezwzględnych adresów URL, ponieważ może być pobierany poza normalną nawigacją witryny. Preferuj jeden autorytatywny cel dla każdego faktu. Jeśli dwie strony nakładają się, rozstrzygnij własność przed wymienieniem obu; indeks powinien ujawniać hierarchię źródeł, a nie upamiętniać wewnętrzną niezgoda.
Używaj krótkich, stabilnych nazw sekcji, takich jak Produkt, Dokumentacja, Polityki i Możliwości agenta. Zachowaj warianty locale w wyraźnie oznaczonych grupach tylko wtedy, gdy różnią się istotnie. Nie linkuj każdego wpisu blogowego; wybierz trwałe badania lub przewodniki tylko wtedy, gdy pomagają systemowi zrozumieć temat i dowody witryny.
Linki przychodzące też mają znaczenie operacyjne. Dokumentacja, portale deweloperskie i wskazówki dostępności AI powinny kierować opiekunów do rekordu implementacyjnego, podczas gdy rekord wskazuje na działający plik i walidator. Tworzy to ścieżkę przeglądu dla ludzi bez zaśmiecania indeksu maszynowego.
Jak mierzyć wyniki
Mierz plik najpierw jako infrastrukturę, a dopiero potem jako wkład w widoczność. Wzrostu cytowań nie można przypisać llms.txt tylko dlatego, że oba wystąpiły po publikacji.
Śledź cztery warstwy:
- Dostępność: status odpowiedzi korzenia URL, zachowanie przekierowań, typ treści, kodowanie, opóźnienie, niezależność od renderowania i czas działania.
- Integralność: powodzenie parsowania, wymagane sekcje, zduplikowane adresy URL, zepsute linki, cele przekierowań, niezgodność kanoniczna, nieautoryzowane domeny, ujawnione tajemnice i zmiany skrótu treści.
- Świeżość: dni od ostatniej istotnej weryfikacji, zmiany miejsc docelowych od weryfikacji, pokrycie rejestru źródeł, potwierdzenie właściciela i czas naprawy odchylenia.
- Wyniki: pobrania z logów serwera przez identyfikowalnych agentów, tam gdzie jest to prawnie i technicznie odpowiednie, wizyty w indeksowanych miejscach docelowych, cytowania AI preferowanych stron kanonicznych i dokładność odpowiedzi na śledzone pytania o markę lub produkt.
Ustal linię bazową przed wdrożeniem: które adresy URL są cytowane, które fakty są błędnie przedstawiane, czy plik korzeniowy istnieje i które crawlery go żądają. Adnotuj publikację i każdą istotną aktualizację. Porównuj okna obserwacyjne wystarczająco długie, aby uniknąć odczytania pojedynczego pobrania lub cytowania jako trendu, i zachowaj rozróżnienie między korelacją a przyczynowością.
Testuj tryby awarii bezpośrednio. Zmień nazwę kopii stagingowej wymienionego adresu URL i potwierdź, że walidator wychwyci błąd. Zmień mapowanie kanoniczne i potwierdź, że generator aktualizuje indeks. Wyłącz możliwość w kontrolowanym środowisku testowym i potwierdź, że sprawdzenie manifestu nie powiedzie się. Te testy dowodzą systemu utrzymania, a nie zewnętrznego przyjęcia.
Użyj jak mierzymy wyniki , aby oddzielić dostępność techniczną, reprezentację maszynową, wykrywanie, cytowanie, zaangażowanie i wyniki biznesowe. W AmICited przejrzyj działający plik w sekcji Agent Accessibility i użyj raportu Cockpit , aby obserwować cytowane adresy URL i widoczność AI wraz z adnotacjami wdrożeniowymi. Wiarygodne twierdzenie o sukcesie brzmi: „plik jest ważny, aktualny i kieruje systemy do zamierzonych źródeł”; każda zmiana widoczności poniżej wymaga oddzielnego dowodu.
FAQ
Często zadawane pytania
Czym jest strona llms.txt?
Czy llms.txt to to samo co robots.txt lub mapa witryny XML?
Czy publikacja llms.txt poprawia pozycje lub gwarantuje cytowania przez AI?
Co powinno znaleźć się w manifeście agenta?
Czy każda witryna powinna publikować plik llms-full.txt?
Jak często należy przeglądać llms.txt?
Więcej samouczków w tej sekcji
Gotowy, aby zastosować to w praktyce?
Bezpłatne sprawdzenie · 7-dniowy okres próbny · wymagana karta kredytowa