SEO Playbook · Process

Lista kontrolna zarządzania budżetem indeksowania

Skorzystaj z tej listy kontrolnej budżetu indeksowania, aby znaleźć zmarnowane żądania botów, kontrolować fasety i parametry, wyczyścić mapy witryny i szybciej poprawić wykrywanie priorytetowych adresów URL.

15 min read

Budżet indeksowania to praktyczne ograniczenie tego, ile wyszukiwarka jest w stanie i chce indeksować na stronie w danym czasie. Zarządzanie nim oznacza redukcję żądań, które nie mogą poprawić wykrywania ani indeksowania, a następnie ułatwienie znajdowania i tańsze pobieranie ważnych adresów URL.

Lista kontrolna: zarządzanie budżetem indeksowania. Ramy czasowe: 1–2 dni robocze na diagnozę, następnie 1–3 sprintów inżynieryjnych na zatwierdzone poprawki. Właściciel: lider techniczny SEO. Współpracownicy: inżynier platformy, właściciel CDN lub infrastruktury, inżynier analityk oraz właściciel merchandisingu lub treści dla każdego obszaru URL objętego zmianą. Uprawnienia do wydania: lider techniczny SEO i właściciel inżynieryjny wspólnie.

Bądźmy szczerzy co do zakresu: zdrowa witryna z 2000 lub 8000 kanonicznych stron prawie nigdy nie potrzebuje projektu budżetu indeksowania. Ma problem z priorytetyzacją, linkowaniem, jakością lub indeksowalnością. Rozpocznij tę listę kontrolną, gdy duża lub szybko zmieniająca się witryna ma dowody marnowania zasobów przez indeksujące roboty, opóźnionego wykrywania, wielokrotnego indeksowania niskowartościowych adresów URL lub obciążenia serwera — nie dlatego, że raport indeksowania zawiera dużą liczbę.

Dlaczego ta faza i dlaczego tutaj

Mimo że jest to samodzielna lista kontrolna, a nie ponumerowana faza, wykorzystuje ona techniczny audyt bazowy : reguły kanoniczne, ustalenia dotyczące kodów statusu, zachowanie renderowania, architekturę witryny, inwentarz map witryny i pokrycie indeksowania. Potrzebuje także zatwierdzonego inwentarza treści, ponieważ „marnowanie" nie może być zdefiniowane, dopóki biznes nie określi, które adresy URL powinny być znajdowane, aktualizowane i indeksowane.

Wykonaj ją po tym, jak zespół potrafi odróżnić wartościowe strony kanoniczne od filtrów, duplikatów, wygasłego asortymentu, wyszukiwania wewnętrznego i ścieżek administracyjnych. Wykonanie jej wcześniej zachęca do blokowania wszystkiego. Wykonanie jej po dużym wdrożeniu programowym, migracji lub wydaniu nawigacji fasetowanej jest zbyt późne: roboty indeksujące mogą już być uwięzione w praktycznie nieograniczonej przestrzeni URL.

Jeśli pominięta na naprawdę dużej witrynie, nowe i zmienione priorytetowe adresy URL mogą czekać w nieskończoność za niezliczonymi kombinacjami parametrów, stronami błędów, łańcuchami przekierowań i duplikatami. Jeśli wykonana na małej, zdrowej witrynie, pochłania czas inżynierów bez rozwiązywania rzeczywistego ograniczenia. Argument zależności jest prosty: klasyfikacja poprzedza kontrolę, a dowody poprzedzają reguły.

Dane wejściowe i wyjściowe

Wynikiem jest kontrakt z zespołem inżynieryjnym i następny cykl pomiarowy. „Poprawić efektywność indeksowania" nie jest wynikiem.

KierunekElementWarunek akceptacji
WejścieInwentarz kanonicznych URLKażdy objęty zakresem URL lub wzorzec ma przypisany zamierzony status: indeksowalna strona kanoniczna, duplikat, przekierowanie, wygasły, zablokowany lub błąd.
WejścieZweryfikowane logi serweraCo najmniej 14 reprezentatywnych dni obejmuje znacznik czasu, żądany URL, status, bajty lub czas odpowiedzi, agent użytkownika, referrer (tam, gdzie dostępny) i zweryfikowaną tożsamość bota wyszukiwarki.
WejścieEksport pokrycia i map witrynyData eksportu, właściwość, przesłane adresy URL, werdykty indeksowania, dowody ostatniego indeksowania, ostrzeżenia i błędy są odnotowane.
WejścieGraf linkówŹródło indeksowania, miejsce docelowe, głębokość, liczba linków przychodzących, cel kanoniczny, status i szablon są dostępne dla wszystkich wykrywalnych wewnętrznych adresów URL.
WejścieKontekst wydania i zapotrzebowaniaMigracje, zmiany szablonów, rotacja asortymentu, kadencja publikacji, priorytetowe katalogi i sezonowe terminy są opatrzone datami.
WyjścieDiagnoza budżetu indeksowaniaOkreśla ilościowo żądania według bota, szablonu, katalogu, statusu, wzorca parametru, stanu kanonicznego i priorytetu biznesowego.
WyjściePolityka wzorca URLKażdemu marnotrawnemu wzorcowi przypisuje jeden sposób leczenia, właściciela, ryzyko, przypadek testowy, zakres wdrożenia i warunek wycofania.
WyjściePoprawki map witryny i linkowaniaWymienia adresy URL do dodania lub usunięcia, cele głębokości, zmiany nawigacji, naprawy stron osieroconych i dowody wymagane po wydaniu.
WyjścieLinia bazowa monitorowaniaPrzechowuje wskaźniki sprzed zmian, opóźnienie ponownego indeksowania, wskaźnik błędów, pokrycie priorytetowych URL, punkty kontrolne i progi alertów.

Lista kontrolna

Zapisz PASS, FAIL lub N/A i dołącz dowody dla każdej pozycji. Każda pozycja jest ukończona tylko wtedy, gdy jej warunek „Gotowe, gdy" może być zaobserwowany.

1. Udowodnij, że budżet indeksowania jest ograniczeniem

Co: zdecyduj, czy ta praca zasługuje na projekt. Dlaczego: budżet indeksowania jest często obwiniany, gdy strona jest w rzeczywistości niskiej jakości, osierocona, niekanoniczna, zablokowana lub celowo wykluczona. Jak: porównaj liczbę kanonicznych URL, dzienne tworzenie URL, kondycję serwera, daty ostatniego indeksowania, opóźnienie wykrywania, przyczyny pokrycia oraz udział zweryfikowanych żądań botów spędzonych poza inwentarzem kanonicznym. Segmentuj według katalogu i szablonu; średnia dla całej witryny ukrywa jedną wymykającą się sekcję. Narzędzie: potok logów, crawler, raporty pokrycia wyszukiwarek, eksporty map witryny i kalendarz wydań. Gotowe, gdy: podpisana diagnoza wymienia co najmniej jedno zmierzone ograniczenie lub zamyka listę kontrolną jako „nieistotne" wraz z dowodami i bardziej odpowiednim kolejnym działaniem.

2. Zbuduj wiarygodny zbiór danych żądań botów

Co: utwórz jedną znormalizowaną tabelę żądań dla okna analizy. Dlaczego: ciągi agenta użytkownika mogą być fałszowane, próbkowane analityki pomijają boty, a logi CDN mogą różnić się od logów źródłowych. Analiza plików logów oznacza badanie rekordów dostępu serwera, aby zobaczyć, co crawlerzy faktycznie żądali. Jak: połącz dane CDN i źródłowe tam, gdzie to konieczne, znormalizuj hosta i kodowanie URL, usuń statyczne zasoby, chyba że renderowanie jest w zakresie, zweryfikuj główne boty wyszukiwarek opublikowaną metodą weryfikacji dostawcy i zachowaj status, bajty, czas odpowiedzi i wynik cache. Narzędzie: logi CDN lub serwera WWW, weryfikacja DNS, SQL lub analizator logów. Gotowe, gdy: zakres dat i retencja są udokumentowane, znane boty są oddzielone od niezweryfikowanych agentów, sumy zgadzają się z surowymi rekordami, a to samo zapytanie może odtworzyć każdy wykres w diagnozie.

3. Zmierz, gdzie żądania są marnowane

Co: sklasyfikuj każde żądanie crawlera jako użyteczne kanoniczne, duplikat, przekierowanie, błąd, zablokowane, parametr, fasetę, wyszukiwanie wewnętrzne, miękki 404, zasób lub nieznane. Miękki 404 to strona, która zwraca 200 OK, ale zachowuje się jak brakujący lub pusty wynik. Dlaczego: całkowity wolumen indeksowania nie pokazuje, czy crawlerzy odświeżają asortyment, czy kręcą się w pętli przez bezwartościowe stany. Jak: połącz żądania z indeksowaniem i inwentarzem kanonicznym, grupuj według znormalizowanej ścieżki i sygnatury parametru, a następnie uszereguj wzorce według liczby żądań i kosztu serwera. Porównaj te wzorce z przyczynami pokrycia, takimi jak odkryte ale nie indeksowane, indeksowane ale nie indeksowane, duplikat, zablokowane i miękki 404; pokrycie wyjaśnia zgłoszony wynik wyszukiwarki, podczas gdy logi dowodzą żądań. Przejrzyj nieznaną grupę ręcznie, zamiast wpychać ją do wygodnej etykiety. Narzędzie: zweryfikowane logi, eksport pokrycia, crawler witryny, eksport kanoniczny i profiler odpowiedzi. Gotowe, gdy: co najmniej 95% objętych zakresem żądań botów ma przejrzaną klasyfikację, pozostała nieznana część jest wymieniona, a główne wzorce marnotrawstwa mają przykładowe adresy URL, wyniki pokrycia i właścicieli.

4. Ogranicz fasety i parametry u źródła

Co: zarządzaj parametrami filtrów, sortowania, paginacji, śledzenia, sesji i wyszukiwania. Nawigacja fasetowana pozwala użytkownikom łączyć filtry, takie jak marka, kolor i rozmiar; niekontrolowane kombinacje mogą stworzyć praktycznie nieskończoną przestrzeń indeksowania. Dlaczego: blokowanie crawlera po tym, jak szablony wygenerowały miliony linków, leczy objaw, pozostawiając odkrywanie, zachowanie użytkowników, analitykę i inne boty bez ochrony. Jak: przypisz każdemu parametrowi funkcję i jedną politykę: indeksowalna strona docelowa, duplikat kanoniczny, strona noindex, przekierowanie, stan bez linku lub zablokowany wzorzec. Użyj stabilnego porządkowania parametrów, zapobiegaj pustym i sprzecznym kombinacjom oraz usuwaj parametry śledzenia i sesji z linków wewnętrznych. Nie kanonikalizuj strony do celu o znacząco różnej treści tylko po to, by ją stłumić. Narzędzie: rejestr parametrów, kod źródłowy szablonu, crawler z raportami wzorców URL, logi i zautomatyzowane testy URL. Gotowe, gdy: każdy zaobserwowany parametr ma jedną zatwierdzoną politykę, indeksowalne szablony emitują tylko dozwolone kombinacje, zabronione kombinacje mają pokrycie testowe, a wolumen logów dla docelowych wzorców spada w uzgodnionym punkcie kontrolnym.

5. Wyeliminuj nieskończone przestrzenie i pułapki indeksowania

Co: zamknij ścieżki, które mogą generować nieograniczone daty, kalendarze, paginację, ID, warianty wielkości liter, segmenty ścieżek lub rekurencyjne filtry. Dlaczego: crawler może kontynuować odkrywanie syntaktycznie nowych adresów URL, nawet jeśli każda strona zawiera ten sam pusty lub zduplikowany wynik. Jak: ustaw skończone granice, zwracaj 404 lub 410 dla niemożliwych stanów, linkuj tylko do prawidłowych zakresów, normalizuj reguły wielkości liter i ukośników, przekieruj dokładne duplikaty raz i przestań generować linki do następnej strony poza ostatnim zestawem wyników. Testuj nieprawidłowe i skrajne wartości, nie tylko ścieżkę szczęśliwą. Narzędzie: syntetyczny generator URL, crawler, logi, testy routera i testy reguł brzegowych. Gotowe, gdy: każdy generator ma udokumentowane maksimum, stany poza zakresem zwracają zamierzoną odpowiedź, żadna testowana ścieżka nie tworzy nowego nieograniczonego ciągu, a dotknięte wzorce żądań maleją bez blokowania wartościowych stron.

6. Popraw miękkie 404, błędy i marnotrawstwo przekierowań

Co: spraw, aby kody odpowiedzi opisywały rzeczywisty wynik. Dlaczego: pusta strona z kodem 200 każe crawlerom parsować i oceniać treść, która powinna być zadeklarowana jako brakująca; powtarzające się odpowiedzi 5xx pochłaniają przepustowość i mogą sprawić, że host będzie wyglądał na zawodny; łańcuchy zużywają kilka żądań, aby dotrzeć do jednego celu. Jak: zwracaj 404 dla brakujących URL, 410 dla celowo usuniętych zasobów (tam, gdzie to właściwe), 200 tylko dla merytorycznych stron i pojedyncze przekierowanie do ostatecznego kanonicznego celu dla przeniesionych URL. Napraw linki wewnętrzne prowadzące do przekierowań lub błędów. Narzędzie: logi, crawler, zestaw testów HTTP, monitoring i inwentarz tras. Gotowe, gdy: próbkowane puste wyniki nie zwracają już 200, priorytetowe trasy nie mają łańcucha przekierowań, linki wewnętrzne prowadzą bezpośrednio, a próg wskaźnika błędów w regułach decyzyjnych jest spełniony przez dwa kolejne okna pomiarowe.

7. Ujednolić kontrolę kanoniczną i indeksowania

Co: dopasuj odpowiedź, kanoniczny URL , meta robots, nagłówki HTTP robots, linki wewnętrzne i członkostwo w mapie witryny. Dlaczego: sprzeczne sygnały powodują wielokrotne ponowne odwiedziny: URL może być przesłany w mapie witryny, kanonikalizowany gdzie indziej, linkowany w całej nawigacji i zablokowany dyrektywą, która wyjaśnia jego status. Jak: stwórz macierz reguł dla każdej klasy URL i przetestuj wyrenderowaną odpowiedź produkcyjną. Używaj robots.txt do zarządzania dostępem crawlera, nie jako niezawodnego mechanizmu usuwania; zablokowany URL nie może ujawnić dyrektywy noindex na poziomie strony crawlerowi, który nigdy go nie pobiera. Narzędzie: crawler, surowy i wyrenderowany HTML, inspektor nagłówków, tester robots i inspekcja URL. Gotowe, gdy: 100% priorytetowych próbek i wszystkie przypadki testowe szablonów są zgodne z jedną spójną regułą, żaden indeksowalny kanoniczny URL nie jest zablokowany i żaden wykluczony wzorzec nie jest promowany przez mapy witryny lub nawigację główną.

8. Wyczyść mapy XML do priorytetowego kanału

Co: publikuj tylko kanoniczne, indeksowalne adresy URL z kodem 200 i prawdziwe daty modyfikacji w każdej mapie witryny XML . Dlaczego: mapa witryny to sygnał odkrywania, a nie archiwum każdego URL wyprodukowanego przez CMS. Przekierowania, duplikaty, błędy i niezmienione znaczniki czasu lastmod osłabiają ten sygnał i zaciemniają porównania pokrycia. Jak: uzgodnij adresy URL w mapie witryny z inwentarzem kanonicznym, podziel pliki według stabilnych jednostek diagnostycznych, takich jak typ treści lub katalog, usuń wykluczone URL i aktualizuj lastmod tylko przy merytorycznych zmianach stron. Prześlij zmienione mapy witryny i zapisz pobieranie, ostrzeżenia i błędy. Narzędzie: parser map witryny, eksport CMS, logi i raporty map witryny wyszukiwarek. Gotowe, gdy: każdy przesłany URL zwraca 200, jest samokanoniczny i indeksowalny, wykluczenia wynoszą zero, lastmod przechodzi próbkowaną kontrolę zmiany treści, a przesłane liczby zgadzają się z zatwierdzonym inwentarzem.

9. Użyj linków wewnętrznych, aby przybliżyć priorytetowe strony

Co: napraw osierocone strony i zmniejsz odległość kliknięć do wartościowych URL poprzez użyteczne linkowanie wewnętrzne . Głębokość indeksowania to liczba kroków linków, których crawler potrzebuje, aby dotrzeć do strony z wybranej strony startowej. Dlaczego: blokowanie marnotrawstwa nie mówi crawlerowi, co ma odwiedzić dalej; robią to stabilne linki HTML z silnych, często odwiedzanych stron. Jak: oblicz głębokość i linki przychodzące ze strony głównej i odpowiednich hubów, dodaj linki kontekstowe lub nawigacyjne tam, gdzie użytkownicy odnoszą korzyści, zastąp linki do przekierowanych URL i upewnij się, że paginacja odsłania głębszy asortyment. Nie spłaszczaj wszystkiego w stopkę. Narzędzie: crawler grafu linków, szablony, logi i wydajność wyszukiwania według katalogu. Gotowe, gdy: każdy priorytetowy URL ma co najmniej jeden indeksowalny link przychodzący, nie ma priorytetowej osieroconej strony, uzgodnione priorytetowe szablony są w odległości trzech kroków linku od odpowiedniego huba, a logi potwierdzają, że nowo linkowane próbki są odkrywane lub ponownie odwiedzane.

10. Chroń wydajność hosta i ścieżki renderowania

Co: utrzymuj szybkie i udane żądania crawlerów bez serwowania botom wyszukiwarek znacząco innej strony. Dlaczego: zapotrzebowanie na indeksowanie nie może skompensować hosta, który przekracza limit czasu, nieproporcjonalnie ogranicza prędkość legalnych crawlerów lub wymaga kosztownego renderowania dla podstawowej treści i linków. Jak: porównaj czas odpowiedzi i błędy według bota, trasy, stanu cache i szablonu; buforuj bezpieczne odpowiedzi; usuń kosztowne ścieżki zapytań; zachowaj niezbędny HTML i linki w początkowej odpowiedzi; i przetestuj reguły zapory i CDN z zweryfikowanymi botami. Narzędzie: monitorowanie wydajności aplikacji, analityka CDN, logi, testy dostępności i inspekcja wyrenderowanej strony. Gotowe, gdy: host spełnia uzgodnione progi odpowiedzi i błędów przy oczekiwanym obciążeniu, zweryfikowane crawlerry nie są przypadkowo blokowane, a priorytetowa treść plus linki są obecne bez interakcji użytkownika.

11. Wdrażaj według wzorca i weryfikuj kompromis

Co: wydaj najmniejszy spójny zestaw reguł, a następnie porównaj przed i po. Dlaczego: globalna zmiana robots, kanoniczna, routingu lub nawigacji może usunąć wartościowe długoogonowe strony szybciej niż usuwa marnotrawstwo. Jak: zacznij od jednego mierzalnego wzorca URL lub katalogu, zachowaj grupę kontrolną tam, gdzie to praktyczne, opisz wydanie i porównaj żądania botów, błędy, opóźnienie ponownego indeksowania priorytetu, pokrycie, wyświetlenia i obciążenie serwera po pełnym cyklu indeksowania. Trzymaj instrukcje wycofania obok reguły. Narzędzie: dziennik wdrożeń, logi serwera, raporty pokrycia, raporty AmICited i monitoring. Gotowe, gdy: docelowa miara marnotrawstwa poprawia się, priorytetowe odkrywanie i indeksowanie nie regresują poza zadeklarowaną tolerancję, właściciel podpisuje wynik, a decyzja o następnym wdrożeniu lub wycofaniu jest odnotowana.

Narzędzia w AmICited

AmICited dostarcza dowody z wyszukiwarek i wydajności wokół diagnozy. Surowe logi serwera pozostają źródłem prawdy dla zachowania na poziomie żądań między botami.

  1. Otwórz Bing Crawl w raporcie indeksowania Bing na żywo , aby przejrzeć aktywność indeksowania Bing i zgłoszone problemy z URL. Zapisz zakres, typ problemu, przykładowe adresy URL i czas eksportu; nie uogólniaj zachowania Bing na wszystkie crawlerry.
  1. Użyj Map witryny i indeksowanie w raporcie map witryny , aby porównać przesłane liczby, ostatnie pobranie, ostrzeżenia i błędy, przesłać oczyszczoną mapę witryny lub zażądać indeksowania dla ograniczonej partii zmienionych priorytetowych URL. Żądanie przyspiesza ponowne rozpatrzenie; nie sprawia, że zablokowana lub niskiej jakości strona staje się indeksowalna.
  1. Sprawdź reprezentatywne zwycięzców, wzorce marnotrawstwa i naprawione strony w Inspekcji URL w raporcie inspekcji URL . Zapisz zadeklarowany i wybrany kanoniczny URL, werdykt pokrycia, ostatnie indeksowanie i czas inspekcji. Jego widok pokrycia to rosnąca próbka, a nie kompletny raport budżetu indeksowania.
  1. Otwórz Katalogi Google Search w raporcie katalogów , aby porównać kliknięcia i wyświetlenia według sekcji przed ograniczeniem katalogu lub zmianą jego linków. Sekcja o niskim ruchu może być nadal strategicznie konieczna; używaj tego raportu do oceny wpływu na wyszukiwanie, a nie do samodzielnego deklarowania marnotrawstwa indeksowania.

Reguły decyzyjne: jak wygląda zło w liczbach

Są to operacyjne wyzwalacze dla tej listy kontrolnej, a nie uniwersalne limity wyszukiwarek. Zastąp je tylko udokumentowaną linią bazową witryny i zatwierdzoną tolerancją ryzyka.

MiaraZaliczZbadajDziałaj
Liczba kanonicznych URL i tempo zmianPoniżej 10 000 i stabilne, bez dowodów opóźnienia10 000–100 000 lub częste zmiany asortymentuPowyżej 100 000 plus opóźnienie wykrywania lub marnotrawstwo; powyżej 1 000 000 wymaga regularnego nadzoru nawet przed uruchomieniem
Zweryfikowane żądania botów do niekanonicznych, parametrowych, przekierowań, błędów lub miękkich 404Poniżej 10%10–25%Powyżej 25% przez dwa reprezentatywne okna
Odpowiedzi 5xx dla zweryfikowanych botówPoniżej 0,5%0,5–1%Powyżej 1% w ciągu dnia lub jakikolwiek utrzymujący się klaster na priorytetowych szablonach
Odpowiedzi typu przekierowanie w żądaniach botówPoniżej 5%5–10%Powyżej 10% lub jakikolwiek powtarzający się łańcuch wieloetapowy
Ważność mapy witryny100% kanonicznych, indeksowalnych URL z kodem 200Jakiekolwiek niezgodności w trakcie aktywnej korektyJakikolwiek powtarzający się członek mapy witryny będący przekierowaniem, błędem, blokadą, noindex lub niekanoniczny
Wykrywanie lub ponowne indeksowanie priorytetowych stron po wydaniu90% zaobserwowane w ciągu 7 dni70–89% w ciągu 7 dniPoniżej 70% w ciągu 7 dni, mierzone na co najmniej 20 priorytetowych URL
Głębokość linków priorytetowych stronTrzy lub mniej kroków od odpowiedniego hubaCztery krokiPięć lub więcej kroków lub jakakolwiek strona osierocona
Nieznana klasyfikacja żądańPoniżej 5%5–10%Powyżej 10% zweryfikowanych żądań botów

Nie otwieraj projektu budżetu indeksowania wyłącznie dlatego, że witryna przekracza wiersz dotyczący liczby URL. I odwrotnie, nie odrzucaj witryny z 20 000 stron, której pułapka kalendarzowa generuje miliony unikalnych adresów URL. Dowody ograniczonego wykrywania lub marnotrawstwa są czynnikiem decydującym.

Produkt końcowy

Przekaż wersjonowany pakiet, a nie slajd z napisem „indeksowanie zoptymalizowane":

  • crawl-budget-summary.md: zakres, decyzja, metoda weryfikacji botów, okno analizy, ustalenia, zatwierdzone sposoby leczenia, ryzyka, kolejność wydania i wyzwalacze wycofania.
  • crawl-pattern-register.csv: znormalizowany wzorzec, przykładowy URL, cel, liczba żądań, udział, odpowiedź, stan kanoniczny, stan mapy witryny, linki przychodzące, wartość biznesowa, sposób leczenia, właściciel i status.
  • priority-url-sample.csv: co najmniej 20 URL z polami linii bazowej i punktu kontrolnego dla wykrywania, ostatniego indeksowania, werdyktu indeksowania, głębokości, linków przychodzących, odpowiedzi i wybranego kanonicznego.
  • sitemap-reconciliation.csv: przesłany URL, stan w inwentarzu, odpowiedź, kanoniczny, indeksowalność, walidacja lastmod, działanie i dowody.
  • monitoring-spec.md: zapytania, pulpity nawigacyjne, progi, właściciele, kadencja, trasy alertów, daty punktów kontrolnych i retencja.

Lider techniczny SEO jest właścicielem pakietu; inżynieria zatwierdza zmiany tras i infrastruktury; właściciel treści lub merchandisingu zatwierdza każdą decyzję usuwającą wykrywalną ścieżkę użytkownika lub indeksowalną stronę docelową.

Co może pójść nie tak

Zespół optymalizuje małą witrynę. Inżynierowie spędzają sprint na blokowaniu parametrów, podczas gdy ważne strony pozostają cienkie lub osierocone. Zamknij listę kontrolną jako nieistotną i przekieruj pracę na treść, linkowanie lub indeksowalność.

Robots.txt staje się narzędziem do usuwania. Zablokowane adresy URL mogą pozostać znane, a crawlerry nie mogą pobrać ich dyrektyw na poziomie strony. Najpierw zdefiniuj zamierzony cykl życia, usuń wewnętrzne generowanie i użyj odpowiedzi, przekierowania, kanonicznego lub zachowania noindex, które mu odpowiada.

Każda fasetka traktowana jest jako duplikat. Kombinacja marki i kategorii z realnym popytem może być użyteczną stroną docelową; kolejność sortowania zazwyczaj nie jest. Decyduj na poziomie wzorca, używając popytu i odrębności treści.

Oczekuje się, że tag kanoniczny zatrzyma indeksowanie. Kanonikalne wyrażają preferowaną wersję, ale duplikaty mogą być nadal pobierane w celu oceny relacji. Usuń marnotrawne linki i generowanie, zamiast polegać na jednej wskazówce.

Mapy witryny stają się zrzutami bazy danych. Przekierowane, wygasłe, zablokowane i niekanoniczne adresy URL zaciemniają asortyment, który zespół faktycznie chce indeksować. Uzgodnij członkostwo w mapie witryny jako bramkę wydania.

Analityka jest mylona z logami. Analityka po stronie klienta rzadko rejestruje żądania botów wyszukiwarek. Bez zweryfikowanych logów dostępu zespół nie może zmierzyć alokacji żądań ani kosztu odpowiedzi.

Wdrożenie blokuje strony generujące przychód. Szeroka reguła dotycząca parametrów lub ścieżki łapie prawidłowe kategorie, zlokalizowane strony, paginację lub cele kampanii. Testuj pozytywne i negatywne przykłady, wdrażaj jeden wzorzec na raz i zachowaj szybkie wycofanie.

Sukces oznacza mniej żądań. Wolumen indeksowania może spaść, ponieważ wartościowe strony zniknęły z wykrywania. Udana zmiana redukuje marnotrawstwo, podczas gdy priorytetowe wykrywanie, indeksowanie i popyt wyszukiwania pozostają zdrowe.

Następna faza

Przekaż rejestr wzorców, uzgodnienie map witryny, próbkę priorytetową i progi monitorowania do ciągłego odświeżania i iteracji . Ta faza potrzebuje stabilnych ścieżek wykrywania i wiarygodnych sygnałów zmian; w przeciwnym razie odświeżona strona może zostać poprawnie opublikowana, ale pozostać niezauważona za pułapkami indeksowania lub słabymi linkami wewnętrznymi.

Wznów tę listę kontrolną po migracji, zmianie platformy lub routingu, wydaniu nawigacji fasetowanej, znaczącej ekspansji asortymentu, utrzymującym się incydencie błędów lub naruszeniu uzgodnionego progu. Nie powtarzaj całego ćwiczenia według kalendarza, gdy linia bazowa monitorowania pozostaje czysta.

FAQ

Poniższe FAQ obejmuje zakres, reguły robots, parametry, mapy witryny i kadencję przeglądów. Zasadą przewodnią jest spójność: najpierw sklasyfikuj przestrzeń URL, po drugie użyj dowodów żądań, a zmieniaj kontrolę crawlerów tylko wtedy, gdy zamierzony wynik dla użytkownika i indeksowania jest wyraźny.

Przestań wysyłać crawlerry w ślepe uliczki
Wyczyść mapę witryny, sprawdź priorytetowe adresy URL i zweryfikuj zmiany indeksowania za pomocą danych wyszukiwarek i logów serwera.

← All SEO Playbook guides

Gotowy, aby zastosować to w praktyce?

Bezpłatne sprawdzenie · 7-dniowy okres próbny · bez karty kredytowej