Strony osierocone: jak je znaleźć i ponownie podlinkować

W tym artykule
Strony osierocone to opublikowane adresy URL w Twojej witrynie, do których nie prowadzi link z żadnej innej strony. Tylko tyle. Żeby je znaleźć, porównujesz pełną listę publikowanych adresów z adresami, do których dociera crawler idący po linkach od strony głównej. Jeśli publikujesz często, prawie na pewno masz takie strony. Starsze wpisy powoli wypadają ze stron kategorii, archiwów i bloków z powiązanymi wpisami, aż w końcu nic do nich nie prowadzi. Metoda ma pięć kroków: zbierz listę adresów z mapy witryny albo z CMS-a, uruchom crawl, który idzie tylko po linkach, porównaj obie listy, sprawdź różnice w logach serwera i podlinkuj to, co warto zachować.
Czym są strony osierocone i dlaczego mają znaczenie?
Strona osierocona to opublikowany adres URL, do którego nie prowadzi żaden link wewnętrzny. Czytelnik nie trafi na nią, klikając po witrynie. Robot też nie. Wyszukiwarki odkrywają nowe adresy, idąc za linkami na stronach, które już przeszukały, i dokładnie ten proces opisuje przewodnik Google o mapach witryn. Google przyznaje tam też, że w dużych witrynach trudniej zadbać o to, by każda strona miała link z co najmniej jednej innej strony.
Serwisy z treścią nie tworzą sierot przez jakiś spektakularny błąd. Winne są nudne rzeczy. Stronicowane archiwa spychają stare wpisy coraz dalej. Kategorie znikają albo zmieniają nazwy, ktoś usuwa widżet, zmienia się menu. Wystarczy edycja sluga, żeby zepsuć jedyny link, jaki wpis kiedykolwiek miał. Strony osierocone to jednak nie to samo co strony głęboko schowane. Te drugie mają linki, tylko leżą wiele kliknięć od strony głównej. Jedne i drugie mogą skończyć jako głębokie strony bez indeksacji, ale naprawia się je inaczej: głębokie strony potrzebują krótszych ścieżek, a sieroty po prostu pierwszego linku. (I nie, naprawa żadnej z nich nie gwarantuje lepszej indeksacji ani pozycji).
Jaki link robot może przejść?
Ze statusu sieroty wyciąga stronę tylko jeden rodzaj linku: standardowy element <a> z atrybutem href, za którym Google może pójść. Strona Google o linkach dostępnych dla robotów mówi, że tekst kotwicy powinien stać między elementami <a>, które Google potrafi przeszukać, i że każda ważna dla Ciebie strona powinna mieć link z co najmniej jednej innej strony w witrynie.
A co z linkami, które istnieją tylko w skrypcie albo w obsłudze kliknięcia, bez porządnego <a href>? Mogą się nie liczyć. Moja rada: otwórz wyrenderowany HTML strony, która linkuje, i sprawdź, czy element naprawdę tam jest, zanim odhaczysz sierotę jako naprawioną. Zajmuje to minutę. Oszczędza fałszywego „zrobione”.
Jak znaleźć strony osierocone: mapa witryny kontra crawl
Wyeksportuj każdy adres, który uważasz za opublikowany. Przeszukaj witrynę od strony głównej, idąc tylko po linkach. Wszystko, co jest na pierwszej liście, a brakuje go na drugiej, to kandydat na sierotę. Takie porównanie mapy witryny z crawlem to serce każdego audytu linkowania wewnętrznego:
- Wyeksportuj adresy z mapy witryny XML albo prosto z CMS-a, obejmując opublikowane wpisy i strony.
- Uruchom zwykły crawler od strony głównej z wyłączonym odkrywaniem przez mapę witryny.
- Ujednolić obie listy: ten sam protokół, spójny ukośnik na końcu, bez parametrów śledzących.
- Porównaj listy, żeby dostać adresy, do których crawler nigdy nie dotarł.
- Usuń celowe wykluczenia, na przykład strony z podziękowaniem albo adresy z noindex.
Jest jedna pułapka, na której ludzie potykają się bez przerwy. Crawler musi ignorować mapę witryny. Jeśli pozwolisz mu ją czytać, chętnie znajdzie tam Twoje sieroty, a problem po cichu zniknie z wyników. Do samego porównania wystarczy wyszukiwanie w arkuszu albo krótki skrypt. Nic wymyślnego.
Sprawdź logi serwera, zanim cokolwiek naprawisz
Po co w ogóle logi? Bo pokazują, o które strony z listy kandydatów Googlebot wciąż pyta, a o które nie pyta nigdy, i to mówi Ci, co podlinkować najpierw. Wpis, który nadal odwiedza robot, jest w zupełnie innej sytuacji niż taki, który całkiem zniknął z pola widzenia. Nasz poradnik o szukaniu adresów, których Googlebot nie odwiedza pokazuje, jak filtrować logi pod tym kątem.
Skoro już tam jesteś, poszukaj adresów, których nie ma na żadnej z list: starych slugów, wariantów z parametrami, stron, które w ogóle nie trafiły do mapy witryny. Aha, i sprawdź, czy ruch to naprawdę Googlebot. Nie ufaj samemu user agentowi - każdy może go podrobić.
Jak ponownie podlinkować strony osierocone
Każda strona warta zachowania powinna dostać co najmniej jeden link kontekstowy z powiązanej strony, która sama ma już dobre linkowanie. Reszta? Decydujesz indywidualnie. W praktyce każdy kandydat trafia do jednej z tych grup:
- Podlinkuj: strona nadal jest przydatna i potrzebuje tylko drogi dojścia.
- Połącz i przekieruj: pokrywa się z mocniejszym wpisem, więc połącz treść i dodaj przekierowanie na własnym serwerze albo w NGINX.
- Zaktualizuj i podlinkuj: jest nieaktualna, ale wciąż wartościowa.
- Wyklucz albo usuń: nie ma żadnej wartości dla czytelników.
Gdzie umieścić nowe linki? W powiązanych istniejących wpisach, w hubach tematycznych albo na stronach kategorii, w nawigacji serii i w starszych wpisach, które i tak aktualizujesz (to ostatnie jest najtańszą wygraną). Google zaleca tekst kotwicy opisowy, zwięzły i trafny, i zaznacza, że liczą się też słowa wokół linku. Nie upychaj więc kilku linków tuż obok siebie. Nasze notatki o anchorach linków wewnętrznych w nawigacji przekładają te zasady na praktykę. Tylko miej uczciwe oczekiwania: nowy link sprawia, że strona jest osiągalna, ale nie gwarantuje indeksacji ani pozycji.
Jak nie dopuścić do powrotu stron osieroconych
Rzecz w tym, że sieroty wracają zawsze, gdy publikujesz szybciej, niż linkujesz. Sprawdzanie linków musi więc być częścią każdego nowego wpisu i każdej zmiany struktury, a nie sprzątaniem raz w roku. Większość załatwia krótka rutyna:
- Podlinkuj każdy nowy wpis z co najmniej jednego istniejącego wpisu w dniu publikacji.
- Sprawdź linki ponownie po zmianie menu, kategorii albo slugów.
- Regularnie powtarzaj porównanie mapy witryny z crawlem.
Mapa witryny pomaga w odkrywaniu stron. Nie zastępuje linków wewnętrznych. Przegląd map witryn od Google opisuje dobrze podlinkowaną witrynę jako taką, w której Googlebot znajdzie wszystkie ważne strony, idąc po linkach od strony głównej. Jasne ścieżki pomagają też w skupieniu crawlowania na kluczowych stronach zamiast na przypadkowych wariantach adresów.
To naprawdę jedna pętla, którą powtarzasz: spisz, co publikujesz, przeszukaj to, co podlinkowane, porównaj jedno z drugim, sprawdź różnice w logach i podlinkuj strony, które nadal służą czytelnikom. Nudne? Trochę. Ale działa.
FAQ
Czy strona w mapie witryny nadal może być osierocona?
Tak, jeśli nie prowadzi do niej żaden link wewnętrzny. Mapa witryny pomaga wyszukiwarkom odkryć adres, ale czytelnicy i roboty idące po linkach nadal tam nie trafią. Strona pozostaje sierotą, dopóki nie podlinkuje jej inna strona w Twojej witrynie.
Usuwać strony osierocone czy je podlinkować?
Podlinkuj te, które nadal są przydatne. Treści pokrywające się z innymi wpisami połącz albo zaktualizuj, a połączone adresy przekieruj. Usuwaj tylko strony, które nie mają żadnej wartości dla czytelników.
Czy podlinkowanie strony osieroconej sprawi, że zostanie zaindeksowana?
Podlinkowanie sprawia, że do strony da się dojść po linkach, a właśnie tego oczekuje Google. Indeksacja nadal nie jest jednak gwarantowana i nie ma określonego terminu, kiedy mogłaby nastąpić.
Daj każdej stronie własne IP.
Pierwszą domenę dodasz w kilka minut.


