Umiejscowienie meta tagu robots: head, body i sprzeczne reguły

W tym artykule
Umiejscowienie meta tagu robots jest mniej rygorystyczne, niż wynikałoby z większości poradników. Wyszukiwarka Google nie wymaga, żeby tag znajdował się w sekcji head dokumentu HTML, i respektuje meta tagi robots także w body. Zabłąkany noindex liczy się więc w dowolnym miejscu strony. W dowolnym. Jeśli Twój motyw albo kreator stron wypluwa te tagi w dziwnych miejscach, czytaj dalej: poniżej znajdziesz to, co udokumentował Google, sposób rozstrzygania sprzecznych reguł, metodę wytropienia niechcianych tagów oraz sytuacje, w których lepszym narzędziem jest nagłówek odpowiedzi.
Czy umiejscowienie meta tagu robots ma znaczenie dla Google?
Mniejsze, niż mogłoby się wydawać. Dokumentacja nadal każe umieszczać tag w sekcji <head>, ale wyszukiwarka Google przetwarza też meta tagi robots znalezione poza nią. 24 marca 2026 roku Google dodał do dokumentacji meta tagów robots uwagę opisującą, jak wyszukiwarka traktuje te tagi poza sekcją head dokumentu HTML, co odnotowano w dzienniku zmian dokumentacji Search Central. Samo zachowanie się nie zmieniło, po prostu nigdy wcześniej nie było spisane. Nie trzeba więc niczego nowego naprawiać. Audyt zrobić warto.
Sekcja head niech zostanie Twoim standardowym miejscem: tak zalecają wytyczne i tego spodziewają się inne narzędzia. Przestań jednak traktować body jako miejsce, w którym tag jest ignorowany.
Dlaczego noindex w body to realne ryzyko
Meta tag robots w body jest respektowany, więc noindex wstrzyknięty w środek strony może usunąć adres URL z wyników wyszukiwania. Zwykle trafia tam razem z kodem, nad którym właściciel serwisu nie ma kontroli:
- wtyczki, które wypisują własne reguły indeksowania,
- widżety i bloki kreatorów stron,
- osadzone szablony skopiowane z innego serwisu albo ze środowiska testowego,
- JavaScript, który dopisuje tagi po załadowaniu strony.
Innym częstym winowajcą jest uszkodzony kod sekcji head. Gdy pojawia się w niej element, który tam nie pasuje, parser może zamknąć head przedwcześnie i wypchnąć wszystko, co jest dalej, do body. Twój tag robots siedzi wtedy w body, choć w źródle szablonu nadal widać go w sekcji head, więc łatwo to przeoczyć.
Tagi kanoniczne zachowują się odwrotnie. Dla tagu canonical obowiązuje zasada: tylko head. rel=canonical jest akceptowany w sekcji head i nigdzie indziej. To samo błędne umiejscowienie, które utrzymuje noindex przy życiu, sprawia więc, że canonical zostaje zignorowany. Strona, która konsoliduje duplikaty z ukośnikiem końcowym, może po cichu stracić ten sygnał, podczas gdy dyrektywa ograniczająca działa dalej.
Sprzeczne meta tagi robots: która reguła wygrywa?
Ta bardziej restrykcyjna. Gdy reguły robots są ze sobą sprzeczne, noindex wygrywa z index. Reguły można łączyć na liście rozdzielanej przecinkami albo w osobnych meta tagach, co opisuje specyfikacja meta tagu robots od Google.
Konflikty pojawiają się też między różnymi miejscami: tag w sekcji head może kłócić się z tagiem w body albo z nagłówkiem X-Robots-Tag. Google respektuje każdy noindex, niezależnie od tego, gdzie go znajdzie.
Dodanie tagu „index” w sekcji head nie anuluje więc noindex w innym miejscu. Zabłąkaną dyrektywę trzeba usunąć u źródła.
Jak znaleźć zabłąkane tagi noindex na swoich stronach
Porównaj surowe źródło z wyrenderowanym kodem HTML, bo tagi wstrzyknięte przez JavaScript pojawiają się dopiero po renderowaniu. Ja pracowałbym w tej kolejności:
- Przeszukaj źródło strony pod kątem name=”robots” oraz nazw konkretnych robotów, takich jak googlebot.
- Sprawdź wyrenderowany kod HTML w narzędziu URL Inspection w Search Console i powtórz tam wyszukiwanie.
- Sprawdź, czy w nagłówkach odpowiedzi jest X-Robots-Tag.
- Wyłączaj wtyczki, widżety albo moduły kreatora jeden po drugim, aż tag zniknie.
- Po poprawce przetestuj ponownie działający adres URL.
Przejrzyj też ustawienia wtyczki SEO, w tym przełączniki dla poszczególnych szablonów i typów wpisów, które wypisują noindex dla archiwów, tagów albo stron załączników.
Jest jeden haczyk: strona zablokowana w robots.txt nie jest crawlowana, więc jej reguły indeksowania nie zostaną znalezione i są ignorowane. Czym różnią się te dwa mechanizmy, wyjaśnia porównanie noindex i disallow, a ta różnica decyduje o tym, czy Twoja dyrektywa w ogóle zostanie odczytana.
Kiedy zamiast tego użyć nagłówka X-Robots-Tag
Nagłówka odpowiedzi X-Robots-Tag używaj dla zasobów innych niż HTML, takich jak pliki PDF, wideo czy obrazy, w których meta tagu nie da się umieścić. Każdą regułę, której można użyć w meta tagu robots, da się podać także w ten sposób.
Nagłówek ustawia się w konfiguracji serwera WWW i może on stosować reguły globalnie za pomocą wyrażeń regularnych. Na własnym serwerze źródłowym NGINX oznacza to blok location dopasowany do rozszerzeń plików, które chcesz objąć, z linią add_header wysyłającą X-Robots-Tag i wartość noindex.
- Meta tag - pojedyncze strony HTML, w których masz kontrolę nad szablonem.
- Nagłówek odpowiedzi - pliki bez kodu HTML i wzorce obejmujące cały serwis.
Jeśli Twój hosting stoi za Jalvo, czyli reverse proxy NGINX z adresami IP z UE i USA, nagłówek nadal konfiguruje się na serwerze źródłowym. Po każdej zmianie odpytaj publiczny adres URL i sprawdź nagłówki odpowiedzi.
Umiejscowienie meta tagu robots w skrócie: head to konwencja, body nadal jest respektowane, a wygrywa najbardziej restrykcyjna reguła. Audytuj wyrenderowany kod HTML i nagłówki odpowiedzi, a nie tylko szablon, który sam napisałeś.
FAQ
Czy Google respektuje noindex umieszczony w body?
Tak. Wyszukiwarka Google nie wymaga umieszczenia tagu w sekcji head i respektuje meta tagi robots także w body. To nic nowego, dopiero niedawno zostało to udokumentowane.
Co się dzieje, gdy strona ma jednocześnie index i noindex?
Obowiązuje bardziej restrykcyjna reguła, więc strona nie jest indeksowana. Drugi tag z wartością „index” nie nadpisuje pierwszego. Usuń niechcianą dyrektywę u źródła.
Czy mogę zablokować indeksowanie pliku PDF meta tagiem robots?
Nie. Pliki inne niż HTML nie mogą zawierać meta tagu, więc potrzebują nagłówka odpowiedzi X-Robots-Tag ustawionego na serwerze WWW. Adres URL musi też pozostać dostępny do crawlowania, bo plik zablokowany w robots.txt nigdy nie jest pobierany.
Daj każdej stronie własne IP.
Pierwszą domenę dodasz w kilka minut.


