Indeksowalność
ważność wysokamierzonysposób indexability
Czy strona nie ma noindex w meta robots lub nagłówku X-Robots-Tag. Błędny noindex na produkcji to znikanie z Google.
WIKI
artykuł z 16.09.2026 · źródeł 9Indeksowalność to parametr monitoringu stron internetowych, który sprawdza, czy strona nie prosi wyszukiwarek o pominięcie jej w wynikach wyszukiwania. Pomiar szuka reguły noindex w dwóch miejscach: w znaczniku meta o nazwie robots w kodzie HTML i w nagłówku odpowiedzi HTTP X-Robots-Tag. Wynikiem jest informacja, czy taka reguła jest obecna. Reguła noindex oznacza, że strony, pliku multimedialnego albo zasobu nie należy pokazywać w wynikach wyszukiwania [1].
Jak działa
Znacznik meta robots pozwala sterować indeksowaniem pojedynczej strony HTML i umieszcza się go w sekcji head [1]. Te same reguły można przekazać nagłówkiem X-Robots-Tag w odpowiedzi HTTP dla danego adresu URL [1]. Nagłówek sprawdza się tam, gdzie znacznika w HTML nie da się użyć, na przykład przy plikach graficznych [1]. Według Google obie metody wdrożenia noindex działają tak samo, a wybór zależy od wygody i typu treści [2].
Reguły można kierować do konkretnego robota. W znaczniku meta Google obsługuje dwa tokeny: googlebot dla wyników tekstowych i googlebot-news dla wiadomości, a inne wartości pomija [1]. Nagłówek X-Robots-Tag może zawierać nazwę robota przed regułami, np. googlebot: nofollow [1]. Wielkość liter w nazwach i wartościach nie ma znaczenia [1]. Gdy reguły się wykluczają, obowiązuje bardziej restrykcyjna [1]. Reguła none jest równoważna parze noindex, nofollow [1].
Reguła działa dopiero wtedy, gdy robot ją odczyta. Po pobraniu strony i wydobyciu znacznika albo nagłówka Google usuwa stronę z wyników wyszukiwania w całości, niezależnie od linków z innych witryn [2]. Ponowne odwiedziny robota mogą jednak nastąpić dopiero po miesiącach, zależnie od znaczenia strony [2].
Standardy i specyfikacje
- Specyfikacja Google opisuje znacznik
metarobots i nagłówekX-Robots-Tag, obsługiwane reguły, tokeny robotów i zasadę pierwszeństwa bardziej restrykcyjnej reguły [1]. - noindex a robots.txt. Plik robots.txt określa, które adresy robot może pobierać, i służy głównie do ograniczania obciążenia serwera; nie jest mechanizmem wykluczania strony z Google [3]. Strona zablokowana w robots.txt może zostać zaindeksowana, jeśli prowadzą do niej linki z innych miejsc, a wynik pojawia się wtedy bez opisu [3]. Żeby
noindexzadziałał, zasób nie może być zablokowany w robots.txt [2]. Jeśli jest, robot nie znajdzie reguł indeksowania i je pominie [1]. - WordPress. Na ekranie Ustawienia → Czytanie opcja „Proś wyszukiwarki o nieindeksowanie witryny” prosi wyszukiwarki o pominięcie witryny [4]. Od wersji 5.3 włączenie jej dodaje do sekcji
headznacznikmetarobots z wartościąnoindex,nofollow, a do wersji 5.2 plik robots.txt odpowiadał regułąDisallow: /[4]. Zmianę uzasadniono tym, że strona nie musi być pobierana, by trafić do wyników, i że chodzi o zniechęcenie do wyświetlania witryny, a nie tylko do jej pobierania [5]. Opcja nie blokuje dostępu do witryny; respektowanie prośby zależy od wyszukiwarek [4]. - Funkcje WordPressa. Od wersji 5.7 funkcja
wp_robots()zbiera reguły przez filtrwp_robotsi wypisuje znacznik tylko wtedy, gdy jest co najmniej jedna reguła [6]. Funkcjawp_robots_noindex()dodajenoindex, gdy opcjablog_publicjest wyłączona [7]. Funkcjawp_robots_no_robots()zawsze dodajenoindex, a do tegonofollowdla witryny niepublicznej albofollowdla publicznej [8].
Zagrożenia i skutki
Reguła pozostawiona po pracach nad witryną. Google w wytycznych dotyczących przenoszenia witryn zauważa, że część właścicieli blokuje pobieranie całej witryny w czasie jej budowy [9]. Zaleca przygotowanie listy adresów, z których reguły noindex zostaną usunięte przy rozpoczęciu przeniesienia, i przypomina o usunięciu reguł noindex i blokad w robots.txt potrzebnych tylko na czas migracji [9]. Pozostawiona reguła na produkcji prowadzi do usunięcia stron z wyników po ich ponownym pobraniu [2].
Reguła w nagłówku. Nagłówek X-Robots-Tag należy do odpowiedzi HTTP, a nie do kodu strony [1]. Dodaje się go między innymi w plikach konfiguracyjnych serwera WWW, na przykład .htaccess i httpd.conf w Apache [1]. Przegląd samego HTML takiej reguły nie ujawni.
noindex połączony z blokadą w robots.txt. Jeśli adres ma regułę noindex, a jednocześnie jest zablokowany w robots.txt, robot nie zobaczy reguły, a strona może nadal pojawiać się w wynikach [2]. Taki zestaw daje odwrotny skutek od zamierzonego.
Opóźniony skutek. Usunięcie strony z indeksu i jej powrót po zdjęciu reguły wymagają ponownego pobrania, które może nastąpić po długim czasie [2]. Google udostępnia raport indeksowania stron w Search Console do śledzenia stron, z których odczytano noindex [2].
Przykłady
| Konfiguracja | Co zobaczy robot | Skutek w wynikach |
|---|---|---|
meta name="robots" content="noindex" w head | reguła w HTML [1] | strona usunięta z wyników [2] |
nagłówek X-Robots-Tag: noindex | reguła w odpowiedzi HTTP [1] | ten sam skutek co znacznik [2] |
meta name="googlebot" content="noindex" | reguła tylko dla robota Google [1] | inne wyszukiwarki jej nie dotyczą [1] |
content="none" | odpowiednik noindex, nofollow [1] | strona usunięta z wyników [2] |
noindex i Disallow w robots.txt | robot nie pobiera strony, reguły nie widzi [1] | adres może zostać w wynikach bez opisu [3] |
| WordPress z opcją nieindeksowania | meta robots noindex,nofollow [4] | prośba do wyszukiwarek, dostęp bez zmian [4] |
- [1] Robots meta tag, data-nosnippet, and X-Robots-Tag specifications · Google Search Central
- [2] Block Search Indexing with noindex · Google Search Central
- [3] Robots.txt Introduction and Guide · Google Search Central
- [4] Settings Reading screen · WordPress.org Documentation
- [5] Changes to prevent search engines indexing sites · Make WordPress Core
- [6] wp_robots() — Function Reference · WordPress Developer Resources
- [7] wp_robots_noindex() — Function Reference · WordPress Developer Resources
- [8] wp_robots_no_robots() — Function Reference · WordPress Developer Resources
- [9] Site Moves and Migrations · Google Search Central
STATS
wyniki z systemu · tylko liczby zbiorczeTen parametr nie zapisuje odczytu per strona — przebieg zostawia tylko ustalenia, więc liczby sprawdzonych stron i wyników „ok” system nie ma. Pojawią się po wdrożeniu zapisu przebiegów per strona per parametr.
Ten parametr nie otworzył jeszcze żadnego ustalenia w bazie LAB247. Pusto nie znaczy „czysto” — znaczy, że nic nie przekroczyło reguły.
- Przebiegów
- 33sposób indexability
- W 30 dni
- 33przebiegów
- Ostatni
- 19.09.2026start przebiegu
- Stron w przebiegach
- —33 przebiegów bez liczby stron
CARD
karta z kodu CREATO_PING, odczyt 16.09.2026| Obszar i ważność | SEO · wysoka (S01) |
|---|---|
| Workflow i częstotliwość | creato_ping_security_v2 · P3 działa na LAB247cron co 24 h, T1–T3; T4 raz po anomalii · Dokładny skan. dns_integrity porównuje NS, MX, SPF i DMARC z wzorcem z poprzedniego przebiegu. |
| Sonda i helper | sposób indexability · CREATO_PING/helpers/indexability_check.py |
| Testy |
|
| Typ wyniku | 0 albo 1 ustalenie noindex z listą sygnałów: meta robots, nagłówek X-Robots-Tag, blokada całości w robots.txt |
| Jednostka | brak — wynik jakościowy |
| Próg i reguła | Timeout 5,0 s. Reguła: co najmniej jeden z trzech sygnałów = noindex (powaga normalna w helperze). |
| Gdzie leżą pokrętła | CREATO_PING/helpers/indexability_check.py → _META_ROBOTS_NOINDEX, _DISALLOW_ALL, _USER_AGENT_ALLCREATO_PING/helpers/html_fetch.py → MAX_BODY_BYTESCREATO_PING/helpers/security_runner.py → _TASK_SEVERITIES (dalej idą tylko urgent i high)CREATO_PING/config/incident_policy.toml → [finding] noindex |
| Retencja odczytów | Nic: helper nadaje powagę poniżej wysokiej, filtr przebiegu odrzuca ustalenie przed zapisem, a produkcja idzie z --no-stats. Nie ma ani odczytu per strona, ani ustalenia, ani licznika — statystyki i replay niemożliwe. |
| Znane rozbieżności |
|
| Karta przepisana z | CREATO_PING/helpers/indexability_check.py · CREATO_PING/helpers/html_fetch.py · CREATO_PING/helpers/security_runner.py · CREATO_PING/config/incident_policy.toml · CREATO_PING/workflows/_prod/creato_ping_security_v2.json · odczyt 16.09.2026 |
Helper zgłasza powagę normalną, a filtr przebiegu przepuszcza tylko pilną i wysoką — ustalenie odpada, zanim zostanie odczytana polityka. Wpis w polityce (wysoka, WARNING, gate=true — decyzja 2026-07-11 „awaria SEO → warning”) nie jest osiągany: w produkcji noindex nie tworzy subtaska.
| Ustalenie | Powaga | Pewność | Skutek | Subtask / alarm | Co zrobić |
|---|---|---|---|---|---|
| noindex na produkcjinoindex | Wysokie | Ewidentne | WARNING | tak / tak | Usuń noindex w ustawieniach WordPress lub wtyczce SEO. |
LOOP
pętli: 1Trafności jeszcze nie liczymy: zamknięcie subtaska nie niesie dziś werdyktu (prawdziwy / fałszywy / nie dało się sprawdzić). Cztery liczby pojawią się, gdy każde zamknięcie dostanie werdykt — to warunek startu pętli 1.
Sygnał: Działające strony wypadały z całego skanu bezpieczeństwa: serwer deklarujący gzip wysyłał coś innego, a WAF odrzucał nagłówek monitora. Bez strony głównej nie było odczytu wersji ani heurystyk infekcji. · dotyczy też: Wersja WordPressa, Malware / infekcja
- 1. Zbiórkaręcznieodczyt z nocnego skanu, bez zapisu per strona
- 2. Werdyktręcznieczłowiek rozpoznał zdrowe strony jako „martwe” w skanie
- 3. Miarabrakliczników trafności wtedy nie było
- 4. Kartabrakkarta parametru powstała 2026-09-16
- 5. Zmianazrobionepowtórki pobrania strony głównej
- 6. Replaybrakbrak zapisanych odczytów do replayu
| Data | Zmiana | Powód | Wpływ na system | Commit · replay |
|---|---|---|---|---|
| 2026-09-05 | Kod 403, 406, 415, 429 lub 451 dla nagłówka monitora = jedna powtórka z nagłówkami przeglądarki (nie dla Googlebota); błąd dekompresji = jedna powtórka bez kompresji.helpers/html_fetch.py | Blokada nagłówka monitora i błędny gzip dawały „stronę martwą”, choć działała dla ludzi. | cały system Wspólne pobranie strony głównej zasila też infekcję, indeksowalność i SEO; Googlebot celowo bez powtórki, żeby nie zamazać sygnału cloakingu. Wydłużenie limitu połączenia z tego samego wydania opisuje pętla exposure-h1. | b0fc77cbez replayubez zapisu zatwierdzenia |