ARK. S01Parametr monitoringuSEO · lista 50 parametrów

Indeksowalność

ważność wysokamierzonysposób indexability

Czy strona nie ma noindex w meta robots lub nagłówku X-Robots-Tag. Błędny noindex na produkcji to znikanie z Google.

ARK. 1

WIKI

artykuł z 16.09.2026 · źródeł 9

Indeksowalność to parametr monitoringu stron internetowych, który sprawdza, czy strona nie prosi wyszukiwarek o pominięcie jej w wynikach wyszukiwania. Pomiar szuka reguły noindex w dwóch miejscach: w znaczniku meta o nazwie robots w kodzie HTML i w nagłówku odpowiedzi HTTP X-Robots-Tag. Wynikiem jest informacja, czy taka reguła jest obecna. Reguła noindex oznacza, że strony, pliku multimedialnego albo zasobu nie należy pokazywać w wynikach wyszukiwania [1].

Jak działa

Znacznik meta robots pozwala sterować indeksowaniem pojedynczej strony HTML i umieszcza się go w sekcji head [1]. Te same reguły można przekazać nagłówkiem X-Robots-Tag w odpowiedzi HTTP dla danego adresu URL [1]. Nagłówek sprawdza się tam, gdzie znacznika w HTML nie da się użyć, na przykład przy plikach graficznych [1]. Według Google obie metody wdrożenia noindex działają tak samo, a wybór zależy od wygody i typu treści [2].

Reguły można kierować do konkretnego robota. W znaczniku meta Google obsługuje dwa tokeny: googlebot dla wyników tekstowych i googlebot-news dla wiadomości, a inne wartości pomija [1]. Nagłówek X-Robots-Tag może zawierać nazwę robota przed regułami, np. googlebot: nofollow [1]. Wielkość liter w nazwach i wartościach nie ma znaczenia [1]. Gdy reguły się wykluczają, obowiązuje bardziej restrykcyjna [1]. Reguła none jest równoważna parze noindex, nofollow [1].

RYS. 1.1Googlebot odczytuje reguły strony

Reguła działa dopiero wtedy, gdy robot ją odczyta. Po pobraniu strony i wydobyciu znacznika albo nagłówka Google usuwa stronę z wyników wyszukiwania w całości, niezależnie od linków z innych witryn [2]. Ponowne odwiedziny robota mogą jednak nastąpić dopiero po miesiącach, zależnie od znaczenia strony [2].

RYS. 1.2Od noindex do wypadnięcia z indeksu

Standardy i specyfikacje

  • Specyfikacja Google opisuje znacznik meta robots i nagłówek X-Robots-Tag, obsługiwane reguły, tokeny robotów i zasadę pierwszeństwa bardziej restrykcyjnej reguły [1].
  • noindex a robots.txt. Plik robots.txt określa, które adresy robot może pobierać, i służy głównie do ograniczania obciążenia serwera; nie jest mechanizmem wykluczania strony z Google [3]. Strona zablokowana w robots.txt może zostać zaindeksowana, jeśli prowadzą do niej linki z innych miejsc, a wynik pojawia się wtedy bez opisu [3]. Żeby noindex zadziałał, zasób nie może być zablokowany w robots.txt [2]. Jeśli jest, robot nie znajdzie reguł indeksowania i je pominie [1].
  • WordPress. Na ekranie Ustawienia → Czytanie opcja „Proś wyszukiwarki o nieindeksowanie witryny” prosi wyszukiwarki o pominięcie witryny [4]. Od wersji 5.3 włączenie jej dodaje do sekcji head znacznik meta robots z wartością noindex,nofollow, a do wersji 5.2 plik robots.txt odpowiadał regułą Disallow: / [4]. Zmianę uzasadniono tym, że strona nie musi być pobierana, by trafić do wyników, i że chodzi o zniechęcenie do wyświetlania witryny, a nie tylko do jej pobierania [5]. Opcja nie blokuje dostępu do witryny; respektowanie prośby zależy od wyszukiwarek [4].
  • Funkcje WordPressa. Od wersji 5.7 funkcja wp_robots() zbiera reguły przez filtr wp_robots i wypisuje znacznik tylko wtedy, gdy jest co najmniej jedna reguła [6]. Funkcja wp_robots_noindex() dodaje noindex, gdy opcja blog_public jest wyłączona [7]. Funkcja wp_robots_no_robots() zawsze dodaje noindex, a do tego nofollow dla witryny niepublicznej albo follow dla publicznej [8].

Zagrożenia i skutki

Reguła pozostawiona po pracach nad witryną. Google w wytycznych dotyczących przenoszenia witryn zauważa, że część właścicieli blokuje pobieranie całej witryny w czasie jej budowy [9]. Zaleca przygotowanie listy adresów, z których reguły noindex zostaną usunięte przy rozpoczęciu przeniesienia, i przypomina o usunięciu reguł noindex i blokad w robots.txt potrzebnych tylko na czas migracji [9]. Pozostawiona reguła na produkcji prowadzi do usunięcia stron z wyników po ich ponownym pobraniu [2].

Reguła w nagłówku. Nagłówek X-Robots-Tag należy do odpowiedzi HTTP, a nie do kodu strony [1]. Dodaje się go między innymi w plikach konfiguracyjnych serwera WWW, na przykład .htaccess i httpd.conf w Apache [1]. Przegląd samego HTML takiej reguły nie ujawni.

noindex połączony z blokadą w robots.txt. Jeśli adres ma regułę noindex, a jednocześnie jest zablokowany w robots.txt, robot nie zobaczy reguły, a strona może nadal pojawiać się w wynikach [2]. Taki zestaw daje odwrotny skutek od zamierzonego.

Opóźniony skutek. Usunięcie strony z indeksu i jej powrót po zdjęciu reguły wymagają ponownego pobrania, które może nastąpić po długim czasie [2]. Google udostępnia raport indeksowania stron w Search Console do śledzenia stron, z których odczytano noindex [2].

Przykłady

KonfiguracjaCo zobaczy robotSkutek w wynikach
meta name="robots" content="noindex" w headreguła w HTML [1]strona usunięta z wyników [2]
nagłówek X-Robots-Tag: noindexreguła w odpowiedzi HTTP [1]ten sam skutek co znacznik [2]
meta name="googlebot" content="noindex"reguła tylko dla robota Google [1]inne wyszukiwarki jej nie dotyczą [1]
content="none"odpowiednik noindex, nofollow [1]strona usunięta z wyników [2]
noindex i Disallow w robots.txtrobot nie pobiera strony, reguły nie widzi [1]adres może zostać w wynikach bez opisu [3]
WordPress z opcją nieindeksowaniameta robots noindex,nofollow [4]prośba do wyszukiwarek, dostęp bez zmian [4]
TAB. 1.1Przypisy9
  1. [1] Robots meta tag, data-nosnippet, and X-Robots-Tag specifications · Google Search Central
  2. [2] Block Search Indexing with noindex · Google Search Central
  3. [3] Robots.txt Introduction and Guide · Google Search Central
  4. [4] Settings Reading screen · WordPress.org Documentation
  5. [5] Changes to prevent search engines indexing sites · Make WordPress Core
  6. [6] wp_robots() — Function Reference · WordPress Developer Resources
  7. [7] wp_robots_noindex() — Function Reference · WordPress Developer Resources
  8. [8] wp_robots_no_robots() — Function Reference · WordPress Developer Resources
  9. [9] Site Moves and Migrations · Google Search Central
ARK. 2

STATS

wyniki z systemu · tylko liczby zbiorcze
TAB. 2.1Odczyty per strona

Ten parametr nie zapisuje odczytu per strona — przebieg zostawia tylko ustalenia, więc liczby sprawdzonych stron i wyników „ok” system nie ma. Pojawią się po wdrożeniu zapisu przebiegów per strona per parametr.

TAB. 2.3Ustalenia

Ten parametr nie otworzył jeszcze żadnego ustalenia w bazie LAB247. Pusto nie znaczy „czysto” — znaczy, że nic nie przekroczyło reguły.

TAB. 2.4Przebiegi z tym sposobem sprawdzeniaod 09.09.2026
Przebiegów
33sposób indexability
W 30 dni
33przebiegów
Ostatni
19.09.2026start przebiegu
Stron w przebiegach
33 przebiegów bez liczby stron
ARK. 3

CARD

karta z kodu CREATO_PING, odczyt 16.09.2026
RYS. 3.1Droga parametru przez system: Indeksowalność
TAB. 3.1Pomiarpliki: 5
Obszar i ważnośćSEO · wysoka (S01)
Workflow i częstotliwośćcreato_ping_security_v2 · P3 działa na LAB247cron co 24 h, T1–T3; T4 raz po anomalii · Dokładny skan. dns_integrity porównuje NS, MX, SPF i DMARC z wzorcem z poprzedniego przebiegu.
Sonda i helpersposób indexability · CREATO_PING/helpers/indexability_check.py
Testy
  1. Tylko przebieg P3; strony w przebiegu sprawdzane po kolei.
  2. Strona główna ze wspólnego pobrania (to samo co infekcja i wykrywanie wersji), do 5 przekierowań, przy blokadzie UA powtórka z nagłówkami przeglądarki. Kod 400 i wyżej, błąd albo timeout = brak ustalenia.
  3. Meta robots: wyrażenie wymaga atrybutu name=robots przed content i słowa noindex w content.
  4. X-Robots-Tag: nagłówek odpowiedzi końcowej zawiera noindex (bez rozróżniania robota).
  5. Osobny GET /robots.txt bez przekierowań: kod 200 i gdziekolwiek wiersz User-agent: * oraz gdziekolwiek wiersz Disallow: / = sygnał.
Typ wyniku0 albo 1 ustalenie noindex z listą sygnałów: meta robots, nagłówek X-Robots-Tag, blokada całości w robots.txt
Jednostkabrak — wynik jakościowy
Próg i regułaTimeout 5,0 s. Reguła: co najmniej jeden z trzech sygnałów = noindex (powaga normalna w helperze).
Gdzie leżą pokrętłaCREATO_PING/helpers/indexability_check.py → _META_ROBOTS_NOINDEX, _DISALLOW_ALL, _USER_AGENT_ALLCREATO_PING/helpers/html_fetch.py → MAX_BODY_BYTESCREATO_PING/helpers/security_runner.py → _TASK_SEVERITIES (dalej idą tylko urgent i high)CREATO_PING/config/incident_policy.toml → [finding] noindex
Retencja odczytówNic: helper nadaje powagę poniżej wysokiej, filtr przebiegu odrzuca ustalenie przed zapisem, a produkcja idzie z --no-stats. Nie ma ani odczytu per strona, ani ustalenia, ani licznika — statystyki i replay niemożliwe.
Znane rozbieżności
  1. Parametr martwy w produkcji: powaga normalna w helperze nie przechodzi filtra, więc decyzja polityki (wysoka, WARNING) nie działa. Audyt jednej ze stron we wrześniu 2026 znalazł noindex na całej stronie, a subtaska nie było.
  2. Sygnał z robots.txt nie rozróżnia grup: plik blokujący tylko wybrane roboty (osobna grupa z Disallow: /) obok grupy User-agent: * daje fałszywy noindex; test helpera od początku nazywa to znanym ograniczeniem. Kandydat na pierwszą pętlę.
  3. Meta z content przed name nie jest wykrywana; pomijane są meta name=googlebot i dyrektywa none (= noindex, nofollow).
  4. X-Robots-Tag skierowany do innego robota liczy się jak noindex dla Google.
  5. Brak trzeciego stanu: błąd albo kod 400+ strony głównej dają pustą listę, nieodróżnialną od „indeksowalna”. Sprawdzana tylko strona główna.
kandydaci do pętli: kod a opis parametru albo specyfikacja
Karta przepisana zCREATO_PING/helpers/indexability_check.py · CREATO_PING/helpers/html_fetch.py · CREATO_PING/helpers/security_runner.py · CREATO_PING/config/incident_policy.toml · CREATO_PING/workflows/_prod/creato_ping_security_v2.json · odczyt 16.09.2026
TAB. 3.2Co oznacza failtypów ustaleń: 1

Helper zgłasza powagę normalną, a filtr przebiegu przepuszcza tylko pilną i wysoką — ustalenie odpada, zanim zostanie odczytana polityka. Wpis w polityce (wysoka, WARNING, gate=true — decyzja 2026-07-11 „awaria SEO → warning”) nie jest osiągany: w produkcji noindex nie tworzy subtaska.

UstaleniePowagaPewnośćSkutekSubtask / alarmCo zrobić
noindex na produkcjinoindexWysokieEwidentneWARNINGtak / takUsuń noindex w ustawieniach WordPress lub wtyczce SEO.
ARK. 4

LOOP

pętli: 1
RYS. 4.1Pętla parametru — sześć etapów
TAB. 4.1Trafność, 30 dnialarmy · prawdziwe · fałszywe · bez rozstrzygnięcia

Trafności jeszcze nie liczymy: zamknięcie subtaska nie niesie dziś werdyktu (prawdziwy / fałszywy / nie dało się sprawdzić). Cztery liczby pojawią się, gdy każde zamknięcie dostanie werdykt — to warunek startu pętli 1.

TAB. 4.2Pętle1 · zmian: 1 · wpływających na cały system: 1
Zdrowa strona nie może wyglądać na martwą: powtórki pobraniazamknięta historyczna 2026-09-05

Sygnał: Działające strony wypadały z całego skanu bezpieczeństwa: serwer deklarujący gzip wysyłał coś innego, a WAF odrzucał nagłówek monitora. Bez strony głównej nie było odczytu wersji ani heurystyk infekcji. · dotyczy też: Wersja WordPressa, Malware / infekcja

  1. 1. Zbiórkaręcznieodczyt z nocnego skanu, bez zapisu per strona
  2. 2. Werdyktręcznieczłowiek rozpoznał zdrowe strony jako „martwe” w skanie
  3. 3. Miarabrakliczników trafności wtedy nie było
  4. 4. Kartabrakkarta parametru powstała 2026-09-16
  5. 5. Zmianazrobionepowtórki pobrania strony głównej
  6. 6. Replaybrakbrak zapisanych odczytów do replayu
DataZmianaPowódWpływ na systemCommit · replay
2026-09-05Kod 403, 406, 415, 429 lub 451 dla nagłówka monitora = jedna powtórka z nagłówkami przeglądarki (nie dla Googlebota); błąd dekompresji = jedna powtórka bez kompresji.helpers/html_fetch.pyBlokada nagłówka monitora i błędny gzip dawały „stronę martwą”, choć działała dla ludzi.cały system Wspólne pobranie strony głównej zasila też infekcję, indeksowalność i SEO; Googlebot celowo bez powtórki, żeby nie zamazać sygnału cloakingu. Wydłużenie limitu połączenia z tego samego wydania opisuje pętla exposure-h1.b0fc77cbez replayubez zapisu zatwierdzenia
Blog 24/7
20.09Zastrzeżony PESEL: zmiana raz na 30 minut, blokada przy wypłaciedobreprogramy.pl20.09Fałszywe SMS-y od GITD o mandacie za autostradę wyłudzają dane kartyinstalki.pl20.09Pakiet npm indexed-btree omija blokadę skryptów instalacyjnychbleepingcomputer.com19.09SolarWinds łata CVE-2026-28326 w Access Rights Manager, zdalny kod bez logowaniathehackernews.com19.09Orkes Conductor: luka CVE-2026-58138 atakowana w sieci, poprawka w wersji 3.30.2thehackernews.com19.09Trzy luki jądra Linux w katalogu CISA KEV, Red Hat potwierdza aktywne atakithehackernews.com18.09Publiczne exploity na cztery luki jądra Linux dają lokalnie uprawnienia rootthehackernews.com18.09Brevo: skradziony klucz API Cloudflare i skrypty ClickFix na stronach klientówbleepingcomputer.com18.09WaterPlum z Korei Północnej zainfekowała 30 000 urządzeń w 100 krajachtherecord.media18.09Jedna zgoda OAuth daje napastnikowi dostęp do poczty i plików mimo MFAdarkreading.com