Blokuota dėl kitos 4xx problemos: kaip tai ištaisyti

Atidarote „Search Console“ ir štai jis: Neindeksuota: „Blokuota dėl kitos 4xx problemos“. Nėra būsenos kodo, nėra paveikto failo, nėra akivaizdžios priežasties.
Šiame vadove tiksliai paaiškinama, kurios klaidos sukelia šią žymę, kaip rasti už jos slypintį tikrąjį būsenos kodą ir kaip ištaisyti kiekvieną priežastį – įskaitant diagnostikos veiksmus, kuriuos dauguma straipsnių praleidžia. Norėdami sužinoti, kur ši ataskaita įsitvirtina platesniame įrankyje, žr. mūsų išsamų „Google Search Console“ vadovą.
Ką iš tikrųjų reiškia „blokuota dėl kitos 4xx problemos“
„Blokuota dėl kitos 4xx problemos“ reiškia, kad „Googlebot“ paprašė URL adreso ir gavo 4xx (kliento pusės) atsaką, kurio „Search Console“ dar neišskiria į atskirą kategoriją.
Kadangi „Google“ negalėjo gauti puslapio, jis jo neindeksuos. Tokiais atvejais URL adresas lieka už paieškos rezultatų ribų, kol grąžins sėkmingą būseną.
Čia esminis žodis yra „kita“. „Search Console“ jau turi skirtas žymes trims dažniausiems 4xx kodams:
- 401 → „Blokuota dėl neteisėtos užklausos (401).“
- 403 → „Blokuota dėl uždraustos prieigos (403).“
- 404 → „Nerasta (404).“
Taigi „kita 4xx“ tampa skėčiu visiems kitiems 4xx diapazono atvejams: 400, 405, 408, 410, 429 ir panašiems kodams. Pranešimas yra miglotas, nes „Google“ žino, kad įvyko 4xx, tačiau tai nėra vienas iš tų, kuriuos jie yra pažymėję.
Kurie 4xx būsenos kodai sukelia šią klaidą
Tai yra kodai, kurie dažniausiai patenka po šia žyme. Prieš ką nors taisydami turite nustatyti, kurį iš jų jūsų serveris iš tiesų grąžina.
| Kodas | Pavadinimas | Tipinė priežastis |
|---|---|---|
| 400 | Bad Request | Netaisyklingas URL adresas, netinkami simboliai, sugadinta užklausa |
| 405 | Method Not Allowed | Serveris atmeta užklausos metodą (pvz., GET išjungtas tame kelyje) |
| 406 | Not Acceptable | Turinio derybų (content negotiation) neatitikimas |
| 408 | Request Timeout | Serveris per lėtai atsako per jam skirtą laiką |
| 410 | Gone | Puslapis pašalintas visam laikui (žr. pastabą žemiau) |
| 411 / 412 / 421 / 422 | Įvairios | Ilgio / išankstinės sąlygos / neteisingai nukreiptos / neapdorojamos užklausos problemos |
| 429 | Too Many Requests | Užklausų ribojimas (labai dažna priežastis didesnėse ar agresyviai apsaugotose svetainėse) |
| 451 | Unavailable for Legal Reasons | Geografinis / teisinis blokavimas |
| 418 | I'm a teapot | Juokinga būsena, apibrėžta RFC (reta, bet realus kodas, kurį kai kurios sistemos retkarčiais grąžina) |
Pastaba apie 410 (Gone): jei puslapis sąmoningai pašalintas visam laikui, 410 yra teisingas atsakas ir jo „taisyti“ nereikėtų. Tiesiog įsitikinkite, kad tai ne puslapis, kurį iš tikrųjų norite indeksuoti.
Kas sukelia 4xx klaidas „Googlebot“
Dauguma atvejų kyla iš vienos iš šių penkių priežasčių:
- Saugumo taisyklės ir WAF. Užkardos, tokios kaip „Cloudflare“, „Sucuri“ ar „AWS WAF“, kartais klaidingai palaiko „Googlebot“ grėsme ir grąžina 403 arba blokuoja užklausą. Tą patį gali padaryti ir „WordPress“ saugumo įskiepiai.
- Užklausų ribojimas (429). Serveris grąžina 429, kai nusprendžia, kad per greitai gauta per daug užklausų, o „Google“ neindeksuos puslapio, kuriame jis nuolat ribojamas.
- Serverio ar CDN konfigūracija. CDN taisyklė, .htaccess direktyva ar šablono pakeitimas gali pradėti grąžinti 4xx URL adresuose, kurie jūsų naršyklėje atvaizduojami puikiai.
- Netaisyklingi URL adresai (400). 400 reiškia, kad serveris nesuprato užklausos – dažnai dėl neteisingos URL adreso struktūros ar blogų parametrų. Tai dažna su fasetine navigacija ir sesijos / sekimo parametrais.
- Failų teisės. Per griežtai nustatytos katalogų teisės (pvz., 700 vietoj 755) gali sukelti 403.
Naudinga užuomina: kadangi tai yra kliento pusės atsakai, susiję su tuo, kaip pateikiama užklausa, tos pačios klaidos savo naršyklėje dažnai nematysite – būtent todėl ši ataskaita atrodo tokia neaiški.
Kaip rasti tikslų 4xx būsenos kodą, kurį gavo „Google“
„Search Console“ praneša, kad puslapis paveiktas, bet ne kurį 4xx kodą jis grąžino. Turite tai išsiaiškinti patys. Vykdykite šią seką:
- Išvardykite paveiktus URL adresus. „Search Console“ eikite į Indexing → Pages, slinkite iki „Why pages aren't indexed“ ir spustelėkite „Blocked due to other 4xx issue“, kad pamatytumėte visą sąrašą. Jie yra skiltyje Pages → skirtuke Not indexed.
- Patikrinkite URL adresą. Spustelėkite URL adresą, tada Test live URL URL tikrinimo įrankyje. Jis parodo tiksliai tai, ką matė „Googlebot“, įskaitant HTTP atsaką ir bet kokius peradresavimus.
- Pasiimkite kaip „Googlebot“. Kadangi klaida dažnai priklauso nuo naudotojo agento, atkurkite ją su „Googlebot“ naudotojo agentu. „Chrome DevTools“ atidarykite skirtuką „Network conditions“, atžymėkite „Use browser default“ ir pasirinkite „Googlebot Smartphone“, tada perkraukite ir perskaitykite būsenos kodą. Taip pat galite terminale paleisti
curl -A "Googlebot" -I https://yoururl. - Patikrinkite serverio žurnalus. Žurnalai rodo tikrąjį būsenos kodą, kurį jūsų serveris grąžino „Google“ IP adresams – tai yra atspirties taškas, kai DevTools ir naršyklė nesutampa.
- Įsitikinkite, kad tai tikrai „Googlebot“. Jei blokuoja WAF, prieš plėsdami prieigą patvirtinkite, kad užklausą teikiantis IP adresas iš tikrųjų priklauso „Google“, kad neatvertumėte durų suklastotiems robotams.
Kaip ištaisyti kiekvieną 4xx klaidą, kodas po kodo
Kai žinote kodą, sprendimas iš jo išplaukia:
| 4xx kodas | Tikėtina priežastis | Kaip ištaisyti |
|---|---|---|
| 403 | WAF ar užkarda blokuoja „Googlebot“ | Įtraukite patikrintą „Googlebot“ į baltąjį sąrašą arba pakoreguokite jį gaudančią taisyklę. Ištaisykite failų teises, jei to priežastis. |
| 429 | Užklausų ribojimas | Padidinkite arba suderinkite užklausų ribą patikrintiems paieškos robotams ir patikrinkite, ar įskiepis arba CDN neriboja nuskaitymų. |
| 400 | Netaisyklingas URL adresas | Pataisykite URL adreso struktūrą, nustokite generuoti netinkamas parametrų kombinacijas ir kanonizuokite parametruotus URL adresus. |
| 405 / 406 / 408 | Serverio taisyklė, turinio derybos ar laiko limitas | Ištaisykite serverio pusės taisyklę, turinio derybas ar laiko limito elgseną paveiktiems keliams. |
| 410 (neturėtų būti pašalintas) | Puslapis pašalintas per klaidą | Atkurkite puslapį arba 301 peradresuokite jį į artimiausią atitikmenį, jei jis turi vertės ir atgalinių nuorodų. |
| 404 / 410 (sąmoningi) | URL adresas tikrai nebeegzistuoja | Palikite kaip yra. Tai ne klaidos, kurias reikia taisyti. Jei apimtis didelė, užblokuokite nuskaitymo švaistymą su robots.txt. |
Kaip patvirtinti 4xx pataisą „Search Console“
Ištaisę pagrindinę priežastį, grįžkite į ataskaitą „Blocked due to other 4xx issue“ ir spustelėkite Validate fix.

„Google“ iš naujo nuskaitys paveiktus URL adresus; pataisytų URL adresų pakartotinis nuskaitymas paprastai užtrunka nuo kelių dienų iki kelių savaičių, priklausomai nuo nuskaitymo biudžeto.
Ataskaita atsinaujina, kai „Google“ pakartotinai bando kiekvieną URL adresą, todėl naujausios pataisos nebus rodomos iškart. Laikykite URL tikrinimo įrankį po ranka, kad patvirtintumėte, jog kiekvienas puslapis dabar grąžina 200, prieš pasikliaudami patvirtinimu.
4xx paveiktų URL adresų paieška dideliu mastu su „SEOcrawl AI“
„Search Console“ parodo problemą, bet verčia tikrinti URL adresus po vieną. SEOcrawl AI surenka jūsų „Search Console“ aprėpties duomenis ir atskleidžia indeksavimo būsenas visoje svetainėje, todėl paveiktus URL adresus galite pastebėti masiškai, o ne spustelėdami po vieną.
Mūsų MCP serveris leidžia perskaityti visą indeksavimo aprėpties suskirstymą pagal būseną ir filtruoti nuskaitytus puslapius pagal būsenos kodą (pavyzdžiui, visus grąžinančius 404) tiesiai iš „Claude“ ar „ChatGPT“, bei žymėti juos taisyklėmis, rankiniu būdu arba per MCP. Sujunkite tai su suplanuotais nuskaitymais ir įspėjimais, kad pagautumėte 4xx URL adresų šuolį anksčiau, nei jis pakenks jūsų reitingams.
Raskite kiekvieną 4xx paveiktą URL adresą vienoje vietoje. Užuot spustelėję „Search Console“ URL po URL, „SEOcrawl AI“ parodo visą jūsų indeksavimo aprėpties suskirstymą ir leidžia filtruoti nuskaitytus puslapius pagal būsenos kodą tiesiai iš „Claude“ ar „ChatGPT“. Išbandykite „SEOcrawl AI“.
DUK
Ką reiškia 4xx klaida?
4xx klaida yra kliento pusės HTTP būsena, reiškianti, kad pačios užklausos įvykdyti nepavyko: puslapis nerastas, prieiga uždrausta, užklausa netaisyklinga arba serveris ją riboja.
4xx šeimai priklauso, be kita ko, 400 (netaisyklinga užklausa), 403 (uždrausta), 404 (nerasta), 410 (pašalinta) ir 429 (per daug užklausų). SEO požiūriu bet koks 4xx puslapyje, kurį norite indeksuoti, yra problema, nes „Google“ negali gauti turinio, kad jį reitinguotų.
Ar 4xx klaidos kenkia SEO?
Taip, kai jos ištinka puslapius, kuriuos norite matyti indekse. 4xx grąžinantis puslapis negali būti nuskaitomas, todėl jis nebus indeksuojamas ar reitinguojamas, o jūs prarandate srautą, kurį jis būtų surinkęs.
Dideliu mastu paplitusios 4xx klaidos taip pat švaisto nuskaitymo biudžetą ir gali signalizuoti apie prastą svetainės priežiūrą. Sąmoningi 404 ir 410 tikrai nebeegzistuojantiems URL adresams yra normalu; problema kyla dėl 4xx atsakų puslapiuose, kurie turėtų veikti.
Kas yra 4xx klaida SEO požiūriu?
SEO požiūriu 4xx klaida yra bet koks kliento pusės atsakas, sustabdantis paieškos sistemų prieigą prie URL adreso. Svarbiausi yra 404 (sugadinti arba pašalinti puslapiai), 403 (blokuota prieiga, dažnai užkardos) ir kodai, slypintys už „blokuota dėl kitos 4xx problemos“, tokie kaip 400, 429 ir 410.
Kaip sužinoti, kurį 4xx gavo „Google“?
„Search Console“ kodo neįvardija, todėl patikrinkite jį patys. Atidarykite paveiktą URL adresą URL tikrinimo įrankyje ir paleiskite Test live URL, kad pamatytumėte atsaką, arba pasiimkite puslapį su „Googlebot“ naudotojo agentu („Chrome DevTools“ skydelyje „Network conditions“ arba komanda curl -A "Googlebot" -I [url]).
Serverio žurnalai pateikia galutinį būsenos kodą, kurį jūsų serveris grąžino „Google“. Norėdami tai atlikti daugybei URL adresų iš karto, „SEOcrawl AI“ leidžia masiškai filtruoti nuskaitytus puslapius pagal būsenos kodą.
Autorius: David Kaufmann

Pastaruosius 10+ metų praleidau visiškai apsėstas SEO — ir, tiesą sakant, nenorėčiau, kad būtų kitaip.
Mano karjera pakilo į naują lygį, kai dirbau vyresniuoju SEO specialistu Chess.com — vienoje iš 100 lankomiausių svetainių visame internete. Darbas tokiu mastu, apimant milijonus puslapių, dešimtis kalbų ir vieną konkurencingiausių SERPs, išmokė mane to, ko joks kursas ar sertifikatas niekada nebūtų galėjęs. Ta patirtis pakeitė mano supratimą apie tai, kaip iš tikrųjų atrodo puikus SEO — ir tapo pagrindu viskam, ką nuo tada sukūriau.
Iš tos patirties įkūriau SEO Alive — agentūrą prekės ženklams, kurie rimtai žiūri į organinį augimą. Mes čia ne tam, kad pardavinėtume dashboards ir mėnesines ataskaitas. Mes čia tam, kad kurtume strategijas, kurios iš tikrųjų daro poveikį, sujungdami tai, kas geriausia klasikiniame SEO, su jaudinančiu nauju Generative Engine Optimization (GEO) pasauliu — užtikrindami, kad jūsų prekės ženklas pasirodytų ne tik Google mėlynosiose nuorodose, bet ir AI sugeneruotuose atsakymuose, kuriuos ChatGPT, Perplexity ir Google AI Overviews kasdien pateikia milijonams žmonių.
Ir kadangi neradau įrankio, kuris tinkamai valdytų abu šiuos pasaulius, sukūriau jį pats — SEOcrawl, enterprise SEO intelligence platformą, kuri vienoje vietoje sujungia rankings, techninius auditus, backlinks stebėseną, crawl būklę ir AI prekės ženklo matomumo sekimą. Tai platforma, apie kurios egzistavimą visada svajojau.
Atraskite daugiau šio autoriaus turinio

