robots.txt: Pilnīga konfigurēšanas rokasgrāmata

Esat noguruši dzirdēt par robots.txt un nezināt, par ko ir runa? Neuztraucieties – šodien piedāvājam risinājumu jūsu problēmai. Šajā ierakstā pēc iespējas skaidrāk paskaidrosim, kas ir robots.txt, kā to konfigurēt (īpaši WordPress vidē) un kādu ietekmi tas var atstāt uz mūsu projekta SEO.
Ķersimies pie lietas!
Kas ir robots.txt un kam tas paredzēts?
robots.txt ir vienkārši fails, kas tiek mitināts jūsu vietnes saknes direktorijā un ļauj liegt noteiktiem robotiem (piemēram, Google vai Bing) apmeklēt jūsu vietni vai tās daļas.
UZMANĪBU: ir svarīgi zināt, ka tas ir protokols, un parasti visi „labie“ roboti to ievēro (GoogleBot, BingBot, Semrush, ...), taču jebkurš robots ar ļauniem nolūkiem to var apiet, piemēram, Screaming Frog, atzīmējot šo opciju:

Kāpēc fails robots.txt ir svarīgs SEO?
Kā jau iepriekš minējām, visi labie roboti (piemēram, GoogleBot) ievēro šo protokolu, tāpēc mēs varam izmantot šo failu, lai vadītu Google pa mūsu vietni. Lapas, kuras šeit aizliedzat, Google Search Console parādās kā „Bloķēts ar robots.txt“.
Ko? Ko jūs ar to domājat? Vadīt Google ar robots.txt?
Jā, neuztraucieties – paskaidrosim to ar piemēru, lai viss kļūtu daudz skaidrāks:
Iedomājieties, ka jūsu vietnē ir privāta zona, kurai var piekļūt tikai reģistrēti lietotāji, un, kā mēs labi zinām, Google nevar piekļūt nevienai vietnei, kurai nepieciešama pieteikšanās (pagaidām...).
Tātad, vai gan nebūtu jēga, lai Google netērētu mūsu pārmeklēšanas budžetu (crawl budget), pārmeklējot lapas, kurām tam nav nekādas vērtības?
Tieši tā! Viens no svarīgākajiem robots.txt pielietojumiem ir bloķēt ceļus, kuriem Google ir maza vērtība, un tādā veidā likt tam koncentrēties uz mūsu vietnes svarīgajām lapām. Šī iemesla dēļ robots.txt vajadzētu būt vienam no stūrakmeņiem, kas jāpatur prātā mūsu SEO stratēģijā.
Šis ir tikai viens piemērs no tūkstošiem lietu, ko varam paveikt ar šo failu. Citi piemēri ir mūsu vietnes kartes (sitemap) norādīšana, pārmeklēšanas intervāla samazināšana, resursu pārmeklēšanas bloķēšana, ...
Kā izveidot robots.txt failu
Nu... ķersimies pie darba!
Izveidot šo failu ir patiešām vienkārši – jums vienkārši jāpaņem savs teksta redaktors (Notepad operētājsistēmā Windows vai TextEdit operētājsistēmā Mac) vai jāizmanto tiešsaistes redaktors un, sagatavojot savu robots.txt, jāeksportē tas kā txt fails.
Kad tas mums ir, atliek tikai nosaukt to par „robots.txt“ un augšupielādēt to savas vietnes saknes direktorijā, izmantojot servera paneli vai FTP.
Lai pārbaudītu, vai tas ir augšupielādēts pareizi, jums vienkārši jāpievieno „/robots.txt“ savam domēnam, piemēram https://seocrawl.com/robots.txt
UZMANĪBU: uzmanieties ar kešatmiņu – labāk to apskatīt inkognito režīmā ;)
Bet ja man ir WordPress?
Ja jums ir WordPress, tas ir vienkāršāk, jo labākie SEO spraudņi, piemēram, Rank Math vai Yoast, tiek piegādāti ar iebūvētu papildinājumu, kas ļauj rediģēt robots.txt tieši.
Rank Math gadījumā jūs to atradīsiet: Rank Math > General Settings > Edit robots.txt

Yoast gadījumā mums būs jādodas uz: SEO > Tools > File Editor
Šādā veidā jūs varat viegli rediģēt vai izveidot failu, neveicot nevienu no iepriekš aprakstītajiem soļiem.
Komandas
Tālāk apskatīsim daudzas mums pieejamās komandas kopā ar to atbilstošajiem piemēriem:
Bloķēt visas vietnes pārmeklēšanu
User-agent: * Disallow: /
PIEZĪME: ja jūs izstrādājat savu vietni un nevēlaties, lai neviens robots iekļūtu tajā, lasītu un indeksētu jūsu saturu, šis noteikums lieliski darbojas.
Bloķēt lapas pārmeklēšanu
User-agent: * Disallow: /lapas-kuru-nevelos-parmeklet-url
Bloķēt mapes pārmeklēšanu
User-agent: * Disallow: /mape/
Atļaut piekļuvi lapai
User-agent: * Allow: /lapa
Bloķēt mapi un atļaut lapu šajā mapē
User-agent: * Disallow: /mape/ Allow: /mape/lapa
Norādīt vietnes karti (sitemap)
Sitemap: https://domain.com/sitemap.xml
Dot norādījumus konkrētiem robotiem
Šajā gadījumā pakavēsimies nedaudz ilgāk. Ja pamanījāt, lielākā daļa iepriekšējo direktīvu sākās ar:
User-agent: *
Tas „*“ attiecas uz visiem robotiem. Tas ir, visas direktīvas pēc šīs rindas attiecas uz visiem robotiem. Ja mēs vēlamies nosūtīt konkrētus norādījumus noteiktiem robotiem, mums tas būs jāmaina šādi:
User-agent: Googlebot Ja vēlamies atsaukties uz Google robotu
User-agent: Bingbot Ja vēlamies atsaukties uz Bing robotu
User-agent: DuckDuckBot Ja vēlamies atsaukties uz DuckDuckGo robotu
Viss, kas jums jādara, ir jānoskaidro, kā sauc robotu, kuram vēlaties dot norādījumu, un jānosauc tas tā, kā tikko parādījām.
Pārskatiet un pārbaudiet robots.txt failu
Tagad, kad esat pabeiguši „noskaņot“ savu robots, lai padarītu to pilnībā optimizētu un pielāgotu savai vietnei, atliek vien to pārbaudīt.
Pārbaudīt? Kāpēc?
Nu, pārbaudīt, lai pārliecinātos, ka neesam nekur kļūdījušies un ka tas patiešām darbojas un bloķē tās vietnes daļas, kuras vēlamies bloķēt.
Tam iesakām izmantot šo rīku.

Kad esat iekšā, jums vienkārši jādara:
-
Jāievada URL, kuram vēlaties pārbaudīt, vai pārmeklēšana ir atļauta
-
Jāizvēlas User Agent
-
Jānospiež TEST
Uzreiz pēc tam tiks ielādēts viss mūsu robots.txt fails, un zem tā tiks norādīts, vai piekļuve ir atļauta vai nē.

Šajā gadījumā, kā redzam, tas sniedz pozitīvu rezultātu, taču, ja mēs ievadītu URL, kas nav atļauts, tas arī izceltu rindu, kas to bloķē:

Turklāt šis rīks ļauj mums rediģēt robots.txt failu tieši no turienes, lai veiktu jebkurus nepieciešamos labojumus, lai rezultāts atbilstu mūsu mērķim. Kad tas ir mainīts un pārbaudīts, atliek tikai piemērot šos jaunos labojumus savam robots.
Papildu padoms: padariet savu robots.txt neaizmirstamu
Mēs jums parādījām daudz koda rindu, kas darbojas robotiem, taču jūs varat ievietot arī komentārus, sākot rindu ar „#“. Tas ir, viss, kas sākas ar „#“, robotiem tiks ignorēts. Tas paver veselu iespēju un iekšēju joku pasauli. Šī iemesla dēļ mudinām jūs aplūkot windupschool, pccomponentes vai Minube robots.txt – jūs noteikti sastapsiet kaut ko pārsteidzošu ?

Secinājums
Kā redzējāt, failam robots.txt ir daudz ko piedāvāt, un tas arī prasa lielu uzmanību, jo nepareizi ievietota direktīva var bloķēt jūsu vietnes pārmeklēšanu.
Ceram, ka šī rokasgrāmata jums noderēs, un, ja rodas jautājumi, tiekamies komentāros.
Autors: David Kaufmann

Pēdējos 10+ gadus esmu pavadījis, pilnībā aizrāvies ar SEO — un, godīgi sakot, es to nevēlētos citādi.
Mana karjera sasniedza jaunu līmeni, kad strādāju par vecāko SEO speciālistu Chess.com — vienā no 100 visapmeklētākajām vietnēm visā internetā. Darbs šādā mērogā, aptverot miljoniem lapu, desmitiem valodu un vienu no konkurētspējīgākajām SERPs, iemācīja man to, ko neviens kurss vai sertifikāts nekad nespētu. Šī pieredze mainīja manu skatījumu uz to, kā patiesībā izskatās izcils SEO — un kļuva par pamatu visam, ko esmu izveidojis kopš tā laika.
No šīs pieredzes es nodibināju SEO Alive — aģentūru zīmoliem, kas nopietni domā par organisko izaugsmi. Mēs neesam šeit, lai pārdotu dashboards un ikmēneša atskaites. Mēs esam šeit, lai veidotu stratēģijas, kas patiešām rada rezultātus, apvienojot labāko no klasiskā SEO ar aizraujošo jauno Generative Engine Optimization (GEO) pasauli — nodrošinot, ka jūsu zīmols parādās ne tikai Google zilajās saitēs, bet arī AI ģenerētajās atbildēs, ko ChatGPT, Perplexity un Google AI Overviews katru dienu piegādā miljoniem cilvēku.
Un tā kā es nevarēju atrast rīku, kas pareizi apstrādātu abas šīs pasaules, es izveidoju to pats — SEOcrawl, enterprise SEO intelligence platformu, kas vienuviet apvieno rankings, tehniskos auditus, backlinks uzraudzību, crawl veselību un AI zīmola redzamības izsekošanu. Tā ir platforma, par kuras esamību es vienmēr biju vēlējies.
Atklājiet vairāk šī autora satura

