Kuidas leida veebisaidi saidikaart

Kuidas leida veebisaidi saidikaart
Ognian Mikov
SEO õpetused

Iga veebisaidi saidikaardi leidmine on suhteliselt lihtne ja siin aitame teil selle ülesande täita. Alustame kõige levinumast saidikaardi formaadist, milleks on XML, ning seejärel käsitleme veel mõnda teist. Kõigepealt alustame põhitõdedest.

Mis on saidikaart?

XML-saidikaart on veebisaidi lehtede loend, mille eesmärk on aidata erinevaid otsingumootoreid. See annab olulist teavet teie veebisaidi URL-ide kohta, sealhulgas lehtede, videote, piltide, failide ja nende omavaheliste seoste kohta. Lisaks lehtedele sisaldab XML-saidikaart ka täiendavaid metaandmeid iga URL-i kohta:

  • viimase uuendamise kuupäev- kui sageli see muutub ja - selle prioriteet võrreldes teiste lehtedega.

Kui rääkida SEO parimatest tavadest, tuleks saidikaart optimeerida nii, et see sisaldaks ainult indekseeritavat ja kvaliteetset sisu. Iga katkine (404), ümbersuunav või dubleeriv leht selle sees võib otsingumootoreid segadusse ajada.

Saidikaart on nagu veebisaidi kavand. See on koostatud koodivormingus ja näeb tavaliselt välja selline:

SEOcrawl sitemap
SEOcrawl sitemap

Või selline:

Sitemap XML
Sitemap XML

Miks on vaja saidikaarti leida?

Saidikaardi põhitõed, sealhulgas nende peamise eesmärgi, oleme juba käsitlenud. Vaatame nüüd, miks meil üldse võiks tekkida soov neid faile leida.

Nagu eespool arutasime, on saidikaardid asendamatu ja lihtne viis teavitada otsingumootoreid ja eelkõige nende roomajaid (nt Googlebot) meie veebisaidi olulisest sisust.

Kõigepealt võiksite kontrollida, kas teil üldse on XML-saidikaart. Kui see on olemas, on järgmine samm see üle vaadata ja veenduda, kas see on õigesti loodud ja sisaldab õiget teavet.

Lõpuks, kui teil saidikaarti pole, võiksite selle luua ja otsingumootoritele esitada — Google'i puhul tehakse seda Google Search Console'i Sitemaps'i aruande kaudu. Arvestage, et XML-saidikaardid ei ole mingil juhul kohustuslikud. Sellegipoolest aitavad need otsingumootorite roomajatel uusi veebisaite ja lehti kiiremini leida, indekseerida ja lõpuks reastada.

Nüüd on aeg süveneda detektiivitöösse ja need saidikaardid üles leida!

Valmis? Läki!

Lihtsad viisid saidikaardi leidmiseks

Alustame oma teekonda mõnest kõige lihtsamast viisist veebisaidi saidikaardi leidmiseks.

1) Kontrollige käsitsi levinud XML-saidikaardi asukohti

Üks levinumaid (ja lihtsamaid) viise veebisaidi XML-saidikaardi leidmiseks on käsitsi kontrollida mõnda standardset asukohta. See on äärmiselt lihtne — teil tuleb vaid sisestada oma veebisaidi URL brauserisse ja seejärel proovida mõnda erinevat variatsiooni. Näitan teile:

See on kõige populaarsem asukoht, kuid mitte ainus. Seega, kui esimese katsega ei vea, on siin veel mõned kiired kontrollid, mida proovida:

  • /sitemap_index.xml (mis on kõigi saidikaartide indeks juhul, kui veebisaidil on neid rohkem kui üks).

Just nii on lugu meie enda XML saidikaardiga selles blogis. Näitan teile:

SEOcrawl sitemap URL
SEOcrawl sitemap URL

Ja siin on, kuidas see välja näeb:

SEOcrawl saidikaartide loend
SEOcrawl saidikaartide loend

Sisuliselt on need eraldi saidikaardid, mis on jaotatud nende sees olevate postituste tüübi järgi.

Kui ka nüüd ei vea, proovime veel mõnda võimalust:

  • /sitemap-index.xml- /sitemap.php- /sitemap.txt- /sitemap.xml.gz- /sitemap/- /sitemap/sitemap.xml- /sitemapindex.xml- /sitemap/index.xml- /sitemap1.xml

Märkus: XML-failid on vaid üks viis saidikaardi kirjeldamiseks. On olemas ka RSS- ja Atom-vormingud.

Seega peame lisama veel mõned võimalikud saidikaardi asukohad:

  • /rss/- /rss.xml- /atom.xml

Nendest räägime lähemalt hiljem.

Lihtsalt kinnituseks — erinevaid alternatiive proovides tuleb enne „/“ märki kirjutada veebisaidi domeeninimi.

2) Kontrollige robots.txt-faili

Kui olete endiselt meiega, tähendab see, et kas teil ei õnnestunud leida faili, mis on meie artikli peamine eesmärk, või olete lihtsalt uudishimulik ja innukas rohkem teada saama.

Tegelikult, olgu täpne põhjus milline tahes, mul on teile häid uudiseid — jätkame oma teekonda veel ühe väga lihtsa nõuandega.

Robots.txt on eriline fail, mis on hästi tuntud SEO-spetsialistidele (ja ka programmeerijatele) ning mis annab otsingumootorite roomajatele kasulikke juhiseid. Veelgi enam, just siin saab väga sageli leida lingi veebisaidi saidikaardile.

Idee on selles, et kuna otsingumootorid külastavad neid robots.txt-faile, on saidikaardi lingi sinna lisamine igati mõistlik. Nii on neil lihtsam saidikaart üldse üles leida ja veebisaiti roomata.

Kas olete valmis veel üheks heaks uudiseks?! Siin see on — veebisaidi robots.txt-failile ligipääsemiseks tuleb brauseris oma domeeninimele lihtsalt lisada /robots.txt ja vajutada „Enter“. See sarnaneb eelmise sammuga, kus lisasime erinevaid võimalikke saidikaardi teekondi.

Mis toimib paremini kui reaalne näide? Vaadake meie enda robots.txt-faili URL-aadressi:

https://seocrawl.com/robots.txt

See on väike, kuid lihtne ja kasulik fail mõne olulise funktsiooniga. Kui olete selle juba avanud, näete peaaegu kohe seda väikest aaret, mida otsite — saidikaardi faili:

SEOcrawl robots.txt
SEOcrawl robots.txt

Voilà! Ma ju lubasin, et see on lihtne :)

3) Kontrollige Google Search Console'i

Olgu, saidikaarti ikka veel ei leia? Pole probleemi! Meil on teile veel nõuandeid, mis aitavad meil tee leida.

Näitan teile veel üht lihtsat ja kiiret viisi.

Google Search Console (varem tuntud ka kui Webmaster Tools) on veel üks koht, kust otsitud teed leida. Muidugi peate selleks olema veebisaidi omanik või teile peab olema antud juurdepääs.

Kui vastate ühele neist kriteeriumidest, on järgmine samm logida sisse GSC-sse ja valida vasakpoolsest menüüst Sitemaps:

Sitemaps'i jaotis Google Search Console'is
Sitemaps'i jaotis Google Search Console'is

Kui keegi on saidikaardi (või saidikaardid) juba varem esitanud, näete seda kohe:

Esitatud saidikaardid
Esitatud saidikaardid

Koos saidikaardi täpse URL-aadressiga esitatakse lisateavet: saidikaardi tüüp (indeksfailid, mis sisaldavad teisi saidikaarte, või tavalised saidikaardid veebisaidi lehtedega), millal see esitati, millal viimati loeti, selle olek ja mitu URL-i selles on.

NÕUANNE: Kui suhtute SEO-sse ja oma veebisaidi orgaanilise jõudluse parandamisse tõsiselt, on Google Search Console hädavajalik tööriist. Sellest saadavaid teadmisi on lugematul hulgal.

Lisaks üks boonus: GSC olemasolu võimaldab teil proovida meie võimsat tööriista — SEOcrawl.

4) Kontrollige Bing Webmaster Tools'i

Hea uudis on see, et Bing Webmaster Tools töötab peaaegu samamoodi nagu Google Search Console. Pole üllatav, et viimast nimetati varem Google Webmaster Tools'iks, sest neil on palju ühist.

Jällegi tuleb sisse logida ja seejärel liikuda vasakpoolsesse külgribasse, kus on saadaval jaotis „Sitemaps“.

Sitemaps'i jaotis Bing Webmaster Tools'is
Sitemaps'i jaotis Bing Webmaster Tools'is

Klõpsake sellel, ja kui saidikaart/saidikaardid on juba esitatud, saate neid lähemalt uurida.

Esitatud saidikaardid Bing Webmaster Tools'is
Esitatud saidikaardid Bing Webmaster Tools'is

Edasijõudnud viisid saidikaardi leidmiseks

Ikka veel meiega? Olgu, see tähendab, et kas otsite endiselt seda kallist saidikaardi faili asukohta või olete väga julge, astudes edasijõudnute jaotisse. Mõlemal juhul soovin teid õnnitleda, et olete nii kaugele jõudnud, ja soovin teile õnne :)

Luban, et see pole nii keeruline ja hirmutav! Läki!

5) Kasutage Google'i otsinguoperaatoreid

Google'i otsinguoperaatorid (tuntud ka kui käsud) võivad olla väga võimsad erinevate SEO-eesmärkide jaoks (nt linkide loomise võimaluste leidmine, sisuideed, tehniliste probleemide avastamine jpm). Sel juhul kasutame neid siiski selleks, et leida uuritava veebisaidi XML-saidikaart.

Selleks tuleb meil ära kasutada käsku „filetype:“. See võib olla väga kasulik, kui ühendame selle käsuga „site:“. Sisuliselt otsib mõlema kombinatsioon kindlaid failitüüpe ainult soovitud veebisaidilt.

Näide: site:chess.com filetype:xml

Ja siin on, mida see otsing Google'is annab:

Google'i otsinguoperaatorite kasutamine saidikaartide leidmiseks
Google'i otsinguoperaatorite kasutamine saidikaartide leidmiseks

Siin see ongi! Google kuvab kõik veebisaidi indekseeritud saidikaardid ja me saame neid lähemalt uurida.

Kui kuvatakse mõni ebaoluline tulemus, saate oma otsingut veelgi täpsustada. Seekord lisame oma arsenali operaatori „inurl“.

Näiteks: site:uefa.com filetype:xml inurl:sitemap

Operaator inurl saidikaartide leidmiseks
Operaator inurl saidikaartide leidmiseks

Märkus: nagu eespool mainisime, võivad saidikaardid olla ka tekstifailid. Nende leidmiseks saame teha sarnase otsingu, kuid teistsuguse laiendiga.

Näiteks: site:WebsiteURL inurl:sitemap filetype:txt

Ja selle tulemus on järgmine:

Operaator filetype saidikaartide leidmiseks
Operaator filetype saidikaartide leidmiseks

NÕUANNE: Need käsud paljastavad saidikaardi asukoha ainult siis, kui Google on selle indekseerinud. Mõned WP pluginad, mis loovad saidikaarte, lisavad neile automaatselt sildi no follow, no index. Seega, kui te lõpuks ühtegi tulemust ei leia, ärge muretsege!

Jätkame järgmise ideega.

SEO Site Checkup
SEO Site Checkup

6) Kasutage veebipõhist tööriista

Teine tehnika on proovida veebipõhist tööriista, näiteks SEO Site Checkup, kus teil tuleb vaid oma veebisaidi URL kleepida ja vajutada Checkup. Seejärel saate midagi sellist:Märkus: See tööriist töötab, kontrollides standardseid saidikaardi asukohti, mida varem mainisime (sitemap.xml, sitemap1.xml, sitemapindex.xml ja nii edasi). Seetõttu ei pruugi see mõnel konkreetsel juhul teie veebisaidi saidikaarti leida.

7) Kontrollige veebisaidi CMS-i

Olenevalt sisuhaldussüsteemist (CMS), millel sait töötab, võivad XML-saidikaardid asuda erinevates kohtades. Hea uudis on see, et kõige populaarsematel CMS-idel on vaikeasukohad, kust võiksite oma otsingut alustada.

Kõigepealt tuleb meil tuvastada veebisaidi CMS. See on üsna lihtne protsess ja selleks saame kasutada nii veebipõhiseid tööriistu kui ka brauserilaiendusi.

Näiteks üks kasulik laiendus on Built With, mis tuvastab lisaks CMS-ile veel palju muud veebisaidil kasutatavat tarkvara ja programme. Nii kuvab see otsitava teabe:

Laiendus Built With CMS-i tuvastamiseks
Laiendus Built With CMS-i tuvastamiseks

Kui eelistate veebipõhist tööriista, on üks võimalik lahendus WhatCMS:

WhatCMS SEOcrawli puhul
WhatCMS SEOcrawli puhul

Alternatiiv on CMS Detect:

CMS Detect SEOcrawli puhul
CMS Detect SEOcrawli puhul

Nüüd, kui teame täpset CMS-i, uurime mõnda kõige populaarsemat sisuhaldussüsteemi ja seda, kus nad tavaliselt XML-faile hoiavad.

Wordpress

Enne 2020. aastat loodi saidikaarte peamiselt pluginate abil. Tänapäeval peaksid need aga WP sisseehitatud funktsionaalsuse tõttu asuma aadressil /wp-sitemap.xml.

Kui uuritav veebisait kasutab saidikaardi loomiseks siiski pluginat, võite proovida mõnda järgmistest asukohtadest:

  • /sitemap.xml- /tag-sitemap.xml- /sitemap_index/xml- /category-sitemap.xml

Teise võimalusena saate kontrollida plugina seadeid ja leida teekonna sealt.

Wix, Shopify, Joomla, Squarespace, Magento

Hea uudis on see, et kõik need genereerivad XML-saidikaardid oma kasutajatele automaatselt. Seega on vaikeasukoht (kui seda pole täiendavalt muudetud): /sitemap.xml

Märkusega, et domeeninimi käib enne „/“ osa.

BOONUS: Järjehoidja (bookmarklet) kohe Sitemap.xml leidmiseks

Kui olete tootlikkuse austaja ja säästate aega igal pisiülesandel (kas me, SEO-inimesed, pole kõik sellised?!), võib teile kasuks tulla kiire järjehoidja (bookmarklet), mis võimaldab kohe kontrollida veebisaidi XML-saidikaarti.

Teil tuleb vaid lisada see JavaScripti kood:

javascript:void(location.href='http://' + location.host + '/sitemap.xml')

Lisage see järjehoidjatesse ja iga kord, kui sellel klõpsate, avaneb saidikaardi fail, kui see asub vaikeasukohas /sitemap.xml.

Kiire ja lihtne!

Muud tüüpi saidikaartide leidmine

Rääkisime peamiselt XML-saidikaartidest, kuna see on kõige levinum vorming, et näidata roomajatele, mis teie domeenil toimub. Sellegipoolest tasub mainida ka teisi tüüpe, mida mõnel veebisaidil samuti leida võib.

  • HTML. Need on tavaliselt loodud kasutajate mugavuseks ja on väga abiks eriti suuremate veebisaitide puhul.

Näiteks eBay pakub oma külastajatele virtuaalset „kaarti“ põhiliste lehtede ja kategooriatega: https://pages.ebay.com/sitemap.html

HTML sitemap
HTML sitemap
  • RSS. Mõnel juhul kasutavad veebisaidid saidikaardina RSS-voogu, mis asub tavaliselt aadressil: /rss/ või /rss.xml.

  • Atom. Sama kehtib Atomi voo kohta ja selle leiate tavaliselt aadressilt: /atom.xml- TXT. See on standardne tekstifail, nagu ühte sellist näidet juba arutasime. Asukoht: /sitemap.txt

Saidikaarti pole? Mida sel juhul teha?

Pärast erinevate saidikaardi leidmise võimaluste läbivaatamist tasub öelda paar sõna selle kohta, mida teha, kui saidikaarti pole veel loodud. Nii on lugu enamiku täiesti uute veebisaitidega, mis on olnud võrgus lühikest aega. Või mõne väga väikese saidiga.

Samuti arvestage, et saidikaarti ei vaja mitte kõik veebisaidid. Kui veebisaidil on vaid mõni leht, saate suurepäraselt hakkama ka ilma selleta.

Kui soovite siiski luua oma XML-saidikaardi, saate lihtsalt kasutada teie CMS-süsteemiga ühilduvat pluginat. Mõned head näited WP jaoks:

  • Rank Math Sitemap Plugin- WP Sitemap Plugin- Google XML Sitemaps- WordPress SEO by Yoast

Teise võimalusena saate luua saidikaardi käsitsi või kasutada roomajat (crawler), mis vaatab teie veebisaidi läbi ja ekspordib saidikaardi üleslaadimiseks.

Kokkuvõtteks:

Loodan, et need nõuanded aitasid teil saidikaartide maailma sügavamalt sukelduda ja olete nüüd paremini kursis sellega, kuidas need töötavad, miks me neid vajame… ja loomulikult kuidas neid leida.

Andke meile kommentaarides teada, kui on veel midagi, mida sooviksite teada, või lihtsalt jagage oma kogemust :)

Edu!

Autor: Ognian Mikov

Ognian Mikov

SEO tuli minu ellu esimest korda 2012. aastal ja sellest ajast peale olen sellesse täielikult armunud. Minu jaoks on see rohkem kui lihtsalt töö — see on ühtaegu kirg ja hobi, mis hoiab mind motiveerituna õppima ja end täiendama. Olgu ma uurimas uusi teemasid, loomas sisu või süvenemas tehnilistesse parandustesse, mind paelub alati digiturunduse avar maailm ja arvukad võimalused veebisaidi tulemuslikkust parandada.

2021. aastal liitusin SEO Alive ja SEOcrawl-iga — oma esimese kaugtööettevõttega — kus sain arendada uusi oskusi ja töötada põnevate projektide kallal. Kõige tähtsam, mul oli võimalus kohtuda ja õppida uskumatutelt kolleegidelt, kellest on saanud ka sõbrad.

Mul on bakalaureusekraad Marketingus ja magistrikraad PR & Advertising alal. Vabal ajal naudin aja veetmist tütrega, samuti male, jalgpalli (Само Левски & Més que un club) ja pokkeri mängimist ning vaatamist.

→ Loe kõiki Ognian artikleid
Rohkem selle autori artikleid: Ognian Mikov

Avastage rohkem selle autori sisu