Kuidas tuvastada ja parandada duplikaatsisu?

Kuidas tuvastada ja parandada duplikaatsisu?
David Kaufmann
SEO õpetused

Kui töötad SEO maailmas, oled tõenäoliselt sattunud olukorda, kus tuleb tegeleda ühe kõige levinuma probleemiga, mis mõjutab otsingumootorite asetusi ja võib kaasa tuua karistusi: duplikaatsisuga. Otsingumootorite nagu Google, Bing või Yahoo peamine eesmärk on kuvada kasutajate otsingukavatsuse jaoks kõige asjakohasemat teavet. Selleks järjestavad nad tulemused kahanevas järjekorras, premeerides originaalset, kõrgekvaliteedilist sisu ja karistades sisu, mis on kopeeritud, dubleeritud, ebaoluline või manipuleeritud, et saada tulemuslehtedel kõrgemat kohta.

Selles artiklis selgitame, mis on duplikaatsisu, kuidas seda tuvastada ja parandada, milline on selle mõju SEO-le ning milliseid tööriistu saame sellega töötamiseks kasutada. Kas liitud meiega? Alustame! ?

Mis on duplikaatsisu?

Nagu juba mainisime, karistavad otsingumootorid nagu Google lehti, millel on duplikaatsisu, mida tõlgendatakse kui kaht lehte erinevate URL-idega, kuid sama sisuga. Seetõttu väldi võimalikult palju sisu kopeerimist teiselt veebisaidilt ja selle kleepimist oma saidile (nii säästad end paljudest peavaludest Google'iga ja võimalikest õiguslikest tagajärgedest nende saitide omanike poolt, kust sisu võtsid!?).

SEO Alive näpunäide**:** Otsingumootorite optimeerimisele spetsialiseerunud agentuurina soovitame tungivalt hoolitseda oma veebisaidi sisu eest ja vältida seda halba tava. Ole kannatlik ja järjekindel, kirjuta originaalset sisu, ja tulemused tulevad varem, kui arvad. Selles osas väljendab Google oma seisukohta väga selgelt, nagu näeme selle ametlikus dokumentatsioonis duplikaatsisu kohta, seega peame olema väga ettevaatlikud selle suhtes, mida kirjutame.

Rääkides SEO järjestamisest, saame eristada kaht tüüpi duplikaatsisu: sisemist ja välist duplikaatsisu.

Sisemine duplikaatsisu

Seda tüüpi duplikaatsisu tekib üldjuhul URL-i parameetrite halva rakendamise või kategooriate ja siltide taksonoomiate halva haldamise tõttu. Võimalikud põhjused, mis võivad tekitada sisemist duplikaatsisu, on järgmised:

  • Vead kategooriate ja siltide loomisel: See viga on levinud blogides, kus on suur artiklite loend ja kategooriad ning sildid luuakse ilma igasuguse korra või loogikata. Vaatame näidet:

Kujutame ette, et meil on digiturunduse blogi mitme kategooriaga:

https://myblogdigital.com/category-a/topic/

https://myblogdigital.com/category-b/topic/

https://myblogdigital.com/category-c/topic/ Duplikaatsisu vältimiseks tuleb märkida, milline on peamine, ja panna ülejäänud kaks kanoniseeruma peamisele URL-ile.

  • "Non-www" vs "www" ja "http" vs "https" domeenid: See on veel üks viga, millele peame tähelepanu pöörama. On võimalik, et kui me pole otsingumootoritele täpsustanud, milline on kanooniline domeen, pääsevad nad ligi teistele versioonidele ja tekitavad duplikaatsisu. Seetõttu soovitame SEO Alive poolt määrata, milline saab olema sinu kanooniline domeen, ja seadistada 301 ümbersuunamised versioonile, mida soovid eelistatuna esile tõsta.
  • Parameetritega URL-id: See viga on levinud e-kaubanduse veebisaitidel, kus parameetritega URL-id võimaldavad filtreerimist, et pakkuda kasutajatele teavet. Oletame, et meil on kellade müügisait ja järgmine URL:

https://www.mywatchstore.com/watches/garmin?color=black See leht kuvaks kõik "Garmin" mudeli kellad mustas värvitoonis.

Võimalus seada lehtedele filtreid võib olla tõsine ebamugavus, kui seda õigesti ei hallata, kuna otsingumootorid võivad kuvada mitu URL-i kombinatsiooni:

https://www.mywatchstore.com/watches/garmin?color=black&type=sport

https://www.mywatchstore.com/watches/garmin?type=sport&color=black Seetõttu soovitame SEO Alive poolt seada kanoonilise versiooni filtreerimata lehele, et ülejäänud parameetritega URL-id säilitaksid oma lehe autoriteedi (URL Ratio).

Väline duplikaatsisu

Väline duplikaatsisu viitab mis tahes sisule, mis on välja võetud, täielikult või osaliselt kopeeritud ühelt või mitmelt veebisaidilt, mis kuuluvad erinevatele veebihalduritele või administraatoritele.

Seda tava peetakse otsingumootorite silmis rämpsuks; seetõttu, nagu artikli alguses mainisime, tuleks seda iga hinna eest vältida.

Veel üks välise duplikaatsisu põhjus võib olla sündikeerimisstrateegiad, mille puhul veebisaidid suunavad liiklust teistele saitidele, et otsingumootoritega manipuleerida. Google'i algoritm on tänapäeval piisavalt tark, et sellist tava tuvastada.

Kuidas saame kontrollida, kas meie veebisaidil on duplikaatsisu?

Oskus duplikaatsisu tuvastada on veebisaidi sisustrateegias ülimalt oluline. Kui me seda tegurit ei kontrolli, riskime sellega, et meie lehed libisevad tasapisi Google'i tippkohtadelt allapoole, sest Google täiustab pidevalt SERP-e, otsides originaalset, kõrgekvaliteedilist sisu. Seepärast toome näite, kuidas võiksime oma veebisaidil sisu tuvastada, ja anname mõned strateegiad seda tüüpi sisu vältimiseks.

Oletame, et meil on veebipood (e-kaubandus), kus igast tootelehest on olemas prinditav versioon. Seda peetakse duplikaadiks, kuna sama sisu kohta on olemas kaks "versiooni" erinevate URL-ide all:

Toote üksikasjade leht: https://mywebsite.com/product3560

Prinditav versioon: https://mywebsite.com/product3560_print Seda tüüpi duplikaatsisu vältimiseks saame rakendada järgmisi strateegiaid:

Strateegia nr 1: 301 ümbersuunamiste kasutamine

Kui oleme oma veebisaiti ümber struktureerinud, saame seadistada 301 ümbersuunamised (püsivad ümbersuunamised) SEO pistikprogrammide kaudu, mis sisalduvad sisuhaldussüsteemide (CMS) erinevates hoidlates, või .htaccess faili kaudu, et suunata nutikalt ümber kasutajad, otsingumootorite robotid ja muud roomamisfunktsiooniga tööriistad.

Strateegia nr 2: canonical sildi kasutamine

Silti rel="canonical" kasutatakse selleks, et öelda otsingumootoritele, milline on algne leht (kanooniline versioon) ja millised lehed on koopia. Nii keskendab otsingumootori robot oma indekseerimise roomamiseelarve lehele, mis on selle metasildiga märgitud.

Canonical sildi kasutamiseks peame kõigepealt valima, millist lehte soovime otsingumootoritel kuvada, ja lisama HTML-koodi </head> sektsiooni järgmise rea (vaatame canonicali näidet tootelehel "Zalando" veebisaidil):

<link rel="canonical" ahref= "https://www.zalando.es/adidas-originals-stripe-circle-camiseta-estampada-white-ad121000k-a11.html"/> Näiteks kui ühel URL-il kuvame toote üksikasju ja teisel URL-il samu üksikasju erinevate värvidega, saame öelda Google'ile, milline on kanooniline URL, mida soovime kasutajatele kuvada.

Strateegia nr 3: robots.txt faili kasutamine

Seda faili redigeerides saame öelda otsingumootorite robotitele, et nad ei roomaks teatud meie veebisaidi lehti või sektsioone. Kujutame ette, et meie veebisaidil on järgmised tootelehed:

https://www.mywebsite.com/category/product-page.html/

https://www.mywebsite.com/category/product-page1.html/ (versioon duplikaatsisuga)

Järgmise juhisega robots.txt failis:

  • Disallow /product-page.1html/

Saame vältida duplikaatsisu tekkimist, lisaks muidugi esimese URL-i määramisele kanooniliseks versiooniks.

Duplikaatsisu mõju SEO järjestusele

Pärast Google Panda algoritmi esimese versiooni väljalaskmist juba 2011. aastal, mis karistas domeene õhukese sisu ja duplikaatsisuga, avaldas Matt Cutts 2013. aastal video selle kohta, kuidas Google duplikaatsisu käsitleb ja millist negatiivset mõju see võib SEO seisukohast järjestuspositsioonidele avaldada:



Järeldused, mida saame Matt Cuttsi videost teha, on need, et kuigi Google'i sõnul on 25–30 % veebist duplikaatsisu, ei käsitle otsingumootor seda otseselt rämpsuna, välja arvatud juhul, kui kavatsus on pettuslikult luua või kopeerida sisu suurtes kogustes või otseselt manipuleerida positsioonidega otsingutulemuste lehtedel "black hat" taktikate abil.

Lühidalt, seda tüüpi sisu loomine võib tekitada otsingumootoritele nagu Google madala kvaliteedi signaale ning olla ka takistuseks sisu lingimõõdikute (nagu autoriteet, asjakohasus või usaldusväärsus) konsolideerimisel väliste linkide (tagasilinkide) seisukohast, mis võivad viia selle sisu erinevatele versioonidele.

Tööriistad duplikaatsisu tuvastamiseks

Kui rääkida duplikaatsisu tuvastamisest, on turul lugematul hulgal tööriistu, mis võivad seda ülesannet hõlbustada. Heidame neile pilgu! ?

Tööriistad duplikaatsisu tuvastamiseks meie veebisaidil

  • Ahrefs: Ahrefsiga saame näha "site audit" funktsioonis ja tingimusel, et oleme lisanud projekti SEO auditeerimiseks, kas meie veebisaidil on duplikaatsisu või mitte. Selleks läheme "duplicate content" vahekaardile. Seal kuvatakse meile graafik, kus saame tuvastada võimalikud vead, mida peame parandama:
Duplikaatsisu funktsioon Ahrefsis
Duplikaatsisu funktsioon Ahrefsis

Ahrefsi "Duplicate Content" funktsiooni vaade

  • Screaming Frog: Selle tuntud tarkvararoomajaga on samuti võimalik duplikaatsisu tuvastada. Selleks peame sisestama domeeni, mida kraapida, ja eksportima "internal" andmed .csv-vormingusse. Tabelis saad vaadata, sortida ja filtreerida, millistel lehtedel on dubleeritud pealkirjad, metakirjeldused, päised jne.

SEO Alive näpunäide: Kasuta oma tabelis tingimusliku vormindamise reegleid, et määrata, milliseid URL-e parandad, lähtudes oma duplikaatsisu tasemest ning iga lehe olulisusest ja asjakohasusest.

  • Safecont: See tööriist on tõesti huvitav, kuna keskendub eranditult sisuanalüüsile ja kasutab "machine learning'ut", et tuvastada ja leida klastreid ning sisu sarnasusi. See on üsna põhjalik ja selle kasutamine võib tuua meile palju kasu, kui soovime oma veebisaidil duplikaatsisu tuvastada.
Safecont sisutööriist
Safecont sisutööriist

Safeconti "Similarity" funktsiooni vaade

Tööriistad duplikaatsisu tuvastamiseks teiselt veebisaidilt

  • Copyscape: Kui soovime teada, kas mõni sisu on teise veebisaidi suhtes dubleeritud, on Copyscape otsingumootor, mis on spetsialiseerunud sisu plagieerivate veebilehtede tuvastamisele. Selles otsingumootoris pead lihtsalt sisestama URL-i, kus asub sisu, mida soovid kontrollida, ja tööriist tagastab lehed, mis seda sisu jagavad, järjestatuna kõrgeimast madalaima astmeni.
  • Plagium: See on veel üks Copyscape'iga väga sarnane tööriist, erinevusega, et URL-i asemel peame sisestama kontrollitava teksti. Tuleb märkida, et sellel on tasuline versioon, seega "tasuta" versioonil on piirang kuni 5000 tähemärki kontrollimiseks.

Kokkuvõte

SEO Alive'is oleme 100 % "White Hat SEO" agentuur, seega meie soovitus artikli lõpus on vältida duplikaatsisu igal ajal. Kui tuvastad oma veebisaidil seda tüüpi sisu, toetu kõigile strateegiatele ja näpunäidetele, mille oleme andnud. ? Pea meeles: Google'ile meeldib originaalne, kõrgekvaliteediline sisu!

Ja sina, kas oled kogenud halba kogemust duplikaatsisuga või kannatanud selle tõttu mõne karistuse all? Kuidas sa selle lahendasid? Räägi meile sellest, kui soovid, kommentaarikastis! Vastame hea meelega. Kohtumiseni järgmine kord!

Autor: David Kaufmann

David Kaufmann

Olen viimased 10+ aastat olnud täielikult SEO-sse haaratud — ja ausalt öeldes ei tahaks ma seda teisiti.

Minu karjäär jõudis uuele tasemele, kui töötasin vanem-SEO-spetsialistina Chess.com-is — ühel 100 külastatuimast veebisaidist kogu internetis. Sellises mahus töötamine, hõlmates miljoneid lehti, kümneid keeli ja üht konkurentsitihedaimat SERPs, õpetas mulle asju, mida ükski kursus ega sertifikaat kunagi ei suudaks. See kogemus muutis minu arusaama sellest, milline suurepärane SEO tegelikult välja näeb — ja sai aluseks kõigele, mille olen sellest ajast peale üles ehitanud.

Sellest kogemusest lähtudes asutasin SEO Alive — agentuuri brändidele, kes suhtuvad orgaanilisse kasvu tõsiselt. Me ei ole siin selleks, et müüa dashboards ja igakuiseid aruandeid. Me oleme siin selleks, et luua strateegiaid, mis päriselt tulemusi liigutavad, ühendades klassikalise SEO parima osa põneva uue Generative Engine Optimization (GEO) maailmaga — tagades, et teie bränd ilmub mitte ainult Google'i sinistes linkides, vaid ka AI genereeritud vastustes, mida ChatGPT, Perplexity ja Google AI Overviews iga päev miljonitele inimestele edastavad.

Ja kuna ma ei leidnud tööriista, mis mõlemat neist maailmadest korralikult hallanuks, ehitasin selle ise — SEOcrawl, enterprise SEO intelligence platvormi, mis toob kokku rankings, tehnilised auditid, backlinks jälgimise, crawl tervise ja AI brändi nähtavuse jälgimise ühte kohta. See on platvorm, mille olemasolu ma alati soovisin.

→ Loe kõiki David artikleid
Rohkem selle autori artikleid: David Kaufmann

Avastage rohkem selle autori sisu