Kā atklāt un novērst dublētu saturu?

Ja strādā SEO jomā, tu droši vien esi nonācis situācijā, kad jārisina viena no visbiežāk sastopamajām problēmām, kas ietekmē meklētājprogrammu rangus un var novest pie sodiem: dublēts saturs. Meklētājprogrammu, piemēram, Google, Bing vai Yahoo, galvenais mērķis ir parādīt lietotāju meklēšanas nolūkam visatbilstošāko informāciju. Lai to izdarītu, tās sarindo dilstošā secībā, atalgojot oriģinālu, augstas kvalitātes saturu un sodot saturu, kas ir kopēts, dublēts, nebūtisks vai manipulēts, lai ieņemtu augstāku vietu rezultātu lapās.
Šajā rakstā mēs paskaidrosim, kas ir dublēts saturs, kā to atklāt un novērst, kāda ir tā ietekme uz SEO un kādus rīkus mēs varam izmantot darbā ar to. Vai pievienosies mums? Sāksim! ?
Kas ir dublēts saturs?
Kā jau minējām, meklētājprogrammas, piemēram, Google, soda lapas, kurām ir dublēts saturs, kas tiek interpretēts kā divas lapas ar atšķirīgiem URL, bet vienādu saturu. Tāpēc, cik vien iespējams, izvairies kopēt saturu no citas vietnes un ielīmēt to savā (tā ietaupīsi sev daudz galvassāpju ar Google un iespējamu tiesvedību no to vietņu īpašniekiem, no kurām paņēmi saturu!?).
SEO Alive padoms**:** Kā meklētājprogrammu optimizācijā specializējusies aģentūra mēs stingri iesakām rūpēties par savas vietnes saturu un izvairīties no šīs sliktās prakses. Esi pacietīgs un neatlaidīgs, raksti oriģinālu saturu, un rezultāti nāks drīzāk, nekā domā. Šajā ziņā Google ļoti skaidri pauž savu nostāju, kā redzams tās oficiālajā dokumentācijā par dublētu saturu, tāpēc mums jābūt ļoti uzmanīgiem ar to, ko rakstām.
Runājot par SEO rangošanu, mēs varam izšķirt divus dublēta satura veidus: iekšēju un ārēju dublētu saturu.
Iekšējs dublēts saturs
Šāda veida dublēts saturs parasti rodas sliktas URL parametru ieviešanas vai sliktas kategoriju un birku taksonomiju pārvaldības dēļ. Iespējamie cēloņi, kas var radīt iekšēju dublētu saturu, ir šādi:
- Kļūdas kategoriju un birku veidošanā: Šī kļūda ir izplatīta blogos, kuros ir liels rakstu saraksts un kategorijas un birkas tiek veidotas bez jebkādas kārtības vai loģikas. Apskatīsim piemēru:
Iedomāsimies, ka mums ir digitālā mārketinga blogs ar vairākām kategorijām:
https://myblogdigital.com/category-a/topic/
https://myblogdigital.com/category-b/topic/
https://myblogdigital.com/category-c/topic/ Lai izvairītos no dublēta satura, ir nepieciešams atzīmēt, kura ir galvenā, un pārējām divām iestatīt canonical uz galveno URL.
- "Non-www" pret "www" un "http" pret "https" domēni: Šī ir vēl viena kļūda, kurai mums jāpievērš uzmanība. Ir iespējams, ka, ja meklētājprogrammām nebūsim norādījuši, kurš ir kanoniskais domēns, tās var piekļūt citām versijām un radīt dublētu saturu. Tāpēc no SEO Alive puses mēs iesakām noteikt, kurš būs tavs kanoniskais domēns, un iestatīt 301 pāradresācijas uz versiju, kuru vēlies izvirzīt priekšplānā.
- Parametrizēti URL: Šī kļūda ir izplatīta e-komercijas vietnēs, kur URL ar parametriem ļauj filtrēt, lai lietotājiem piedāvātu informāciju. Pieņemsim, ka mums ir pulksteņu tirdzniecības vietne un šāds URL:
https://www.mywatchstore.com/watches/garmin?color=black Šī lapa parādītu visus "Garmin" modeļa pulksteņus melnā krāsā.
Iespēja iestatīt filtrus lapās var būt nopietns sarežģījums, ja tā netiek pareizi pārvaldīta, jo meklētājprogrammas var parādīt vairākas URL kombinācijas:
https://www.mywatchstore.com/watches/garmin?color=black&type=sport
https://www.mywatchstore.com/watches/garmin?type=sport&color=black Tāpēc no SEO Alive puses mēs iesakām iestatīt kanonisko versiju uz nefiltrēto lapu, lai pārējie parametrizētie URL saglabātu savu lapas autoritāti (URL Ratio).
Ārējs dublēts saturs
Ārējs dublēts saturs attiecas uz jebkādu saturu, kas tiek iegūts, pilnībā vai daļēji kopēts no vienas vai vairākām vietnēm, kuras pieder dažādiem tīmekļpārziņiem vai administratoriem.
Šī prakse meklētājprogrammu acīs tiek uzskatīta par mēstuli; tāpēc, kā minējām raksta sākumā, no tās vajadzētu izvairīties par katru cenu.
Vēl viens ārēja dublēta satura cēlonis var būt sindicēšanas stratēģijas, kurās vietnes novirza trafiku uz citām vietnēm, lai manipulētu ar meklētājprogrammām. Google algoritms mūsdienās ir pietiekami gudrs, lai atklātu šāda veida praksi.
Kā mēs varam pārbaudīt, vai mūsu vietnē ir dublēts saturs?
Prasme atklāt dublētu saturu ir īpaši svarīga vietnes satura stratēģijā. Ja mēs nekontrolēsim šo faktoru, mēs riskējam, ka mūsu lapas pakāpeniski noslīdēs no augšējām pozīcijām Google, jo Google nepārtraukti pilnveido SERP rezultātus, meklējot oriģinālu, augstas kvalitātes saturu. Tāpēc mēs parādīsim piemēru, kā mēs varētu atklāt saturu savā vietnē, un sniegsim dažas stratēģijas, kā izvairīties no šāda veida satura.
Pieņemsim, ka mums ir tiešsaistes veikals (e-komercija), kurā ir katras produkta lapas drukājamā versija. Tas tiek uzskatīts par dublikātu, jo pastāv divas viena un tā paša satura "versijas" ar atšķirīgiem URL:
Produkta detaļu lapa: https://mywebsite.com/product3560
Drukājamā versija: https://mywebsite.com/product3560_print Lai izvairītos no šāda veida dublēta satura, mēs varam pielietot šādas stratēģijas:
1. stratēģija: 301 pāradresāciju izmantošana
Ja mēs esam pārstrukturējuši savu vietni, mēs varam iestatīt 301 pāradresācijas (pastāvīgas pāradresācijas), izmantojot SEO spraudņus, kas iekļauti dažādās satura pārvaldības sistēmu (SPS) krātuvēs, vai izmantojot .htaccess failu, lai gudri pāradresētu lietotājus, meklētājprogrammu botus un citus rīkus ar rāpošanas funkciju.
2. stratēģija: canonical birkas izmantošana
Birka rel="canonical" tiek izmantota, lai pateiktu meklētājprogrammām, kura ir oriģinālā lapa (kanoniskā versija) un kuras lapas ir kopija. Šādā veidā meklētājprogrammas robots koncentrēs savu indeksēšanas rāpošanas budžetu uz lapu, kas atzīmēta ar šo meta birku.
Lai izmantotu canonical birku, vispirms mums jāizvēlas, kuru lapu mēs vēlamies redzēt meklētājprogrammās, un HTML kodā, </head> sadaļā, jāpievieno šāda rindiņa (apskatīsim canonical piemēru produkta lapā "Zalando" vietnē):
<link rel="canonical" ahref= "https://www.zalando.es/adidas-originals-stripe-circle-camiseta-estampada-white-ad121000k-a11.html"/> Piemēram, ja vienā URL mēs parādām produkta detaļas, bet citā URL — tās pašas detaļas ar atšķirīgām krāsām, mēs varam pateikt Google, kurš ir kanoniskais URL, ko vēlamies parādīt lietotājiem.
3. stratēģija: robots.txt faila izmantošana
Rediģējot šo failu, mēs varam pateikt meklētājprogrammu botiem nerāpot noteiktas mūsu vietnes lapas vai sadaļas. Iedomāsimies, ka mūsu vietnē ir šādas produktu lapas:
https://www.mywebsite.com/category/product-page.html/
https://www.mywebsite.com/category/product-page1.html/ (versija ar dublētu saturu)
Ar šādu norādi robots.txt failā:
- Disallow /product-page.1html/
Mēs varam novērst dublēta satura rašanos, papildus, protams, iestatot pirmo URL kā kanonisko versiju.
Dublēta satura ietekme uz SEO rangošanu
Pēc pirmās Google Panda algoritma versijas izlaišanas vēl 2011. gadā, kas sodīja domēnus ar zemvērtīgu saturu un dublētu saturu, Mets Katss 2013. gadā publicēja video par to, kā Google apstrādā dublētu saturu un kādu negatīvu ietekmi tas var atstāt uz rangošanas pozīcijām no SEO viedokļa:
Secinājumi, ko varam izdarīt no Meta Katsa video, ir tādi, ka, lai gan saskaņā ar Google 25–30 % tīmekļa ir dublēts saturs, meklētājprogramma to tieši neuzskata par mēstuli, ja vien nolūks nav krāpnieciski radīt vai kopēt saturu lielos apjomos vai tieši manipulēt ar pozīcijām meklēšanas rezultātu lapās, izmantojot "black hat" taktikas.
Īsāk sakot, šāda veida satura veidošana var radīt zemas kvalitātes signālus meklētājprogrammām, piemēram, Google, kā arī radīt šķērsli satura saišu metriku (piemēram, autoritātes, atbilstības vai uzticamības) konsolidēšanai no ārējo saišu (atpakaļsaišu) viedokļa, kuras var vest uz dažādām šī satura versijām.
Rīki dublēta satura atklāšanai
Runājot par dublēta satura atklāšanu, tirgū ir neskaitāmi rīki, kas var atvieglot šo uzdevumu. Apskatīsim tos! ?
Rīki dublēta satura atklāšanai mūsu vietnē
- Ahrefs: Ar Ahrefs mēs varam redzēt, "site audit" funkcijā un ar nosacījumu, ka esam pievienojuši projektu SEO auditam, vai mūsu vietnē ir dublēts saturs vai nav. Lai to izdarītu, dosimies uz "duplicate content" cilni. Tur mums tiks parādīts grafiks, kurā varēsim identificēt iespējamās kļūdas, kas mums jālabo:

Ahrefs "Duplicate Content" funkcijas skats
- Screaming Frog: Ar šo labi zināmo programmatūras rāpuli arī ir iespējams atklāt dublētu saturu. Lai to izdarītu, mums būs jāievada domēns, ko skrāpēt, un jāeksportē "internal" dati uz .csv formātu. Izklājlapā tu vari apskatīt, kārtot un filtrēt, kurām lapām ir dublēti virsraksti, meta apraksti, galvenes utt.
SEO Alive padoms: Izmanto nosacījuma formatēšanas noteikumus savā izklājlapā, lai noteiktu, kurus URL tu labosi, pamatojoties uz tavu dublēta satura līmeni un katras lapas nozīmi un atbilstību.
- Safecont: Šis rīks ir patiešām interesants, jo tas ir vērsts tikai un vienīgi uz satura analīzi un izmanto "machine learning", lai atklātu un atrastu klasterus un satura līdzības. Tas ir diezgan visaptverošs, un tā izmantošana var mums sniegt daudz labuma, ja vēlamies atklāt dublētu saturu savā vietnē.

Safecont "Similarity" funkcijas skats
Rīki dublēta satura atklāšanai no citas vietnes
- Copyscape: Ja vēlamies uzzināt, vai kāds saturs ir dublēts attiecībā pret citu vietni, Copyscape ir meklētājprogramma, kas specializējas tīmekļa lapu atklāšanā, kuras plaģiē saturu. Šajā meklētājprogrammā tev tikai jāievada URL, kurā izvietots saturs, ko vēlies pārbaudīt, un rīks atgriež lapas, kas dala šo saturu, sakārtotas no augstākās līdz zemākajai pakāpei.
- Plagium: Šis ir vēl viens rīks, ļoti līdzīgs Copyscape, ar atšķirību, ka URL vietā mums jāievada pārbaudāmais teksts. Jāatzīmē, ka tam ir maksas versija, tāpēc "bezmaksas" versijai ir ierobežojums līdz 5000 rakstzīmēm, ko pārbaudīt.
Secinājumi
SEO Alive mēs esam 100 % "White Hat SEO" aģentūra, tāpēc mūsu ieteikums raksta beigās ir vienmēr izvairīties no dublēta satura. Ja atklāj šāda veida saturu savā vietnē, paļaujies uz visām stratēģijām un padomiem, ko esam snieguši. ? Atceries: Google patīk oriģināls, augstas kvalitātes saturs!
Un tu, vai esi piedzīvojis sliktu pieredzi ar dublētu saturu vai cietis kādu sodu tā dēļ? Kā tu to atrisināji? Pastāsti mums par to, ja vēlies, komentāru sadaļā! Mēs ar prieku atbildēsim. Uz tikšanos nākamreiz!
Autors: David Kaufmann

Pēdējos 10+ gadus esmu pavadījis, pilnībā aizrāvies ar SEO — un, godīgi sakot, es to nevēlētos citādi.
Mana karjera sasniedza jaunu līmeni, kad strādāju par vecāko SEO speciālistu Chess.com — vienā no 100 visapmeklētākajām vietnēm visā internetā. Darbs šādā mērogā, aptverot miljoniem lapu, desmitiem valodu un vienu no konkurētspējīgākajām SERPs, iemācīja man to, ko neviens kurss vai sertifikāts nekad nespētu. Šī pieredze mainīja manu skatījumu uz to, kā patiesībā izskatās izcils SEO — un kļuva par pamatu visam, ko esmu izveidojis kopš tā laika.
No šīs pieredzes es nodibināju SEO Alive — aģentūru zīmoliem, kas nopietni domā par organisko izaugsmi. Mēs neesam šeit, lai pārdotu dashboards un ikmēneša atskaites. Mēs esam šeit, lai veidotu stratēģijas, kas patiešām rada rezultātus, apvienojot labāko no klasiskā SEO ar aizraujošo jauno Generative Engine Optimization (GEO) pasauli — nodrošinot, ka jūsu zīmols parādās ne tikai Google zilajās saitēs, bet arī AI ģenerētajās atbildēs, ko ChatGPT, Perplexity un Google AI Overviews katru dienu piegādā miljoniem cilvēku.
Un tā kā es nevarēju atrast rīku, kas pareizi apstrādātu abas šīs pasaules, es izveidoju to pats — SEOcrawl, enterprise SEO intelligence platformu, kas vienuviet apvieno rankings, tehniskos auditus, backlinks uzraudzību, crawl veselību un AI zīmola redzamības izsekošanu. Tā ir platforma, par kuras esamību es vienmēr biju vēlējies.
Atklājiet vairāk šī autora satura

