Kısa cevap: Kopya içerik sorunu; aynı içeriği sunan tüm URL’leri tespit edip aralarından tek bir asıl adres seçerek ve kalanları 301 yönlendirme ya da canonical etiketiyle o adrese işaret ederek çözülür. Google bu durumda ceza vermez; sadece bir URL seçip diğerlerini yok sayar ve seçtiği adres çoğu zaman sizin istediğiniz adres olmaz.

Asıl mesele son cümlede. Kopya içerik kendini Search Console’da bir uyarıyla göstermez. Eskiden sıralanan bir sayfanın sessizce düşmesi, temiz ürün URL’si dururken izleme parametreli hâlinin sıralanması ya da dört yüz sayfalık bir sitenin indekste iki bin sayfayla görünmesi olarak ortaya çıkar. Bu rehber, dokuz düzeltmeyi harcanan saat başına en çok zararı ortadan kaldıran sırayla anlatıyor: her sorunu bulmak için gereken kontroller ve elinizdeki dört aracın hangisinin nerede kullanılacağı.

Kopya içerik tam olarak nedir?

Kopya içerik, birbirine büyük ölçüde benzeyen metnin birden fazla adresten erişilebilir olmasıdır — ister kendi sitenizde ister farklı siteler arasında. Bu tanım çoğu kişinin sandığından geniştir ve sitelere sessizce trafik kaybettiren tür, neredeyse hiçbir zaman endişe ettikleri tür değildir.

Asıl zararı kendi sitenizin ürettiği kopyalar verir

On site sahibine kopya içeriği sorun, dokuzu birinin makalelerini çalmasını anlatır. Bu da oluyor ve genellikle zararsız. Pahalıya patlayan tür, kimsenin bilerek oluşturmadığı, sitenin kendi kendine ürettiği kopyalardır:

  • URL varyasyonları. Aynı ana sayfanın http://, https://, www’lu, www’suz, sonunda eğik çizgiyle ve çizgisiz, bir de /index.php ile erişilebilir olması. Daha hiçbir içerik yayımlanmadan tek bir sayfa için sekiz adrese kadar çıkar.
  • Parametreler. Oturum kimlikleri, izleme etiketleri, sıralama ve filtreleme değerleri; yani aynı sayfanın sonuna eklenen ?utm_source=, ?sort=fiyat veya ?sessionid= uzantıları.
  • Filtreli kategori sayfaları. Beş filtresi ve her filtrede dört seçeneği olan bir kategori, aynı on iki ürünün farklı alt kümelerini gösteren yüzlerce taranabilir URL üretebilir.
  • Yazdırma sayfaları ve mobil alt alan adları. Yıllar önce kurulmuş ve artık kimsenin hatırlamadığı bir eklentinin her makale için ürettiği ikinci bir kopya.
  • Etiket, yazar ve tarih arşivleri. Tek bir yazının altı ayrı arşiv sayfasında tam metin olarak yer alması.
  • Test ve geliştirme ortamları. Şifre konulması unutulduğu için indekslenmiş, sitenin tamamının ikinci bir kopyası: test.siteadi.com.

Bunların hiçbiri bir karar değil. Hepsi varsayılan ayar ve kopya içerik tam olarak varsayılan ayarlarda yaşıyor.

Kopya içerik cezası diye bir şey yok — daha kötüsü var

Google on yılı aşkın süredir aynı şeyi söylüyor: içeriğin tekrarlanması tek başına manuel işlem ya da algoritmik bir düşüş sebebi değil. Ceza, büyük ölçekte kopyalanan veya hiçbir değer katmadan yeniden üretilen içerik için var. Tedarikçinizin her bayisine verdiği ürün açıklamasını yayımlamak bir ihlal değildir; sadece rekabet edilebilir bir şey değildir.

Gerçekte olan şey daha sessiz ve fark etmesi daha zor. Google kopyaları bir küme hâlinde gruplar, kümeyi temsil edecek tek bir URL seçer ve sadece onu indeksler. Google’ın yinelenen URL’leri birleştirme dokümantasyonu bu süreci canonicalization olarak anlatıyor; buradaki kritik ayrıntı, sizin rel="canonical" etiketinizin bu kararda bir emir değil, bir ipucu olması.

Bunun üç maliyeti var. Bağlantı sinyalleri tek bir sayfada birikmek yerine kopyalar arasında bölünür. Tarama bütçesi yeni sayfalar yerine varyasyonlara harcanır; birkaç bin URL’yi aşan her sitede bu ciddi bir kayıptır ve tarama bütçesi rehberinde ayrıntılı anlatılıyor. Üçüncüsü de en can sıkıcı olanı: Google yanlış URL’yi seçebilir — izleme parametreli olanı, yazdırma sürümünü, HTTP varyantını. İyi optimize edilmiş bir sayfanın görünmez kalıp yerine sadeleştirilmiş bir kopyasının sıralanması tam olarak böyle olur.

Ne kadar benzerlik fazla benzerliktir?

Yayımlanmış bir eşik yok; bir eşik veren her araç Google’ın değil kendi hesabının sonucunu söylüyor. Pratik ölçüt daha basit ve daha işe yarar: iki sayfayı da gören bir insan “bunlar neden ayrı ayrı var?” diye soracaksa, o iki sayfa ayrı ayrı var olmamalı.

Bir miktar tekrar normaldir ve beklenir. Menüler, alt bilgi, mesafeli satış sözleşmesi metinleri, teknik özellik tabloları ve yasal uyarılar internetteki her sitenin her sayfasında tekrar eder; arama motorları bu kalıp metinleri 2000’lerin başından beri ayırt ediyor. Soru, sayfanın var olma sebebi olan asıl içeriğin anlamlı biçimde farklı olup olmadığı. Sadece ilçe adı değişen iki hizmet sayfası kopyadır. Gerçekten farklı iki ürünün, aynı 200 kelimelik kargo koşullarını paylaşan sayfaları değildir.

Belirli bir sayfa çifti için tahmin yürütmek yerine somut bir orana bakmak isterseniz ikisini bir Metin Benzerliği / Kopya Kontrolü aracından geçirin ve çıkan oranı kendi niyet değerlendirmenizle birlikte okuyun.

1. Adım — Hiçbir şeyi düzeltmeden önce hepsini bulun

Haritasını çıkarmadığınız bir kopyalanmayı düzeltmeye kalkmak, canonical’ı ters yöne kurup sıralanan sayfaları kaybetmenin en yaygın yoludur. Önce bir saatinizi her şeyi bulmaya ayırın.

Neredeyse her şeyi ortaya çıkaran beş kontrol

  • İndekslenen sayfa sayısıyla yayımlanan sayfa sayısını karşılaştırın. Search Console’daki Sayfalar raporunu açın ve indekslenen sayıyı sitede olduğunu düşündüğünüz URL sayısıyla karşılaştırın. 400 sayfa yayımladıysanız ve Google 3.100 gösteriyorsa aradaki farkı parametreler ya da filtreler üretiyordur. Aynı raporun “Kullanıcı tarafından seçilmiş standart sayfa olmadan yinelenen” ve “Uygun standart etiketi olan alternatif sayfa” satırları, Google’ın size doğrudan bildirdiği kopyalardır ve çoğu kişi o satırlara kadar hiç kaydırmaz.
  • Tüm URL varyasyonlarını elle isteyin. Ana sayfanızı sekiz biçimde çağırın: www’lu ve www’suz, HTTP ve HTTPS, sonunda eğik çizgili ve çizgisiz. Her biri tek bir 301 ile tek bir adreste bitmeli. Bir Yönlendirme & HTTP Durum Kontrolü zincirin tamamını ve son durum kodunu gösterir; kodun neden önemli olduğunu 301 ve 302 farkı rehberi anlatıyor.
  • Siteyi tarayıp başlığa göre sıralayın. Aynı başlık etiketi, kopya sayfaların en hızlı göstergesidir. Bir Teknik Site Denetimi (Tarayıcı) taraması bunları yan yana listeler; aynı başlığı paylaşan dokuz sayfa, incelenecek dokuz sayfa demektir.
  • Kendi cümlelerinizi Google’da aratın. Bir sayfanızdan alışılmadık bir cümle alın, tırnak içine koyup aratın. Site içi kopyalar için başına site:siteadi.com ekleyin; site dışı kopyalar için eklemeyin. Bu yöntem, içeriğinizi kaynak göstermeden yayımlayan siteleri de bulur.
  • Önemli sayfalarda canonical etiketini kontrol edin. Bir Meta Etiket Analizcisi canlı bir URL’den canonical, robots ve Open Graph verisini çeker. Ana sayfalarınızda kendine işaret eden canonical bulunması temel beklentidir; beklenmedik bir adrese işaret eden her etiket bir bulgudur.

Listeyi değil, deseni okuyun

Tarayıcı size yüzlerce satırlık, önceliksiz bir tablo verecek. Satırları tek tek okumak yerine gruplayın. Neredeyse her kopya içerik sorunu dört kovadan birine düşer ve her kovanın tüm grubu çözen tek bir düzeltmesi vardır: URL varyasyonları, parametre ve filtreler, şablon kaynaklı tekrarlar ve ayrı ayrı yazılmış sayfalar arasındaki gerçek içerik örtüşmesi.

Sırayı da bu şekilde kurun. İlk ikisi bir günde biten yapılandırma değişiklikleridir ve çoğu sitede kopya URL’lerin yüzde sekseninden fazlasını temizler. Sonuncusu haftalar süren editoryal iştir. Editoryal işi başa almak yaygın ve pahalı bir hatadır; çünkü her biri dört ayrı adresten erişilebilen iki sayfayı yeniden yazmak hiçbir şeyi çözmez.

2. Adım — Önce URL varyasyonlarını kapatın

Bu, rehberin tamamındaki en yüksek getirili bir saatlik iştir ve çoğu sitede yarısı yapılmış, yarısı bozuk hâlde durur.

Tek bir asıl biçim seçin ve her yerde ona uyun: HTTPS mi HTTP mi, www’lu mu çıplak alan adı mı, sonunda eğik çizgi var mı yok mu, ve her zaman küçük harf. Hangisini seçtiğinizin bir önemi yok; birini seçip hiç sapmamanın var. Ardından geri kalan her biçimi tek bir 301 ile buraya yönlendirin — tek adımda, zincir kurmadan. http://siteadi.com/sayfa/ isteğinin üç ara yönlendirmeden geçerek https://www.siteadi.com/sayfa adresine varması kullanıcı için çalışır ama her istekte tarama bütçesi yakar.

Kuralın kalıcı olmasını dört madde sağlar:

  • İç bağlantılar yalnızca asıl biçimi kullanmalı. Yönlendirmeleriniz doğru ama menünüzün yarısı diğer biçime bağlanıyorsa her iç bağlantı bir yönlendirme harcar. Bağlantı listesini bir Link Analizcisi ile çıkarıp şablonları düzeltin.
  • XML site haritasında yalnızca asıl URL’ler bulunmalı. Yönlendirilen adres yok, parametreli sürüm yok, noindex’li sayfa yok. Bir Sitemap Bulucu & Doğrulayıcı ile doğrulayın; gerisi XML site haritası rehberinde var.
  • Her sayfa kendine işaret eden bir canonical etiketi taşımalı — asıl biçimde ve protokol dâhil tam adresle.
  • URL’ler pratikte büyük-küçük harfe duyarlıdır. Linux sunucularda /Urun ile /urun iki farklı sayfadır. Büyük harfli adresleri sunucu düzeyinde küçük harfe yönlendirin; ayrıntısı URL yapısı rehberinde var.

Türkiye’deki sitelerde bu adıma iki madde daha ekleniyor. Birincisi Türkçe karakterli eski adresler: /ürün/kışlık-mont gibi URL’ler tarayıcıda yüzde kodlu hâle gelir ve aynı sayfanın hem kodlanmış hem sadeleştirilmiş sürümü indekste kalabilir; asıl biçim olarak Türkçe karakterden arındırılmış slug’ı seçip diğerini yönlendirin. İkincisi eski altyapıdan kalan .html, .asp ya da ?sayfa= biçimindeki adresler: yeni sisteme geçerken çoğu sitede bunlar kapatılmıyor, yıllarca ikinci bir kopya olarak yaşamaya devam ediyor.

Son olarak test ortamlarını robots.txt ile değil HTTP kimlik doğrulamasıyla kapatın. Engellenen bir test sitesi, birisi ona bağlantı verdiği anda yine indekslenebilir; çünkü robots.txt taramayı engeller, indekslemeyi değil. Bu ayrım noindex ve disallow rehberinde ayrıntılı anlatılıyor. HTTPS’e geçtiyseniz eski protokolün hâlâ doğru yönlendirdiğini de HTTPS geçiş rehberindeki kontrol listesiyle doğrulayın.

3. Adım — Parametreleri ve filtreleri kontrol altına alın

Kopyalanmanın can sıkıcı bir ayrıntıdan gerçek bir tarama sorununa dönüştüğü yer parametrelerdir. Renk, beden, marka, fiyat ve sıralama filtreleri olan tek bir kategori sayfası, aynı on iki ürünü yeniden dizen binlerce benzersiz URL üretebilir.

İşe yarayan ayrım şu: parametre sayfanın ne hakkında olduğunu değiştiriyor mu? İzleme parametreleri (utm_source, fbclid, gclid), oturum kimlikleri ve sıralama değerleri değiştirmez. ?sort=fiyat aynı ürünleri başka sırayla gösterir ve bu sayfanın sırasız hâlinden daha iyi yanıtladığı bir arama yoktur. Bunlar temiz URL’ye işaret eden bir canonical taşımalı ve hiçbir iç bağlantı bunlara verilmemeli.

Kümeyi gerçekten daraltan filtreler farklı bir durum. /kosu-ayakkabisi?marka=asics gerçek bir arama talebine karşılık gelebilir; o zaman indekslenebilir bir sayfayı hak eder — ama parametre olarak değil, kendi başlığı, açıklaması ve giriş metni olan /kosu-ayakkabisi/asics gibi sabit ve bağlantı verilebilir bir adres olarak. İki ve daha fazla filtrenin birleşimi ise neredeyse hiçbir zaman bunu hak etmez. Sınırın nereye çizileceğini ve tarayıcıların bu kombinasyon patlamasından nasıl uzak tutulacağını filtreli navigasyon rehberi anlatıyor.

Türkiye’deki e-ticaret altyapılarının çoğu bu URL’leri varsayılan olarak taranabilir üretir. Ticimax, İdeasoft, T-Soft ya da WooCommerce üzerinde çalışıyorsanız filtre ve sıralama bağlantılarının canonical davranışı panelden yönetilebilen bir ayardır; kurulumda dokunulmadığı için binlerce gereksiz URL sessizce birikir. Yeni bir siteyi devraldığınızda ilk bakılacak yerlerden biri burasıdır.

Sayfalama da bu başlığın hemen yanında duruyor ve düzenli olarak yanlış yapılıyor. Bir listelemenin 2, 3 ve 4. sayfasını 1. sayfaya canonical vermeyin — o sayfalarda farklı ürünler var ve bunu yapmak Google’a o ürünlerin var olmadığını söyler. Her sayfalama sayfası kendine canonical vermeli. rel="next" ve rel="prev" etiketleri artık indeksleme için kullanılmadığından güncel yaklaşım sayfalama SEO rehberinde duruyor.

Kuralları kurduktan sonra varsaymayın, doğrulayın. Filtreli bir URL’yi çağırıp sunucunun ne döndürdüğünü bir HTTP Başlık Kontrolü kontrolüyle görün; ardından Robots.txt Test Aracı ile kurallarınızın parametreli adreslerle birlikte temiz adresleri de yanlışlıkla engellemediğinden emin olun.

4. Adım — Her tip için doğru aracı seçin

Elinizde dört araç var ve yanlışını kullanmak hiçbir şey yapmamaktan kötüdür; çünkü hatalı bir canonical ya da yanlışlıkla konmuş bir noindex, çalışan bir sayfayı ortadan kaldırır. Aşağıdaki tablo, onlarca kez vereceğiniz kararın kendisidir.

AraçŞu durumda kullanınŞu durumda kullanmayın
301 yönlendirmeKopya adresin hiç var olmaması gerekiyorsa: taşıma sonrası eski URL’ler, www ve HTTP varyantları, birleştirilen sayfalar, canlı muadili olan kaldırılmış ürünler.Kullanıcının o sayfaya hâlâ ulaşması gerekiyorsa — filtreli görünüm ya da yazdırma sürümü gibi.
Canonical etiketiİki adres de erişilebilir kalmalı ama sadece biri indekslenmeli: parametreli sürümler, yazdırma görünümü, iki kategoride birden listelenen ürün, partner sitedeki yeniden yayım.Sayfalar esasen farklıysa. Farklı sayfalar arasındaki canonical dikkate alınmaz; alınmadığı sürece de size hiçbir faydası olmaz.
noindexSayfa kullanıcı için var olmalı ama aramada işi yoksa: site içi arama sonuçları, teşekkür sayfaları, tek yazılık etiket arşivleri, üyelik sayfaları.Sayfanın dış bağlantısı ya da mevcut sıralaması varsa — sinyaller korunsun diye yönlendirin veya canonical verin.
Yeniden yazma / birleştirmeİki sayfa da bilerek yazılmışsa, ikisi de aynı arama niyetini hedefliyorsa ve teknik olarak bir kusur yoksa.Örtüşen kısım asıl içerik değil kalıp metinse ya da sorun içerik kılığına girmiş bir URL sorunuysa.

Bu adımda yapılan hasarın çoğunu üç kural önler. Canonical bir emir değil ipucudur — iki sayfa esaslı biçimde farklıysa Google etiketi dikkate almaz; o yüzden üstünü örtmek yerine kopyalanmanın kendisini çözün. Aynı sayfada noindex ile başka adrese işaret eden canonical’ı asla birlikte kullanmayın; iki direktif birbiriyle çelişir ve sonuç öngörülemez olur. Ve bir adresin indeksten çıkmasını istiyorsanız onu robots.txt ile engellemeyin: engellenen sayfa taranamaz, taranamayan sayfadaki noindex de hiçbir zaman okunamaz. Uygulama ayrıntıları ve alan adları arası canonical kullanımı canonical etiketi rehberinde var.

Kopya içerik düzeltme karar şeması: kullanıcının kopya adrese hâlâ ulaşması gerekip gerekmediğinden başlayan bir akış; gerekmiyorsa 301 yönlendirme, iki adres de erişilebilir kalmalı ama tek adres indekslenmeliyse canonical etiketi, sayfa kullanıcıya hizmet ediyor ama aramada işi yoksa noindex, iki sayfa da aynı niyet için bilerek yazıldıysa yeniden yazma veya birleştirme; yanında en sık yapılan üç hata ve her birinin yol açtığı sonuç.
Dört araç, her biri için tek soru: adres erişilebilir kalmalı mı ve sayfalar gerçekten farklı mı?

5. Adım — Tedarikçiden gelen ürün metnini yeniden yazın

Türkiye’deki e-ticaret sitelerinde site dışı kopyalanmanın açık ara en büyük kaynağı, XML entegrasyonuyla gelen tedarikçi ürün açıklamalarıdır. Aynı bayilik ağındaki iki yüz mağaza, aynı paragrafı harfi harfine yayımlar. Hiçbiri o metinle sıralanmaz; sıralanan olursa da özgün hiçbir şey söylemediği hâlde bunu aşacak otoritesi olan site olur.

Otuz bin ürünlük bir katalogda her sayfayı yeniden yazmak gerçekçi değil ve bunu varsaymak, bu projelerin daha başlamadan durmasının sebebi. Bunun yerine önceliklendirin. Ciro ve gösterim verinizi çekin, ürünlerin ilk yüzde 20’sini alın ve yalnızca o sayfalara özgün asıl içerik yazın. Uzun kuyruğu şimdilik tedarikçi metniyle bırakın — o sayfalar zaten marka ve model numarasıyla sıralanır, çünkü kimse bir paragrafı aratmıyor.

Önemli sayfalara yazılacak şey daha fazla sıfat değil; kimsede olmayan bilgidir: bu ürün kime uygun, kime uygun değil; sizde bulunan iki alternatife göre farkı ne; destek ekibinizin her hafta yanıtladığı soru hangisi; gerçek müşteri yorumları ve üreticinin render görselleri yerine kendi çektiğiniz fotoğraflar. Bunlardan iki yüz kelime, yeniden ifade edilmiş altı yüz kelimelik teknik özellik metnini geçer. Şablonun tamamı e-ticaret ürün sayfası rehberinde duruyor.

Sorunun diğer yarısı varyant sayfaları. Altı renk ve beş bedeni olan bir gömlek, metni neredeyse aynı olan otuz indekslenebilir URL olmamalı. Ya varyant seçicili tek bir ürün sayfası kullanın ya da her varyantı ana ürüne canonical verin. En kötü durumdaki sayfalarınızın hâlini bir Zayıf İçerik Kontrolü taramasıyla görün; araç gerçekten zayıf sayfalarla yalnızca kısa görünen sayfaları birbirinden ayırıyor.

Bir de pazaryeri tarafı var. Ürününüzün Trendyol, Hepsiburada veya n11 listelemesinde kendi sitenizdeki metnin aynısını kullanmak yasak değil ama işinize de yaramıyor: pazaryerinin alan adı otoritesi neredeyse her durumda sizinkini geçtiğinden, aynı metinle kendi sayfanız yerine onların sayfası sıralanır. Kendi sitenizdeki asıl içeriği pazaryeri metninden farklı yazmak, bu rekabetin kaybedilmemesi için gereken en küçük hamledir.

6. Adım — Ajans metni, kopyalayan siteler ve çeviri sayfalar

Site dışı kopyalanma, site içi kopyalanmadan çok daha az ilginizi hak ediyor; ama üç durum bilinçli bir karar gerektiriyor.

İzin verdiğiniz yeniden yayımlar

Bir partner sitesi makalenizi yeniden yayımlıyorsa sizin orijinalinize işaret eden alan adları arası bir canonical isteyin. Eklemezlerse — büyük yayıncıların çoğu eklemez — kopyalarına noindex konması ya da ilk paragrafta sizin sürümünüze açık bir bağlantı verilmesi de işe yarar. Yapılmaması gereken şey, kendi makalenizi hiçbir canonical olmadan LinkedIn’de, Medium’da ve üç partner sitede tam metin yayımlayıp sonra Google’ın hangisini seçtiğini merak etmek.

Türkiye’de bunun en yaygın hâli haber siteleri: AA, DHA ve İHA metinlerinin yüzlerce sitede kelimesi kelimesine yayımlanması. Ajans aboneliği olan bir yayındaysanız o haberle sıralanma ihtimaliniz yok denecek kadar düşüktür. Değer, metnin kendisinde değil eklediğiniz kısımda — kendi muhabirinizin eklediği ayrıntı, yerel bağlam, konuyla ilgili arşiv bağlantıları — ve bunlar ajans metninin üstüne değil, içine yazıldığında işe yarıyor.

İzinsiz kopyalayanlar

İçeriğinizi toptan kopyalayan siteler çoğunlukla önemsizdir. Google orijinali tespit etmekte güvenilir biçimde iyidir; özellikle orijinal yerleşik bir alan adındaysa, önce taranmışsa ve site içinden bağlantı alıyorsa. İçeriğinizin bir spam alan adında birebir durması normal koşullarda sıralamanız için tehdit değildir.

Yalnızca kopyalayan site kendi içeriğinizle sizi gerçekten geçiyorsa harekete geçin; bu nadirdir ve genellikle bir saldırıdan çok sizin tarafınızdaki bir tarama sorununa işaret eder. İçeriğinizin ve markanızın nerelerde yeniden üretildiğini bir Marka Bahsetme Takibi taramasıyla görebilirsiniz. Durum ciddiyse mekanizma Google’ın kaldırma sürecinden yapılan telif bildirimidir; geri kalan her durumda görmezden gelmek hem doğru hem de en ucuz yanıttır.

Çeviriler ve bölgesel sürümler

Gerçek çeviriler kopya içerik değildir. Google farklı dilleri farklı içerik olarak değerlendirir. Tuzak, aynı dildeki bölgesel sürümlerdedir — metni birebir aynı, yalnızca fiyatı değişen Türkiye ve Almanya sayfaları gibi. Burası kopyalanmadır ve doğru çözüm hreflang’dir: Google’a bu sayfaların kopya değil, farklı kitleler için alternatif olduğunu söyler ve her pazarda doğru olanı gösterir. Etiketler ve sıkça atlanan karşılıklı referans kuralı hreflang rehberinde anlatılıyor.

Çözüm olmayan bir şey de var: sayfa sayısını çoğaltmak için siteyi makine çevirisiyle sekiz dile açmak. Bu, her dilde düşük değerli içerik üretir ve kalite güncellemelerinde bir sitenin konumunu kaybetmesinin sayılı güvenilir yollarından biridir; trafik düşüşü rehberi bunu diğer sebeplerle birlikte listeliyor.

7. Adım — Kendini çoğaltan şablonları düzeltin

Bazı kopyalanmayı tek tek sayfalar değil şablonun kendisi üretir; bu yüzden sayfalara ayrı ayrı bakınca görünmez.

İlçe ve şehir sayfaları bu konuda açık ara birinci. Dokuz yüz kelimelik hizmet metninin on iki yerinde ilçe adının değiştirilmesiyle üretilen sayfalar bir kopya kümesidir ve rakip biraz olsun somut bir şey yayımladığı anda çalışmayı bırakır. “Kadıköy çilingir”, “Üsküdar çilingir”, “Maltepe çilingir” şablonunu herkes kullandığı için Google bu sayfaları uzun süredir birbirinden ayırt edemiyor. Her konum sayfasında yalnızca o konum için geçerli olan malzeme bulunmalı: varsa gerçek adres, orada çalışan ekip, isim ve tarihiyle yerel işler, hizmet alanının yerel tariflerle anlatımı ve o bölgedeki müşterilerden gelen yorumlar. Bir ilçe için gerçekten yerel üç paragraf yazamıyorsanız o ilçenin sayfaya ihtiyacı yoktur. Destekleyici sinyaller yerel SEO ve NAP rehberinde duruyor.

Etiket ve kategori arşivleri, yazıları özet yerine tam metin gösterdiğinde kopya üretir. Özet gösterin ve üç dörtten az içerik listeleyen arşivlere noindex verin — tek yazılık bir etiket sayfası, o yazının daha kötü bir sürümüdür.

Kalıp metin oranı, çoğu denetimin kabul ettiğinden daha önemli. 150 kelime asıl içeriği ve 800 kelime ortak alt bilgi, kampanya bloğu ve yasal metni olan bir sayfada baskın olan kısım ortak metindir. Çözüm alt bilgiyi silmek değil; asıl içeriği sayfanın belirleyici özelliği olacak kadar doyurucu hâle getirmek.

Yazdırma sayfaları ve m. alt alan adları hâlâ epeyce sitede duran eski kalıplar. Yazdırma için ayrı bir URL gerekmez; ayrı bir mobil alt alan adı ise duyarlı tasarımdan bu yana yanlış mimari ve mobil öncelikli indeksleme altında doğrudan bir risk. İkisinden biri sitenizde varsa bugün ana sürüme canonical verin ve kaldırmayı planlayın.

8. Adım — Birbiriyle yarışan sayfaları birleştirin

Son kategori, hiçbir sistemin otomatik üretmediği kopyalanma: aylar arayla farklı kişiler tarafından yazılmış, hepsi aynı sorguyu hedefleyen iki, üç ya da dört sayfa. Buna anahtar kelime yamyamlığı deniyor ve metnin değil niyetin tekrarlanmasıdır.

Belirtisi bir kez öğrenince kolay tanınıyor. Search Console’da bir sorguyu filtreleyip o sorguda görünen sayfalara bakın. URL aydan aya değişiyorsa ya da iki sayfanız yirmili sıralarda yer değiştirip duruyorsa Google hangi sayfanın sorguyu yanıtladığına karar veremiyor demektir — bu yüzden ikisini de ortada bırakır ve ikisi birden, tek bir güçlü sayfanın sıralanacağı yerin altında kalır.

Çiftleri şüpheli URL’lerinizi bir Anahtar Kelime Yamyamlığı Kontrolü aracından geçirerek bulun, örtüşmeyi iki metin üzerinde bir Metin Benzerliği / Kopya Kontrolü kontrolüyle doğrulayın. Ardından üç çözümden birini seçin:

  • Birleştirin. Çoğu durumda doğru yanıt. Hepsinden en iyi malzemeyi alın, en güçlü URL üzerinde tek bir kapsamlı sayfa kurun ve diğerlerini oraya 301 ile yönlendirin. Bağlantıları ve geçmişi birleşen tek sayfa, üç parçayı her seferinde geçer.
  • Farklılaştırın. Sayfalar gerçekten farklı niyetlere hizmet ediyor ama bu kötü ifade edilmişse geçerli — bilgilendirici bir rehberle ticari bir hizmet sayfası gibi. Başlıkları, ara başlıkları ve giriş paragraflarını farkı açık edecek şekilde yeniden yazın ve iki sayfayı birbirine bağlayın.
  • Canonical verin. Ticari sebeplerle iki sayfa da yayında kalmak zorundaysa ve birleştirme mümkün değilse başvurulacak son seçenek.

Birleştirmeden sonra iç bağlantıları düzeltin. Yönlendirdiğiniz sayfalara bağlanan sayfalar artık doğrudan hayatta kalan sayfaya bağlanmalı; yeni sayfanın alması gerekip de almadığı bağlantıları bir İç Bağlantı Fırsatı Bulucu taraması gösterir. Teşhis sürecinin tamamı yamyamlık rehberinde , yapının sonradan yeniden kurulması iç bağlantı stratejisi rehberinde anlatılıyor.

9. Adım — Sorunun geri gelmesini engelleyin

Kopya içerik bitirilen bir proje değil. Yayın yapmanın, eklentilerin ve altyapı güncellemelerinin yan ürünü ve bir şey onu izlemediği sürece geri gelir.

Yeni bir içerik yayımlamadan önce hedef sorguyu kendi sitenizde aratın. Konuyu kapsayan bir sayfa zaten varsa yanına bir rakip eklemek yerine o sayfayı geliştirin. Bu tek alışkanlık gelecekteki yamyamlığın çoğunu baştan önler; blog yazısı yazma rehberinde bir adım olarak yer alıyor.

Ayda bir Search Console’daki Sayfalar raporunda yinelenen ve hariç tutulan kategorilerdeki büyümeye bakın. Ani bir sıçrama genellikle bir eklenti güncellemesinin ya da yeni bir şablonun URL üretmeye başladığı anlamına gelir. Komşu durumların nasıl okunacağını tarandı ancak indekslenmedi rehberi anlatıyor.

Üç ayda bir siteyi bir Teknik Site Denetimi (Tarayıcı) ile baştan sona tarayıp yinelenen başlık ve açıklamalara göre sıralayın. Bu, şablon kaynaklı bozulmaları büyümeden yakalar.

Her yayın sonrası sekiz ana sayfa varyantını ve örnek bir ürün adresini bir Yönlendirme & HTTP Durum Kontrolü üzerinden yeniden çağırın. Yönlendirme kuralları bir dağıtımın bozduğu ilk şeylerdendir ve aylarca kimse fark etmez. Zaten uyguladığınız teknik SEO denetim listesine bu maddeyi ekleyin.

Düzeltmeler ne kadar sürede etki eder?

Buradaki hiçbir düzeltme anında sonuç vermez; çünkü her değişikliğin sayılabilmesi için yeniden taranması gerekir. Aşağıdaki tablo sitelerin tipik olarak gördüğü örüntü ve bunu bilmek, üçüncü haftada hiçbir şey olmadı diye doğru bir düzeltmeyi geri alma klasiğini önler.

DüzeltmeEmekEtki süresiNe görmelisiniz
URL varyasyonlarının 301 ile birleştirilmesi1–2 saat2–6 haftaİndekslenen sayfa sayısı düşer, tek ana sayfa sürümü kalır, bağlantı sinyalleri birleşir
Parametrelere canonical verilmesiYarım gün4–12 haftaSearch Console’daki yinelenen satırlar küçülür, tarama gerçek sayfalara kayar
Yarışan sayfaların birleştirilmesiKüme başına 1–2 gün3–8 haftaSıralama tek URL’de sabitlenir ve genellikle yükselir
Ürün açıklamalarının yeniden yazılmasıSüreklilik ister1–3 ayYeniden yazılan sayfalarda uzun kuyruk gösterimleri
Zayıf arşivlere noindex verilmesi2 saat3–8 haftaİndekslenen sayfa sayısı düşer, ortalama sayfa kalitesi yükselir

Büyük siteler küçüklerden daha uzun sürer; 200.000 URL’yi yeniden taramak 500 URL’yi yeniden taramaktan uzun sürdüğü için. Belirli bir düzeltmenin daha hızlı alınmasını istiyorsanız Search Console’dan birkaç temsili URL için indeksleme talebi gönderin ve değişen sayfaların sık taranan bir yerden bağlantı aldığından emin olun.

Sorunu büyüten yedi hata

  • Sayfalama sayfalarını 1. sayfaya canonical vermek. Google’a ikinci sayfadan sonrasının var olmadığını söyler; büyük bir katalogda ürünlerin çoğunu indeksten çıkarır.
  • Kopyaları robots.txt ile engellemek. Engellenen adres taranamaz, üzerindeki noindex hiç okunmaz; üstelik dış bağlantısı olan engelli bir adres, açıklaması olmadan yine de sonuçlarda görünebilir.
  • Kullanıcının hâlâ ihtiyaç duyduğu sayfaları yönlendirmek. 301 sayfayı ortadan kaldırır. Filtreli görünümler, yazdırma sürümleri ve üyelik sayfaları erişilebilir kalmalı; doğru araç canonical ya da noindex’tir.
  • Dış bağlantısı olan kopyaları silmek. Bağlantı almış bir sayfada 404 döndürmek, zaten kazanılmış otoriteyi çöpe atmaktır. Onun yerine en yakın canlı muadiline yönlendirin.
  • İçerik hırsızlığını acil durum saymak. Spam alan adlarındaki kopyaları kovalamakla geçen saatler, dört bin site içi kopya üreten parametre sorununa ayrılmayan saatlerdir.
  • Metni “özgünleştirmek” için başkalaştırmak. Tedarikçi açıklamasını eş anlamlılarla yeniden yazmak, teknik olarak farklı ama aynı derecede değersiz bir sayfa üretir. Hedef benzersizlik değil, işe yararlık.
  • Göreli canonical adresleri. Canonical etiketi protokol ve alan adı dâhil mutlak bir URL olmalı. Göreli olanlar tam da en çok ihtiyaç duyduğunuz durumlarda bozulur.

14 günlük temizlik planı

Dokuz adım üç aylık bir iş gibi görünüyorsa değerin büyük kısmının ilk iki haftada olduğunu bilin. Sıralama şöyle.

1–2. gün — ölçün. İndekslenen sayfa sayısını, yayımlanan sayfa sayısını ve Search Console Sayfalar raporundaki yinelenen satırları kaydedin. Bir Teknik Site Denetimi (Tarayıcı) çalıştırıp yinelenen başlıkları dışa aktarın. Bu hem başlangıç noktanız hem sonraki kanıtınız.

3–4. gün — sekiz varyant. Ana sayfanın tüm varyasyonlarını bir Yönlendirme & HTTP Durum Kontrolü ile test edin, yönlendirmeleri tek adıma indirin, küçük harfi zorunlu kılın, iç bağlantıları ve site haritasını asıl biçime güncelleyin. Test ortamını şifreleyin.

5–7. gün — parametreler. Sitenizin ürettiği her parametreyi listeleyin. İçeriği değiştirmeyenlere canonical verin, hangi filtrelerin sabit ve indekslenebilir adresi hak ettiğine karar verin, sayfalamanın kendine canonical verdiğini doğrulayın.

8–10. gün — yamyamlık. En çok trafik alan sayfalarınızı bir Anahtar Kelime Yamyamlığı Kontrolü aracından geçirin, en kötü üç kümeyi seçin, her birini tek sayfada birleştirip kalanları 301 ile yönlendirin. İç bağlantıları yeni adrese çevirin.

11–14. gün — şablonlar ve içerik. Arşivleri özete çevirin, zayıf olanlara noindex verin ve en çok ciro getiren yirmi ürün ya da konum sayfasının asıl içeriğini yeniden yazın.

14. günde indekslenen sayfa sayısı büyük ihtimalle hâlâ düşüyor olacak — bu düzeltmenin çalıştığının işareti, bozulduğunun değil. 60. günde ilk gün kaydettiğiniz değerlere karşı yeniden ölçün.

Sık sorulan sorular

Kopya içerik SEO sıralamasına zarar verir mi?

Ceza yoluyla değil. Zararı, bağlantı sinyallerini birkaç URL arasında bölmesinden, tarama bütçesini varyasyonlara harcatmasından ve hangi sürümün indeksleneceği kararını Google’a bırakmasından geliyor — Google’ın seçimi de sıklıkla optimize ettiğiniz sayfa değil, parametreli sürüm ya da yazdırma görünümü oluyor.

Sitemi kopya içerik açısından ücretsiz nasıl kontrol ederim?

Search Console’daki indekslenen sayfa sayısını gerçekte yayımladığınız sayfa sayısıyla karşılaştırın, Sayfalar raporundaki “yinelenen” satırlarını okuyun, siteyi bir Teknik Site Denetimi (Tarayıcı) ile tarayıp başlığa göre sıralayın ve sayfalarınızdan alışılmadık cümleleri tırnak içinde aratın. Belirli bir sayfa çifti için bir Metin Benzerliği / Kopya Kontrolü kontrolü size somut bir oran verir.

Yüzde kaç benzerlik kabul edilebilir?

Google yayımlanmış bir eşik vermiyor; araçların yüzdesi de Google’ın değil kendi algoritmalarının ölçümü. Sayfa geneli benzerliğe değil asıl içeriğe bakın: ortak menü, alt bilgi ve teknik özellik tabloları normaldir, buna karşılık merkez metni birbirinin yerine geçebilen iki sayfa yüzde kaç çıkarsa çıksın kopyadır.

Canonical etiketi mi 301 yönlendirme mi kullanmalıyım?

Kopya adresin herkes için var olmayı bırakması gerekiyorsa 301 kullanın — taşıma sonrası eski bir adres ya da birleştirilen bir sayfa gibi. Kullanıcının iki adrese de erişmesi gerekiyor ama indekste yalnızca biri olmalıysa canonical kullanın — filtreli bir listeleme ya da yazdırma görünümü gibi.

Aynı ürün açıklamasının birçok sitede olması kopya içerik midir?

Evet, ve bu bir ihlal değil — sadece rekabet edilebilir bir şey değil. İki yüz bayinin daha yayımladığı bir paragrafla kimse sıralanmaz. En çok ciro getiren ürünlerinizin asıl içeriğini önce yeniden yazın; uzun kuyruğu bırakın, o sayfalar zaten marka ve model numarasıyla sıralanıyor.

Birisi içeriğimi kopyalarsa ceza alır mıyım?

Normal koşullarda hayır. Google orijinali tespit etmekte güvenilir biçimde iyidir; özellikle sizinki önce tarandıysa, yerleşik bir alan adındaysa ve site içinden iyi bağlantı alıyorsa. Yalnızca bir kopya sizi gerçekten geçiyorsa harekete geçin; bu da genelde kendi sitenizdeki bir tarama sorununa işaret eder.

Çeviri sayfalar kopya içerik sayılır mı?

Farklı diller farklı içerik olarak değerlendirilir, dolayısıyla gerçek çeviriler sorun değildir. Risk, aynı dildeki bölgesel sürümlerde — metni birebir aynı olan Türkiye ve Almanya sayfaları gibi. Bunlar için hreflang etiketleri gerekir; böylece Google sayfaların kopya değil, farklı kitleler için alternatif olduğunu anlar.

Kopya içeriği düzelttikten sonra toparlanma ne kadar sürer?

Yönlendirme birleştirmesi için iki ila altı hafta, parametre değişiklikleri için dört ila on iki hafta, birleştirilen sayfalar için üç ila sekiz hafta; çünkü her düzeltmenin sayılabilmesi için yeniden taranması gerekiyor. Büyük siteler bu aralıkların üst ucunda. Önce indekslenen sayfa sayısının düştüğünü göreceksiniz — bu, düzeltmenin çalıştığı anlamına gelir.

Önce URL’ler, sonra kelimeler

Kopya içerik sorunlarının neredeyse tamamı kılık değiştirmiş bir yapılandırma sorunudur. URL varyasyonlarını birleştirin, parametreleri kontrol altına alın, yönlendirme ile canonical ile noindex arasında bilinçli seçim yapın; yeniden yazmaya ancak ondan sonra başlayın. Sırayı ters kuran siteler aylarını içeriğe harcarken teknik kopyalanma o emeği sessizce iptal ediyor.

Şimdi atılacak adım on beş dakika sürüyor: ana sayfa varyantlarınızı bir Yönlendirme & HTTP Durum Kontrolü üzerinden geçirin, siteyi bir Teknik Site Denetimi (Tarayıcı) ile tarayıp sonuçları başlığa göre sıralayın ve bugünkü indekslenen sayfa sayınızı bir kenara yazın. Bu üç veri kopyalanma sorununuzun büyüklüğünü söyler — altmış gün sonra da onu çözüp çözmediğinizi.