← Blog'a Dön
Duplicate Content Nasıl Önlenir? Kopya İçerik Rehberi
Teknik SEO 23 dk okuma Yayın: Güncelleme:

Duplicate Content Nasıl Önlenir? Kopya İçerik Rehberi

Duplicate content nedir, Google'ı nasıl etkiler? URL parametreleri, www/non-www, HTTP/HTTPS, faceted navigation kaynaklı kopya içerik sorunları ve canonical, noindex, 301 çözümleri.

Duplicate content, yani kopya içerik; web dünyasının en yaygın ve aynı zamanda en çok göz ardı edilen teknik SEO sorunlarından biridir. Büyük bir e-ticaret sitesi binlerce ürün sayfasını filtrelerle çoğaltabilir. Kurumsal bir blog www ile non-www sürümünü aynı anda sunuyor olabilir. Bir medya platformu yazıcı dostu sayfalar nedeniyle arama motorlarını yanıltıyor olabilir.

Bu sorunların hiçbiri kasıtlı değildir; büyük çoğunluğu altyapısal kararların doğal bir yan ürünüdür. Ama Google’ın gözünden bakıldığında kasıt fark etmez; aynı içerik birden fazla URL’de yaşıyorsa arama motoru hangisini sıralayacağına karar vermekte güçlük çeker ve bu belirsizlik sıralama gücünüzü dağıtır.

Bu kapsamlı rehberde duplicate content nedir, kaç türü vardır, hangi mekanizmalar onu tetikler ve her senaryo için hangi teknik çözümü uygulamanız gerekir — tüm bunları pratik örneklerle ele alacağız.


Duplicate Content Nedir?

Duplicate content (kopya içerik), aynı veya büyük ölçüde benzer içeriğin birden fazla URL üzerinden erişilebilir olması durumudur. Google, bu tanımı hem bir alan adı içindeki kopyalar (iç kopya içerik) hem de farklı alan adları arasındaki kopyalar (dış kopya içerik) için kullanır.

Google’ın resmi açıklamasına göre web’deki içeriğin yaklaşık %25-30’u bir şekilde kopya ya da neredeyse kopya niteliktedir. Bu oran şaşırtıcı görünebilir, ancak sayfa parametrelerini, oturum kimliklerini, izleme kodlarını ve içerik sendikasyonunu hesaba kattığınızda bu tablonun nasıl oluştuğu netleşir.

Google’ın Kopya İçeriğe Yaklaşımı

Google, kopya içeriği otomatik olarak bir ceza nedeni olarak değerlendirmez. Bunun yerine şu iki senaryo gerçekleşir:

1. Canonical seçimi: Google, kopyalar arasında “kanonik” (yetkili) URL’yi kendi belirlediği sinyaller doğrultusunda seçer. Bu seçim sizin istediğiniz URL olmayabilir. Güçlü bir ürün sayfası yerine filtre parametreli bir varyant sıralanmaya başlayabilir.

2. İçerik gruplama: Çok sayıda kopya URL’den gelen bağlantı gücü dağılır. Beş farklı URL aynı içeriği sunuyorsa, o beş URL’ye gelen tüm backlink’ler tek bir URL’ye yönlendirilmiş olsaydı sağlayacağı bütünleşik otorite ortaya çıkmaz.

Kasıtlı manipülasyon içeren durumlarda (örneğin başka sitelerin içeriğini scraping yaparak yayınlamak) Google manuel ceza da uygulayabilir; ancak bu durum teknik kaynaklı kopya içerikten çok farklı bir sorundur.


İç ve Dış Duplicate Content Arasındaki Fark

İç Kopya İçerik

Aynı alan adı içinde birden fazla URL’nin özdeş veya büyük ölçüde benzer içerik sunmasıdır. En yaygın örnekler:

  • https://ornek.com/urun/kirmizi-spor-ayakkabi ile https://ornek.com/urun/kirmizi-spor-ayakkabi?renk=kirmizi&beden=42
  • https://www.ornek.com/blog/makale ile https://ornek.com/blog/makale
  • https://ornek.com/sayfa ile https://ornek.com/sayfa/ (trailing slash farkı)

Dış Kopya İçerik

Aynı içeriğin farklı alan adlarında görünmesidir. Başlıca kaynaklar:

  • İçerik sendikasyonu: Bir haber sitesi içeriğinizi izninizle yayınlarsa, Google hangi sürümün orijinal olduğunu doğru tespit edemeyebilir.
  • Scraping: Başka siteler içeriğinizi izinsiz kopyalarsa, bunlar dış kopya içerik oluşturur.
  • Affiliate içerik: Üretici açıklamalarını değiştirmeden kullanan distribütör siteleri.
  • Çok dilli veya çok bölgeli siteler: Aynı dilde birden fazla ülke sürümü sunan siteler.

Duplicate Content’in Başlıca Kaynakları

1. URL Parametreleri Kaynaklı Kopyalar

URL parametreleri, en yaygın ve en karmaşık kopya içerik kaynağıdır. Bir URL’ye eklenen ?, & ve = karakterleriyle oluşturulan parametreler; filtreleme, sıralama, oturum yönetimi ve izleme gibi işlevler için kullanılır.

Ancak her parametre, teknik olarak yeni ve bağımsız bir URL üretir. Google bu URL’leri farklı sayfalar olarak görür. Örneğin bir e-ticaret sitesinde:

https://ornek.com/erkek-ayakkabi
https://ornek.com/erkek-ayakkabi?siralama=fiyat-artan
https://ornek.com/erkek-ayakkabi?siralama=fiyat-azalan
https://ornek.com/erkek-ayakkabi?siralama=populer
https://ornek.com/erkek-ayakkabi?renk=siyah
https://ornek.com/erkek-ayakkabi?renk=siyah&siralama=fiyat-artan

Bu altı URL özünde aynı içeriği sunar; yalnızca sıralama düzeni veya görüntülenen ürünler değişir. Bir site yalnızca 3 sıralama kriteri ve 5 renk filtresi sunsa bile kombinasyonlar onlarca URL’ye ulaşır.

İzleme parametreleri özellikle dikkat ister. UTM parametreleri (?utm_source=newsletter&utm_medium=email), Google Analytics veya diğer araçların kullandığı oturum kimlikleri (?sessionid=abc123) ve affiliate ID’leri (?ref=partner42) aynı sayfayı teknik olarak farklı URL’lerde sunar.

2. www ve Non-www Versiyonları

https://www.ornek.com ile https://ornek.com adresleri sunucu düzeyinde birleştirilmemişse, her ikisi de tam anlamıyla farklı URL’ler olarak değerlendirilir. Siteyi ziyaret eden bir kullanıcı her iki versiyona da ulaşabiliyorsa Google, aynı içeriği iki ayrı URL’de görür.

Bu sorun görünürde basit gibi görünse de düzinelerce sayfa içeren bir sitede son derece önemli bir etki yaratır: Ana sayfanızdan tüm iç sayfalara kadar her URL’nin iki versiyonu oluşur ve bu durum hem bağlantı gücünü böler hem de tarama bütçesini boşa harcar.

3. HTTP ve HTTPS Versiyonları

SSL/TLS geçişi yanlış yapılandırıldığında benzer bir durum HTTP ve HTTPS için de geçerli olur. http://ornek.com/sayfa ile https://ornek.com/sayfa ayrı URL’ler olarak değerlendirilir. Bu sorun özellikle HTTPS’e geçiş döneminde ciddi boyutlara ulaşabilir; HTTP versiyon hâlâ erişilebilirken Google her ikisini de tarıyor olabilir.

4. Trailing Slash Tutarsızlığı

https://ornek.com/hakkimizda ile https://ornek.com/hakkimizda/ teknik olarak farklı URL’lerdir. Sunucu her iki versiyona da cevap veriyorsa — biri 301 ile diğerine yönlendirmiyorsa — kopya içerik oluşur.

Bu sorun sıklıkla göz ardı edilir çünkü görsel olarak fark neredeyse sıfırdır. Ancak Google botlarının gözünde iki farklı kaynak söz konusudur.

5. Büyük/Küçük Harf Tutarsızlığı

URL’ler büyük/küçük harfe duyarlıdır. https://ornek.com/Blog/Makale-Basligi ile https://ornek.com/blog/makale-basligi farklı URL’ler olabilir. Sunucu her ikisine de yanıt veriyorsa kopya içerik ortaya çıkar.

6. Yazıcı Dostu (Printer-Friendly) Sayfalar

Eski web tasarım pratiklerinden kalan bir sorun: Sayfaların /print/ veya ?print=1 gibi ayrı versiyonlarını sunmak. Bu versiyonlar gezinme öğelerini, başlıkları ve kenar çubuklarını kaldırır, ancak ana içerik aynı kalır. Google her ikisini de dizine ekler.

https://ornek.com/blog/makale
https://ornek.com/blog/makale?format=print
https://ornek.com/print/blog/makale

Modern CSS baskı medya sorguları bu yaklaşımın yerini almış olsa da eski sistemlerde bu yapı hâlâ yaygındır.

7. Mobil Alt Alan Adları

m.ornek.com gibi ayrı mobil alt alan adları kullanan siteler, masaüstü sürümle özdeş içeriği farklı bir alan adında sunar. Google, bu durumu dış kopya içerik olarak algılayabilir. Günümüzde duyarlı (responsive) tasarım standart haline geldiğinden bu sorun azalmıştır; ancak eski sistemlerde hâlâ görülür.

8. E-Ticaret Filtre Sayfaları (Faceted Navigation)

Yönlü gezinme (faceted navigation), e-ticaret sitelerinin en büyük duplicate content kaynaklarından biridir. Kullanıcıların ürünleri renk, beden, marka, fiyat aralığı ve derecelendirmeye göre filtreleyebildiği sistemler, her filtre kombinasyonu için yeni bir URL üretir.

Bir giyim sitesini düşünelim:

Filtre KombinasyonuOluşan URL
Yok (temel kategori)/kadin/elbise
Renk: Kırmızı/kadin/elbise?renk=kirmizi
Renk: Kırmızı, Beden: M/kadin/elbise?renk=kirmizi&beden=m
Beden: M, Fiyat: 0-500/kadin/elbise?beden=m&fiyat=0-500
Marka: X, Renk: Mavi/kadin/elbise?marka=x&renk=mavi

10 renk, 8 beden, 5 fiyat aralığı ve 20 marka seçeneğiyle bile teorik URL kombinasyonu binleri geçer. Bu URL’lerin büyük çoğunluğu değerli içerik değil, teknik varyantlardır.

9. Sayfalandırma Sayfaları

Sayfalandırılmış içerik listeleri (/blog/sayfa/2, /blog/sayfa/3) kısmen kopya içerik niteliği taşır: başlık, açıklama, gezinme ve alt bilgi bölümleri genellikle tüm sayfalarda aynıdır.

10. Hreflang ve Çok Dilli/Çok Bölgeli Kopyalar

Aynı dili konuşan farklı ülkelere yönelik içerik sunan siteler ciddi bir kopya sorunuyla yüzleşir. İngilizce içerik hem ABD (/en-us/) hem İngiltere (/en-gb/) hem de Avustralya (/en-au/) için yayınlandığında, bu üç URL özünde aynı metni içerebilir.

Benzer şekilde, İspanyolca içerik hem İspanya (/es-es/) hem Meksika (/es-mx/) hem de Arjantin (/es-ar/) için yayınlandığında ve yalnızca küçük yerel uyarlamalar yapıldığında Google, bu sayfalar arasındaki içerik benzerliğini kopya olarak değerlendirebilir.


Tarama Bütçesi ve Duplicate Content İlişkisi

Duplicate content yalnızca sıralama gücünü dağıtmaz; aynı zamanda Google’ın tarama bütçesini de verimsiz kullanmasına neden olur.

Tarama bütçesi (crawl budget), Google’ın belirli bir süre içinde bir siteyi ne sıklıkla ve ne kadar derinlikte tarayacağını belirleyen kaynak miktarıdır. Küçük ve orta ölçekli sitelerde bu kavram genellikle pratikte sorun yaratmaz; ancak binlerce veya milyonlarca URL’ye sahip sitelerde — özellikle e-ticaret platformlarında — tarama bütçesi hayati bir kısıt haline gelir.

Google’ın tarama robotu (Googlebot) her site için sınırlı bir süre tahsis eder. Bu sürenin büyük bölümü, aynı içeriği farklı parametrelerle sunan yüzlerce ya da binlerce URL’yi taramakla geçerse; yeni yayınlanan ürün sayfaları, blog yazıları veya güncellenen içerikler daha geç taranır ve daha geç dizine eklenir.

Tarama Bütçesini Etkileyen Duplicate Content Senaryoları

Üç senaryo tarama bütçesini en çok tüketir:

Parametre kombinasyonları: Faceted navigation’dan kaynaklanan binlerce URL, Googlebot’un tümünü taramaya çalışmasına neden olabilir. Hiçbiri yeni içerik sunmasa da her biri ayrı bir tarama isteği tetikler.

Sayfalandırma derinliği: Çok sayfalı listeler, özellikle son sayfalarda içerik yoğunluğu düşük ise bütçeyi tüketir. Listelerin ilk 2-3 sayfasına arama trafiğinin büyük çoğunluğu gelirken Googlebot binlerce sayfa taramaya devam edebilir.

Oturum kimlikleri: Her kullanıcı ziyaretinde yeni bir sessionid parametresi üreten sistemler, teorik olarak sonsuz sayıda benzersiz URL oluşturabilir. Bu durum hem sunucu yükünü artırır hem de tarama bütçesini geri dönüşsüz biçimde tüketir.

Tarama Bütçesini Optimize Etmek İçin Adımlar

  1. XML site haritanıza yalnızca canonical, 200 durum kodu döndüren URL’leri ekleyin.
  2. robots.txt ile değer üretmeyen parametre kalıplarını tarama dışında bırakın.
  3. Google Search Console’da URL parametrelerini doğru şekilde tanımlayın.
  4. İç bağlantı yapınızda kopya URL’lere değil canonical URL’lere bağlantı verin.
  5. Sayfalandırılmış içeriklerde rel="next" / rel="prev" yerine (artık Google tarafından desteklenmiyor) noindex veya güçlü canonical uygulamaları tercih edin.

Duplicate Content’i Tespit Etme Yöntemleri

Sorunları çözmeden önce neyin nerede olduğunu anlamanız gerekir.

Google Search Console ile Tarama

Google Search Console’un “Dizin oluşturma” > “Sayfalar” bölümünde dizine eklenemeyen sayfaların listesine ulaşabilirsiniz. “Canonical etiketiyle yinelenen” ve “Google tarafından seçilen alternatif kanonik” satırları, Google’ın kanonik kararlarını nasıl verdiğini doğrudan gösterir.

”Google tarafından seçilen alternatif kanonik” durumu özellikle önemlidir: Canonical etiketiniz bir URL işaret ederken Google başka bir URL’yi tercih ediyorsa, bu bir sinyal uyumsuzluğuna işaret eder.

Screaming Frog ile Tarama

Screaming Frog SEO Spider, site genelinde kopya başlık ve meta açıklamaları, aynı içeriğe sahip URL gruplarını ve canonical etiket tutarsızlıklarını tespit etmede son derece etkilidir. “Duplicate” filtresi, içerik karmalarına göre eşleşen URL gruplarını listeler.

Ahrefs veya Semrush ile Canonical Analizi

Bu araçların “Site Denetimi” modülleri, canonical etiket eksikliğini, yanlış canonical hedeflerini ve sayfa düzeyinde kopya içerik uyarılarını merkezi bir kontrol panelinde sunar.

Manuel URL Analizi

Özellikle parametre kökenli kopyalar için şu basit testi uygulayın:

  1. Sitenizin kategori veya ürün URL’lerinden birini alın.
  2. Sonuna çeşitli parametre kombinasyonları ekleyin.
  3. Bu URL’lerin tamamı yükleniyorsa ve sunucu 301 yönlendirmesi yapmıyorsa kopya içerik riskiyle karşı karşıyasınız demektir.

Duplicate Content Çözüm Yöntemleri

1. Canonical Etiket (rel=“canonical”)

Canonical etiketi, arama motorlarına “bu sayfanın birden fazla versiyonu olabilir, ancak sıralama için şu URL’yi kullan” mesajını verir. <head> bölümüne eklenen bu HTML etiketi, kopya içerik yönetiminin temel taşıdır.

<link rel="canonical" href="https://ornek.com/kadin/elbise" />

Parametreli URL örneği. Filtre uygulanmış sayfa şu canonical etiketini içermelidir:

<!-- https://ornek.com/kadin/elbise?renk=kirmizi sayfasında -->
<link rel="canonical" href="https://ornek.com/kadin/elbise" />

Bu sayede Google, filtre sayfasına işaret eden bağlantı gücünü kanonik URL’ye aktarır ve sıralama için doğru sayfayı seçer.

Canonical etiketi hakkında kritik noktalar:

  • Canonical bir öneri niteliğindedir, kesin bir direktif değildir. Google, sayfa içeriğinin kanonik URL’den çok farklı olduğunu düşünürse kendi kararını verebilir.
  • Self-referencing canonical (kendi kendine işaret eden canonical), her sayfada bulunması gereken iyi bir uygulamadır. Bir sayfa kopyası olmasa bile <link rel="canonical" href="kendi-url'si" /> eklemek, gelecekte oluşabilecek parametreli kopyaları önceden önler.
  • Canonical zincirleri oluşturmaktan kaçının. A sayfası B’yi canonical gösteriyorsa ve B sayfası C’yi canonical gösteriyorsa Google bu zinciri izlemeyebilir. Her zaman son kanonik URL’ye doğrudan işaret edin.
  • Canonical hedefi 200 döndürmelidir. 301, 404 veya 500 durum kodu döndüren bir URL’yi canonical olarak işaret etmeyin.

Canonical etiketini doğru oluşturmak için aracımızı kullanabilirsiniz.

2. 301 Yönlendirmesi

301 (Kalıcı Yönlendirme), URL birleştirme için en güçlü yöntemdir. Bir URL’nin artık başka bir URL’de yaşadığını hem kullanıcılara hem de arama motorlarına bildirir; sayfa otoritesinin büyük bölümünü hedef URL’ye taşır.

www / non-www birleştirme için:

# Apache .htaccess
RewriteEngine On
RewriteCond %{HTTP_HOST} ^ornek\.com [NC]
RewriteRule ^(.*)$ https://www.ornek.com/$1 [R=301,L]

HTTP’den HTTPS’e yönlendirme için:

RewriteCond %{HTTPS} off
RewriteRule ^(.*)$ https://%{HTTP_HOST}%{REQUEST_URI} [R=301,L]

Trailing slash tutarsızlığı için:

Sunucu düzeyinde ya trailing slash’ı kaldırın ya da ekleyin — tutarlılık önemlidir. Seçiminizi yaptıktan sonra diğer versiyonu 301 ile doğru versiyona yönlendirin.

301 yönlendirmesini canonical etiketten ayıran temel fark şudur: 301, eski URL’yi ortadan kaldırır. Canonical ise eski URL’yi erişilebilir bırakırken Google’a sıralama kararını verir. Kullanıcıların eski URL’ye gelmesini istemediğiniz durumlarda (örneğin www/non-www birleştirme) 301 tercih edin.

3. Noindex Etiketi

noindex meta etiketi veya HTTP başlığı, Google’a bir sayfayı dizine eklememesini söyler. Bu yaklaşım, arama motorları tarafından sıralanmasını istemediğiniz ancak kullanıcılar için erişilebilir tutmak istediğiniz sayfalar için uygundur.

<meta name="robots" content="noindex, follow" />

Noindex ne zaman tercih edilmeli?

  • Yazıcı dostu sayfa varyantları
  • Oturum tabanlı URL’ler
  • Dahili arama sonuç sayfaları
  • Yalnızca filtre/sıralama parametresi içeren sayfalar (hiçbir benzersiz içerik barındırmıyorsa)
  • Yazar arşiv sayfaları (içerik az ve özgün değer taşımıyorsa)

noindex, follow kombinasyonu özellikle önemlidir: Sayfayı dizine eklemez, ancak sayfadaki bağlantıları takip etmesine izin verir. Bu sayede iç bağlantı yapısı bozulmaz.

Noindex ile canonical arasındaki fark: Canonical, Google’a “bu sayfanın yetkili sürümü şu URL’dir” derken; noindex, “bu sayfayı arama sonuçlarında gösterme” der. Kopya sayfanın hiçbir sıralama değeri taşımasını istemiyorsanız canonical; sayfayı tamamen indeks dışında bırakmak istiyorsanız noindex kullanın.

4. URL Parametresi Yönetimi (Google Search Console)

Google Search Console’un “Eski Araçlar” bölümünde bulunan URL Parametreleri aracı, Google’a belirli parametrelerin içeriği değiştirip değiştirmediğini veya yalnızca sunumu etkileyip etkilemediğini bildirmenizi sağlar.

Parametre TürüÖrnekGSC’de Tanımlama
İçeriği değiştirenrenk, beden, marka”İçeriği değiştirir - filtreler”
Sıralamayı etkileyensiralama, sayfa”İçeriği değiştirir - sıralar”
Yalnızca izleme amaçlıutm_source, ref”İçeriği değiştirmez - yoksay”
Oturum kimliğisessionid”İçeriği değiştirmez - yoksay”

Bu ayar, Google’ın hangi URL’leri tarayacağını optimize ederek tarama bütçesini daha verimli kullanmasını sağlar.

Not: Google Search Console’daki URL Parametreleri aracı yalnızca Google’ı etkiler; Bing ve diğer motorlar için ayrı yapılandırmalar gerekebilir. Ayrıca bu araç yalnızca bir ipucu sunar; Google bu ipuçlarını her zaman izlemeyebilir.

5. robots.txt ile Parametre Engelleme

robots.txt ile belirli parametre kalıplarını tamamen taramadan çıkarabilirsiniz:

User-agent: *
Disallow: /*?siralama=
Disallow: /*?utm_
Disallow: /*?sessionid=

Ancak bu yöntem dikkatle kullanılmalıdır: robots.txt ile engellenen URL’leri Google, canonical veya noindex sinyallerini okuyamadan indeks dışında bırakır. Bir sayfaya işaret eden backlink’ler varsa ve canonical yönlendirmesi yok ise bu bağlantı değeri kaybolur.

robots.txt ile noindex/canonical arasında seçim:

  • Sayfaya backlink gelebiliyorsa: canonical veya 301 tercih edin
  • Sayfanın varlığından haberdar edilmesini istemiyorsanız: robots.txt kullanın
  • İkisi birleştirilebilir: robots.txt engeli olmadan noindex ekleyin (Google sayfayı tarayabilir ve noindex sinyalini okuyabilir)

Faceted Navigation İçin Kapsamlı Strateji

Yönlü gezinme sistemleri, duplicate content yönetiminin en karmaşık boyutunu oluşturur. Yalnızca tek bir yöntemle çözülmez; çok katmanlı bir strateji gerektirir.

Katman 1: Canonical Etiket Hiyerarşisi

Tüm filtre kombinasyonu URL’leri, temel kategori URL’sini canonical göstermelidir. Bu, minimum gereksinimi karşılar.

Katman 2: Değerli Filtre Sayfalarını Tanımlayın

Bazı filtre kombinasyonları gerçek arama talebi taşır ve sıralanmayı hak eder. Örneğin “kırmızı spor ayakkabı” gibi bir ifadenin yeterli arama hacmi varsa, bu filtreye özel bir URL oluşturup onu canonical haline getirmek ve sayfaya özgün meta başlık/açıklama yazmak doğru stratejidir.

Bu tür “değerli” filtreleri belirlemek için anahtar kelime araştırması yapın. Ahrefs, Semrush veya Google Keyword Planner ile hangi filtre kombinasyonlarının aranabilir ifadelere karşılık geldiğini tespit edin.

Katman 3: JavaScript ile URL Üretimini Kontrol Altına Alın

Bazı modern e-ticaret sistemleri, filtre değişimlerini JavaScript ile History API aracılığıyla URL’ye yansıtır. Bu yaklaşımla yalnızca seçili birkaç filtre kombinasyonunun URL üretmesini sağlayabilir, geri kalanları ise durum olarak yönetebilirsiniz.

Katman 4: Tarama Bütçesi Yönetimi

Google’ın botları sınırsız tarama kapasitesine sahip değildir. Milyonlarca parametre kombinasyonu üreten bir site, tarama bütçesinin büyük bölümünü anlamsız sayfalarda harcar. Bu, değerli içeriklerinizin daha geç taranması anlamına gelir.

robots.txt ile değer taşımayan parametre kombinasyonlarını tamamen tarama dışında bırakmak bu sorunu azaltır.


Hreflang ile Çok Dilli/Çok Bölgeli Kopya Yönetimi

Uluslararası siteler için hreflang etiketi hem dil/bölge hedeflemeyi hem de duplicate content yönetimini aynı anda sağlar.

<link rel="alternate" hreflang="tr-TR" href="https://ornek.com/tr/" />
<link rel="alternate" hreflang="en-US" href="https://ornek.com/en-us/" />
<link rel="alternate" hreflang="en-GB" href="https://ornek.com/en-gb/" />
<link rel="alternate" hreflang="x-default" href="https://ornek.com/" />

Hreflang, Google’a “bu URL’ler kopya değil; farklı kullanıcı segmentlerine yönelik versiyonlardır” mesajını verir. Böylece Google, içerik benzerliğine rağmen her versiyonu ilgili hedef kitle için bağımsız olarak değerlendirir.

Hreflang’ın doğru çalışması için temel kurallar:

  • Her hreflang çifti karşılıklı olmalıdır. A sayfası B’ye işaret ediyorsa B de A’ya işaret etmelidir.
  • x-default etiketi, hiçbir dil/bölge eşleşmediğinde gösterilecek varsayılan sayfayı belirtir.
  • Hreflang’da belirtilen URL’ler 200 durum kodu döndürmelidir.
  • Hreflang XML site haritasında veya HTTP başlıklarında da belirtilebilir; ancak en yaygın ve güvenilir yöntem HTML <head> bölümüdür.

Hreflang kurulumu, yalnızca duplicate content çözümü değil, aynı zamanda doğru içeriğin doğru kullanıcıya sunulmasını sağlayan bir hedefleme mekanizmasıdır. Türkçe içeriğin yanlışlıkla İngilizce arama sonuçlarında sıralanması ya da Türkiye hedefli içeriğin Almanya için gösterilmesi bu etiket olmadan kolaylıkla gerçekleşebilir.


Sesli Arama ve AMP Sayfaları Kaynaklı Kopyalar

AMP Sayfaları

Accelerated Mobile Pages (AMP), özellikle medya ve haber siteleri için içeriğin mobil hızlandırılmış versiyonunu sunar. Her AMP sayfası, kanonical HTML sayfasına karşılık gelir ve bu iki sürüm teknik olarak farklı URL’lerdir.

<!-- Ana HTML sayfasında -->
<link rel="amphtml" href="https://ornek.com/makale/amp/" />

<!-- AMP sayfasında -->
<link rel="canonical" href="https://ornek.com/makale/" />

Bu karşılıklı bağlantı, Google’a AMP sayfasının ana URL’nin bir varyantı olduğunu bildirir. Doğru yapılandırıldığında AMP sayfası, ana URL’nin sıralamasına katkıda bulunur; bağımsız bir kopya olarak davranmaz.

Sesli Arama Sayfaları

Bazı siteler sesli arama için optimize edilmiş ayrı içerik sayfaları oluşturur. Bu yaklaşım, sayfanın ana içerikten büyük ölçüde farklılaşmadığı sürece duplicate content riski taşır. Sesli arama optimizasyonu, ayrı URL’ler üretmek yerine aynı sayfanın yapısal verilerini ve içerik formatını geliştirmek üzerine kurulmalıdır.


İçerik Sendikasyonu ve Dış Kopya İçerik Yönetimi

İçeriğinizi başka platformlara sağlıyorsanız veya başka platformlardaki içerikleri sitenize entegre ediyorsanız şu adımları uygulayın:

İçeriğinizi başka sitelere sağlıyorsanız:

Sendikasyon ortaklarınızdan orijinal içerik URL’nize canonical etiket eklemelerini isteyin:

<link rel="canonical" href="https://sizin-siteniz.com/orijinal-makale" />

Bu mümkün değilse, sendikasyon anlaşması kapsamında yayınlanan içeriklerin en az 2-3 hafta sonra yayınlanmasını talep edin. Bu gecikme, Google’ın orijinal içeriği önce indekslemesine zaman tanır.

Başka sitelerin içeriğini scraping yaptığını tespit ediyorsanız:

Google’ın Kopyalanan İçerik Bildir aracını veya DMCA kaldırma sürecini kullanabilirsiniz. Aynı zamanda, kendi içerik sayfalarınızın güçlü dahili bağlantılar, yapısal veri ve yüksek Domain Authority ile desteklendiğinden emin olun; bu faktörler Google’ın orijinal kaynağı doğru tespit etmesine yardımcı olur.


Duplicate Content Kontrol Listesi

Sitenizi periyodik olarak bu kontrol listesiyle değerlendirin:

Teknik Temel

  • www ve non-www versiyonlarından biri 301 ile diğerine yönlendiriyor mu?
  • HTTP versiyonu HTTPS’e 301 ile yönlendiriliyor mu?
  • Trailing slash tutarsızlığı var mı? Sunucu her iki versiyona da yanıt veriyor mu?
  • URL büyük/küçük harf tutarsızlığı kontrol edildi mi?
  • Her sayfada self-referencing canonical etiketi var mı?

Parametre Yönetimi

  • Hangi parametreler içeriği değiştiriyor, hangiler yalnızca görünümü etkiliyor?
  • Google Search Console’da URL parametreleri tanımlandı mı?
  • Yalnızca izleme amaçlı parametreler (UTM vb.) canonical veya robots.txt ile yönetiliyor mu?

E-Ticaret Özel Kontroller

  • Tüm faceted navigation URL’leri temel kategori URL’sini canonical gösteriyor mu?
  • Değerli filtre kombinasyonları (aranabilir ifadeler) bağımsız canonical URL’lere sahip mi?
  • Sıralama ve sayfalandırma URL’leri nasıl yönetiliyor?

Uluslararası Siteler

  • Hreflang etiketleri tüm dil/bölge kombinasyonlarını kapsıyor mu?
  • Hreflang çiftleri karşılıklı mı?
  • x-default doğru URL’ye işaret ediyor mu?

İçerik Üretim Süreci

  • Yeni sayfalar yayına alınmadan önce canonical ekleme prosedürü var mı?
  • İçerik sendikasyonu yapılıyorsa ortakların canonical politikası belirlendi mi?

CMS’lerde Duplicate Content: WordPress, Shopify ve Magento Özel Senaryoları

WordPress’te Kopya İçerik Kaynakları

WordPress, varsayılan yapılandırmasıyla birkaç farklı kopya içerik senaryosu üretir:

Kategori ve etiket arşivleri: Bir yazı hem bir kategoride hem de birkaç etikette listelenirse, aynı yazı birden fazla arşiv sayfasında görünür. Arşiv sayfaları genellikle yazı özetlerini içerdiğinden bu durum büyük ölçekli kopya içerik sorunu yaratmaz; ancak meta başlıklar ve açıklamalar özgünleştirilmezse sorun derinleşir.

Yazar arşivi: Tek yazarlı bloglarda yazar arşiv sayfası (/author/admin/), ana blog sayfasıyla (/blog/) özünde aynı içeriği sunar. Bu sayfanın noindex olarak işaretlenmesi yaygın bir uygulamadır.

Sayfa kalıpları: WordPress, her yazı için birden fazla URL üretebilir: /?p=123, /blog/makale-basligi/, /blog/makale-basligi (trailing slash farkı) gibi. Kalıcı bağlantı (permalink) yapısı doğru yapılandırılmadığında bu URL’lerin tümü erişilebilir olabilir.

Çözüm: Yoast SEO veya Rank Math gibi eklentiler, canonical etiket yönetimini merkezi olarak sunar. Bu eklentiler aynı zamanda arşiv sayfaları için noindex ayarını kolaylaştırır.

Shopify’da Kopya İçerik

Shopify, platform mimarisi gereği bazı kopya içerik yapıları üretir:

Bir ürün hem /products/urun-adi hem de /collections/koleksiyon-adi/products/urun-adi yollarından erişilebilir olur. Shopify bu durumu canonical etiket ile yönetir; /products/ URL’si otomatik olarak canonical yapılır. Ancak bu düzenin bozulmadığından emin olmak için tema kodunu kontrol etmek gerekir.

Shopify’ın ?variant= parametreleri de dikkat ister. Her renk veya beden seçeneği farklı bir varyant ID’si üretebilir ve bunlar parametreli URL’ler oluşturur. Shopify bu URL’lere otomatik canonical ekler, ancak tema özelleştirmelerinde bu yapının korunup korunmadığını test edin.

Magento / Adobe Commerce’te Kopya İçerik

Magento, tarihsel olarak en karmaşık kopya içerik senaryolarını üreten e-ticaret platformlarından biridir:

  • Çoklu mağaza görünümleri (store views) aynı içeriği farklı URL’lerde sunabilir.
  • Katmanlı gezinme (layered navigation), faceted navigation’ın Magento’daki karşılığıdır ve benzer parametre sorunlarını üretir.
  • Yeniden yazma (URL rewrite) tablosu büyüdükçe URL tutarsızlıkları artabilir.

Magento için en yaygın çözüm kombinasyonu: Tüm parametreli URL’ler için canonical etiket, Google Search Console’da parametre yönetimi ve değer taşımayan filtre kombinasyonları için robots.txt engeli.


Sık Yapılan Hatalar

Hata 1: Canonical Zinciri Oluşturmak

A → B → C şeklinde canonical zinciri oluşturmak, Google’ın son kanonik URL’yi bulmasını zorlaştırır. Her kopya doğrudan yetkili URL’ye işaret etmelidir.

Hata 2: 301 Yönlendirmesini Canonical Yerine Yanlış Kullanmak

Kullanıcıların hâlâ kullandığı ve backlink alan bir sayfayı 301 ile yönlendirmek, o URL’nin tüm bağlantı değerini aktarır ama sayfayı ortadan kaldırır. Kullanıcılara erişilebilir tutmak istediğiniz sayfalar için canonical tercih edin.

Hata 3: Noindex ile robots.txt’i Eş Zamanlı Kullanmak

robots.txt ile engellenen sayfalara Google giremez ve noindex etiketini okuyamaz. Bir URL’yi robots.txt ile engelliyorsanız noindex eklemenin anlamı yoktur; zaten tarama yapılmaz. İki yöntem birbirini dışlar.

Hata 4: Canonical’ı 301 Yönlendirilen URL’ye İşaret Ettirmek

Canonical etiketi her zaman son durumda 200 döndüren URL’ye işaret etmelidir. Canonical hedefi 301 dönüyorsa Google bu zinciri takip edebilir, ancak bu gereksiz bir karmaşıklık ekler.

Hata 5: Site Genelinde Tek Bir Canonical Kullanmak

Bazı CMS yapılandırmaları tüm sayfalarda ana sayfayı canonical gösterir. Bu durum tüm dahili sayfaların sıralanmasını engeller. Her sayfa kendi URL’sini canonical göstermelidir.


Teknik SEO Denetiminde Duplicate Content’in Yeri

Duplicate content, teknik SEO denetiminin ayrılmaz bir parçasıdır. Site mimarisi değişikliklerinde, CMS geçişlerinde, alan adı birleştirmelerinde veya e-ticaret filtre sistemi güncellemelerinde kopya içerik sorunları sıklıkla ortaya çıkar ya da mevcut sorunlar derinleşir.

Bu nedenle periyodik denetimlerde şu araçların kombinasyonunu kullanın:

  • Google Search Console: Kanonik kararlar ve dizine eklenememe nedenlerini görüntülemek için.
  • Screaming Frog: Site geneli tarama ve içerik eşleşme analizi için.
  • Ahrefs / Semrush Site Denetimi: Canonical etiket sorunları ve kopya meta veriler için.
  • Siteliner: Dahili kopya içerik oranını ölçmek için ücretsiz bir alternatif.

Teknik SEO hizmetlerimiz hakkında bilgi almak için bu sayfayı ziyaret edebilirsiniz.


Sonuç: Doğru Yaklaşım, Doğru Araç

Duplicate content yönetiminde tek bir “doğru yöntem” yoktur. Sorunun kaynağı, etkilenen sayfa türü ve hedefleriniz, hangi aracın kullanılacağını belirler:

SenaryoÖnerilen Çözüm
www / non-www birleştirme301 yönlendirmesi
HTTP → HTTPS geçişi301 yönlendirmesi
Parametre varyantları (filtre, sıralama)Canonical etiket
Yazıcı dostu sayfalarNoindex veya canonical
Yalnızca izleme parametreleri (UTM)Canonical + GSC parametre ayarı
Değerli faceted navigation URL’leriBağımsız canonical + özgün meta veriler
Değersiz faceted navigation URL’leriCanonical veya noindex
Çok dilli/çok bölgeli içerikHreflang
Dış kopya (scraping)DMCA + güçlü iç bağlantı yapısı
AMP sayfalarıKarşılıklı canonical + amphtml bağlantısı

Duplicate content sorunları, arama motoru sıralamalarını doğrudan etkileyen teknik kararların doğal bir yan ürünüdür. Önemli olan bu kararları farkında olarak almak, mevcut sorunları sistematik biçimde tespit etmek ve uygun çözümü doğru senaryoya uygulamaktır.

Bu rehberde ele aldığımız yöntemleri sitenizin gerçek ihtiyaçlarına göre önceliklendirin: Önce www/HTTPS gibi temel birleştirme sorunlarını çözün, ardından parametre yönetimine geçin, son olarak faceted navigation ve uluslararası yapılandırmaları ele alın. Her adım, arama motorlarının sitenizi daha doğru anlamasına ve sıralamada hak ettiğiniz konumu almanıza katkı sağlayacaktır.

Onur Öztürk
// yazar

Onur ÖZTÜRK

SEO Uzmanı & Dijital Pazarlama Danışmanı

15 yılı aşkın deneyimle sağlık turizmi, e-ticaret ve kurumsal markalar için SEO stratejisi geliştiriyorum. Google Partner ve Meta Business Partner olarak 150'den fazla işletmenin organik büyümesine katkı sağladım.

Toplantı Planlayın