İçeriğe atla
SEO Evaluate
İlgili yazılar
SEO5 dk okuma

Teknik SEO'da indeksleme sorunları: teşhis ve düzeltme

Sayfa neden indekste değil sorusuna tek bir akışla cevap: Search Console durumlarını okuma, URL denetimiyle doğrulama, kök nedeni bulma ve düzeltmeyi kanıtlama.

Yazan Roozbeh Nazari · CEO

Teknik SEO'da indeksleme sorunları: teşhis ve düzeltme

"Sayfamız Google'da çıkmıyor" cümlesi, teknik SEO'da en sık duyulan ve en az bilgi taşıyan şikâyet. Sayfa taranmamış olabilir, taranıp indekslenmemiş olabilir, indekslenip başka bir URL'nin gölgesinde kalmış olabilir ya da indekste olup aranan sorguda görünmüyor olabilir. Bu dört durumun düzeltmesi birbirinden tamamen farklı ve ilk iş, hangisinde olduğunuzu anlamak. Bu yazı, bunun için sabit bir teşhis akışı öneriyor: her seferinde aynı sırayla, aynı araçlarla.

Akış, teknik SEO çalışmalarımızda her indeksleme şikâyetine uyguladığımız sıranın yazılı hâli. Tarama tarafındaki daha geniş kontrol listesi için 20 maddelik production listesi yazısına bakabilirsiniz.

Adım 1: şikâyeti bir duruma çevirin

Search Console'un sayfa indeksleme raporu, her URL'yi Google'ın kendi adlandırdığı bir duruma koyuyor. Bu adlar teşhisin dili ve akışın ilk adımı, şikâyeti bu adlardan birine çevirmek. Rapordaki durumlar kabaca dört kümeye ayrılıyor.

  • Erişim engeli: sunucu hatası (5xx), yönlendirme hatası, robots.txt tarafından engellendi, 401 ve 403 engelleri, bulunamadı (404), yumuşak 404.
  • Açık talimat: noindex olarak işaretlendi.
  • Google'ın tercihi: tarandı ancak şu anda indekslenmedi, keşfedildi ancak şu anda indekslenmedi.
  • Kopya yönetimi: uygun canonical etiketi olan alternatif sayfa, kullanıcı tarafından seçilmiş canonical olmayan kopya, Google'ın kullanıcıdan farklı canonical seçtiği kopya, yönlendirmeli sayfa.

Her kümenin anlamı farklı. Erişim engeli teknik bir arıza, açık talimat sizin verdiğiniz bir karar, Google'ın tercihi bir kalite ya da kapasite sinyali, kopya yönetimi ise bir mimari sorun. Rapordaki adı bulmadan düzeltmeye başlamak, hangi kümede olduğunuzu tahmin etmek demek.

Adım 2: tek URL'de doğrulayın

Rapor toplu bir görüntü verir ve gecikmeli güncellenir. Teşhisi tek bir URL üzerinde, URL denetim aracıyla doğrulamak gerekiyor. Araç iki şey söylüyor: Google'ın indeksteki sürümü bu sayfa hakkında ne biliyor ve canlı test yapıldığında sayfa bugün indekslenebilir durumda mı. İkisi arasındaki fark, sorunun hâlâ sürüp sürmediğini gösteriyor; indeksteki sürüm hatalı ama canlı test temizse düzeltme yapılmış ve yeniden tarama bekleniyor demektir.

Canlı testin bir de görmezden gelinen çıktısı var: Google'ın işlediği HTML. Tarayıcıda gördüğünüz sayfa ile Google'ın işlediği sayfa aynı olmayabiliyor; başlık, canonical ve ana içerik işlenmiş HTML'de yoksa, teşhisin geri kalanına geçmeden önce bu farkın nedenini bulmak gerekiyor. Çoğu zaman neden, istemci tarafında geç yüklenen bir bileşen ya da bota farklı cevap veren bir katman.

Canlı testte iki alana bakılmalı: taramaya izin verilip verilmediği ve sayfanın seçilen canonical adresi. Çok dilli sitelerde ikinci alan sürprizlerle dolu; Türkçe sayfa için Google'ın İngilizce sürümü canonical seçtiği durumlar, çoğu zaman hreflang ve canonical'ın birbirini tutmamasından kaynaklanıyor.

Adım 3: kök nedeni kümeye göre arayın

Erişim engeli kümesinde kök neden neredeyse her zaman altyapıda. 5xx hataları sunucu ya da uygulama katmanında; yönlendirme hataları zincir ya da döngüde; robots.txt engeli dosyanın kendisinde, bazen bir dağıtımla birlikte yanlış ortamın dosyasının canlıya çıkmasında. Yumuşak 404, yani sayfanın 200 döndürüp içeriğinin boş ya da "bulunamadı" olması, sıklıkla istemci tarafında yüklenen içeriğin Googlebot'a boş gelmesinden kaynaklanıyor.

Bir de bot ile kullanıcıya farklı davranan sunucular var. Kullanıcının diline göre otomatik yönlendirme yapan siteler, Googlebot'u da yönlendiriyor ve dil sürümlerinin bir kısmı hiç taranmıyor. Bu vakayı kendi sitemizde yaşadık ve locale auto-redirect yazısında test yöntemiyle birlikte anlattık; teşhis akışının bu adımında Googlebot'un aldığı cevabı kullanıcının aldığı cevapla karşılaştırmak zorunlu.

Açık talimat kümesinde kök neden bir noindex etiketi ya da başlığı. Burada sorulacak soru "etiket nerede" değil, "etiketi kim, neden koydu". Test ortamından canlıya taşınan bir şablon, CMS'te sayfa bazlı bir ayar ya da SEO eklentisinin varsayılanı olabilir. Etiketi kaldırmadan önce kaynağını bulmazsanız, bir sonraki dağıtımda geri geliyor.

Google'ın tercihi kümesi en zor olanı, çünkü teknik olarak her şey doğru görünüyor. "Keşfedildi ancak indekslenmedi" çoğu zaman tarama kapasitesi ya da iç bağlantı zayıflığı; "tarandı ancak indekslenmedi" ise çoğu zaman sayfanın sitenin geri kalanına kıyasla yeterince ayırt edici bulunmaması. Burada düzeltme teknik değil: sayfaya sitenin içinden bağlantı vermek, benzer sayfaları birleştirmek ya da içeriği gerçekten farklı kılmak.

Kopya yönetimi kümesinde kök neden mimaride: parametreli URL'ler, sondaki eğik çizgi farkları, http ve https sürümleri, aynı içeriğin iki dil sürümü altında canonical'sız yayınlanması. Google'ın kullanıcıdan farklı canonical seçmesi, Google'ın hatası değil, iki sinyalin çelişmesidir; yönlendirme, canonical ve hreflang'ın aynı URL'yi göstermesi gerekiyor.

Adım 4: düzeltmeyi kanıtlayın, varsaymayın

Düzeltme yapıldıktan sonra üç kanıt aranıyor. Birincisi, URL denetim aracında canlı testin temiz çıkması. İkincisi, sunucu günlüğünde Googlebot'un sayfayı düzeltmeden sonra gerçekten tekrar çekmiş olması; bu olmadan indeks durumu değişmez. Üçüncüsü, raporda durumun değişmesi; bu üçüncü kanıt günler ya da haftalar alabiliyor ve bu süreyi kısaltmak için tek araç, URL denetiminden indeksleme talebi.

İndeksleme talebini toplu bir düzeltme aracı olarak görmemek gerekiyor. Tek tek önemli sayfalar için işe yarıyor; yüzlerce sayfa için yapılması gereken, site haritasının güncel olması ve iç bağlantıların o sayfalara gerçekten ulaşması. Google'ın robots.txt dokümanı burada sık karıştırılan bir noktayı açıkça yazıyor: robots.txt bir sayfayı Google dışında tutmanın aracı değildir; bunun için noindex ya da parola koruması gerekir. Bu, ters yönde de geçerli: robots.txt ile engellenmiş bir sayfaya noindex koymanın etkisi yok, çünkü Google etiketi görmek için sayfayı tarayamıyor.

Akışı sabit tutmanın nedeni

Bu dört adımın her seferinde aynı sırayla uygulanması, teşhis hızından çok yanlış düzeltmeyi önlemek için. En sık gördüğümüz hata, "tarandı ancak indekslenmedi" durumundaki bir sayfa için canonical değiştirmek ya da "keşfedildi ancak indekslenmedi" için içerik yeniden yazmak; ikisi de kümeyi yanlış okumaktan kaynaklanıyor ve haftalar kaybettiriyor. Akış, her düzeltmeyi bir durum adına ve bir kanıta bağladığı için, ne yapıldığının ve neden yapıldığının kaydı da kendiliğinden oluşuyor.

Sonuç

İndeksleme sorunu tek bir sorun değil, dört kümeden birine düşen bir durum. Teşhis akışı, şikâyeti Search Console'un adlandırdığı duruma çevirmekle başlıyor, tek URL'de canlı testle doğrulanıyor, kök neden kümeye göre aranıyor ve düzeltme üç kanıtla kapatılıyor. Bu sırayı bozmadan uygulayan ekipler, aynı sayfayı üç kez düzeltmek yerine bir kez düzeltiyor.

Kaynaklar

// İLETİŞİM

Brief'inizi iletin. Brief'iniz bize ulaşsın.

Tanışma görüşmemiz ücretsiz. Brief'iniz bize ulaştığı an pazar fırsatınızı ve en öncelikli büyüme fırsatlarınızı haritalandırırız.