İçeriğe geç
ETErhan TunçerSEO Uzmanı

Robots.txt Test

Site adresini, kontrol etmek istediğiniz yolu ve bot adını girin; robots.txt kurallarına göre o yolun taranmasına izin verilip verilmediğini görün.

robots.txt Kuralları Nasıl Yorumlanır?

Google, robots.txt dosyasındaki kuralları değerlendirirken en uzun (en spesifik) eşleşen kuralı esas alır — kuralların sırası önemli değildir. Eşit uzunlukta bir Allow ve Disallow kuralı çakışırsa, Allow kuralı öncelikli kabul edilir.

Botlara Özel Kural Grupları

"User-agent: Googlebot" gibi belirli bir bota özel bir grup varsa, o bot için yalnızca o grup uygulanır — genel "User-agent: *" grubuyla birleştirilmez. Bu yüzden belirli botları test etmek, genel davranışı test etmekten farklı sonuçlar verebilir.

Sık Yapılan robots.txt Hataları

HataSonucu
Yanlışlıkla "Disallow: /" bırakmakTüm site taranmaz hale gelir
CSS/JS dosyalarını engellemekGoogle sayfayı doğru render edemez
Sitemap satırını unutmakBotlar sitemap'i bulmakta gecikebilir

Robots.txt Test Aracı Nasıl Çalışır?

Bu robots.txt test aracı, belirttiğiniz domain'in robots.txt dosyasını çeker ve girdiğiniz belirli bir URL yolunun, seçtiğiniz bot (Googlebot, Bingbot veya genel "*" grubu) tarafından taranmasına izin verilip verilmediğini simüle eder. Dosyadaki kuralları Google'ın resmi yorumlama mantığına göre değerlendirir — en spesifik eşleşen kuralı esas alır ve hangi satırın nihai kararı belirlediğini gösterir. Bu sayede, yayına almadan önce bir kuralın gerçekten beklediğiniz gibi çalışıp çalışmadığını test edebilirsiniz.

robots.txt Nedir ve Neden Vardır?

robots.txt, bir web sitesinin kök dizininde bulunan, arama motoru botlarına sitenin hangi bölümlerini tarayabileceklerini bildiren basit bir metin dosyasıdır. Bu dosya bir güvenlik önlemi değildir — yalnızca "iyi niyetli" botlara bir yönerge sunar; kötü niyetli botlar bu kuralları görmezden gelebilir. Asıl amacı, arama motorlarının tarama bütçesini (crawl budget) sitenizin önemli sayfalarına yönlendirmesine yardımcı olmak ve yönetim panelleri, arama sonucu sayfaları veya tekrarlayan içerik gibi değersiz alanların taranmasını önlemektir.

En Kritik ve En Yaygın Hata: "Disallow: /"

Bir robots.txt dosyasında yanlışlıkla bırakılan tek bir satır — Disallow: / — sitenizintamamının taranmasını engelleyebilir. Bu hata genellikle bir geliştirme veya test ortamından canlıya geçiş sırasında, geliştirme ortamı için eklenen bu kısıtlayıcı kuralın canlı siteye de yanlışlıkla taşınmasıyla ortaya çıkar. Sonuç genellikle haftalar sonra, organik trafiğin dramatik biçimde düşmesiyle fark edilir — bu yüzden her yeni site lansmanından veya büyük güncellemeden sonra robots.txt dosyasını bu araçla kontrol etmek kritik bir güvenlik adımıdır.

CSS ve JavaScript Dosyalarını Engellememenin Önemi

Google, bir sayfayı doğru şekilde render edebilmek (görselleştirebilmek) için sayfanın CSS ve JavaScript dosyalarına da erişebilmesi gerekir. Eskiden yaygın olan bir uygulama, bu dosyaları içeren klasörleri (örneğin /wp-content/themes/ gibi) robots.txt ile engellemekti — ancak bu, Google'ın sayfanızı düzgün render edememesine ve içeriği yanlış anlamasına yol açabilir. Modern SEO uygulamasında, CSS ve JavaScript dosyalarının taranmasına izin vermek genel kabul gören bir standarttır.

Sitemap Referansının Önemi

robots.txt dosyasının sonuna eklenen Sitemap: https://siteniz.com.tr/sitemap.xml satırı, arama motoru botlarının sitenizin XML site haritasını hızlıca bulmasını sağlar. Bu satır zorunlu olmasa da (site haritanızı Search Console'a ayrıca gönderebilirsiniz), robots.txt üzerinden referans vermek, botların sitenizi ilk keşfettiği andan itibaren site haritanıza erişebilmesini garanti eden basit ve önerilen bir uygulamadır.

Robots.txt dosyanızı sıfırdan oluşturmak için Robots.txt Oluşturucuaracını, site haritanızın doğru yapılandırıldığını kontrol etmek için iseXML Sitemap Kontrol aracını kullanabilirsiniz.

Bota Özel Kural Gruplarının Karmaşıklığı

Birden fazla User-agent grubu tanımlandığında, Google'ın bu grupları nasıl yorumladığını doğru anlamak kritik önem taşır. Eğer dosyada hem "User-agent: *" (tüm botlar için genel kural) hem de "User-agent: Googlebot" (özellikle Google için özel kural) grupları varsa, Googlebot yalnızca kendisine özel grubu dikkate alır — genel gruptaki kurallar Googlebot için otomatik olarak uygulanmaz. Bu davranış, birçok site sahibinin farkında olmadığı bir detaydır ve yanlış varsayımlarla kurgulanmış robots.txt dosyalarının beklenenden farklı sonuçlar vermesine yol açabilir. Bu araç, hangi bot için hangi grubun geçerli olduğunu net biçimde göstererek bu karmaşıklığı ortadan kaldırır.

Wildcard ve Özel Karakterlerin Kullanımı

robots.txt, belirli örüntüleri eşleştirmek için * (herhangi bir karakter dizisi) ve $(URL'nin sonu) gibi özel karakterleri destekler. Örneğin Disallow: /*.pdf$ kuralı, sitenizdeki tüm PDF dosyalarının taranmasını engeller. Bu joker karakterler güçlü bir esneklik sunsa da, yanlış kullanıldığında beklenenden çok daha geniş bir URL kümesini yanlışlıkla engelleyebilir. Karmaşık örüntüler içeren kuralları canlıya almadan önce mutlaka bu araçla birkaç örnek URL üzerinde test etmenizi öneririz.

Değişikliklerin Etkisinin Gecikmesi

robots.txt dosyanızda bir değişiklik yaptığınızda, bu değişikliğin etkisi anında görünmez — Google, dosyayı periyodik olarak yeniden kontrol eder ve genellikle 24 saat içinde günceller, ancak bu süre sitenizin tarama sıklığına göre değişebilir. Acil bir düzeltme yaptıysanız (örneğin yanlışlıkla eklenen bir "Disallow: /" satırını kaldırdıysanız), Google Search Console üzerinden robots.txt dosyasının yeniden kontrol edilmesini talep ederek bu süreci hızlandırabilirsiniz.

Konuyla ilgili daha fazla bilgi için Googlebot Nedir? yazımıza göz atabilirsiniz.

Sıkça Sorulan Sorular

robots.txt nedir?

Sitenizin kök dizininde yer alan, hangi botların hangi sayfaları/klasörleri tarayabileceğini belirten bir metin dosyasıdır. Arama motoru botları bu dosyayı siteyi taramadan önce kontrol eder.

robots.txt olmayan bir sitede ne olur?

Dosya yoksa botlar varsayılan olarak tüm siteyi taramakta serbesttir; bu araç da bu durumda "izin veriliyor" sonucu döner.

En spesifik kural mı yoksa ilk eşleşen kural mı geçerlidir?

Google'ın robots.txt yorumlama kuralına göre, bir yol için en uzun (en spesifik) eşleşen kural geçerlidir; eşitlik durumunda Allow kuralı Disallow'a göre önceliklidir.

"User-agent: *" ne anlama gelir?

Belirtilmemiş tüm botlar için geçerli genel kural grubunu ifade eder. Belirli bir bot (örn. Googlebot) için ayrı bir grup varsa, o bot için o grup öncelikli olarak uygulanır.

robots.txt ile noindex meta etiketi arasındaki fark nedir?

robots.txt taranmayı (crawling) engeller, noindex ise indekslenmeyi (indexing) engeller. Bir sayfa robots.txt ile engellenmişse Google onun noindex etiketini bile göremez.

Bu araç gerçek Googlebot davranışını mı simüle ediyor?

Evet, aynı robots.txt yorumlama mantığını (en uzun eşleşen kural, Allow/Disallow önceliği) uygular; ancak Google'ın kendi resmi test aracı kesin referans olarak kabul edilir.

Sitemap: satırı ne işe yarıyor?

robots.txt dosyasına eklenen bu satır, botlara sitenizin XML sitemap adresini bildirir; bu araç bulduğu tüm sitemap adreslerini ayrıca listeler.

Farklı botlar için farklı kurallar test edebilir miyim?

Evet, açılır menüden Googlebot, Bingbot, GPTBot veya ClaudeBot gibi belirli botları seçip o bota özel kuralları test edebilirsiniz.

robots.txt dosyamı yanlış yapılandırırsam ne olur?

Yanlışlıkla tüm siteyi (Disallow: /) engellerseniz, arama motorları sitenizi tamamen taramayı bırakabilir — bu ciddi bir SEO hasarına yol açabilir, bu yüzden değişiklik sonrası mutlaka test edilmelidir.

Bu araç size yeterli gelmedi mi?

Stratejiyi kuran da uygulayan da benim — sitenize özel, uçtan uca bir SEO değerlendirmesi için ulaşın.

Ücretsiz SEO Analizi İsteyin

← Tüm Araçlar

WhatsApp'tan yazın