Robots.txt Dosyasının Doğru Yapılandırılması Rehberi
Arama motoru optimizasyonu dünyasında, teknik altyapının önemi sıklıkla içerik stratejilerinin gölgesinde kalır. Oysa bir web sitesinin arama motorları tarafından nasıl tarandığı, dizine eklenme sürecinin ilk ve en belirleyici adımıdır. Bu sürecin kontrol merkezlerinden biri de, sitenizin kök dizininde yer alan küçük ama son derece güçlü bir metin dosyasıdır: robots.txt. Arama motoru botlarının sitenize geldiğinde ilk baktığı yer olan bu dosya, hangi sayfaların taranabileceğini, hangi kaynaklara erişilemeyeceğini ve site haritanızın nerede bulunduğunu botlara bildirir.
robots.txt dosyasının doğru yapılandırılması, yalnızca teknik SEO’nun bir gerekliliği değil, aynı zamanda tarama bütçenizin verimli kullanılması için belirleyici bir faktördür. Yanlış yapılandırılmış bir robots.txt dosyası, en değerli sayfalarınızın arama sonuçlarından tamamen kaybolmasına yol açabilir. Ne yazık ki, bu kritik dosyada yapılan hatalar çoğu zaman fark edilmez ve sitenin organik görünürlüğü aylar boyunca sessizce zarar görür.
Tam da bu noktada, SEO uzmanlarının ve web yöneticilerinin robots.txt dosyasının inceliklerine hâkim olması, olası felaketleri önlemenin anahtarıdır. Bu rehberde, robots.txt dosyasının ne olduğundan başlayarak, adım adım doğru yapılandırma yöntemlerini, sık yapılan hataları, en iyi uygulamaları ve test etme süreçlerini kapsamlı biçimde ele alacağız.
Hızlı Cevap
![]()
robots.txt dosyasının doğru yapılandırılması için dosyayı sitenizin kök dizinine yerleştirin, user-agent ve disallow/allow direktiflerini doğru söz dizimiyle yazın, önemli sayfaları yanlışlıkla engellemediğinizden emin olun ve sitemap bağlantısını dosyaya ekleyin. Dosyanızı Google Search Console’daki robots.txt test aracıyla mutlaka doğrulayın.
Robots.txt Dosyası Nedir ve Nasıl Çalışır?
![]()
Robots.txt, web sitenizin kök dizininde bulunan ve arama motoru botlarının siteyi nasıl tarayacağını belirleyen düz metin biçimli bir dosyadır. Robot Hariç Tutma Standardı olarak da bilinen bu protokol, 1994 yılında Martijn Koster tarafından önerilmiş ve günümüzde neredeyse tüm arama motorları tarafından gönüllü olarak uygulanmaktadır. Botlar bir siteyi ziyaret ettiğinde ilk olarak robots.txt dosyasını arar ve buradaki talimatlara göre tarama davranışlarını şekillendirir.
Robots.txt dosyası bir güvenlik duvarı değildir. Yani bir sayfayı robots.txt ile engellemek, o sayfanın dizine eklenmeyeceğini garanti etmez. Sayfa başka bir yerden bağlantı almışsa, arama motoru o sayfayı dizine ekleyebilir ancak içeriğini tarayamaz. Bu kritik ayrım, özellikle hassas içeriklerin korunması söz konusu olduğunda yanlış anlaşılmalara yol açar. Sayfaların dizine eklenmesini engellemek için meta robots etiketi veya X-Robots-Tag HTTP başlığı kullanılmalıdır.
Dosyanın çalışma prensibi oldukça basittir. Her bir arama motoru botu için ayrı ayrı kurallar tanımlanabilir, tüm botları kapsayan genel kurallar belirlenebilir veya belirli dizinler için özel izinler verilebilir. Bu esneklik, site sahiplerine tarama süreci üzerinde hassas bir kontrol imkânı sunar. Özellikle büyük ölçekli sitelerde tarama bütçesinin doğru yönetilmesi, robots.txt dosyasının stratejik kullanımıyla mümkün olur.
Robots.txt Dosyasının Doğru Yapılandırılması İçin Temel Kurallar
![]()
robots.txt dosyasının doğru yapılandırılması, belirli söz dizimi kurallarına uymayı ve mantıksal bir yapı kurmayı gerektirir. Bu kurallar görünüşte basit olsa da, uygulamada yapılan küçük hatalar büyük SEO sorunlarına neden olabilir. Aşağıda yapılandırma sürecinin her bir bileşenini ayrıntılı olarak inceleyeceğiz.
Dosya Konumu ve Erişilebilirlik
Robots.txt dosyası mutlaka sitenin kök dizininde, yani example.com/robots.txt adresinde erişilebilir olmalıdır. Alt dizinlerde veya alt alan adlarında ayrı robots.txt dosyaları tanımlanamaz. Her alt alan adı kendi kök dizininde kendi robots.txt dosyasına sahip olmalıdır. Örneğin, blog.example.com için robots.txt dosyası blog.example.com/robots.txt adresinde bulunmalıdır. Dosyanın UTF-8 kodlamasıyla kaydedilmesi ve botlar tarafından erişilebilir durumda olması hayati önem taşır. Eğer robots.txt dosyasına erişilemiyorsa veya sunucu 500 hatası veriyorsa, botlar genellikle siteyi taramaya devam eder ancak bu durum tarama bütçesinin verimsiz kullanılmasına yol açabilir.
Söz Dizimi Kuralları
Robots.txt dosyasının söz dizimi katı kurallara tabidir. Her direktif ayrı bir satırda yazılmalıdır. User-agent tanımlaması, kuralların hangi bota uygulanacağını belirtir ve her kural grubu bir user-agent satırıyla başlar. Disallow direktifi, belirtilen yolun taranmasını engellerken, Allow direktifi ise daha geniş bir Disallow kuralı içinde istisna oluşturmak için kullanılır. Yorum satırları # işaretiyle başlar ve botlar tarafından dikkate alınmaz. Sitemap direktifi ise XML site haritasının konumunu bildirir. Direktifler arasında boş satır bırakılarak farklı botlar için kural grupları birbirinden ayrılır.
User-agent Tanımlamaları
Her büyük arama motorunun kendine özgü bir bot adı bulunur. Google için Googlebot, Bing için Bingbot, Yandex için YandexBot kullanılır. Tüm botları kapsamak için yıldız işareti (*) kullanılarak genel kurallar tanımlanır. Örneğin, User-agent: * ifadesi, özel bir kural tanımlanmamış tüm botlar için geçerli olacak kuralları belirler. Belirli bir bot için özel kurallar tanımlandığında, o bot genel kuralları değil, kendisi için tanımlanan kuralları takip eder. Bu nedenle, robots.txt dosyasını yapılandırırken en spesifik bot kurallarını dosyanın üst kısmına, genel kuralları ise alt kısma yerleştirmek iyi bir uygulamadır.
Disallow ve Allow Direktifleri
Disallow direktifi, botların belirli bir yolu veya dizini taramasını engeller. Örneğin, Disallow: /admin/ ifadesi, /admin/ dizini ve altındaki tüm dosyaların taranmasını engeller. Disallow: / ifadesi ise tüm siteyi taramayı engeller ve son derece dikkatli kullanılmalıdır. Allow direktifi, Disallow ile engellenen bir yol içinde belirli bir alt yola izin vermek için kullanılır. Örneğin, Disallow: /resimler/ ve Allow: /resimler/genel/ kuralları, /resimler/ dizinini engellerken /resimler/genel/ dizinine erişime izin verir. Bu direktifler sıralı olarak değerlendirilir ve en spesifik kural öncelik kazanır. Yol belirtirken büyük/küçük harf duyarlılığına dikkat edilmelidir, çünkü Linux sunucularda /Dizin/ ve /dizin/ farklı yollar olarak değerlendirilir.
Robots.txt Dosyasında Sık Yapılan Hatalar ve SEO’ya Etkileri
![]()
Robots.txt yapılandırması sırasında yapılan hatalar, organik trafik kaybından dizin temizliğine kadar uzanan ciddi sonuçlar doğurabilir. Bu hataların farkında olmak ve bunlardan kaçınmak, SEO performansınızı korumanız için kritik öneme sahiptir.
Tüm Siteyi Yanlışlıkla Engellemek
En yıkıcı hatalardan biri, Disallow: / direktifiyle tüm sitenin taramaya kapatılmasıdır. Bu hata genellikle geliştirme ortamından canlı siteye geçiş sırasında robots.txt dosyasının güncellenmemesinden kaynaklanır. Sonuç olarak arama motorları sitenizi tamamen taramayı durdurur ve tüm sayfalarınız zamanla dizinden düşer. Bu durumun fark edilmesi ve düzeltilmesi haftalar alabilir ve organik trafiğiniz neredeyse sıfırlanabilir. Geliştirme aşamasında tüm siteyi engellemek için kullanılan bu direktifin, site yayına alınmadan önce kaldırıldığından emin olunmalıdır.
Önemli Kaynakları Engellemek
CSS, JavaScript ve resim dosyalarının yanlışlıkla engellenmesi, arama motorlarının sayfalarınızı doğru şekilde işleyememesine neden olur. Googlebot’un sayfaları tam olarak render edebilmesi için bu kaynaklara erişebilmesi gerekir. Özellikle JavaScript ile oluşturulan içerikler söz konusu olduğunda, JS dosyalarının engellenmesi içeriğin hiç görülememesine yol açabilir. Benzer şekilde, CSS dosyalarının engellenmesi sayfa düzeninin anlaşılamamasına ve mobil uyumluluk değerlendirmelerinde sorun yaşanmasına neden olur. Google, önemli kaynakların taranabilir olmasını önerir ve bu kaynakları engellemenin sıralama üzerinde olumsuz etkileri olabileceğini belirtir.
Büyük/Küçük Harf Duyarlılığı
Robots.txt dosyasında belirtilen yollar büyük/küçük harfe duyarlıdır. Örneğin, Disallow: /Admin/ kuralı yalnızca tam olarak /Admin/ yolunu engeller; /admin/ yoluna erişime izin verir. Bu durum, özellikle Windows sunucularda geliştirme yapıp Linux sunucuya geçiş yapıldığında beklenmedik sorunlara yol açar. Dosyada belirtilen yolların, sunucu dosya sistemindeki gerçek yol adlarıyla birebir eşleştiğinden emin olunmalıdır.
Sitemap URL’sini Yanlış Belirtmek
Sitemap direktifi, XML site haritanızın tam URL’sini belirtmek için kullanılır. Bu URL’nin yanlış yazılması, botların site haritanızı bulamamasına neden olur. Sitemap direktifi mutlak URL olarak belirtilmeli ve dosyanın robots.txt ile aynı alan adında yer alması gerekir. Ayrıca, sitemap URL’sinin robots.txt dosyasında belirtilmesi, site haritasının keşfedilme hızını artırsa da, Google Search Console üzerinden de site haritası gönderimi yapılması önerilir.
Robots.txt ve Meta Robots Etiketi Arasındaki Fark
![]()
SEO dünyasında sıkça karıştırılan iki kavram olan robots.txt ve meta robots etiketi, aslında birbirini tamamlayan ancak farklı amaçlara hizmet eden araçlardır. Robots.txt dosyası, botların sayfaları taramasını kontrol ederken; meta robots etiketi, sayfaların dizine eklenmesini ve bağlantıların takip edilmesini yönetir. Bu temel fark, doğru stratejinin belirlenmesinde belirleyicidir.
Bir sayfayı robots.txt ile engellediğinizde, bot o sayfayı taramaz ancak sayfa başka kaynaklardan bağlantı almışsa dizine eklenebilir. Sayfanın dizine eklenmesini tamamen engellemek istiyorsanız, meta robots etiketinde noindex direktifini kullanmalısınız. Öte yandan, bir sayfayı robots.txt ile engellemeden yalnızca noindex eklerseniz, bot sayfayı tarar ancak dizine eklemez. İki yöntemin birlikte kullanımı ise etkisizdir; çünkü robots.txt ile engellenen bir sayfayı bot tarayamayacağı için meta robots etiketini de göremez.
Doğru strateji, taranmasını istemediğiniz ancak dizine eklenmesinde sakınca görmediğiniz sayfalar için robots.txt kullanmak; taranmasına izin verip dizine eklenmesini istemediğiniz sayfalar için ise meta robots noindex kullanmaktır. Örneğin, site içi arama sonuç sayfaları genellikle her iki yöntemle de kontrol edilir; taranmaları robots.txt ile sınırlandırılırken, dizine eklenmeleri noindex ile engellenir.
Robots.txt Dosyasının SEO Açısından En İyi Uygulamaları
![]()
SEO performansınızı en üst düzeye çıkarmak için robots.txt dosyasını stratejik bir araç olarak kullanmanız gerekir. En iyi uygulamalar, yalnızca hatalardan kaçınmayı değil, aynı zamanda tarama bütçesini optimize etmeyi de hedefler.
Öncelikle, her site için bir robots.txt dosyası oluşturulmalıdır. Boş bir robots.txt dosyası bile hiç olmamasından iyidir, çünkü dosyanın bulunmaması sunucu loglarında gereksiz 404 hatalarına yol açar. Dosyada mutlaka XML site haritanızın URL’si belirtilmelidir. Bu, botların sitenizin yapısını daha hızlı kavramasına yardımcı olur.
Tarama bütçesini korumak için gereksiz sayfaların taranması engellenmelidir. Yönetici panelleri, oturum açma sayfaları, alışveriş sepeti sayfaları, site içi arama sonuçları ve yazıcı dostu sayfalar gibi SEO değeri taşımayan bölümler robots.txt ile kapatılabilir. Ancak bu engellemeleri yaparken çok dikkatli olunmalı ve yanlışlıkla önemli sayfaların engellenmediğinden emin olunmalıdır. Engelleme kurallarınızı düzenli aralıklarla gözden geçirmek ve test etmek, olası sorunları erkenden tespit etmenizi sağlar.
Ayrıca, her büyük arama motoru için ayrı kurallar tanımlamak yerine, genel kurallarla başlayıp yalnızca gerekli durumlarda spesifik bot kuralları eklemek daha temiz bir yapı sunar. Crawl-delay direktifi, tarama hızını sınırlamak için kullanılabilir ancak Google bu direktifi resmi olarak desteklemez. Google için tarama hızı ayarları Search Console üzerinden yapılmalıdır.
Robots.txt Dosyasını Test Etme ve Doğrulama
![]()
robots.txt dosyasının doğru yapılandırılması kadar, bu yapılandırmanın beklendiği gibi çalıştığından emin olmak da önemlidir. Neyse ki, Google ve diğer arama motorları bu süreci kolaylaştıran test araçları sunar.
Google Search Console bünyesindeki robots.txt test aracı, dosyanızı satır satır analiz ederek söz dizimi hatalarını ve mantıksal tutarsızlıkları tespit eder. Bu araç sayesinde belirli bir URL’nin Googlebot tarafından taranıp taranamayacağını test edebilir, farklı bot türleri için ayrı ayrı simülasyon yapabilirsiniz. Test aracı ayrıca, dosyanızda yaptığınız değişiklikleri canlıya almadan önce önizlemenize olanak tanır. Bu özellik, özellikle kritik değişiklikler söz konusu olduğunda hayat kurtarıcıdır.
Test sürecinde dikkat edilmesi gereken başlıca noktalar şunlardır: Tüm önemli sayfalarınızın taranabilir olduğundan emin olun, engellemek istediğiniz dizinlerin doğru şekilde kapatıldığını doğrulayın, sitemap URL’sinin geçerli ve erişilebilir olduğunu kontrol edin, ve farklı user-agent’lar için kuralların beklendiği gibi çalıştığını test edin. Ayrıca, robots.txt dosyanızın boyutunun 500 kilobaytı aşmadığından emin olun; Google bu sınırın üzerindeki dosyaları kısmen işler ve bu durum beklenmedik tarama davranışlarına yol açabilir.
Manuel test için, tarayıcınızdan example.com/robots.txt adresine giderek dosyanın doğru içerikle yüklendiğini görebilirsiniz. Ancak unutmayın ki bu yöntem yalnızca dosyanın varlığını ve temel erişilebilirliğini kontrol eder; söz dizimi hatalarını ve mantıksal sorunları tespit etmek için Search Console aracını kullanmanız şarttır.
Sıkça Sorulan Sorular
![]()
Robots.txt dosyası olmazsa ne olur?
Robots.txt dosyası bulunmadığında arama motoru botları sitenizi herhangi bir kısıtlama olmadan taramaya devam eder. Bu durum doğrudan bir ceza veya sıralama kaybına yol açmaz ancak tarama bütçesi kontrolsüz kullanılır. Ayrıca sunucu loglarınızda robots.txt için sürekli 404 hataları oluşur. Boş da olsa bir robots.txt dosyası bulundurmak, bu gereksiz hataları önler ve profesyonel bir yaklaşım sergiler.
Robots.txt ile engellenen sayfalar dizine eklenir mi?
Evet, robots.txt ile engellenen sayfalar belirli koşullarda dizine eklenebilir. Eğer sayfa başka sitelerden bağlantı almışsa, Google sayfayı tarayamasa da bu bağlantılar aracılığıyla sayfanın varlığını öğrenir ve dizine ekleyebilir. Ancak içerik taranamadığı için arama sonuçlarında sayfa başlığı ve açıklaması yerine genel bir mesaj görüntülenir. Sayfaların dizine eklenmesini tamamen engellemek için meta robots noindex etiketi kullanılmalıdır.
Robots.txt dosyasına sitemap eklemek zorunlu mu?
Zorunlu değildir ancak şiddetle tavsiye edilir. Sitemap direktifi, botların site haritanızı keşfetmesini hızlandırır ve yeni eklenen sayfaların daha çabuk taranmasını sağlar. Site haritanızı hem robots.txt dosyasında belirtmek hem de Google Search Console üzerinden göndermek, en sağlam yaklaşımdır.
Robots.txt dosyasındaki bir hata ne kadar sürede düzeltilir?
Robots.txt dosyasındaki bir hata düzeltildikten sonra, botların dosyayı yeniden ziyaret etmesi genellikle 24 ila 48 saat sürer. Ancak hatanın etkilerinin tamamen ortadan kalkması, sitenizin büyüklüğüne ve tarama sıklığına bağlı olarak günler hatta haftalar alabilir. Özellikle tüm siteyi engelleyen bir hata söz konusuysa, düzeltme sonrası toparlanma süreci birkaç haftayı bulabilir.
Robots.txt dosyası güvenlik amacıyla kullanılabilir mi?
Hayır, robots.txt bir güvenlik aracı değildir. Dosya herkese açık olduğu için, hangi dizinleri gizlemeye çalıştığınızı potansiyel kötü niyetli kişilere bildirmiş olursunuz. Hassas içeriklerin korunması için sunucu tarafında kimlik doğrulama, IP kısıtlaması veya parola koruması gibi gerçek güvenlik önlemleri kullanılmalıdır.
Robots.txt dosyası SEO sıralamasını doğrudan etkiler mi?
Robots.txt dosyası doğrudan bir sıralama sinyali değildir. Ancak dolaylı olarak büyük etkisi vardır. Yanlış yapılandırılmış bir robots.txt dosyası önemli sayfaların taranmasını engelleyerek dizinden düşmesine, tarama bütçesinin israf edilmesine ve sonuç olarak organik görünürlüğün azalmasına neden olabilir. Bu bakımdan robots.txt dosyasının doğru yapılandırılması, sağlıklı bir SEO stratejisinin temel taşlarından biridir.
Sonuç olarak, robots.txt dosyasının doğru yapılandırılması, teknik SEO’nun göz ardı edilemez bir parçasıdır. Arama motoru botlarının sitenizi verimli şekilde taramasını sağlamak, tarama bütçesini korumak ve olası dizin kayıplarının önüne geçmek için bu küçük dosyaya gereken özen gösterilmelidir. Düzenli testler, güncel tutma ve en iyi uygulamalara bağlı kalma alışkanlığı edindiğinizde, robots.txt dosyası SEO performansınızı sessizce destekleyen güvenilir bir müttefike dönüşecektir.


