İçeriğe geç
Approvalens

Ücretsiz · kayıt yok

robots.txt Oluşturucu ve Test Aracı

Platformunu seç, dışarıda tutmak istediğin yapay zekâ botlarını işaretle, site haritanı ekle. Dosya sen seçtikçe yazılır; Test sekmesi 16 bot için bir yolun açık mı kapalı mı olduğunu ve kararı hangi satırın verdiğini gösterir. Her şey tarayıcında çalışır.

robots.txt hazırla ya da test et

Ne yapmak istiyorsun?

Platformun

Platformun

Her satıra bir tane, / ile başlayarak. Arama sonuçları ve yönetim sayfaları tipik örnekler.

Her satıra bir tane. WordPress'te /wp-admin/admin-ajax.php açık kalmalı.

Yapay zekâ eğitim botlarını engelle

Model eğitmek için metin toplarlar. Engellemek Google Arama'yı ve AdSense'i etkilemez.

Yapay zekâ arama ve asistan botlarını engelle

ChatGPT, Claude ve Perplexity'de soruları cevaplamak için sayfaları getirirler; çoğu zaman sana link verirler.

Tam adres, her satıra bir tane; örneğin https://ornek.com/sitemap.xml.

robots.txt
# AdSense crawler: everything open (it ignores the * group anyway)
User-agent: Mediapartners-Google
Disallow:

User-agent: *
Disallow: /wp-admin/
Disallow: /?s=
Disallow: /search/
Allow: /wp-admin/admin-ajax.php

robots.txt adıyla sitenin köküne kaydet.

Araç nasıl bir dosya yazıyor?

En fazla üç gruptan oluşan kısa bir dosya: Mediapartners-Google'ı adıyla anan ve Disallow'u boş bir grup (AdSense botu açıkça serbest); dışarıda tutmayı seçtiğin yapay zekâ botları için bir grup; geri kalan herkes için taranmasını istemediğin yolları ve site haritanı içeren * grubu.

Google'ın belgelerine göre Mediapartners-Google * grubunu zaten yok sayıyor; yani ilk grup teknik olarak şart değil. Dosyayı sonradan açan herkes (sen dahil) niyetini net görsün diye ekleniyor.

Test sekmesi nasıl karar veriyor?

Dosyayı Google'ın belgelediği gibi okur: bir bot yalnızca kendisini en özel biçimde anan gruba uyar; grubun içinde en uzun eşleşen kural kazanır; eşitlikte Allow kazanır; * her karakter dizisiyle, $ adresin sonuyla eşleşir. Mediapartners-Google ve AdsBot-Google * grubunu atlar. Yapay zekâ botları tam adlarıyla eşleşir; gpt adlı bir grup GPTBot'a uygulanmaz.

Her bot için sonucu ve kararı veren satırı görürsün. Klasik hatayı yakalamaya genelde bu yeter: botun hiç okumadığı bir gruba yazılmış Allow kuralı.

Yapay zekâ botları: eğitim botu mu, arama botu mu?

Eğitim botları (GPTBot, ClaudeBot, CCBot ile Google-Extended ve Applebot-Extended belirteçleri) model eğitmek için metin toplar. Arama ve asistan botları (OAI-SearchBot, ChatGPT-User, Claude-SearchBot, PerplexityBot) bir soruyu cevaplamak için sayfayı o an getirir ve çoğu zaman sana link verir. İkinci grubu engellersen o cevaplarda görünmezsin.

Google-Extended, Google Arama'yı ya da AdSense'i etkilemez. İçeriğin Gemini modelleri için kullanılıp kullanılmayacağını belirleyen ayrı bir belirteç; engellemek Googlebot'a ve AdSense botuna dokunmaz.

Reklamlı sitelerde sık görülen robots.txt hataları

  • Canlı sitede User-agent: * altında Disallow: / (çoğu zaman test ortamından kalma)
  • /wp-content/ ya da tema klasörlerini engellemek: Google'ın sayfayı çizmek için ihtiyaç duyduğu CSS ve JavaScript gizlenir
  • Tam adres yerine göreli yol yazılmış Sitemap satırı
  • Başında / olmayan kurallar: sandığın yollarla eşleşmez
  • Aynı bot için birden fazla grup yazıp yalnızca sonuncunun geçerli olduğunu sanmak (gruplar birleşir)

Sorular

Sık sorulan sorular

Bu robots.txt AdSense onayı almamı sağlar mı?

Hiçbir dosya bunu sağlamaz. Sağlayabileceği şey, AdSense botunun ve Googlebot'un dışarıda kalmaması; Google bu durumu, sitenin reklam göstermeye hazır olmama nedenlerinden biri olarak sayıyor.

Yapay zekâ botlarını engellemeli miyim?

Onlardan ne istediğine bağlı. Eğitim botlarını engellemek, robots.txt'ye uyan eğitim verilerinden metnini uzak tutar. Arama botlarını engellemek ise sana ziyaretçi gönderebilecek yapay zekâ cevaplarından da çıkarır. Yapay zekâ eğitim botları rehberimiz bu dengeyi anlatıyor.

robots.txt bir sayfayı Google'dan gizler mi?

Taramayı durdurur, dizine eklemeyi değil. Engellenen bir adres, başka sayfalar ona link veriyorsa açıklamasız biçimde arama sonuçlarında görünebilir. Dizinden uzak tutmak için taranabilen sayfaya noindex koy.

Dosya nereye konur?

Alan adının köküne: https://ornek.com/robots.txt. Her alt alan adının ve her protokol-alan adı birleşiminin kendi dosyası olur. Blogger'da Ayarlar, Tarayıcılar ve dizine ekleme, Özel robots.txt bölümünü kullan.

Search Console varken neden burada test edeyim?

Search Console'un robots.txt raporu, Google'ın dosyanın hangi sürümlerini aldığını ve ayrıştırma hatalarını gösterir. Tek bir yolu AdsBot, Mediapartners-Google ya da yapay zekâ botları için test etmez; Test sekmesi tam olarak bunu yapar.

Rehberler

Bu aracı kullanan rehberler

Bu kontrol nerede karşına çıkar ve bulduğu sorunu nasıl düzeltirsin.

Sonraki adım

Burada tek kontrol, raporda tüm site

Bu, 258 kontrolden yalnızca biri. Tam tablo için tüm siteyi tara; ilk 50 sayfa ücretsiz.

İlk 50 sayfa ücretsiz · üyelik yok · kart gerekmez