llms.txt, /llms.txt adresinde duran düz bir Markdown dosyası: yapay zekâ ajanlarına siten hakkında kısa, seçilmiş bir özet veriyor. Bir başlık, tek paragraflık bir açıklama ve en işe yarar sayfalarına link listeleri. Jeremy Howard tarafından Eylül 2024'te önerildi ve llmstxt.org adresinde açık bir öneri olarak sürdürülüyor. robots.txt gibi bir tarama izni dosyası değil; büyük yapay zekâ şirketlerinin hiçbiri cevaplarında görünmek için gerekli olduğunu söylemiyor. Eklemesi ucuz, onu arayan ajanlar için faydalı; başka önceliklerin varsa atlaman da sorun değil.
Ne işe yarıyor?
Önerinin gerekçesi basit: web sayfaları insanlar için yapılıyor; menü, reklam ve betiklerle sarılı. Bağlam penceresi sınırlı bir ajan ise kısa, uzman elinden çıkmış bir özetle ve temiz metne giden linklerle daha iyi iş çıkarıyor. Belgeye göre llms.txt bilgisi, bir ajan kullanıcıya yardım ederken bir konuda bilgiye ihtiyaç duyduğunda, anlık olarak kullanılıyor. Önerinin sahibi de dosyanın eğitimden çok çıkarım (cevap üretme) sırasında işe yarayacağını beklediğini yazıyor.
Elindeki diğer dosyalarla farkı:
| Dosya | Kime | Amacı |
|---|---|---|
robots.txt |
Botlara | Neyi çekebilecekleri |
sitemap.xml |
Arama motorlarına | Dizine eklenebilecek her adres |
llms.txt |
Yapay zekâ ajanlarına ve asistanlara | Okumaya değer sayfalara linklerle, kısa ve seçilmiş bir site rehberi |
Belge, site haritasının bunun yerini tutmadığını açıkça söylüyor: her şeyi listeliyor, çoğu zaman bir modelin bağlamına sığmayacak kadar uzun ve sayfaların temiz metin sürümlerini göstermiyor.
Biçimi
llmstxt.org belgesine göre, bu sırayla:
- Site ya da proje adını taşıyan bir H1. Zorunlu olan tek kısım bu.
- Kısa bir özet içeren alıntı bloğu (blockquote). Dosyanın gerisini anlamak için gereken temel bilgiler.
- İsteğe bağlı paragraflar ya da listeler (başlık olmadan), daha fazla ayrıntı için.
- İsteğe bağlı H2 bölümleri: her biri bir "dosya listesi". Her madde bir
[ad](url)linki, ardından isteğe bağlı:ve bir not.
## Optional adlı H2'nin özel bir anlamı var: ajanın daha kısa bir bağlam gerektiğinde atlayabileceği linkler.
Çalışan bir örnek
# Karides Defteri
> Tatlı su cüce karidesleri (Neocaridina ve Caridina) için pratik bakım
> rehberleri: su değerleri, akvaryum kurulumu, besleme ve üretim. 2019'dan beri
> tek bir bakıcı tarafından yazılıyor; her rehber kendi akvaryumlarımızda denendi.
Fiyatlar ve ürün linkleri örnektir, sponsor önerisi değildir.
## Buradan başla
- [Neocaridina için su değerleri](https://karidesdefteri.com/su-degerleri): pH, GH, KH ve TDS aralıkları ve gerekçeleri
- [Yeni karides akvaryumunu döngüye sokmak](https://karidesdefteri.com/dongu): haftalık test sonuçlarıyla adım adım
## Bakım rehberleri
- [Karides besleme](https://karidesdefteri.com/besleme): ne, ne kadar, ne sıklıkla
- [Kabuk değiştirme sorunları](https://karidesdefteri.com/kabuk): başarısız kabuk değiştirmenin sebepleri ve çözümleri
## Optional
- [Yazar hakkında](https://karidesdefteri.com/hakkimizda)
- [İletişim](https://karidesdefteri.com/iletisim)
Dosyayı sitenin kökünde düz metin olarak sun. Canlı bir örnek görmek istersen Approvalens kendi dosyasını /llms.txt adresinde yayımlıyor.
Nerede durabilir?
Önerinin 2. sürümü dosyanın kökte (/llms.txt) ya da /docs/llms.txt gibi herhangi bir yolda durmasına izin veriyor; o zaman yalnızca altındaki sayfaları kapsıyor. Birden fazlası geçerliyse ajanların en özel olanı kullanması gerekiyor. Belge ayrıca sayfaların aynı adrese .md eklenmiş Markdown sürümlerini ve bir sayfayı kapsayan llms.txt'yi gösteren rel="describedby" değerli Link başlıklarını öneriyor.
Sık hatalar
| Sorun | Neden oluyor | Çözüm |
|---|---|---|
/llms.txt ana sayfanın HTML'ini ya da 200 dönen bir "bulunamadı" sayfasını veriyor |
CMS ya da çatı bilinmeyen yolları bir sayfaya yönlendiriyor | Gerçek bir dosya sun; yoksa 404 dön |
| İlk satırda H1 yok | Dosya alıntı bloğu ya da listeyle başlıyor | En başa # Site adı yaz |
Linkler göreli (/rehber) |
Site içi menüden kopyalandı | Belgedeki örnekler gibi tam adres kullan |
| Dosya devasa, her yazıyı listeliyor | Site haritasından üretildi | En çok soruyu cevaplayan sayfaları seç; belge dosyanın bağlama sığacak kadar küçük kalmasını istiyor |
| Linkler yönlendirilen, noindex'li ya da silinmiş sayfalara gidiyor | Dosya bir kez yazılıp unutuldu | Önemli sayfa ekleyip çıkardıkça yeniden üret |
Content-Type: text/html ile sunuluyor |
Sunucunun bilinmeyen uzantılar için varsayılanı | text/plain ya da text/markdown olarak sun |
| Yapay zekâ kullanıcı aracılarına robots.txt ya da güvenlik duvarıyla kapalı | Geniş bir bot engeli | Dosyayı çekemeyen ajan onu kullanamaz |
llms.txt ChatGPT'de, Claude'da ya da Google'da görünmene yardım eder mi?
Dürüst cevap: yardım ettiğine dair resmî bir açıklama yok.
- Google, AI Overviews ve AI Mode için bu özelliklerde görünmek amacıyla yeni makine tarafından okunabilir dosyalar, yapay zekâ metin dosyaları ya da işaretleme oluşturmanın gerekmediğini söylüyor (Yapay zekâ özellikleri ve siten).
- OpenAI, Anthropic ve Perplexity botlarını ve robots.txt adlarını belgeliyor (OpenAI, Anthropic, Perplexity). Bot sayfalarında llms.txt'den bir sinyal olarak söz edilmiyor.
- llmstxt.org, binlerce sitenin dosyayı yayımladığını, dokümantasyon platformlarının onu otomatik ürettiğini ve yapay zekâ şirketlerinin kendi geliştirici belgeleri için llms.txt yayımladığını söylüyor. Bu, yayıncıların benimsediğini gösteriyor; bir arama botunun seni ona göre sıraladığını değil.
Yani llms.txt'yi onu okuyan ajanlara, çoğunlukla kodlama asistanlarına ve bir kullanıcı adına siteyi çeken araçlara yapılmış bir incelik olarak gör. Açık bir robots.txt'nin, yapay zekâ arama botlarını geçiren bir güvenlik duvarının ya da HTML'de duran içeriğin yerini tutmuyor. Yapay zekâ araçlarının siteni okuyup okuyamayacağına bunlar karar veriyor; ayrıntılar yapay zekâ botlarına robots.txt izni rehberinde.
Nasıl oluşturulur?
llmstxt.org, dosyayı senin için oluşturan araçları listeliyor: WordPress için Yoast SEO ve AIOSEO eklentileri, ayrıca her Wix sitesi için dosya üreten Wix. Kendi yazdığın bir sitede dosyayı site haritasıyla ya da menüyle aynı veriden üret ki zamanla eskimesin; bizimki de böyle oluşturuluyor.
llms.txt ve AdSense
Ayrı konular. Google'ın belgelerinde llms.txt'yi AdSense'e bağlayan bir şey yok; inceleme sayfalarına, politikalara ve kendi botunun siteye ulaşıp ulaşamadığına bakıyor. AdSense incelemesinin baktığı şeyleri ücretsiz Approvalens taraması kontrol ediyor; tam rapor 20.000 sayfaya kadar tarıyor.
llms.txt'ni kontrol et
Ücretsiz yapay zekâ bot kontrolü /llms.txt dosyanı çekiyor; var olup olmadığını ve llmstxt.org'daki temel biçime uyup uymadığını söylüyor, yapay zekâ botlarının sayfalarına ulaşıp ulaşamadığını da gösteriyor. İsteğimiz bizim sunucumuzdan, benzetilmiş bir kullanıcı aracısıyla gidiyor; IP ile bot doğrulayan bir güvenlik duvarı gerçek ajanlara farklı cevap verebilir.
Sık sorulan sorular
llms.txt bir standart mı?
llmstxt.org'da yayımlanan, herkese açık bir GitHub deposu ve topluluk katkısı olan bir öneri; şu an ikinci sürümünde. robots.txt gibi (RFC 9309) bir IETF ya da W3C standardı değil.
llms.txt ile yapay zekâ eğitimini engelleyebilir miyim?
Hayır. İçinde izin ya da yasak kuralı yok. Bunun için robots.txt'de GPTBot, ClaudeBot, Google-Extended gibi adları kullan.
llms-full.txt nedir?
Bazı sitelerin ve araçların, linklenen sayfaların tam metnini tek dosyada toplamak için kullandığı bir alışkanlık. llmstxt.org'daki temel biçimin parçası değil; adı ve içeriği üreten araca göre değişiyor.
llms.txt olmaması sıralamamı düşürür mü?
Hiçbir arama motorunun belgesinde böyle bir şey yok. Google, yapay zekâ özellikleri için yapay zekâ metin dosyası gerekmediğini söylüyor.
Eskimiş ya da yanlış bir şey mi gördün? Bize yaz, düzeltelim.
Bu rehberi İngilizce oku →Kendi sitende kontrol et. Ücretsiz, kayıt yok.
Bunun için ücretsiz araçlar
Ücretsiz tarama
Kendi siteni kontrol et
Ücretsiz tarama: uygunluk puanı ve tüm sorunlar, genelde birkaç dakikada.