Rehber · Teknik
Yapay zekâ tarayıcıları ve teknik erişim: robots.txt, JavaScript ve llms.txt
En iyi içerik bile bota ulaşmıyorsa cevaplarda yer almaz. Teknik erişim üç soruya indirgenebilir: bot sitenize girebiliyor mu, sayfadaki metni okuyabiliyor mu, neyi okuyacağını anlayabiliyor mu? Bu rehber her birini kontrol listesiyle ele alır.
Yapay zekâ botlarının sitenize erişmesi için arama ve cevap botları robots.txt’de engellenmemeli, güvenlik duvarı bu botları durdurmamalı ve önemli içerik sayfanın ilk HTML’inde yer almalıdır; büyük yapay zekâ tarayıcıları JavaScript çalıştırmaz. Eğitim botlarını engellemek ayrı bir iş kararıdır. llms.txt isteğe bağlı bir kolaylıktır, zorunlu değildir.
1. Hangi botlar var ve ne yapıyorlar?
Yapay zekâ şirketleri arama ve cevap, model eğitimi ve kullanıcı istekleri için ayrı botlar kullanıyor. Örnekler, şirketlerin kendi belgelerinden:
| Şirket | Arama ve cevap | Eğitim | Kullanıcı isteği |
|---|---|---|---|
| OpenAI | OAI-SearchBotKaynak 1: Overview of OpenAI crawlers | GPTBotKaynak 1: Overview of OpenAI crawlers | ChatGPT-UserKaynak 1: Overview of OpenAI crawlers |
| Anthropic | Claude-SearchBotKaynak 2: Does Anthropic crawl data from the web, and how can site owners block the crawler? | ClaudeBotKaynak 2: Does Anthropic crawl data from the web, and how can site owners block the crawler? | Claude-UserKaynak 2: Does Anthropic crawl data from the web, and how can site owners block the crawler? |
| Perplexity | PerplexityBotKaynak 3: Perplexity crawlers | — | Perplexity-UserKaynak 3: Perplexity crawlers |
| Googlebot (AI Overviews ve AI Mode dahil) | Google-ExtendedKaynak 4: Google’s common crawlers (Googlebot, Google-Extended) | — | |
| Meta | Meta-WebIndexerKaynak 5: Meta Web Crawlers | Meta-ExternalAgentKaynak 5: Meta Web Crawlers | Meta-ExternalFetcherKaynak 5: Meta Web Crawlers |
Motor bazında ayrıntı yapay zekâ motorları sayfalarında.
2. robots.txt’yi doğru yazın
- Arama ve cevap botlarını engellemeyin; engellenen motorun cevaplarında kaynak gösterilmek zorlaşır. OpenAI, OAI-SearchBot’u engelleyen sitelerin ChatGPT arama cevaplarında gösterilmediğini yazıyorKaynak 1: Overview of OpenAI crawlers.
- Eğitim botları için ayrı karar verin. Arama ve eğitim botları ayrı tanımlandığı için eğitimi kapatıp aramayı açık tutmak mümkünKaynak 1: Overview of OpenAI crawlersKaynak 2: Does Anthropic crawl data from the web, and how can site owners block the crawler?.
- Bir bota özel grup yazdığınızda o bot
User-agent: *grubunu artık okumaz; RFC 9309’a göre eşleşen grup yoksa*grubu uygulanırKaynak 6: RFC 9309: Robots Exclusion Protocol (Eylül 2022). Gizli yolları bota özel gruplara da ekleyin. - Kullanıcı isteği botlarının bir kısmı robots.txt’ye uymayabilir: OpenAI ChatGPT-User için kuralların uygulanmayabileceğiniKaynak 1: Overview of OpenAI crawlers, Perplexity de Perplexity-User’ın genellikle uymadığını yazıyorKaynak 3: Perplexity crawlers.
Sitenizin hangi botlara açık olduğunu AI bot erişim testiyle görebilirsiniz.
3. Güvenlik duvarını kontrol edin
robots.txt izin verse bile güvenlik duvarı ya da bot koruması tanımadığı istekleri engelleyebilir. OpenAI ve Perplexity botlarının IP aralıklarını JSON dosyaları olarak yayımlıyorKaynak 1: Overview of OpenAI crawlersKaynak 3: Perplexity crawlers; izin listesi bu dosyalarla kurulabilir. Sunucu kayıtlarında bu botların 403 ya da 429 alıp almadığına bakın.
4. İçeriği JavaScript’e bağlamayın
Vercel’in 2024 ölçümüne göre büyük yapay zekâ tarayıcıları JavaScript çalıştırmıyorKaynak 7: The rise of the AI crawler (Dec 2024). Google da her botun JavaScript çalıştıramadığını belirterek sunucu tarafında ya da önceden üretilmiş HTML’i öneriyorKaynak 8: Understand JavaScript SEO basics. Kontrol yolu basit: tarayıcıda JavaScript’i kapatıp sayfayı açın; ana metin, fiyatlar ve iletişim bilgileri görünmüyorsa botlar da görmüyor.
5. llms.txt: ekleyin ama beklentiyi doğru kurun
llms.txt, sitenin kök dizinine konan ve yapay zekâ araçlarına sitenin özetini ve önemli sayfalarını Markdown ile veren bir öneridirKaynak 10: The /llms.txt file. Google, yapay zekâ özelliklerinde görünmek için llms.txt ya da özel bir işaretleme gerekmediğini söylüyorKaynak 9: Optimizing your website for generative AI features on Google Search. Maliyeti düşük olduğu için eklenebilir; ama sıralama aracı değildir. Hazırlamak için llms.txt oluşturucuyu kullanabilirsiniz.
Kontrol listesi
- Arama ve cevap botları robots.txt’de izinli.
- Eğitim botları için bilinçli bir karar verilmiş.
- Bota özel gruplarda gizli yollar tekrar yazılmış.
- Güvenlik duvarı bu botları engellemiyor; IP listeleri tanımlı.
- JavaScript kapalıyken ana metin okunuyor.
- Sayfalar
noindexya da gereksiznosnippettaşımıyor. - llms.txt (isteğe bağlı) biçime uygun.
Sıkça sorulan sorular
01Tüm yapay zekâ botlarını engellersem ne olur?
Eğitim botlarıyla birlikte arama ve cevap botlarını da engellerseniz, bu motorların cevaplarında kaynak gösterilmeniz zorlaşır; örneğin OAI-SearchBot’u engelleyen siteler ChatGPT arama cevaplarında gösterilmezKaynak 1: Overview of OpenAI crawlers.
02Google-Extended’ı engellemek aramayı etkiler mi?
Hayır. Google-Extended, Google Arama’ya dahil olmayı ve sıralamayı etkilemez; Gemini modellerinin eğitimi ve Gemini uygulamalarındaki temellendirme için kullanımı yönetirKaynak 4: Google’s common crawlers (Googlebot, Google-Extended).
03Sitemiz React ile yapıldı. Sorun olur mu?
İçerik sunucuda üretiliyorsa sorun yok; yalnızca tarayıcıda JavaScript ile çiziliyorsa yapay zekâ tarayıcıları metni göremeyebilirKaynak 7: The rise of the AI crawler (Dec 2024)Kaynak 8: Understand JavaScript SEO basics. JavaScript’i kapatarak test edin.
Kaynaklar
- [1]Overview of OpenAI crawlersOpenAI · erişim: 26 Eylül 2026
- [2]Does Anthropic crawl data from the web, and how can site owners block the crawler?Anthropic · erişim: 26 Eylül 2026
- [3]Perplexity crawlersPerplexity · erişim: 26 Eylül 2026
- [4]Google’s common crawlers (Googlebot, Google-Extended)Google Search Central · erişim: 26 Eylül 2026
- [5]Meta Web CrawlersMeta for Developers · erişim: 26 Eylül 2026
- [6]RFC 9309: Robots Exclusion Protocol (Eylül 2022)IETF / RFC Editor · erişim: 26 Eylül 2026
- [7]The rise of the AI crawler (Dec 2024)Vercel · erişim: 26 Eylül 2026
- [8]Understand JavaScript SEO basicsGoogle Search Central · erişim: 26 Eylül 2026
- [9]Optimizing your website for generative AI features on Google SearchGoogle Search Central · erişim: 26 Eylül 2026
- [10]The /llms.txt filellmstxt.org · erişim: 26 Eylül 2026
Bu sayfayı nasıl kaynak gösterirsiniz
Kaynaq. (26 Eylül 2026). Yapay zekâ tarayıcıları ve teknik erişim: robots.txt, JavaScript ve llms.txt. https://kaynaq.pages.dev/rehber/yapay-zeka-tarayicilari-ve-teknik-erisim
Güncellemeler ve düzeltmeler
Bu sayfada henüz düzeltme yok. Bir hata görürseniz bize yazın; düzeltmeyi tarihiyle burada yayımlarız.