REHBER № 06SON GÜNCELLEME · 7 DK OKUMA

Teknik

AI botları ve robots.txt: hangisine izin vermeli, hangisini engellemeli?

Yapay zekâ şirketleri web’i farklı amaçlarla tarayan ayrı botlar kullanıyor: biri modeli eğitmek için, biri arama cevaplarında kaynak göstermek için, biri de kullanıcı bir linki açtırdığında. Hepsini tek kalemde engellemek, istemeden yapay zekâ aramasından da çıkmak demek olabilir.

Hazırlayan: Vextoo Geo Agency Ekibi · Son güncelleme:

✳ Kısa cevap

Yapay zekâ cevaplarında görünmek istiyorsanız arama/atıf botlarına izin verin: OAI-SearchBot (ChatGPT arama)[1], Claude-SearchBot (Claude)[2], PerplexityBot (Perplexity)[3], Bingbot (Copilot) ve Googlebot (AI Overviews). Eğitim botları (GPTBot, ClaudeBot, Google-Extended[4], meta-externalagent[5], CCBot) ayrı bir karardır; engellemek içeriğinizin model eğitiminde kullanılmasını sınırlar, arama cevaplarındaki görünürlüğü doğrudan kesmez.

Hangi bot ne yapıyor?

BotŞirketAmaçÖnerimiz
OAI-SearchBotOpenAI[1]ChatGPT arama sonuçlarıİzin ver
ChatGPT-UserOpenAIKullanıcı isteğiyle ziyaretİzin ver
GPTBotOpenAIModel eğitimiTercih
Claude-SearchBotAnthropic[2]Claude arama indeksiİzin ver
Claude-UserAnthropicKullanıcı isteğiyle ziyaretİzin ver
ClaudeBotAnthropicModel eğitimiTercih
PerplexityBotPerplexity[3]Perplexity arama indeksiİzin ver
Perplexity-UserPerplexityKullanıcı isteğiyle ziyaretİzin ver
GooglebotGoogleArama + AI Overviews / AI Modeİzin ver
Google-ExtendedGoogle[4]Gemini eğitimi ve Gemini uygulamalarında groundingTercih
BingbotMicrosoftBing indeksi → Copilotİzin ver
meta-webindexerMeta[5]Meta AI arama kalitesiİzin ver
meta-externalagentMetaEğitim / doğrudan indekslemeTercih
CCBotCommon CrawlAçık web arşivi (birçok modelin eğitim verisi)Tercih

Örnek robots.txt

Arama ve atıf botlarına açık, eğitim botlarına kapalı bir yapılandırma örneği (kendi tercihinize göre düzenleyin):

# Arama ve atıf botları: serbest
User-agent: OAI-SearchBot
User-agent: ChatGPT-User
User-agent: Claude-SearchBot
User-agent: Claude-User
User-agent: PerplexityBot
User-agent: meta-webindexer
Allow: /

# Model eğitimi botları: kapalı (tercihe bağlı)
User-agent: GPTBot
User-agent: ClaudeBot
User-agent: Google-Extended
User-agent: meta-externalagent
User-agent: CCBot
Disallow: /

# Diğer her şey
User-agent: *
Allow: /
Disallow: /panel/

Sitemap: https://ornek.com/sitemap.xml

Bu sitenin kendi dosyası tüm yapay zekâ botlarına açıktır: robots.txt. Çünkü amacımız alıntılanmak.

robots.txt temiz ama bot yine de giremiyor olabilir

  • CDN / güvenlik duvarı: Cloudflare gibi sağlayıcıların “AI botlarını engelle” ayarları ve bot yönetimi kuralları robots.txt’den bağımsız çalışır. Panelinizi kontrol edin.
  • JavaScript’e bağımlı içerik: Bot sayfaya girse de metin JavaScript ile yükleniyorsa çoğu zaman boş bir sayfa görür.
  • Giriş duvarı ve çerez bariyeri: İçeriği tamamen örten açılır pencereler ayrıştırmayı bozabilir.
  • Sahte bot trafiği: Kötü niyetli tarayıcılar bu adları taklit edebilir; OpenAI ve Perplexity gibi şirketler doğrulama için IP aralıklarını yayımlıyor[1][3].

Tümünü saniyeler içinde kontrol etmek için: GEO Hazırlık Testi.

Sıkça sorulan sorular

01GPTBot’u engellemeli miyim?

Bu bir tercih meselesidir. GPTBot model eğitimi içindir; OpenAI’ye göre ChatGPT arama görünürlüğünü OAI-SearchBot belirler. İçeriğinizin eğitimde kullanılmasını istemiyorsanız GPTBot’u engelleyip OAI-SearchBot’a izin verebilirsiniz.

02Yapay zekâ botlarının siteme girip girmediğini nasıl anlarım?

Sunucu erişim kayıtlarında kullanıcı aracısı (user-agent) adlarını arayın ve şüpheli trafiği şirketlerin yayımladığı IP aralıklarıyla doğrulayın. Hızlı bir robots.txt ve erişim kontrolü için GEO Hazırlık Testi’ni kullanabilirsiniz.

03robots.txt kullanıcı isteğiyle gelen botları engeller mi?

Her zaman değil. OpenAI, ChatGPT-User için robots.txt kurallarının uygulanmayabileceğini; Perplexity, Perplexity-User’ın robots.txt’i genellikle dikkate almadığını belirtiyor. Anthropic ise Claude-User dahil üç botunun da robots.txt’e uyduğunu söylüyor.

Kaynaklar

  1. OpenAI — Overview of OpenAI crawlers · erişim 27 Eylül 2026
  2. Anthropic — Claude crawlers and robots.txt · erişim 27 Eylül 2026
  3. Perplexity — Perplexity Crawlers · erişim 27 Eylül 2026
  4. Google — Google’s common crawlers (Google-Extended) · erişim 27 Eylül 2026
  5. Meta — Meta Web Crawlers · erişim 27 Eylül 2026

Sıradaki adım

Markanız yapay zekâ cevaplarının neresinde?

Ücretsiz ön taramada markanızın 6 yapay zekâ motorundaki mevcut durumunu çıkarır, 48 saat içinde dönüş yaparız.