Kısa cevap: Yapay zeka botları iki farklı türe ayrılır ve bunlara farklı davranmanız gerekir. Eğitim botları — GPTBot, ClaudeBot, Google-Extended — gelecekteki modelleri eğitmek için metin toplar; bunları engellemek yalnızca yarının eğitim verisini etkiler. Getirme botları — OAI-SearchBot, PerplexityBot, ChatGPT-User — kullanıcı soru sorduğu anda sayfanızı canlı çeker; bunları engellemek sizi yapay zeka cevaplarından bugün siler. Hangi görünürlüğü istediğinize karar verin, sonra doğru User-agent kurallarını robots.txt dosyanıza yazın ve canlı bir test aracıyla doğrulayın.

Yapay zeka botu tam olarak nedir

Yapay zeka botu, bir büyük dil modeli şirketi — OpenAI, Anthropic, Perplexity, Google, Apple, Amazon, Meta ve diğerleri — adına web sayfalarını çeken otomatik bir ajandır. Ağ üzerinde geleneksel bir arama botuna neredeyse birebir benzer: bir HTTP isteği gönderir, HTML’inizi okur ve devam eder. Fark, amacındadır. Googlebot, mavi linkleri sıralayan bir arama dizini oluşturmak için sayfanızı çeker. Bir yapay zeka botu ise sayfanızı ya dev bir eğitim havuzuna eklemek için ya da tam şu anda bir kullanıcıya sohbet biçiminde cevap üreten canlı bir modeli beslemek için çeker.

Bu ayrım bu rehberin en önemli fikridir, çünkü "bir botu engellemenin" ne anlama geldiğini değiştirir. Bir eğitim botunu engellerseniz mevcut arama sıralamalarınız hiç değişmez ve kullanıcılar sizi Google’da bulmaya devam eder — yalnızca gelecekteki bir modele katkıda bulunmaktan vazgeçmiş olursunuz. Bir getirme botunu engellerseniz, Google sıralamalarınız hiç bozulmadan ChatGPT ve Perplexity cevaplarından kaybolabilirsiniz. Aynı dosya, aynı sözdizimi, tamamen farklı sonuç. İkisini karıştırırsanız ya korumak istediğiniz eğitim verisini sızdırırsınız ya da istemeden kendinizi hızla büyüyen yapay zeka cevapları dünyasından silersiniz.

İki sütuna bölünmüş bir robots.txt dosyası: bir yanda GPTBot, ClaudeBot, Google-Extended gibi eğitim botları, diğer yanda PerplexityBot ve ChatGPT-User gibi canlı getirme botları için İzin Ver ve Engelle kararları.
Tek robots.txt, iki karar: eğitim botları ile canlı getirme cevap botları.

Eğitim botları ile getirme botları: temel ayrım

Karşılaşacağınız her yapay zeka botu iki kovadan birine girer. Kovaları öğrenmek tek tek isimleri ezberlemekten daha faydalıdır, çünkü sürekli yeni botlar çıkar ve hemen hepsi bu iki tipten biri gibi davranır.

Eğitim botları, modellerin öğrendiği veri kümelerini oluşturmak veya iyileştirmek için büyük ölçekte metin toplar. Kimseye anlık cevap vermezler; bir depoyu doldururlar. Bunları engellemek yalnızca gelecekteki model sürümlerini etkiler — bugün gördüğünüz hiçbir şey değişmez. Bu kovada GPTBot, ClaudeBot, CCBot, Google-Extended, Applebot-Extended, Bytespider, Amazonbot ve Meta-ExternalAgent yer alır.

Getirme botları (canlı getirme, anlık veya cevap botları da denir), bir kullanıcı soru sorduğu anda sayfanızı ister; böylece model içeriğinizin taze, güncel bir sürümünü alıntılayabilir veya özetleyebilir. İşte alıntıya, bağlantıya ve bazen gerçek bir tıklamaya dönüşen trafik budur. Bu kovada OAI-SearchBot, ChatGPT-User, PerplexityBot, Perplexity-User ve Claude-User bulunur.

Ekranınıza yapıştıracağınız cümle şu: eğitim botlarını engellemek içeriğinizi gelecekteki modellerden korur; getirme botlarını engellemek sizi bugün yapay zeka cevaplarından siler. Geniş bir kuralla her şeyi engelleyen yayıncılar çoğu zaman yalnızca ilkini yapmak isterken aslında ikincisini yaptıklarının farkına varmaz. Amacınız üretken arama optimizasyonu — yani yapay zekanın alıntıladığı kaynak olmak — ise getirme botları açık tutmanız gereken botlardır. Onları engellemek, her sayfaya noindex ekleyip Google trafiğinin neden kesildiğine şaşırmanın GEO karşılığıdır.

Aradaki farkı somut bir örnekle düşünün. Diyelim ki bir kullanıcı ChatGPT’ye "en iyi ücretsiz SEO araçları hangileri" diye soruyor. Model cevabı oluştururken OAI-SearchBot ile güncel sayfaları çeker ve en uygun kaynakları alıntılar. Eğer bu botu engellemişseniz, içeriğiniz ne kadar iyi olursa olsun o listede yer alamazsınız — çünkü model sizi o an okuyamaz. Oysa yalnızca GPTBot’u engellemişseniz, bu aynı cevapta hâlâ alıntılanabilirsiniz; sadece bir sonraki model sürümünün eğitim verisine katkıda bulunmamış olursunuz. İşte iki kova arasındaki pratik fark tam olarak budur ve robots.txt’inizi yazarken aklınızda tutmanız gereken tek şeydir.

Bot bot referans listesi

Aşağıda günlüklerinizde görme olasılığınızın en yüksek olduğu botlar, sahiplerine göre gruplanmış pratik bir referans var. Her biri için robots.txt’e yazacağınız tam User-agent ifadesine dikkat edin — bunlar pratikte büyük-küçük harfe duyarlıdır, o yüzden aynen kopyalayın.

OpenAI

  • GPTBoteğitim. Gelecek GPT modelleri için kamuya açık web metnini toplar. User-agent ifadesi: GPTBot.
  • OAI-SearchBotgetirme / keşif. ChatGPT’nin arama özelliğini besler ve cevaplardaki kaynakları öne çıkarır. Ifade: OAI-SearchBot.
  • ChatGPT-Usercanlı kullanıcı eylemi. Bir ChatGPT kullanıcısı (ya da bir GPT/ajan) açıkça istediğinde sayfayı çeker. Ifade: ChatGPT-User.

Anthropic (Claude)

  • ClaudeBoteğitim. Claude modeli eğitimi için kamuya açık içerik toplar. Ifade: ClaudeBot.
  • Claude-Usercanlı kullanıcı eylemi. Bir Claude kullanıcısı belirli bir URL veya konu hakkında soru sorduğunda sayfayı çeker. Ifade: Claude-User.

Perplexity

  • PerplexityBotgetirme / dizinleme. Perplexity’nin cevaplarında alıntılayabilmesi için sayfaları dizinler. Ifade: PerplexityBot.
  • Perplexity-Usercanlı kullanıcı eylemi. Belirli bir kullanıcı sorusunu gerçek zamanlı yanıtlamak için sayfayı çeker. Ifade: Perplexity-User.

Google

  • Google-Extendedeğitim / yapay zeka kullanımı denetimi. Bu ayrı bir bot değil; bir izin ifadesidir. İzin verirseniz Google zaten taranmış içeriğinizi Gemini ve yapay zeka eğitimi için kullanabilir; engellerseniz bu kullanıma katılmazsınız ve bunu Googlebot’un yaptığı normal Google Arama dizinlemesini etkilemeden yaparsınız. Ifade: Google-Extended.

Apple, Amazon, Meta ve Common Crawl

  • Applebot-Extendedeğitim. Apple’ın (Applebot tarafından zaten taranmış) içeriği yapay zeka modelleri için kullanıp kullanamayacağını belirler. Ifade: Applebot-Extended.
  • Amazonbottarama / yapay zeka. Amazon’un botu; kısmen Alexa ve yapay zeka cevaplarını iyileştirmek için kullanılır. Ifade: Amazonbot.
  • Meta-ExternalAgenteğitim. Meta’nın yapay zeka eğitim verisi botu. Ifade: Meta-ExternalAgent.
  • Bytespidereğitim. ByteDance’in (TikTok) botu; büyük ölçüde yapay zeka eğitimiyle ilişkilendirilir. Ifade: Bytespider.
  • CCBoteğitim / veri kümesi. Common Crawl’un botu; kamuya açık arşivi birçok yapay zeka eğitim hattını besler. Ifade: CCBot.

Düzenli olarak yeni ajanlar çıkar, o yüzden bunu değişmez bir liste değil, yaşayan bir liste olarak görün. Erişim günlüklerinizde tanımadığınız bir user-agent belirdiğinde, izin vermeye ya da engellemeye karar vermeden önce sahibini ve amacını araştırın. Bir şeyin gerçek bir bot mu yoksa sahte mi olduğundan emin değilseniz, kaynağa hızlı bir DNS Kayıtları Sorgulama ve isteğin HTTP Başlık Kontrolü kontrolü meşru botu taklitçiden ayırmanıza yardımcı olur.

Robots.txt sözdizimi hatırlatması

Yukarıdaki her şey aynı mütevazı dosyayla yönetilir: alan adınızın kökünde düz metin olarak sunulan robots.txt, örneğin https://example.com/robots.txt. Konunun tamamını istiyorsanız kapsamlı robots.txt rehberimiz baştan sona anlatıyor, ama yapay zeka botları için ihtiyacınız olan kısa sürüm şu.

Bir robots.txt dosyası bir dizi gruptan oluşur. Her grup, botu adlandıran bir veya daha fazla User-agent satırıyla başlar; ardından o bota uygulanan Allow ve Disallow kuralları gelir. Yollar URL yoluna göre eşleştirilir ve * bir joker karakterdir.

  • User-agent: GPTBot — sonraki kuralların uygulanacağı botu adlandırır. Referanstaki tam ifadeyi kullanın.
  • Disallow: / — o user-agent için tüm siteyi engeller.
  • Disallow: (boş) veya Allow: / — her şeyin taranmasına izin verir.
  • Disallow: /private/ — geri kalanı açık bırakırken tek bir klasörü engeller.
  • User-agent: * — kendi grubu olmayan herhangi bir bota uygulanan genel bir gruptur.

İki öncelik kuralı önemlidir. Birincisi, bir bot kendisini adlandıran en özel gruba uyar: GPTBot’un kendi grubu varsa ona uyar ve User-agent: * bloğunu tamamen yok sayar. İkincisi, birden fazla yol kuralı eşleştiğinde en özel (en uzun) kural kazanır ve düzgün davranan bir bot eşitlikleri Allow lehine çözer. İşte bu yüzden geniş bir User-agent: * / Disallow: /, açık tutmak istediğiniz yapay zeka botlarını sessizce yutabilir — yalnızca kendi açık grubu olan botlar bundan kurtulur.

En kritik nokta: robots.txt gönüllüdür. Bir duvar değil, bir ricadır. Saygın operatörler — OpenAI, Anthropic, Google, Perplexity — buna uyar, ama robots.txt hiçbir şeyi zorla uygulatmaz. Bir kilit değil, bir tabela sistemidir. Gerçekten gizli tutmanız gereken her şey kimlik doğrulamanın veya sunucu düzeyinde bir engelin arkasında olmalıdır, asla nazik bir Disallow’un arkasında değil.

Bir ayrıntı daha: Allow ve Disallow satırlarının sırası, düzgün davranan botlar için önemli değildir; önemli olan yolun uzunluğu, yani ne kadar özel olduğudur. Yine de dosyanızı insanlar da okuyacağı için mantıklı bir düzen tutmak faydalıdır: önce adlandırılmış bot grupları, en sonda genel User-agent: * grubu. Ayrıca her grup arasında boş bir satır bırakmak, farklı botlara ait kuralların yanlışlıkla birbirine karışmasını önler. Küçük bir düzen alışkanlığı, ileride hangi bota ne dediğinizi hatırlamanızı çok kolaylaştırır.

Kopyala-yapıştır tarifleri

İşte üç hazır politika. Amacınıza uyanı seçin, robots.txt dosyanıza yapıştırın, yolları uyarlayın ve sonra canlı dosyanıza karşı Robots.txt Test Aracı ile doğrulayın. Kuralları bir formdan derlemeyi tercih ederseniz Robots.txt Oluşturucu sizin için geçerli bir dosya oluşturur.

Tarif A — her şeye izin ver (çoğu yayıncı için önerilir)

Arama ve yapay zeka genelinde maksimum görünürlük istiyorsanız doğru varsayılan budur. Hem eğitim hem getirme botlarını içeri alırsınız ve böylece yapay zeka motorları tarafından alıntılanmaya ve önerilmeye uygun kalırsınız. Aşağıdaki her satır tek bir direktiftir:

  • User-agent: *
  • Allow: /
  • Sitemap: https://example.com/sitemap.xml

Çoğu sitenin ihtiyacı gerçekten bu kadardır. Yapay zeka botlarına izin vermek için her birini adlandırmanız gerekmez — izin verici bir genel grup zaten onları içeri alır. Tek tek adlandırmak yalnızca onlara farklı davranmak istediğinizde önemlidir.

Tarif B — cevap motorlarına izin ver, eğitimi engelle

Yapay zeka cevaplarından gelen trafiği ve alıntıları isteyen, ama arşivinin gelecekteki model eğitimini beslemesini istemeyen yayıncılar için popüler orta yol budur. Getirme botlarına izin verir, eğitim botlarını engellersiniz. Her eğitim botu için bir grup yazın:

  • User-agent: GPTBot ardından Disallow: /
  • User-agent: ClaudeBot ardından Disallow: /
  • User-agent: CCBot ardından Disallow: /
  • User-agent: Google-Extended ardından Disallow: /
  • User-agent: Applebot-Extended ardından Disallow: /
  • User-agent: Bytespider ardından Disallow: /
  • User-agent: Meta-ExternalAgent ardından Disallow: /
  • User-agent: * ardından Allow: /

OAI-SearchBot, ChatGPT-User, PerplexityBot, Perplexity-User ve Claude-User bir Disallow ile adlandırılmadığı için, izin verici User-agent: * grubuna düşer ve canlı cevaplar için sizi çekmeye devam eder. Tüm püf noktası budur: eğitimi isimle engelle, getirmeyi genel gruba bırak.

Tarif C — yapay zekayı tamamen engelle

Bunu yalnızca bilinçli bir nedeniniz varsa kullanın — bir ödeme duvarı, lisans görüşmeleri veya katı bir içerik politikası. Sizi hem yapay zeka eğitiminden hem de yapay zeka cevaplarından çıkarır. Hem eğitim hem getirme botlarını adlandırmanız gerekir, çünkü genel grup tek başına adlandırmadıklarınızı durdurmaz:

  • User-agent: GPTBotDisallow: /
  • User-agent: OAI-SearchBotDisallow: /
  • User-agent: ChatGPT-UserDisallow: /
  • User-agent: ClaudeBotDisallow: /
  • User-agent: Claude-UserDisallow: /
  • User-agent: PerplexityBotDisallow: /
  • User-agent: Perplexity-UserDisallow: /
  • User-agent: Google-ExtendedDisallow: /
  • User-agent: CCBotDisallow: /
  • User-agent: BytespiderDisallow: /

Robots.txt’in gönüllü doğasını unutmayın: bu, uyumlu botları durdurur, kararlı kazıyıcıları değil. İçeriğiniz bir abonelik arkasındaysa bunu yalnızca burada değil, sunucuda zorla uygulatın.

Engellemek GEO’yu neden zedeler — ve dengeler

Tedbir amaçlı yapay zekayla ilgili her şeyi engellemek cazip gelir. Bunu yapmadan önce neyden vazgeçtiğinizi tartın. Yapay zeka cevap motorları gerçek bir keşif kanalına dönüşüyor: insanlar ChatGPT, Perplexity ve Google’ın Yapay Zeka Özetlerinden öneri istiyor ve alıntılanan kaynakları okuyor. Getirme botlarını engellerseniz o konuşmada hiç yoksunuz — onları açık bırakan bir rakip sizin yerinize alıntılanır. Üretken arama optimizasyonunun özü budur ve bunu yapay zeka aramaları için optimizasyon rehberimizle birlikte okumaya değer.

Eğitim sorusu ise her iki tarafta da makul cevapları olan gerçek bir değer kararıdır. Bazı yayıncılar özgün işlerini modellere bedavaya kaptırmamak için eğitimi engeller; bazıları ise eğitim verisinde bulunmanın, canlı bir getirme olmasa bile markalarının modelce "tanınma" ihtimalini artırdığını düşünerek izin verir. İkisi de yanlış değil. Önemli olan, bu seçimi kazara değil bilinçli yapmanızdır. Hata, eğitimi engellemek değildir — eğitimi engellemek isterken getirmeyi engellemek ve sonucunda sessizce yapay zeka cevaplarından kaybolmaktır. Amacınız alıntılanmaksa ChatGPT tarafından alıntılanma rehberimiz, izin verici bir getirme politikasıyla iyi eşleşir.

Botların size gerçekten ulaşabildiğini doğrulama

Robots.txt düzenlemek işin yalnızca yarısıdır. Sonra (a) kurallarınızın düşündüğünüz gibi ayrıştığını ve (b) ulaşması gereken botların tamamen başka bir şey tarafından — bir güvenlik duvarı, bir bot yönetim kuralı, kötü bir yanıt başlığı veya bir DNS sorunu — engellenmediğini doğrulamanız gerekir. Şu kontrolleri sırayla yapın:

  1. Canlı kurallarınızı ayrıştırın. Alan adınızı Robots.txt Test Aracı üzerinden geçirerek adlandırılmış her user-agent’a nasıl davranıldığını görün. Bu, yazım hatalarını, yanlış sıralanmış grupları ve kazara site geneli bir Disallow’u görünürlüğe mal olmadan yakalar.
  2. Sunucu erişim günlüklerinizi okuyun. Gerçek user-agent dizelerini arayın — GPTBot, PerplexityBot, OAI-SearchBot ve arkadaşları. Varlıkları botların sunucunuza ulaştığını kanıtlar; bir düzenlemeden sonra aniden yok olmaları bir kuralın bozulduğunun erken uyarısıdır.
  3. Yanıt başlıklarınızı kontrol edin. Sayfanın 200 OK döndürdüğünü ve gizlice bir noindex başlığı, bir 403 veya botlara yönelik bir yönlendirme döngüsü sunmadığını HTTP Başlık Kontrolü ile doğrulayın. Başlık düzeyinde engelleyen bir sayfa, robots.txt ne kadar dostça olursa olsun alıntılanamaz.
  4. DNS’in temiz çözümlendiğini onaylayın. Bir DNS Kayıtları Sorgulama alan adınızın ve alt alan adlarınızın olması gereken yere işaret ettiğini doğrular; böylece bir bot robots.txt’i okumadan önce eski veya eksik bir kayıt yüzünden geri çevrilmez.
  5. Daha geniş bir sağlık taraması yapın. Kanonik etiketler, meta robots, engellenmiş varlıklar gibi başka hiçbir şeyin hem yapay zeka hem arama için taranabilirliği baltalamadığından emin olmak için hızlı bir Sayfa İçi SEO Denetimi ile bitirin.

Bunları her anlamlı değişiklikten sonra yapın. Bir robots.txt düzenlemesi, site geneli sonuçları olan tek satırlık bir eylemdir; o yüzden iki dakikalık bir doğrulama döngüsü ucuz bir sigortadır.

Bunun llms.txt ile ilişkisi

İnsanlar robots.txt ile daha yeni llms.txt geleneğini sık sık karıştırır, ama bunlar zıt işler yapar. robots.txt erişimi denetler — hangi yapay zeka botunun hangi URL’leri çekebileceğini. llms.txt anlamayı denetler — bir model size ulaştıktan sonra sizi doğru tanımlamasına yardımcı olan, sade dilde bir özettir. Bir botu robots.txt’te engellemek llms.txt’i o bot için anlamsız kılar, çünkü hiçbir şey okumayacaktır; tersine, llms.txt olmadan botlara izin vermek, dağınık HTML’inizi okumalarına ve sizi kötü özetlemelerine yol açabilir. İkisi birlikte çalışır: kapıyı robots.txt ile açın, sonra temiz bir brifingi llms.txt ile verin. Tüm resim için llms.txt rehberimize bakın.

Sık yapılan hatalar

  • Getirmeyi kazara engellemek. Bir numaralı hata: geniş bir Disallow: / veya OAI-SearchBot ya da PerplexityBot’u da kapan aşırı hevesli bir engelleme listesi, yalnızca eğitimi durdurmak isterken sizi yapay zeka cevaplarından siler. İki kovayı her zaman ayırın.
  • User-agent: *’ın adlandırılmış botları kapsadığını varsaymak. Kapsamaz. Kendi grubu olan bir bot genel grubu tamamen yok sayar; bu yüzden * altına koyduğunuz bir kural, GPTBot’un başka yerde özel bir grubu varsa ona ulaşmaz.
  • Robots.txt’e güvenlik olarak güvenmek. Bu, zorla uygulama değil, gönüllü bir yönlendirmedir. Gizli veriyi korumak için asla Disallow’a güvenmeyin — kimlik doğrulama veya sunucu tarafı engelleme kullanın.
  • Joker ve yol kaymaları. Başıboş bir Disallow: /* veya eksik bir bölü işareti amaçlananın çok fazlasını engelleyebilir. Her değişikliği göz kararı değil, test ederek doğrulayın.
  • User-agent ifadelerinde yazım hatası. Gptbot, GPTBot değildir. Yanlış yazılmış bir ifade hiçbir botun eşleşmediği bir grup oluşturur, yani kuralınız sessizce hiçbir şey yapmaz.
  • CSS ve JS’i engellemek. Bir sayfanın oluşturulması için gereken varlıkları engellerseniz hem arama hem yapay zeka botları içeriğinizi yanlış okuyabilir. Kaynak klasörlerini taranabilir tutun.
  • Yeniden doğrulamayı unutmak. Siteler büyüdükçe kurallar kayar. Eski bir engelin kalıcı olmaması için her dağıtımdan sonra Robots.txt Test Aracı’ı yeniden çalıştırın.

Sık sorulan sorular

GPTBot’u engellemek beni ChatGPT cevaplarından çıkarır mı?

Hayır — ve bu en sık görülen karışıklıktır. GPTBot bir eğitim botudur, dolayısıyla onu engellemek içeriğinizi yalnızca gelecekteki model eğitiminin dışında tutar. Canlı ChatGPT cevaplarını oluşturan botlar OAI-SearchBot ve ChatGPT-User’dır. ChatGPT cevaplarında görünmek istiyorsanız GPTBot’u engelleseniz bile bu ikisini açık bırakın.

Google-Extended ile Googlebot arasındaki fark nedir?

Googlebot normal Google Arama dizinlemesi için tarar. Google-Extended ise zaten taranmış içeriğinizi Google’ın Gemini ve yapay zeka eğitimi için kullanıp kullanamayacağını belirleyen ayrı bir izin ifadesidir. Google-Extended’i engellemek, sizi bu yapay zeka kullanımından çıkarırken Googlebot’un sürdürdüğü olağan Arama sıralamalarınıza zarar vermez.

Robots.txt yapay zeka şirketleri için yasal olarak bağlayıcı mı?

Hayır. robots.txt gönüllü bir standarttır. Saygın operatörler ona uyar, ama hiçbir şeyi zorla uygulatmaz ve hukuki bir garanti sunmaz. Gerçekten korumanız gereken içerik için bir Disallow satırına güvenmek yerine kimlik doğrulama veya sunucu düzeyinde erişim denetimi kullanın.

Küçük bir işletme veya blog yapay zeka botlarını engellemeli mi?

Genellikle hayır. Çoğu yayıncı için yapay zeka cevaplarında alıntılanmak ve önerilmek bir tehdit değil, bir fırsattır; bu yüzden Tarif A (her şeye izin ver) mantıklı varsayılandır. Arşivinizi model eğitiminin dışında tutmak için özel bir nedeniniz varsa yalnızca eğitim botlarını (Tarif B) engellemeyi düşünün, ama görünür kalmak için getirme botlarını açık tutun.

Hangi yapay zeka botlarının beni gerçekten ziyaret ettiğini nasıl bilirim?

Sunucu erişim günlüklerinizi okuyun ve GPTBot, ClaudeBot, PerplexityBot ve OAI-SearchBot gibi user-agent dizelerini arayın. Bir isteğin sahte değil gerçek olduğunu onaylamak için kaynağı bir DNS Kayıtları Sorgulama ile çapraz kontrol edin ve sunucunuzun ona döndürdüğü HTTP Başlık Kontrolü’ı inceleyin.

Eğitimi engellersem içeriğim yine de yapay zeka cevaplarında görünebilir mi?

Evet. Eğitim botlarını (örneğin GPTBot veya Google-Extended) engellemek, yalnızca içeriğinizin gelecekteki modelleri eğitmek için kullanılmasını durdurur. Getirme botlarını (OAI-SearchBot, PerplexityBot ve benzerleri) açık bıraktığınız sürece, kullanıcılar soru sorduğunda modeller sayfanızı canlı çekip alıntılamaya devam edebilir. Yani eğitimi engelleyip getirmeyi açık tutarak, arşivinizi korurken yapay zeka cevaplarındaki görünürlüğünüzü koruyabilirsiniz — ki çoğu yayıncı için en dengeli seçim budur.

Yapay zeka botlarına izin vermek sitemi yavaşlatır mı?

Sitelerin büyük çoğunluğu için hayır — yapay zeka botu hacmi normal arama taramasına ve insan trafiğine kıyasla ölçülüdür. Belirli bir agresif bot yük yaratırsa, tüm yapay zeka botlarını kapatmak yerine onu bir Crawl-delay direktifiyle sınırlayabilir veya yalnızca o user-agent’ı engelleyebilirsiniz. Her değişikliği ardından Robots.txt Test Aracı ve hızlı bir Sayfa İçi SEO Denetimi ile doğrulayın.