İçeriğe atla
KaynakOl

114 Türk sitesi: AI engellemesinin yarısı görünmüyor

On üç sektörden 114 Türk alan adını 13 yapay zekâ tarayıcısıyla taradık. Engelleyen sitelerin %48’inde engel robots.txt’de görünmüyor.

Mustafa Gezer 7 dk okuma

Türkiye’de ölçülebilen her üç büyük siteden biri en az bir yapay zekâ tarayıcısını engelliyor. Bu engellemenin %48’i robots.txt’de görünmüyor — site "buyurun tarayın" diyor, sunucusu botu kapıdan çeviriyor. Kaynak Ol olarak Eylül 2026’da on üç sektörden 114 Türk alan adını 13 AI tarayıcısıyla taradık; aşağıdaki sayılar o ölçümün sonucu.

Neyi, nasıl ölçtük

Her alan adı için iki şey ayrı ayrı ölçüldü:

  1. Beyan — robots.txt o bota ne diyor.
  2. Gerçek — o botun user-agent’ıyla atılan gerçek bir HTTP isteğine sunucu ne

yanıt veriyor.

İkisi karşılaştırılabilsin diye her siteye ayrıca normal bir tarayıcı user-agent’ıyla referans isteği atıldı. Referans isteği başarısız olan siteler ölçümden çıkarıldı: site zaten ayakta değilken "botu engelliyor" demek yanlış olurdu.

Örneklem114 alan adı, 13 sektör
Ölçülebilen90
Dışlanan24
Kontrol edilen bot13
Ölçüm tarihi21 Eylül 2026

Sonuçlar toplulaştırılmıştır. Hangi sitenin ne yaptığını tek tek yayımlamıyoruz; amaç kimseyi teşhir etmek değil, yaygın bir yapılandırma hatasını ölçmek.

Ana bulgu: engellemenin yarısı sessiz

Ölçülebilen 90 sitenin 29’u en az bir AI tarayıcısını engelliyor. Ama engelin nerede durduğu her şeyi değiştiriyor:

DurumSiteOran
Hiçbir engel yok61%68
Yalnızca robots.txt yasağı11%12
Yalnızca sunucu engeli — robots.txt izin veriyor14%16
Hem robots.txt hem sunucu4%4

Üçüncü satır bu çalışmanın asıl bulgusu. Bu 14 site robots.txt’de AI botlarına açıkça izin veriyor; sunucuları aynı botu 403 ile geri çeviriyor. Engelleyen 29 sitenin 14’ü, yani %48’i, yalnızca robots.txt okuyan bir araçta "sorun yok" görünür.

Türkiye’deki AI bot kontrol araçlarının tamamı — inceleyebildiğimiz kadarıyla — yalnızca beyan katmanını ölçüyor. Bazıları bunu kendi sayfasında sınır olarak yazıyor. Yani bu 14 site, mevcut araçların hiçbiriyle bulunamaz.

Bot bot: kim kapıda kalıyor

BotSağlayıcı amacırobots.txt yasağıSunucu engeliGeçti
BytespiderEğitim verisi%4%13%80
CCBotAçık veri kümesi%3%12%74
GPTBotChatGPT eğitim%8%11%83
ClaudeBotClaude eğitim%9%10%82
meta-externalagentMeta AI%2%8%90
OAI-SearchBotChatGPT arama%4%7%89
ChatGPT-UserCevap anında sayfa çekme%4%7%89
PerplexityBotPerplexity dizini%4%6%90
Claude-SearchBotClaude arama%2%6%92
Perplexity-UserCevap anında sayfa çekme%0%2%96

Burada dikkat çeken şey, en çok engellenenin eğitim botları olması. Bu bir tercih gibi görünebilir — "verimle model eğitilmesin" demek meşru bir karardır. Ama aynı sitelerin çoğunda robots.txt bu tercihi yazmıyor; engel Cloudflare’in bot kategorisi ayarından geliyor ve site sahibinin böyle bir karar verdiğine dair hiçbir iz yok.

Daha önemlisi: cevap üretirken sayfa çeken botlar da engelleniyor. ChatGPT-User ve PerplexityBot, bir kullanıcı soru sorduğu anda sayfanızı okumaya gelir. Bunlar engellendiğinde model sizi eğitim verisinden tanısa bile, cevabın içinde güncel bilgiyle kaynak gösteremez.

Google-Extended ve Applebot-Extended tabloda "sunucu engeli" sütunu taşımıyor, çünkü bunlar tarayıcı değil — yalnızca robots.txt içinde anlamı olan izin belirteçleri. Ayrıntısı AI botlarının tam listesi yazısında.

Sektör: kim karar verdi, kim kaza geçirdi

En açıklayıcı tablo bu. İki sütunu karşılaştırın:

SektörnEngelliSunucu engelirobots.txt kararı
E-ticaret5%60%40%20
Haber ve medya12%50%8%42
Teknoloji ve telekom9%44%33%11
Otomotiv5%40%40%0
Turizm ve ulaşım5%40%40%0
Perakende5%40%40%0
Dijital pazarlama6%33%17%16
Banka ve finans10%30%0%30
Hukuk7%29%29%0
Sağlık5%20%20%0
Kamu7%14%14%0
Eğitim8%13%13%0
Enerji ve sigorta6%0%0%0

Bankalar ve haber siteleri karar vermiş. Banka sektöründe engelin tamamı robots.txt üzerinden: sunucu seviyesinde tek bir AI botu engeli yok. Haber sitelerinde de engelin büyük kısmı beyanda. Bu iki sektörde birisi oturmuş, "AI botları bu içeriği almasın" demiş ve bunu yazmış. Katılırsınız katılmazsınız, ama bu bir karardır.

Otomotiv, turizm, perakende, hukuk, sağlık, kamu ve eğitimde robots.txt kararı sıfır. Bu sektörlerdeki engelin tamamı sunucudan geliyor. Kimse böyle bir karar vermedi; bir güvenlik duvarı ayarı varsayılan hâliyle açık kaldı ve AI tarayıcılarını içine aldı.

Engelin arkasında ne var

Kaydettiğimiz 75 sunucu engeli olayının dağılımı:

SistemEngel olayıPay
Cloudflare45%60
CloudFront18%24
PerimeterX11%15
Diğer1%1

Cloudflare’in "AI Scrapers and Crawlers" engelleme seçeneği, panelde tek bir düğme. Açık olduğunda GPTBot, ClaudeBot, CCBot ve Bytespider’ı kategorik olarak keser — ve bu ayarın açık olduğu, sitenin robots.txt’sine yansımaz. Sessiz çelişkinin en yaygın kaynağı bu.

Dışlanan 24 site ne anlatıyor

Ölçümden çıkardığımız 24 siteyi saklamıyoruz, çünkü kendi başlarına bir bulgu:

Dışlanma sebebiSite
Normal tarayıcıyı da engelledi (Cloudflare)10
SSL sertifikası doğrulanamadı8
Normal tarayıcıyı da engelledi (Akamai)2
Yanıt yok2
Diğer HTTP hatası2

12 site, normal bir tarayıcı user-agent’ını bile geri çevirdi. Bu sitelerde bota özel bir engel olup olmadığını ayıramadığımız için ölçüme almadık. Ama yapay zekâ tarayıcıları da veri merkezlerinden gelir; bir sunucu veri merkezi trafiğini toptan kesiyorsa, AI tarayıcıları da aynı duvara çarpar. Yani gerçek engelleme oranı ölçtüğümüz %32’den yüksek.

Sekiz sitede sertifika doğrulanamadı. Bu AI ile ilgili değil ama aynı kategoride bir sorun: kimsenin bakmadığı, hata mesajı üretmeyen, sessizce zarar veren bir yapılandırma.

Ne yapmalı

Sıra önemli:

  1. Önce ölçün, sonra yorumlayın. robots.txt’nize bakmak yetmez; gerçek istek

atmadan sunucunuzun ne yaptığını bilemezsiniz. Bot erişim kontrolünü çalıştırın — 13 bot, her biri için ham sunucu yanıtı.

  1. Cloudflare kullanıyorsanız bot ayarını açın ve bakın. "AI Scrapers and Crawlers"

seçeneği açıksa, robots.txt’niz ne derse desin engel oradadır.

  1. Kararınızı yazıya dökün. AI botlarını engellemek meşru bir tercih. Ama tercihi

robots.txt’ye yazmak, hem tutarlılık hem de ileride fikrinizi değiştirdiğinizde tek yerden dönebilmek demek. robots.txt ve llms.txt üreticisi 13 bot için doğru kuralları çıkarır.

  1. Eğitim botu ile cevap botunu ayırın. "Modelim eğitilmesin ama cevaplarda kaynak

gösterileyim" tutarlı bir pozisyondur ve teknik olarak mümkündür: GPTBot’u yasaklayıp OAI-SearchBot ve ChatGPT-User’a izin verebilirsiniz.

Katman ayrımının neden bu kadar önemli olduğunu ayrıntılı anlattığımız yazı: robots.txt izin veriyor ama sunucunuz engelliyor.

Veriyi indirin

Toplulaştırılmış ölçümün tamamı makine okunur biçimde yayında. Sayıları kendiniz doğrulayabilir, kendi analizinizde kullanabilirsiniz — kaynak göstermeniz yeterli.

Dosyalarda tek tek alan adı yok; veri sektör ve bot düzeyinde toplulaştırılmıştır.

Bu ölçümün sınırları

Dürüst olmak gerekirse:

  • Örneklem Türkiye’yi temsil etmiyor. Bunlar sektörlerinin tanınan, yüksek trafikli

siteleri. Küçük ve orta ölçekli sitelerde tablo farklı olabilir — muhtemelen daha kötü, çünkü varsayılan ayarlar daha sık dokunulmadan kalır.

  • Tek zaman noktası. 21 Eylül 2026’daki durum. WAF kuralları haftalık değişir.
  • Tek IP. Ölçüm tek bir veri merkezi IP’sinden yapıldı. Cloudflare bilinen AI

tarayıcı IP aralıklarını ayrı değerlendiriyor olabilir; bu durumda gerçek engelleme oranı ölçtüğümüzden düşük olabilir. Ters yönde ise, veri merkezi trafiğini toptan kesen 12 site sayılmadığı için yüksek olabilir. İki etki zıt yönde çalışıyor ve net etkiyi bilmiyoruz.

  • Her site tek sayfa. Ana sayfa ölçüldü; alt dizinlerde farklı kurallar olabilir.

Bu sınırları yazmamızın sebebi basit: ölçmediğimiz bir şeyi ölçmüş gibi sunmak, bu işin tamamını değersizleştirir. Aynı ölçümü kendi sitenizde çalıştırabilirsiniz ve aynı ham kanıtı görürsünüz.

Mustafa GezerSEO ve AI görünürlük denetçisi

Markaların yapay zekâ destekli arama sistemlerindeki görünürlüğünü ölçer ve düzeltir. Ölçüm metodolojisi ham sunucu yanıtına ve tekrarlı çalıştırmaya dayanır; her bulgu kaydedilmiş bir sunucu yanıtına bağlanır.

Sık sorulanlar

Türkiye’de siteler AI botlarını ne oranda engelliyor?

Eylül 2026’da ölçtüğümüz 90 sitenin 29’u, yani %32’si en az bir yapay zekâ tarayıcısını engelliyor. Bunun 15’i robots.txt ile açıkça yasaklamış, 14’ü ise robots.txt’de izin verdiği hâlde sunucu seviyesinde engelliyor.

robots.txt kontrolü yeterli mi?

Hayır. Ölçümümüzde engelleyen 29 sitenin 14’ü, yani %48’i robots.txt’de "izin veriyor" diyor ama gerçek istekte botu geri çeviriyor. Yalnızca robots.txt okuyan bir araç bu sitelerin tamamını "sorun yok" olarak raporlar.

En çok hangi bot engelleniyor?

Sunucu seviyesinde en çok engellenen Bytespider (%13) ve CCBot (%12). ChatGPT’nin tarayıcısı GPTBot %11, Anthropic’in ClaudeBot’u %10 oranında sunucu engeline takılıyor. Cevap üretirken sayfa çeken ChatGPT-User ve PerplexityBot daha az engelleniyor.

Engellemenin arkasında hangi sistem var?

Kaydettiğimiz 75 sunucu engelinin 45’i, yani %60’ı Cloudflare. Ardından CloudFront (18) ve PerimeterX (11) geliyor. Bu engellerin çoğu bilinçli bir karar değil, varsayılan bot koruması ayarının yan etkisi.

İlgili yazılar

Ölçerek başlayın

Bu yazıda anlatılanın sitenizde geçerli olup olmadığını tahmin etmeyin — ölçün. AI Bot Erişim Kontrolü ücretsiz ve ~10 saniye sürüyor.

WhatsApp