114 Türk sitesi: AI engellemesinin yarısı görünmüyor
On üç sektörden 114 Türk alan adını 13 yapay zekâ tarayıcısıyla taradık. Engelleyen sitelerin %48’inde engel robots.txt’de görünmüyor.
Türkiye’de ölçülebilen her üç büyük siteden biri en az bir yapay zekâ tarayıcısını engelliyor. Bu engellemenin %48’i robots.txt’de görünmüyor — site "buyurun tarayın" diyor, sunucusu botu kapıdan çeviriyor. Kaynak Ol olarak Eylül 2026’da on üç sektörden 114 Türk alan adını 13 AI tarayıcısıyla taradık; aşağıdaki sayılar o ölçümün sonucu.
Neyi, nasıl ölçtük
Her alan adı için iki şey ayrı ayrı ölçüldü:
- Beyan — robots.txt o bota ne diyor.
- Gerçek — o botun user-agent’ıyla atılan gerçek bir HTTP isteğine sunucu ne
yanıt veriyor.
İkisi karşılaştırılabilsin diye her siteye ayrıca normal bir tarayıcı user-agent’ıyla referans isteği atıldı. Referans isteği başarısız olan siteler ölçümden çıkarıldı: site zaten ayakta değilken "botu engelliyor" demek yanlış olurdu.
| Örneklem | 114 alan adı, 13 sektör |
| Ölçülebilen | 90 |
| Dışlanan | 24 |
| Kontrol edilen bot | 13 |
| Ölçüm tarihi | 21 Eylül 2026 |
Sonuçlar toplulaştırılmıştır. Hangi sitenin ne yaptığını tek tek yayımlamıyoruz; amaç kimseyi teşhir etmek değil, yaygın bir yapılandırma hatasını ölçmek.
Ana bulgu: engellemenin yarısı sessiz
Ölçülebilen 90 sitenin 29’u en az bir AI tarayıcısını engelliyor. Ama engelin nerede durduğu her şeyi değiştiriyor:
| Durum | Site | Oran |
|---|---|---|
| Hiçbir engel yok | 61 | %68 |
| Yalnızca robots.txt yasağı | 11 | %12 |
| Yalnızca sunucu engeli — robots.txt izin veriyor | 14 | %16 |
| Hem robots.txt hem sunucu | 4 | %4 |
Üçüncü satır bu çalışmanın asıl bulgusu. Bu 14 site robots.txt’de AI botlarına açıkça izin veriyor; sunucuları aynı botu 403 ile geri çeviriyor. Engelleyen 29 sitenin 14’ü, yani %48’i, yalnızca robots.txt okuyan bir araçta "sorun yok" görünür.
Türkiye’deki AI bot kontrol araçlarının tamamı — inceleyebildiğimiz kadarıyla — yalnızca beyan katmanını ölçüyor. Bazıları bunu kendi sayfasında sınır olarak yazıyor. Yani bu 14 site, mevcut araçların hiçbiriyle bulunamaz.
Bot bot: kim kapıda kalıyor
| Bot | Sağlayıcı amacı | robots.txt yasağı | Sunucu engeli | Geçti |
|---|---|---|---|---|
| Bytespider | Eğitim verisi | %4 | %13 | %80 |
| CCBot | Açık veri kümesi | %3 | %12 | %74 |
| GPTBot | ChatGPT eğitim | %8 | %11 | %83 |
| ClaudeBot | Claude eğitim | %9 | %10 | %82 |
| meta-externalagent | Meta AI | %2 | %8 | %90 |
| OAI-SearchBot | ChatGPT arama | %4 | %7 | %89 |
| ChatGPT-User | Cevap anında sayfa çekme | %4 | %7 | %89 |
| PerplexityBot | Perplexity dizini | %4 | %6 | %90 |
| Claude-SearchBot | Claude arama | %2 | %6 | %92 |
| Perplexity-User | Cevap anında sayfa çekme | %0 | %2 | %96 |
Burada dikkat çeken şey, en çok engellenenin eğitim botları olması. Bu bir tercih gibi görünebilir — "verimle model eğitilmesin" demek meşru bir karardır. Ama aynı sitelerin çoğunda robots.txt bu tercihi yazmıyor; engel Cloudflare’in bot kategorisi ayarından geliyor ve site sahibinin böyle bir karar verdiğine dair hiçbir iz yok.
Daha önemlisi: cevap üretirken sayfa çeken botlar da engelleniyor. ChatGPT-User ve PerplexityBot, bir kullanıcı soru sorduğu anda sayfanızı okumaya gelir. Bunlar engellendiğinde model sizi eğitim verisinden tanısa bile, cevabın içinde güncel bilgiyle kaynak gösteremez.
Google-Extended ve Applebot-Extended tabloda "sunucu engeli" sütunu taşımıyor, çünkü bunlar tarayıcı değil — yalnızca robots.txt içinde anlamı olan izin belirteçleri. Ayrıntısı AI botlarının tam listesi yazısında.
Sektör: kim karar verdi, kim kaza geçirdi
En açıklayıcı tablo bu. İki sütunu karşılaştırın:
| Sektör | n | Engelli | Sunucu engeli | robots.txt kararı |
|---|---|---|---|---|
| E-ticaret | 5 | %60 | %40 | %20 |
| Haber ve medya | 12 | %50 | %8 | %42 |
| Teknoloji ve telekom | 9 | %44 | %33 | %11 |
| Otomotiv | 5 | %40 | %40 | %0 |
| Turizm ve ulaşım | 5 | %40 | %40 | %0 |
| Perakende | 5 | %40 | %40 | %0 |
| Dijital pazarlama | 6 | %33 | %17 | %16 |
| Banka ve finans | 10 | %30 | %0 | %30 |
| Hukuk | 7 | %29 | %29 | %0 |
| Sağlık | 5 | %20 | %20 | %0 |
| Kamu | 7 | %14 | %14 | %0 |
| Eğitim | 8 | %13 | %13 | %0 |
| Enerji ve sigorta | 6 | %0 | %0 | %0 |
Bankalar ve haber siteleri karar vermiş. Banka sektöründe engelin tamamı robots.txt üzerinden: sunucu seviyesinde tek bir AI botu engeli yok. Haber sitelerinde de engelin büyük kısmı beyanda. Bu iki sektörde birisi oturmuş, "AI botları bu içeriği almasın" demiş ve bunu yazmış. Katılırsınız katılmazsınız, ama bu bir karardır.
Otomotiv, turizm, perakende, hukuk, sağlık, kamu ve eğitimde robots.txt kararı sıfır. Bu sektörlerdeki engelin tamamı sunucudan geliyor. Kimse böyle bir karar vermedi; bir güvenlik duvarı ayarı varsayılan hâliyle açık kaldı ve AI tarayıcılarını içine aldı.
Engelin arkasında ne var
Kaydettiğimiz 75 sunucu engeli olayının dağılımı:
| Sistem | Engel olayı | Pay |
|---|---|---|
| Cloudflare | 45 | %60 |
| CloudFront | 18 | %24 |
| PerimeterX | 11 | %15 |
| Diğer | 1 | %1 |
Cloudflare’in "AI Scrapers and Crawlers" engelleme seçeneği, panelde tek bir düğme. Açık olduğunda GPTBot, ClaudeBot, CCBot ve Bytespider’ı kategorik olarak keser — ve bu ayarın açık olduğu, sitenin robots.txt’sine yansımaz. Sessiz çelişkinin en yaygın kaynağı bu.
Dışlanan 24 site ne anlatıyor
Ölçümden çıkardığımız 24 siteyi saklamıyoruz, çünkü kendi başlarına bir bulgu:
| Dışlanma sebebi | Site |
|---|---|
| Normal tarayıcıyı da engelledi (Cloudflare) | 10 |
| SSL sertifikası doğrulanamadı | 8 |
| Normal tarayıcıyı da engelledi (Akamai) | 2 |
| Yanıt yok | 2 |
| Diğer HTTP hatası | 2 |
12 site, normal bir tarayıcı user-agent’ını bile geri çevirdi. Bu sitelerde bota özel bir engel olup olmadığını ayıramadığımız için ölçüme almadık. Ama yapay zekâ tarayıcıları da veri merkezlerinden gelir; bir sunucu veri merkezi trafiğini toptan kesiyorsa, AI tarayıcıları da aynı duvara çarpar. Yani gerçek engelleme oranı ölçtüğümüz %32’den yüksek.
Sekiz sitede sertifika doğrulanamadı. Bu AI ile ilgili değil ama aynı kategoride bir sorun: kimsenin bakmadığı, hata mesajı üretmeyen, sessizce zarar veren bir yapılandırma.
Ne yapmalı
Sıra önemli:
- Önce ölçün, sonra yorumlayın. robots.txt’nize bakmak yetmez; gerçek istek
atmadan sunucunuzun ne yaptığını bilemezsiniz. Bot erişim kontrolünü çalıştırın — 13 bot, her biri için ham sunucu yanıtı.
- Cloudflare kullanıyorsanız bot ayarını açın ve bakın. "AI Scrapers and Crawlers"
seçeneği açıksa, robots.txt’niz ne derse desin engel oradadır.
- Kararınızı yazıya dökün. AI botlarını engellemek meşru bir tercih. Ama tercihi
robots.txt’ye yazmak, hem tutarlılık hem de ileride fikrinizi değiştirdiğinizde tek yerden dönebilmek demek. robots.txt ve llms.txt üreticisi 13 bot için doğru kuralları çıkarır.
- Eğitim botu ile cevap botunu ayırın. "Modelim eğitilmesin ama cevaplarda kaynak
gösterileyim" tutarlı bir pozisyondur ve teknik olarak mümkündür: GPTBot’u yasaklayıp OAI-SearchBot ve ChatGPT-User’a izin verebilirsiniz.
Katman ayrımının neden bu kadar önemli olduğunu ayrıntılı anlattığımız yazı: robots.txt izin veriyor ama sunucunuz engelliyor.
Veriyi indirin
Toplulaştırılmış ölçümün tamamı makine okunur biçimde yayında. Sayıları kendiniz doğrulayabilir, kendi analizinizde kullanabilirsiniz — kaynak göstermeniz yeterli.
- Tam ölçüm özeti (JSON) — yöntem, kapsam, sınırlar dahil
- Bot düzeyi tablo (CSV)
- Sektör düzeyi tablo (CSV)
Dosyalarda tek tek alan adı yok; veri sektör ve bot düzeyinde toplulaştırılmıştır.
Bu ölçümün sınırları
Dürüst olmak gerekirse:
- Örneklem Türkiye’yi temsil etmiyor. Bunlar sektörlerinin tanınan, yüksek trafikli
siteleri. Küçük ve orta ölçekli sitelerde tablo farklı olabilir — muhtemelen daha kötü, çünkü varsayılan ayarlar daha sık dokunulmadan kalır.
- Tek zaman noktası. 21 Eylül 2026’daki durum. WAF kuralları haftalık değişir.
- Tek IP. Ölçüm tek bir veri merkezi IP’sinden yapıldı. Cloudflare bilinen AI
tarayıcı IP aralıklarını ayrı değerlendiriyor olabilir; bu durumda gerçek engelleme oranı ölçtüğümüzden düşük olabilir. Ters yönde ise, veri merkezi trafiğini toptan kesen 12 site sayılmadığı için yüksek olabilir. İki etki zıt yönde çalışıyor ve net etkiyi bilmiyoruz.
- Her site tek sayfa. Ana sayfa ölçüldü; alt dizinlerde farklı kurallar olabilir.
Bu sınırları yazmamızın sebebi basit: ölçmediğimiz bir şeyi ölçmüş gibi sunmak, bu işin tamamını değersizleştirir. Aynı ölçümü kendi sitenizde çalıştırabilirsiniz ve aynı ham kanıtı görürsünüz.
Markaların yapay zekâ destekli arama sistemlerindeki görünürlüğünü ölçer ve düzeltir. Ölçüm metodolojisi ham sunucu yanıtına ve tekrarlı çalıştırmaya dayanır; her bulgu kaydedilmiş bir sunucu yanıtına bağlanır.
Sık sorulanlar
Türkiye’de siteler AI botlarını ne oranda engelliyor?
Eylül 2026’da ölçtüğümüz 90 sitenin 29’u, yani %32’si en az bir yapay zekâ tarayıcısını engelliyor. Bunun 15’i robots.txt ile açıkça yasaklamış, 14’ü ise robots.txt’de izin verdiği hâlde sunucu seviyesinde engelliyor.
robots.txt kontrolü yeterli mi?
Hayır. Ölçümümüzde engelleyen 29 sitenin 14’ü, yani %48’i robots.txt’de "izin veriyor" diyor ama gerçek istekte botu geri çeviriyor. Yalnızca robots.txt okuyan bir araç bu sitelerin tamamını "sorun yok" olarak raporlar.
En çok hangi bot engelleniyor?
Sunucu seviyesinde en çok engellenen Bytespider (%13) ve CCBot (%12). ChatGPT’nin tarayıcısı GPTBot %11, Anthropic’in ClaudeBot’u %10 oranında sunucu engeline takılıyor. Cevap üretirken sayfa çeken ChatGPT-User ve PerplexityBot daha az engelleniyor.
Engellemenin arkasında hangi sistem var?
Kaydettiğimiz 75 sunucu engelinin 45’i, yani %60’ı Cloudflare. Ardından CloudFront (18) ve PerimeterX (11) geliyor. Bu engellerin çoğu bilinçli bir karar değil, varsayılan bot koruması ayarının yan etkisi.