CCBot: robots jetonu, dogrulama, izin verme veya engelleme
Bu sayfa makine cevirisidir. Sayilar ve kanitlar kayitli gozlemlerden oldugu gibi gelir.
CCBot, Common Crawl Foundation tarafindan isletilen bir yapay zeka tarayicisidir. robots.txt belirteci CCBot olup 2026-09-06 tarihinde indirdigimiz saglayici belgeleri bu sayfadaki her ifadenin kaynagidir.
| Robots belirteci | CCBot |
|---|---|
| Saglayici | Common Crawl Foundation |
| Amac | training corpus, public web corpus |
| Belgelenmis dogrulama | yayimlanmamis |
| Saglayici belgelerinin son dogrulanmasi | 2026-09-06 |
| Okunan alan adlari icinde / yolunu engelleyenlerin orani | 18.8% of 128 |
| Last verified |
Kimlik
| Robots belirteci | CCBot |
|---|---|
| Su sekilde eslesir | ccbot |
| Saglayici | Common Crawl Foundation |
| Amac | training corpus, public web corpus |
| Belgeler | https://commoncrawl.org/ccbot |
| Belgelenmis dogrulama | yayimlanmamis |
Not an answer engine itself: it builds the public corpus that many models train on, which is why site owners treat it as an AI crawler. The exact snippet 'User-agent: CCBot Disallow: /' appears on the vendor page fetched on 2026-09-06.
Izin ver veya engelle
User-agent: CCBot Allow: /
User-agent: CCBot Disallow: /
robots.txt kurali, iyi davranan bir tarayicinin yerine getirdigi bir ricadir. Bir erisim denetimi degildir ve bu sayfa kimseye ne secmesi gerektigini soylemez.
Sorular
CCBot robots.txt kurallarina uyar mi?
https://commoncrawl.org/ccbot adresindeki saglayici belgeleri CCBot icin robots.txt dosyasina uyuldugunu belirtiyor. Bu sayfayi indirdik ve 2026-09-06 tarihinde denetleyicimize yanit verdi. Bu, saglayicinin belgeledigi seyin kaydidir, tek bir istegin ne yaptiginin degil.
robots.txt icinde CCBot nasil izin verilir?
Bu grubu sunucunun kokundeki robots.txt dosyasina ekleyin: User-agent: CCBot Allow: /. RFC 9309 uyarinca belirtec, kullanici aracisi dizesinin bir parcasi olarak buyuk kucuk harf ayrimi gozetmeden eslesir ve en uzun eslesen kural gecerlidir.
robots.txt icinde CCBot nasil engellenir?
Bu grubu sunucunun kokundeki robots.txt dosyasina ekleyin: User-agent: CCBot Disallow: /. robots.txt kurali, iyi davranan bir tarayicinin yerine getirdigi bir ricadir; bir erisim denetimi degildir.
Bir istegin gercekten CCBot tarafindan gonderildigini nasil dogrularim?
CCBot icin belgelenmis bir dogrulama yontemi bulamadik: saglayici, indirebilecegimiz ne bir IP aralik dosyasi ne de bir ters DNS uzlasimi yayimliyor. Bunlar olmadan kullanici aracisi dizesi koken kaniti degildir.
Neyi olcuyoruz
robots.txt dosyasini okudugumuz 128 kayitli alan adindan 24 tanesi CCBot icin / yolunu engelliyor, 104 tanesi izin veriyor, yani yuzde 18.8 engelli, hafta 2026-W37. Yalnizca sayilar: hicbir alan adi anilmaz.
Haftalik yapay zeka tarayici erisim endeksi
Kaynaklar
| Kaynak | Tur | HTTP | Dogrulandi | Not |
|---|---|---|---|---|
| https://commoncrawl.org/ccbot | vendor | 200 | 2026-09-06 | 11 occurrences of CCBot in the fetched body |
Ucretsiz veri
Bir alan adini tum jetonlara karsi kontrol et
AEO Watch bagimsiz ve olgusal bir izleme hizmetidir. Hicbir tarayici saglayicisiyla baglantili degildir, hicbiri tarafindan desteklenmez ve hicbiri adina konusmaz. Her ifade, yapildigi tarihi ve arkasindaki ham kaniti tasiyan bir gozlemdir: bir robots.txt satiri, bir HTTP durum kodu, bir baslik. Burada puan, not ve hukum yoktur ve bu sayfadaki hicbir sey tavsiye degildir. Bir site istedigi anda kapsam disinda kalmayi isteyebilir ve bu istek otomatik ve kalici olarak yerine getirilir.