# CCBot

## In short

CCBot は Common Crawl Foundation が運用する AI クローラーです。robots.txt のトークンは CCBot で、2026-09-06 に取得したベンダーの文書がこのページのすべての記述の出典です。

| Fact | Value |
| --- | --- |
| robots トークン | CCBot |
| ベンダー | Common Crawl Foundation |
| 目的 | training corpus, public web corpus |
| 文書化された検証方法 | 公開なし |
| ベンダー文書の最終確認 | 2026-09-06 |
| 読み取ったドメインのうち / を拒否する割合 | 18.8% of 128 |
| Last verified | 2026-09-06 |

## CCBot は robots.txt に従いますか

https://commoncrawl.org/ccbot にあるベンダーの文書は、CCBot が robots.txt を尊重すると記載しています。私たちはそのページを取得し、2026-09-06 に確認しました。これはベンダーが文書化している内容の記録であり、個々のリクエストの動作ではありません。

## robots.txt で CCBot を許可するにはどうしますか

ホストのルートにある robots.txt に次のグループを追加します: User-agent: CCBot
Allow: /。RFC 9309 により、トークンは User Agent の部分文字列として大文字と小文字を区別せずに照合され、最も長く一致した規則が優先されます。

## robots.txt で CCBot を拒否するにはどうしますか

ホストのルートにある robots.txt に次のグループを追加します: User-agent: CCBot
Disallow: /。robots.txt の規則は行儀のよいクローラーが尊重する要請であり、アクセス制御ではありません。

## そのリクエストが本当に CCBot から来たかをどう確認しますか

CCBot について文書化された確認方法は見つかりませんでした。ベンダーは私たちが取得できる IP レンジのファイルも逆引き DNS の規約も公開していません。それがなければ User Agent 文字列は出所の証拠になりません。

## 出典

- https://commoncrawl.org/ccbot (HTTP 200, 確認日 2026-09-06)

AEO Watch は独立した事実重視のモニターです。いかなるクローラー提供者とも提携しておらず、推奨も代弁もしません。すべての記述は、実施した日付と根拠となる生の証拠を伴う観測です。robots.txt の一行、HTTP ステータスコード、ヘッダーなどです。ここに点数、等級、判定はなく、このページのどの内容も助言ではありません。サイトはいつでも除外を求めることができ、その求めは自動的かつ恒久的に守られます。
