CCBot: robots トークン、検証方法、許可と拒否
このページは機械翻訳です。数値と証拠は保存された観測結果をそのまま表示しています。
CCBot は Common Crawl Foundation が運用する AI クローラーです。robots.txt のトークンは CCBot で、2026-09-06 に取得したベンダーの文書がこのページのすべての記述の出典です。
| robots トークン | CCBot |
|---|---|
| ベンダー | Common Crawl Foundation |
| 目的 | training corpus, public web corpus |
| 文書化された検証方法 | 公開なし |
| ベンダー文書の最終確認 | 2026-09-06 |
| 読み取ったドメインのうち / を拒否する割合 | 18.8% of 128 |
| Last verified |
識別情報
| robots トークン | CCBot |
|---|---|
| 照合される文字列 | ccbot |
| ベンダー | Common Crawl Foundation |
| 目的 | training corpus, public web corpus |
| 文書 | https://commoncrawl.org/ccbot |
| 文書化された検証方法 | 公開なし |
Not an answer engine itself: it builds the public corpus that many models train on, which is why site owners treat it as an AI crawler. The exact snippet 'User-agent: CCBot Disallow: /' appears on the vendor page fetched on 2026-09-06.
許可または拒否
User-agent: CCBot Allow: /
User-agent: CCBot Disallow: /
robots.txt の規則は行儀のよいクローラーが尊重する要請です。アクセス制御ではなく、このページは何を選ぶべきかを誰にも指示しません。
よくある質問
CCBot は robots.txt に従いますか
https://commoncrawl.org/ccbot にあるベンダーの文書は、CCBot が robots.txt を尊重すると記載しています。私たちはそのページを取得し、2026-09-06 に確認しました。これはベンダーが文書化している内容の記録であり、個々のリクエストの動作ではありません。
robots.txt で CCBot を許可するにはどうしますか
ホストのルートにある robots.txt に次のグループを追加します: User-agent: CCBot Allow: /。RFC 9309 により、トークンは User Agent の部分文字列として大文字と小文字を区別せずに照合され、最も長く一致した規則が優先されます。
robots.txt で CCBot を拒否するにはどうしますか
ホストのルートにある robots.txt に次のグループを追加します: User-agent: CCBot Disallow: /。robots.txt の規則は行儀のよいクローラーが尊重する要請であり、アクセス制御ではありません。
そのリクエストが本当に CCBot から来たかをどう確認しますか
CCBot について文書化された確認方法は見つかりませんでした。ベンダーは私たちが取得できる IP レンジのファイルも逆引き DNS の規約も公開していません。それがなければ User Agent 文字列は出所の証拠になりません。
計測している内容
robots.txt を読み取った 128 件の収録ドメインのうち、24 件が CCBot に対して / を拒否し、104 件が許可しています。拒否は 18.8% です。2026-W37 週。件数のみで、ドメイン名は挙げません。
出典
| 出典 | 種類 | HTTP | 確認日 | 備考 |
|---|---|---|---|---|
| https://commoncrawl.org/ccbot | vendor | 200 | 2026-09-06 | 11 occurrences of CCBot in the fetched body |
無料データ
AEO Watch は独立した事実重視のモニターです。いかなるクローラー提供者とも提携しておらず、推奨も代弁もしません。すべての記述は、実施した日付と根拠となる生の証拠を伴う観測です。robots.txt の一行、HTTP ステータスコード、ヘッダーなどです。ここに点数、等級、判定はなく、このページのどの内容も助言ではありません。サイトはいつでも除外を求めることができ、その求めは自動的かつ恒久的に守られます。