AIボット署名とは、生成AIクローラーを一意に識別するユーザーエージェント(場合によってはIPアドレス)のパターンです — OpenAIのGPTBot、AnthropicのClaudeBot、PerplexityBot、Google-Extendedなど。AI Labs Auditは継続的に更新される256のアクティブな署名のリポジトリを維持しています。

なぜ専用リポジトリが必要なのか?

AIボットは急速に進化しています:新規参入者(Mistral-AI-User、ByteDance-Sora)、名称変更(Anthropic-AI → ClaudeBot → Claude-Web → Claude-SearchBot)、動作の進化(トレーニングモード vs 検索モード)。最新のリポジトリがなければ、robots.txtやWAFが適切なボットをブロックしてしまったり、実際にコンテンツを消費しているボットを見逃すリスクがあります。

AI Labs Auditリポジトリには何が含まれているか?

各署名について、以下を追跡しています:

  • 提供元(OpenAI、Anthropic、Google、Microsoft、Perplexity、xAI、ByteDance、Common Crawl...)
  • 役割(training、search、agent、browse) — 同じ提供元が異なる役割を持つ複数のボットを持つことがあります
  • マッチングするユーザーエージェントパターン
  • 公式IPレンジ(公開されている場合)
  • robots.txtの推奨事項(allow / disallow / 状況依存)
  • ボットがブロックされた場合のAI可視性への影響

現在、リポジトリには合計256の署名がアクティブに登録されています。

トラッキング側での使用

AI Labs Auditのオープンソーストラッカーは、このリポジトリを活用してサイトで受信した各ヒットを分類します。得られる情報:最もアクティブなボットのトップ、各ボットによって最もクロールされたURL、監査におけるクロール↔引用の相関関係、疑わしいスパイクや欠落ボットに対するアラート。

GEO監査側での使用

監査のGEOスコアは、AI検索ボット(PerplexityBot、OAI-SearchBot、Claude-SearchBot)をブロックするサイトにペナルティを課します。これらはWeb拡張AI応答に表示されるために不可欠だからです。逆に、トレーニングボット(GPTBot training、Google-Extended training)のブロックは、コンテンツを保護したいブランドにとって中立的、あるいは評価されます。

AIの回答では、ブランドが登場するのは6回に1回だけです。あなたのブランドは?

ChatGPTへの質問の回答にあなたの名前がなければ、その分だけ競合があなたの代わりに推奨されています——実際のAI回答6,820件で測定。