ShopifyでGPTBot、ClaudeBot、PerplexityBotのトラフィックを追跡する方法
GA4はShopify上のAIクローラートラフィックを認識できません。サーバーログ、CDNツール、ボット分析を使用してGPTBot、ClaudeBot、PerplexityBotを追跡する方法を学びます。
Shopifyのビルトイン分析とGA4は、GPTBot、ClaudeBot、PerplexityBotを認識できません。これらのボットはJavaScriptを実行せず、トラッキングピクセルを発火させず、クッキーを設定しないため、これらが行うすべてのクロールはクライアント側分析に対して見えません。これらを追跡する唯一の方法はサーバーまたはエッジレイヤーで実行することです。そこで学ぶことは、レファラルクリックが発生する前にあなたのストアがAIが生成した回答に表示されるかどうかの先行指標です。
重要なポイント
- GA4とShopifyのネイティブ分析はAIクローラートラフィックに構造的に盲目です。サーバーログまたはエッジワーカーのみが信頼できるソースです。
- ボットには2つの異なるタイプがあります。トレーニングクローラー(GPTBot、ClaudeBot)と検索/取得クローラー(OAI-SearchBot、PerplexityBot、Claude-SearchBot)です。間違ったものをブロックするとAI推奨から削除されます。
- 30日間のログ調査により、GPTBotは1サイトあたり1日平均約4,200ヒット、ClaudeBotは約1,800、PerplexityBotは約980であることが判明しました。
- AI経由のトラフィックはChatGPTで約14%、Perplexityで12%、Claudeで17%のコンバージョン率がGoogle有機検索の1.7〜2.8%ベースラインと比較して発生します。
- クローラーアクセスは先行指標です。レファラルクリックが到着する前に、どのページが引用候補かを示します。
GA4がこれらのボットを見ることができない理由(そしてなぜそれが重要なのか)
GA4は1つのタイプの訪問者を中心に構築されています。JavaScriptが有効なブラウザを持つ人です。GPTBot、ClaudeBot、PerplexityBot、OAI-SearchBotはGA4測定スクリプトを実行しません。クッキーを設定しません。GA4の観点からすると、それらは単に存在しません。
これは真の盲点です。ChatGPTがあなたのストアを引用するとき、その引用の前にあなたの製品ページの取得が発生しています。その取得を見ることができない場合、あなたのGEO作業が成果を生んでいることを証明できませんし、ボットが重要なページへのアクセスを停止した瞬間を捉えることができません。
Shopifyの状況には追加の摩擦レイヤーが1つあります。自社ホスト型プラットフォームとは異なり、Shopifyはマーチャントに生のサーバーログへの直接アクセスを提供しません。つまり、標準的な「アクセスログをダウンロードしてGPTBotを検索する」ワークフローはそのままでは適用されません。回避策が必要です。
2つのタイプのAIボット(そして混同することが高い理由)
すべてのAIボットが同じ仕事をしているわけではありません。それらを1つのカテゴリとして扱うことはShopifyマーチャントがrobots.txtルールを作成するときに最も一般的な間違いです。
| ボット名 | 運営者 | 主な目的 | ブロックすると失われるもの |
|---|---|---|---|
| GPTBot | OpenAI | モデルトレーニング | トレーニングデータ含有(ChatGPT検索ではない) |
| OAI-SearchBot | OpenAI | ライブ検索インデックス | ChatGPT検索引用の適格性 |
| ChatGPT-User | OpenAI | リアルタイムユーザー取得 | ChatGPTユーザーからのオンデマンド製品取得 |
| ClaudeBot | Anthropic | モデルトレーニング | トレーニングデータ含有 |
| Claude-SearchBot | Anthropic | ライブ検索インデックス | Claude検索引用の適格性 |
| PerplexityBot | Perplexity | インデックス作成+トレーニング | Perplexity引用適格性全体 |
| Perplexity-User | Perplexity | リアルタイムユーザー取得 | ユーザーがPerplexityに質問したときのオンデマンド取得 |
| Google-Extended | Geminiトレーニング同意 | Geminiモデルトレーニング(コアGoogle検索ではない) |
robots.txtポリシーを推進する区別は以下の通りです。GPTBotやClaudeBotなどのトレーニングボットをブロックすると、将来のモデルトレーニングデータセットからあなたのコンテンツを除外します。これは正当な選択です。しかし、OAI-SearchBot、Claude-SearchBot、PerplexityBot、Perplexity-Userなどの検索および取得ボットをブロックすると、AI生成ショッピング回答からあなたの製品を完全に削除します。これらはあなたのストアに事前適格な購入者を送るボットです。
2026年のCloudflareデータセットは、そのネットワーク全体で、2026年6月22日までの28日間におけるAIクローラーリクエストの52.3%がモデルトレーニング用であり、わずか2.6%がライブユーザートリガー取得であることを発見しました。つまり、ほとんどのボットボリュームはトレーニング関連ですが、価値の高い商用取得はリトリーバルボットです。すべてを等しくブロックすることは直接的な収益の影響を持つ誤りです。
ShopifyでAIボットトラフィックを実際に追跡する方法
Shopifyは生のサーバーログを公開しないため、技術的なセットアップと規模に応じて3つの実用的なオプションがあります。
オプション1:CDNログアクセス(CloudflareまたはFastly)
ShopifyストアがCloudflare(無料プランのWorkerを使用している場合でも)の背後にある場合、Shopifyに到達する前にエッジですべてのインバウンドリクエストをログできます。ログストリームをフィルタリングして、GPTBot、OAI-SearchBot、ClaudeBot、Claude-SearchBot、PerplexityBot、Perplexity-User、ChatGPT-User、Google-Extendedを含むユーザーエージェント文字列を探します。URLパスで結果をグループ化して、各ボットが最も多くアクセスするページを確認します。
1つの重要な検証ステップがあります。ユーザーエージェント文字列だけを信頼しないでください。逆DNS検証は、GPTBotであると主張するリクエストが実際にOpenAIのIPレンジから発生していることを確認する方法です。OpenAIとAnthropicはどちらも自社のIPレンジを公開しています。逆DNS検証に失敗するリクエストは、正当なボットになりすましているスクレーパーか、設定が正しくないツールのいずれかです。
オプション2:Shopifyアプリレイヤーボット分析
CDN設定を管理したくないマーチャント向けに、専用ボット分析アプリはサーバー側シグナルを読取り、ダッシュボード内でAIクローラーアクティビティを表示できます。検証済みユーザーエージェント(文字列マッチングだけではなく)でボットを分類し、ページごとのクロール頻度を表示し、トレーニングクローラーと検索/取得クローラーを区別するツールを探します。これは複数のストアを管理するエージェンシーがエンジニアリングオーバーヘッドなしにスケールできるアプローチです。
オプション3:手動ログ監査(CDN1回限り)
継続的なツールなしで迅速な方向指標を得るため、1週間のCDNアクセスログを取得し、上記のユーザーエージェントをフィルタリングします。URLパスでグループ化し、ボットあたりのヒット数をカウントします。これにより、どのページが読まれており、誰が読んでいるかのスナップショットが得られます。継続的な監視の代わりではありませんが、午後の間に最も差し迫った質問に答えます。
データを取得したら何を探すか
- 各ボットが最も多くアクセスする製品ページはどれですか? PDPへのヘビークロールは引用候補である早期シグナルです。そのページが後でゼロのレファラルクリックを獲得する場合、コンテンツが取得されているが選択されていない。これはトラッキング問題ではなくコンテンツ問題です。
- AIクロールがゼロのページはどれですか? ベストセラーがフェッチされていない場合、robots.txtで偶発的なブロックをチェックし、ページがサイトマップにあることを確認し、ボットが解析できないJavaScript描画の背後にないことを確認します。
- ボットがクロールを停止しましたか? 重要なコレクションページでClaudeBotまたはPerplexityBotアクティビティが急落することは、robots.txt回帰、4xxエラー、または正しく発火したCDNルールを意味する場合があります。これを早期に捉えるとAI推奨適格性のサイレント低下を防ぎます。
- トレーニング対取得の分割: 優先ページでのトレーニングボットヒット対取得ボットヒットの比率を追跡します。取得の上昇シェア(OAI-SearchBot、Perplexity-User、ChatGPT-User)ヒットは、コンテンツがトレーニングデータセットだけでなくライブ回答パイプラインに入っていることの肯定的なシグナルです。
クローラーデータをAIレファラル収益に接続する
クローラーアクセスは先行指標であり、コンバージョンイベントではありません。完全なシグナルチェーンは次のようになります。
- AIボットが製品ページをクロール(サーバーログに表示)
- AIエンジンがコンテンツをインデックス作成またはトレーニング
- ショッパーがChatGPT、Perplexity、Claudeに購入質問をする
- あなたの製品が回答に表示される
- ショッパーがクリックスルーする(GA4でchatgpt.com、perplexity.ai、claude.aiからのレファラルとして表示)
- セッションが購入にコンバージョン
ステップ1と2はサーバー側ログにのみ表示されます。ステップ3と4はプロンプトテスト(実際にAIエンジンを対象購入質問でクエリしてあなたの製品が表示されるかどうかを確認)が必要です。ステップ5と6はGA4に存在しますが、デフォルトではGA4はジェネリック「レファラル」バケット内にそれらを埋め込み、カスタムチャネルグループが必要です。
このパイプラインが重要な理由は、分析されたShopifyサイト全体で、AI経由セッションが有機検索よりも劇的に高い率でコンバージョンするためです。150以上のクライアントサイト全体の分析により、ChatGPTレファラルが14.2%でコンバージョン、Perplexityが12.4%、Claudeが16.8%と、Google有機検索の1.76〜2.8%ベースラインと比較されています。このコンバージョンプレミアムはボット監視をSEOハイジーン以上のタスクにします。計測する価値のある収益シグナルです。
robots.txt:すべてを制御する1つの設定
robots.txtを尊重するすべてのAIボットは明示的なAllowまたはDisallowに従います。4つのメジャーボット(GPTBot、ClaudeBot、Google-Extended、PerplexityBot)すべては検証可能なIPレンジを公開し、独立したログ調査で100%のrobots.txt準拠を示しています。
Shopifyのデフォルトrobots.txtはすでにほとんどの有益なボットを許可していますが、監視する価値のある1つの一般的な障害パターンがあります。カスタムrobots.txt.liquidテンプレートに貼り付けられて再検討されなかった2023年代の「すべてのAIボットをブロック」スニペット。いくつかの一般的なShopify SEOアプリは2024年と2025年に「AIボットをブロック」トグルを追加し、デフォルトでトグルが有効になっています。ストアにこれらのアプリの1つがある場合、ストアに到達可能であると仮定する前に現在のrobots.txt状態を確認してください。
2026年でAI検索可視性を望むShopifyストアの安全なベースライン:
- 許可:
OAI-SearchBot、ChatGPT-User、Claude-SearchBot、Claude-Web、PerplexityBot、Perplexity-User - 許可または評価:
GPTBot、ClaudeBot、Google-Extended(トレーニング同意、ほとんどのeコマースコンテンツはトレーニング価値が低い) - ブロック:
Bytespider(ByteDance)、CCBot(Common Crawl包含が必要な場合を除く)、xAI Grok crawler - 常に機密パスからブロック:
/cart、/checkout、/admin、/account
ボットがページに到達したら実際に引用する価値のあるものがあるように製品データを構造化する方法の詳細については、Shopify SEOを参照してください。
ボット可視性からAI推奨証拠へ
GPTBotが火曜日にあなたの製品ページをクロールしたことを知ることは有用です。ショッパーが「あなたのカテゴリで最良のものが$X以下」と入力したときにあなたのストアがChatGPT回答に表示されたことを知ることはループを閉じる証拠です。
ボットトラフィック監視とプロンプトテストは同じ測定システムの2つの半分です。クローラーデータは引用の条件が満たされているかどうかを示します。プロンプトテストは引用が実際に発生しているかどうかを示します。どちらも単独では十分ではありません。
AgentRankはShopifyストア専用にこの測定ループの両側を実行します。ページごとのGPTBot、ClaudeBot、PerplexityBotアクティビティをサーフェスするリアルタイムボットトラフィック監視、およびChatGPTとPerplexityで週単位の自動プロンプトテストで、あなたの製品がAIが生成した回答に表示されるかどうかを確認します。両方のシグナルを1つの場所で確認したい場合は、Shopify App StoreでAgentRankをお試しください。
FAQ
GA4でGPTBotまたはClaudeBotを見ることはできますか? いいえ。GA4はJavaScriptベースであり、実際のブラウザセッションに対してのみ発火します。GPTBot、ClaudeBot、PerplexityBotはJavaScriptを実行しないため、ゼロのGA4イベントを生成します。サーバー側ログ分析またはエッジレイヤーツールのみがこれらのボットを見る信頼できる方法です。
robots.txtでGPTBotを許可するとGoogle検索ランキングに悪影響を与えますか? いいえ。GPTBot、ClaudeBot、PerplexityBotはGooglebotとは完全に別のクローラーであり、標準的なGoogle検索ランキングに影響しません。robots.txtでAIクローラーを許可してもGoogle インデックス作成には影響しません。
典型的なShopifyストアでAIボットはどのくらいの頻度でクロールしますか? クロール頻度はサイトのサイズと更新頻度によって異なります。12の本番サイト全体の30日間のログ調査では、GPTBotが1サイトあたり1日平均約4,200ヒット、ClaudeBotが約1,800ヒット、PerplexityBotが約980ヒットでした。頻繁に更新される製品カタログを持つストアはすべての3つのボットからより高いクロール頻度を集める傾向があります。
よくある質問
GA4でGPTBotまたはClaudeBotを見ることはできますか?
いいえ。GA4はJavaScriptベースであり、実際のブラウザセッションに対してのみ発火します。GPTBot、ClaudeBot、PerplexityBotはJavaScriptを実行しないため、ゼロのGA4イベントを生成します。サーバー側ログ分析またはエッジレイヤーツールのみがこれらのボットを見る信頼できる方法です。
robots.txtでGPTBotを許可するとGoogle検索ランキングに悪影響を与えますか?
いいえ。GPTBot、ClaudeBot、PerplexityBotはGooglebotとは完全に別のクローラーであり、標準的なGoogle検索ランキングに影響しません。robots.txtでAIクローラーを許可してもGoogle インデックス作成には影響しません。
典型的なShopifyストアでAIボットはどのくらいの頻度でクロールしますか?
クロール頻度はサイトのサイズと更新頻度によって異なります。12の本番サイト全体の30日間のログ調査では、GPTBotが1サイトあたり1日平均約4,200ヒット、ClaudeBotが約1,800ヒット、PerplexityBotが約980ヒットでした。頻繁に更新される製品カタログを持つストアはすべての3つのボットからより高いクロール頻度を集める傾向があります。