← Alle AgentRank-artikelen GPTBot, ClaudeBot en PerplexityBot tracking op Shopify

GPTBot, ClaudeBot en PerplexityBot tracking op Shopify

GA4 ziet AI-crawler traffic op Shopify niet. Leer hoe je GPTBot, ClaudeBot en PerplexityBot trackt via server logs, CDN tools en bot analytics.

Shopify's ingebouwde analytics en GA4 kunnen GPTBot, ClaudeBot of PerplexityBot niet zien. Deze bots voeren geen JavaScript uit, activeren geen tracking pixels en stellen geen cookies in. Daarom is elke crawl onzichtbaar voor client-side analytics. De enige manier om ze te tracken is op server- of edge-niveau. Wat je daar leert, is een leading indicator of je winkel in AI-gegenereerde antwoorden zal verschijnen voordat referral clicks aankomen.

Kernpunten

  • GA4 en Shopify's native analytics kunnen AI-crawler traffic niet zien; server logs of edge workers zijn de enige betrouwbare bron.
  • Er zijn twee verschillende bot types: training crawlers (GPTBot, ClaudeBot) en search/retrieval crawlers (OAI-SearchBot, PerplexityBot, Claude-SearchBot); het blokkeren van de verkeerde verwijdert je uit AI-aanbevelingen.
  • Een 30-daagse logstudie toonde GPTBot met gemiddeld ongeveer 4.200 hits per site per dag, ClaudeBot rond 1.800 en PerplexityBot rond 980.
  • AI-referred traffic van ChatGPT converteert met ongeveer 14%, Perplexity met 12% en Claude met 17%, tegenover een 1,7-2,8% Google organische baseline.
  • Crawler bezoeken zijn een leading indicator; ze geven aan welke pagina's kandidaten zijn voor citatie voordat referral clicks aankomen.

Waarom GA4 deze bots niet kan zien (en waarom dat belangrijk is)

GA4 is gebouwd rond één soort bezoeker: een persoon met een JavaScript-enabled browser. GPTBot, ClaudeBot, PerplexityBot en OAI-SearchBot voeren het GA4 meetscript niet uit. Ze stellen geen cookies in. Vanuit GA4's perspectief bestaan ze eenvoudigweg niet.

Dat is een echte blinde vlek. Wanneer ChatGPT je winkel citeert, ging er een fetch van je productpagina aan vooraf. Als je die fetch niet kunt zien, kun je niet bewijzen dat je GEO-werk resultaat oplevert. Je kunt ook niet het moment opvangen dat een bot een belangrijke pagina niet meer bezoekt.

Shopify's situatie heeft een extra complicatie: in tegenstelling tot zelf gehoste platforms geeft Shopify merchants geen directe toegang tot raw server logs. Dit betekent dat de standaard workflow "download je access log en grep op GPTBot" niet direct toepasbaar is. Je hebt een workaround nodig.

De twee soorten AI bots (en waarom ze verwarren duur is)

Niet alle AI bots doen dezelfde klus. Ze als één categorie behandelen is de meest voorkomende fout die Shopify merchants maken bij het schrijven van robots.txt regels.

Bot naamOperatorPrimair doelBlokkeren betekent dat je verliest...
GPTBotOpenAIModel trainingOpname in trainingsgegevens (niet ChatGPT search)
OAI-SearchBotOpenAILive search indexGeschiktheid voor ChatGPT search citaties
ChatGPT-UserOpenAIReal-time user retrievalOn-demand product fetches van ChatGPT users
ClaudeBotAnthropicModel trainingOpname in trainingsgegevens
Claude-SearchBotAnthropicLive search indexGeschiktheid voor Claude search citaties
PerplexityBotPerplexityIndexing + trainingGeschiktheid voor Perplexity citaties volledig
Perplexity-UserPerplexityReal-time user retrievalOn-demand fetches wanneer een user Perplexity vraagt
Google-ExtendedGoogleGemini training consentGemini model training (niet core Google Search)

Het onderscheid dat robots.txt beleid bepaalt: training bots als GPTBot en ClaudeBot blokkeren houdt je content uit toekomstige model training datasets, wat een legitieme keuze is. Maar search en retrieval bots als OAI-SearchBot, Claude-SearchBot, PerplexityBot en Perplexity-User blokkeren verwijdert je producten volledig uit AI-gegenereerde shopping antwoorden. Dit zijn de bots die voorgekwalificeerde kopers naar je winkel sturen.

Een Cloudflare dataset uit 2026 toonde aan dat in haar netwerk 52,3% van AI-crawler requests in de 28 dagen tot 22 juni 2026 voor model training waren en slechts 2,6% waren live user-triggered fetches. Dit betekent dat de meeste bot volume training-gerelateerd is, maar de commercieel waardevolle fetches zijn van retrieval bots. Ze allemaal gelijk blokkeren is een fout met directe gevolgen voor je omzet.

Hoe je AI bot traffic op Shopify werkelijk trackt

Omdat Shopify geen raw server logs beschikbaar maakt, heb je drie praktische opties afhankelijk van je technische setup en schaal.

Optie 1: CDN log access (Cloudflare of Fastly)

Als je Shopify-winkel achter Cloudflare staat (zelfs op een gratis plan met een Worker), kun je elk binnenkomend request aan de edge loggen voordat het Shopify bereikt. Filter de logstream op user-agent strings met GPTBot, OAI-SearchBot, ClaudeBot, Claude-SearchBot, PerplexityBot, Perplexity-User, ChatGPT-User en Google-Extended. Groepeer resultaten op URL path om te zien welke pagina's elke bot het meest bezoekt.

Een belangrijk verificatiestap: vertrouw niet alleen op de user-agent string. Reverse DNS verificatie is hoe je bevestigt dat een request die beweert GPTBot te zijn, werkelijk afkomstig is van OpenAI's IP ranges. OpenAI en Anthropic publiceren beide hun IP ranges openbaar. Een request die reverse DNS niet haalt, is ofwel een scraper die een legitieme bot nabootst, ofwel een slecht geconfigureerde tool.

Optie 2: Shopify app-layer bot analytics

Voor merchants die CDN configuratie niet willen beheren, kunnen dedicated bot analytics apps server-side signalen lezen en AI-crawler activiteit in een dashboard oppervlakken. Zoek naar tools die bots klassificeren op geverifieerde user agent (niet alleen string matching), crawl frequentie per pagina tonen en onderscheid maken tussen training crawlers en search/retrieval crawlers. Dit is de aanpak die schaalt voor agencies die meerdere winkels beheren zonder engineering overhead.

Optie 3: Handmatige log audit (CDN eenmalig)

Voor een snelle richtinggevende baseline zonder doorlopende tools, pak één week CDN access logs en filter op de hierboven genoemde user agents. Groepeer op URL path en tel hits per bot. Dit geeft je een snapshot van welke pagina's worden gelezen en door wie. Het is geen vervanging voor voortdurende monitoring, maar het beantwoordt de meest dringende vraag in een middag.

Waar je op moet letten zodra je de gegevens hebt

  • Welke productpagina's bezoekt elke bot het meest? Zware crawl op een PDP is een vroeg signaal dat het een citatiekandiaat is. Als die pagina later nul referral clicks krijgt, wordt de content opgehaald maar niet geselecteerd. Dat is een content probleem, geen tracking probleem.
  • Welke pagina's krijgen nul AI crawl? Als je bestsellers niet worden opgehaald, controleer robots.txt op onopzettelijke blokkeringen, verifieer dat pagina's in je sitemap staan en bevestig dat ze niet achter JavaScript rendering zitten dat bots niet kunnen parsen.
  • Is een bot gestopt met crawlen? Een plotselinge daling van ClaudeBot of PerplexityBot activiteit op een sleutelcollectiepagina kan betekenen dat robots.txt regressie, een 4xx error of een CDN regel die per ongeluk afvuurde. Dit vroeg opvangen voorkomt een stille daling in AI-aanbevelingskwalificatie.
  • Training vs. retrieval split: Volg de verhouding van training-bot hits tot retrieval-bot hits op je prioriteitspagina's. Een stijgend aandeel van retrieval (OAI-SearchBot, Perplexity-User, ChatGPT-User) hits is een positief signaal dat je content live answer pipelines binnenkomt, niet alleen trainingsgegevenssets.

Crawler data verbinden met AI referral revenue

Crawler bezoeken zijn een leading indicator, geen conversie event. De volledige signaalketens ziet er als volgt uit:

  1. AI bot crawlt je productpagina (zichtbaar in server logs)
  2. AI engine indexeert of traint op de content
  3. Een koper stelt ChatGPT, Perplexity of Claude een koopvraag
  4. Je product verschijnt in het antwoord
  5. De koper klikt door (zichtbaar in GA4 als referral van chatgpt.com, perplexity.ai of claude.ai)
  6. Sessie converteert naar aankoop

Stappen 1 en 2 zijn alleen zichtbaar in server-side logs. Stappen 3 en 4 vereisen prompt testing (werkelijk de AI engines queryen met target koopvragen om te zien of je producten verschijnen). Stappen 5 en 6 zitten in GA4, hoewel GA4 ze standaard verbergt in de generieke "Referral" bucket, waarvoor een custom channel group nodig is.

Waarom deze pipeline belangrijk is: op geanalyseerde Shopify sites converteren AI-referred sessies op dramatisch hogere rates dan organic search. Een analyse van 150+ client sites toonde ChatGPT referrals converteerden op 14,2%, Perplexity op 12,4% en Claude op 16,8%, tegenover een Google organic baseline van 1,76-2,8%. Die conversie premie maakt bot monitoring meer dan een SEO hygiëne taak. Het is een revenue signaal dat de moeite waard is om in te meten.

robots.txt: de ene instelling die alles bepaalt

Elke AI bot die robots.txt respecteert, zal een expliciete Allow of Disallow honoreren. Alle vier de grote bots (GPTBot, ClaudeBot, Google-Extended, PerplexityBot) publiceren verifieerbare IP ranges en hebben 100% robots.txt compliance getoond in onafhankelijke logstudies.

Shopify's standaard robots.txt staat al meeste voordelige bots toe, maar één veelvoorkomend foutpatroon is het volgen waard: een "block all AI bots" snippet uit 2023 dat in een custom robots.txt.liquid template is geplakt en nooit herzien. Verschillende populaire Shopify SEO apps voegden "block AI bots" toggles toe in 2024 en 2025 met de toggle standaard ingeschakeld. Als je winkel een van deze apps heeft, verifieer de huidige staat van je robots.txt voordat je aanneemt dat je winkel bereikbaar is.

Een veilige baseline voor een Shopify-winkel die AI search zichtbaarheid in 2026 wil:

  • Allow: OAI-SearchBot, ChatGPT-User, Claude-SearchBot, Claude-Web, PerplexityBot, Perplexity-User
  • Allow of evalueer: GPTBot, ClaudeBot, Google-Extended (training consent; meeste ecommerce content heeft lage trainingswaarde)
  • Blokkeer: Bytespider (ByteDance), CCBot (tenzij Common Crawl opname gewenst is), xAI Grok crawler
  • Altijd blokkeren van gevoelige paden: /cart, /checkout, /admin, /account

Voor meer context over het structureren van je productgegevens zodat bots eenmaal je pagina's kunnen bereiken werkelijk iets waard hebben om te citeren, zie Shopify SEO.

Van bot zichtbaarheid naar AI aanbevelingsbewijs

Weten dat GPTBot je productpagina dinsdag heeft gecrawld, is nuttig. Weten dat je winkel in een ChatGPT antwoord verscheen toen een koper "beste [jouw categorie] onder EUR X" typte, is het bewijs dat de lus sluit.

Bot traffic monitoring en prompt testing zijn twee helften van hetzelfde meetsysteem. Crawler data vertelt je of de voorwaarden voor citatie worden voldaan. Prompt testing vertelt je of citatie werkelijk gebeurt. Geen van beide alleen is voldoende.

AgentRank voert beide zijden van deze meetsysteem specifiek uit voor Shopify-winkels: real-time bot traffic monitoring dat GPTBot, ClaudeBot en PerplexityBot activiteit per pagina oppervlakt, plus wekelijkse geautomatiseerde prompt tests in ChatGPT en Perplexity om te bevestigen of je producten in AI-gegenereerde antwoorden verschijnen. Wil je beide signalen op één plek zien, probeer AgentRank op de Shopify App Store.

FAQ

Kan ik GPTBot of ClaudeBot in GA4 zien? Nee. GA4 is JavaScript-gebaseerd en vuurt alleen af voor echte browsersessies. GPTBot, ClaudeBot en PerplexityBot voeren geen JavaScript uit, dus ze genereren nul GA4 events. Server-side log analyse of edge-layer tools zijn de enige manier om deze bots te zien.

Schaadt het toestaan van GPTBot mijn Google search rankings? Nee. GPTBot, ClaudeBot en PerplexityBot zijn volledig gescheiden van Googlebot en hebben geen effect op je standaard Google search rankings. GPTBot, ClaudeBot en PerplexityBot in je robots.txt toestaan, verstoort Google indexing op geen enkele manier.

Hoe vaak crawlen AI bots een typische Shopify winkel? Crawl frequentie varieert op basis van site grootte en verversing, maar een 30-daagse logstudie van 12 productiesites toonde GPTBot met gemiddeld ongeveer 4.200 hits per site per dag, ClaudeBot rond 1.800 hits en PerplexityBot rond 980 hits. Frequentie stijgt voor winkels met frequent bijgewerkte productcatalogi.

ai searchshopify seogeobot analyticsai crawlers

Veelgestelde vragen

Kan ik GPTBot of ClaudeBot in GA4 zien?

Nee. GA4 is JavaScript-gebaseerd en vuurt alleen af voor echte browsersessies. GPTBot, ClaudeBot en PerplexityBot voeren geen JavaScript uit, dus ze genereren nul GA4 events. Server-side log analyse of edge-layer tools zijn de enige betrouwbare manier om deze bots te zien.

Schaadt het toestaan van GPTBot in robots.txt mijn Google search rankings?

Nee. GPTBot, ClaudeBot en PerplexityBot zijn volledig gescheiden crawlers van Googlebot en hebben geen effect op je standaard Google Search rankings. GPTBot, ClaudeBot en PerplexityBot in je robots.txt toestaan, verstoort Google indexing op geen enkele manier.

Hoe vaak crawlen AI bots een typische Shopify winkel?

Crawl frequentie varieert op basis van site grootte en content verversing. Een 30-daagse logstudie van 12 productiesites toonde GPTBot met gemiddeld ongeveer 4.200 hits per site per dag, ClaudeBot rond 1.800 en PerplexityBot rond 980. Winkels met frequent bijgewerkte productcatalogi trekken meestal hogere crawl frequentie van alle drie de bots aan.