Il crawl indica l'esplorazione automatica delle pagine web da parte di robot (crawler o spider). Googlebot esegue il crawl del web per alimentare l'indice di Google. BingBot fa lo stesso per Bing. Per l'AEO, il crawl è fondamentale: una pagina non sottoposta a crawl non esiste né per i motori di ricerca né per le IA che utilizzano il RAG.
Crawler importanti per l'AEO
Googlebot: il crawler di Google. Influenza il ranking su Google e le AI Overviews.
BingBot: il crawler di Bing. Fondamentale perché ChatGPT utilizza Bing per il proprio RAG.
GPTBot: il crawler di OpenAI. Alimenta i futuri dati di addestramento.
PerplexityBot: il crawler di Perplexity.
Controllare il crawl: robots.txt
Il file robots.txt controlla quali robot possono eseguire il crawl del tuo sito. Attenzione: bloccare GPTBot o altri crawler IA ti rende invisibile a questi sistemi.
Ottimizzare per il crawl
- Sito veloce (i crawler hanno un "budget" di tempo)
- Nessun blocco per errore nel robots.txt
- Sitemap XML aggiornata
- Struttura di link interni coerente
Ogni domanda posta a ChatGPT senza il tuo nome nella risposta è un competitor raccomandato al posto tuo — misurato su 6.820 risposte AI reali.