llms.txt: guida completa (2026)

Proposto nel settembre 2024 da Jeremy Howard, il file llms.txt viene regolarmente presentato come un nuovo standard di visibilità IA. Prima di farne un pilastro della strategia GEO, occorre distinguere ciò che il file fa tecnicamente da ciò che i bot dei principali attori IA fanno realmente con questi file nel 2026.

Questa guida spiega il formato, la posizione dei principali motori IA nel 2026 e come implementarlo senza sopravvalutarne l'impatto, in complemento alle altre leve AEO misurabili.

Da ricordare:
- Origine: proposta di Jeremy Howard, settembre 2024, llmstxt.org
- Adozione misurata: meno di 1.000 domini censiti da NerdyData a luglio 2025
- Nessun motore IA consumer ha confermato che i suoi crawler sfruttano i llms.txt dei siti terzi

Realtà sul campo a inizio 2026

Il tema llms.txt è attraversato da una confusione frequente tra due usi molto diversi. Chiarire le cose evita di costruire una strategia su una promessa non dimostrata.

Pubblicare un llms.txt non è la stessa cosa che vedere il proprio llms.txt letto dai bot IA

Anthropic, OpenAI e Perplexity pubblicano un llms.txt sulla propria documentazione sviluppatori (ad esempio docs.anthropic.com/llms.txt). Questo file serve la loro API e i loro agenti di coding: descrive come integrare i loro stessi strumenti. Questo uso è diverso dal crawl web. Nessuna comunicazione ufficiale di Anthropic, OpenAI, Google o Perplexity conferma che ClaudeBot, GPTBot, Google-Extended o PerplexityBot legga i llms.txt dei siti terzi.

I numeri misurati nel 2025

  • OtterlyAI ha misurato lo 0,1% di hit sul file llms.txt su un campione di 62.100 richieste di bot IA (studio 90 giorni).
  • Search Engine Land ha pubblicato uno studio su tre mesi (agosto-ottobre 2025): zero visite dei principali bot IA sui file llms.txt monitorati.
  • NerdyData censiva meno di 1.000 domini con un llms.txt a luglio 2025. L'adozione attraversa gli strumenti SEO consumer (Yoast, RankMath hanno integrato generatori), ma resta di nicchia in volume.

Posizione pubblica di Google

John Mueller, Search Advocate di Google, ha dichiarato pubblicamente su Bluesky a giugno 2025 e poi a dicembre 2025: "no AI system currently uses llms.txt". Paragona il file al meta keywords tag e raccomanda di metterlo in noindex. Un llms.txt è apparso e poi è stato rimosso dalla documentazione Search Central di Google a dicembre 2025, il che illustra la prudenza del motore sul tema.

L'origine dello standard

Jeremy Howard ha proposto llms.txt per l'inference time degli agenti di coding: aiutare un assistente LLM a comprendere una documentazione tecnica nel momento in cui uno sviluppatore gli pone una domanda. Il formato non è stato concepito come leva GEO/SEO, e gli attori che l'hanno adottato per primi sono piattaforme di documentazione (Mintlify) e IDE IA (Cursor), non i motori IA consumer.

Conclusione di questa sezione: llms.txt resta pertinente da pubblicare — costo quasi nullo, segnale positivo, possibile valore aggiunto se l'ecosistema evolve. Ma occorre presentarlo per quello che è oggi: una scommessa sul futuro, non una leva di visibilità IA attiva.

Cos'è llms.txt?

llms.txt è un file di testo in formato Markdown posizionato alla radice del vostro sito web (esempio: https://vostrosito.com/llms.txt). Il suo obiettivo dichiarato: offrire ai modelli di linguaggio una vista strutturata e priorizzata del vostro contenuto più importante.

A differenza di una sitemap che elenca esaustivamente tutte le vostre pagine, llms.txt presenta una selezione curata delle vostre risorse essenziali. È una sorta di "guida di lettura" per i LLM che permette loro, se scelgono di leggerlo, di comprendere rapidamente cosa fa la vostra azienda e dove trovare i vostri contenuti strategici.

Il formato è stato proposto da Jeremy Howard nel settembre 2024 su llmstxt.org. L'idea centrale: adattare il concetto di robots.txt all'era dei modelli di linguaggio, ma con un approccio inclusivo piuttosto che restrittivo.

Filosofia di llms.txt: mentre robots.txt dice "non andare lì", llms.txt dice "ecco ciò che è più importante". È un cambio di paradigma proposto dalla comunità open source — la sua adozione da parte dei bot IA consumer resta da confermare.

llms.txt vs robots.txt vs sitemap.xml

Per comprendere bene il posto di llms.txt, confrontiamolo con i file che già conoscete.

Caratteristica robots.txt sitemap.xml llms.txt
Obiettivo Controllare l'accesso Elencare tutte le pagine Descrivere il contenuto chiave ai LLM
Approccio Restrittivo (bloccare) Esaustivo (elencare tutto) Curativo (selezionare)
Target Crawler tradizionali e IA Motori di ricerca Modelli di linguaggio e agenti di coding
Formato Direttive Allow/Disallow XML strutturato Markdown leggibile
Status Standard IETF, rispettato Standard, letto da tutti i motori Convenzione proposta, lettura da parte dei bot IA non confermata

robots.txt resta essenziale per controllare quali bot possono accedere a quali parti del vostro sito. È rispettato dai crawler IA come GPTBot (OpenAI), ClaudeBot (Anthropic), PerplexityBot o Google-Extended.

sitemap.xml aiuta i motori di ricerca tradizionali a scoprire tutte le vostre pagine. La sua natura esaustiva non è ottimale per un riassunto editoriale.

llms.txt propone un formato complementare: un riassunto strutturato, leggibile dagli umani e dalle macchine, che punta alle vostre risorse più strategiche. La sua lettura effettiva da parte dei principali bot IA non è confermata a oggi.

Posizione dei principali motori IA nel 2026

A oggi, nessuno dei principali attori IA ha confermato pubblicamente che i suoi crawler sfruttano i llms.txt dei siti terzi. Ecco lo stato dell'arte per attore, basato sulle comunicazioni ufficiali e sulle misurazioni pubbliche.

Anthropic (Claude)

Anthropic pubblica un llms.txt sulla sua documentazione sviluppatori API, il che è un uso diverso dal crawl web. Nessuna comunicazione ufficiale di Anthropic conferma che ClaudeBot legga i llms.txt dei siti terzi.

OpenAI (ChatGPT, SearchGPT)

OpenAI pubblica anch'essa un llms.txt sulla sua documentazione sviluppatori. Nessuna comunicazione ufficiale conferma che GPTBot o OAI-SearchBot tenga conto dei llms.txt dei siti terzi. Le misurazioni OtterlyAI e Search Engine Land mostrano una frequentazione trascurabile di questi file da parte dei principali bot IA.

Perplexity

Perplexity pubblica un llms.txt sulla sua documentazione. Come per gli altri attori, nessun annuncio ufficiale conferma l'uso del file da parte di PerplexityBot durante il crawl dei siti terzi.

Google (Gemini, Google AI Overviews)

Google non ha mai annunciato il supporto di llms.txt. John Mueller (Google Search Advocate) ha dichiarato pubblicamente nel 2025 che "nessun sistema IA utilizza attualmente llms.txt" e paragona il file al meta keywords tag.

Strumenti di sviluppo (Cursor, Mintlify, Yoast, RankMath)

Il formato è invece utilizzato attivamente dagli IDE IA (Cursor) e dalle piattaforme di documentazione (Mintlify), conformemente all'intenzione iniziale di Jeremy Howard. Lato SEO, Yoast e RankMath hanno aggiunto generatori llms.txt ai loro plugin WordPress nel 2025.

Importante: llms.txt non sostituisce robots.txt. Se bloccate un crawler in robots.txt, non accederà nemmeno a llms.txt. La priorità tecnica per la visibilità IA resta: lasciare che GPTBot, ClaudeBot, PerplexityBot e Google-Extended accedano al vostro sito, servire un HTML leggibile senza JavaScript e strutturare i vostri dati con Schema.org.

Come creare il vostro file llms.txt

La creazione di un file llms.txt segue un formato semplice basato su Markdown. Ecco i passaggi per creare il vostro.

Passaggio 1: struttura di base

Il file inizia con un titolo e una descrizione del vostro sito, seguiti da sezioni tematiche.

# Nome della vostra azienda

> Descrizione concisa della vostra attività e proposta di valore.
> Questa sezione aiuta i LLM a comprendere il vostro posizionamento.

## Documentazione

- [Guida introduttiva](https://vostrosito.com/docs/getting-started) : Introduzione completa alla nostra soluzione
- [Riferimento API](https://vostrosito.com/docs/api) : Documentazione tecnica dell'API
- [FAQ](https://vostrosito.com/faq) : Domande frequenti

## Prodotti

- [Prodotto Principale](https://vostrosito.com/prodotto) : Descrizione e funzionalità
- [Prezzi](https://vostrosito.com/pricing) : Piani e opzioni disponibili

## Blog

- [Articolo 1](https://vostrosito.com/blog/articolo-1) : Argomento trattato
- [Articolo 2](https://vostrosito.com/blog/articolo-2) : Argomento trattato

Passaggio 2: esempio completo

Ecco un esempio concreto per un'azienda SaaS:

# AI Labs Audit

> AI Labs Audit è una piattaforma di audit di visibilità sulle IA
> conversazionali. Aiutiamo le aziende a misurare e ottimizzare
> la loro presenza su ChatGPT, Claude, Gemini e Perplexity.

## Chi siamo

- [Home page](https://ailabsaudit.com/) : Presentazione della piattaforma
- [Chi siamo](https://ailabsaudit.com/a-propos) : La nostra missione e team
- [Contatti](https://ailabsaudit.com/contact) : Contattaci

## Funzionalità

- [Audit IA](https://ailabsaudit.com/features/audit) : Analisi di visibilità multi-IA
- [Report](https://ailabsaudit.com/features/reports) : Report dettagliati
- [Monitoraggio](https://ailabsaudit.com/features/tracking) : Monitoring continuo

## Risorse

- [Blog](https://ailabsaudit.com/blog) : Articoli e guide
- [Glossario AEO](https://ailabsaudit.com/glossaire) : Definizioni del settore
- [Guida llms.txt](https://ailabsaudit.com/blog/llms-txt) : Questa guida

## Prezzi

- [Piani](https://ailabsaudit.com/#pricing) : Opzioni e tariffe

Passaggio 3: deployment

Posizionate il file alla radice del vostro sito web:

# L'URL finale deve essere:
https://vostrosito.com/llms.txt

# Per un sito Flask/Django, posizionatelo nella cartella static
# o configurate una route dedicata

# Per un sito statico, posizionatelo semplicemente alla radice
/llms.txt

Best practice per llms.txt

1. Limitate il numero di link (20-50 massimo)

Più non è meglio. Se un LLM legge il file, funzionerà meglio con un'informazione strutturata e priorizzata. Selezionate le vostre 20-50 pagine più strategiche piuttosto che elencare tutto.

2. Organizzate per categorie logiche

Utilizzate sezioni chiare (Documentazione, Prodotti, Blog, ecc.) per rendere la struttura leggibile. Questo facilità anche la manutenzione del file nel tempo.

3. Redigete descrizioni utili

Ogni link dovrebbe essere accompagnato da una breve descrizione esplicativa. Questa descrizione rende il file utilizzabile come riassunto editoriale per i vostri team e potenzialmente per agenti IA.

4. Aggiornate trimestralmente

Il vostro llms.txt deve riflettere i vostri contenuti attuali. Prevedete una revisione trimestrale minima e aggiornamenti immediati in caso di:

  • pubblicazione di contenuto importante;
  • lancio di nuovi prodotti/servizi;
  • ristrutturazione del sito;
  • cambio di posizionamento.

5. Iniziate dal più importante

L'ordine conta. Posizionate le vostre pagine più strategiche all'inizio del file, sullo stesso principio di un sommario editoriale.

Consiglio pro: il vostro llms.txt dovrebbe rispondere alla domanda: "Se un'IA potesse leggere solo 30 pagine del mio sito, quali sarebbero essenziali per comprendere la mia attività e apportare valore ai suoi utenti?" È un esercizio utile di per sé, indipendentemente dalla lettura effettiva del file da parte dei bot.

Stato dell'adozione nel 2026

L'adozione di llms.txt resta di nicchia in volume ma attraversa gli strumenti SEO consumer. Ecco una vista misurata per categoria di attori.

Adozione confermata

  • Cursor: l'IDE IA utilizza llms.txt per comprendere i progetti lato sviluppatore.
  • Mintlify: piattaforma di documentazione con integrazione native del formato.
  • Yoast, RankMath: generatori llms.txt integrati nei plugin SEO WordPress nel 2025.
  • Framework: integrazioni comunitarie per Next.js, Astro, ecc.

Lettura da parte dei bot IA consumer: non confermata

  • OpenAI/SearchGPT: nessuna comunicazione ufficiale. Le misurazioni pubbliche mostrano una frequentazione trascurabile.
  • Anthropic/Claude: nessuna comunicazione ufficiale sulla lettura dei llms.txt terzi.
  • Perplexity: nessuna comunicazione ufficiale.
  • Google/Gemini: John Mueller ha pubblicamente escluso l'uso di llms.txt da parte dei sistemi IA nel 2025.

Limitazioni e prospettive

Limitazioni attuali

Nessuno standard formale: llms.txt non è né uno standard W3C né uno standard IETF. La sua adozione si basa su una convenzione de facto.

Nessuna garanzia di utilizzo: le misurazioni pubbliche 2025 (OtterlyAI, Search Engine Land) mostrano che i principali bot IA non frequentano significativamente i llms.txt oggi. Creare un file perfetto non garantisce alcuna visibilità IA supplementare a breve termine.

Manutenzione richiesta: un llms.txt obsoleto può essere controproducente se punta a pagine eliminate o contenuto deprecato.

Prospettive 2026-2027

L'evoluzione probabile del formato include:

  • Specifica formale: una RFC o uno standard ufficiale potrebbe emergere se l'adozione si conferma.
  • Estensioni: supporto per i metadati (data di aggiornamento, priorità, lingua).
  • Integrazione CMS: generazione automatica generalizzata in WordPress, Shopify, ecc.
  • Strumenti di validazione: validatori simili a quelli di robots.txt.

Misurate la vostra visibilità IA attuale

Prima di ottimizzare, misurate. I nostri audit analizzano la vostra presenza su ChatGPT, Claude, Gemini e Perplexity e identificano le leve ad alto impatto misurabile.

Richiedere un audit gratuito

Conclusione: bisogna pubblicare un llms.txt?

La risposta resta , ma senza farne un pilastro della strategia GEO. Da conservare in una checklist GEO completa a titolo di "scommessa sul futuro", per quattro ragioni:

  1. Costo minimo: creare un llms.txt richiede meno di un'ora e la manutenzione è leggera.
  2. Nessun rischio: nel peggiore dei casi, il file viene ignorato; nel migliore, viene utilizzato se l'ecosistema evolve.
  3. Esercizio editoriale utile: strutturare le proprie 20-50 pagine strategiche è un esercizio di chiarezza che serve anche agli umani.
  4. Compatibilità con gli agenti interni: gli agenti di coding e gli IDE IA sfruttano realmente il formato.

D'altra parte, non bisogna presentarlo come una leva di visibilità IA attiva oggi. Le vere leve misurabili restano i dati strutturati Schema.org, l'HTML crawlabile senza JavaScript, il contenuto autorevole (segnali E-E-A-T) e, per le FAQ, formati come AQA. È su queste fondamenta che si conquista la visibilità in AEO e GEO nel 2026.

Domande frequenti su llms.txt

Cos'è il file llms.txt?

llms.txt è un file di testo posizionato alla radice del vostro sito che propone ai modelli di linguaggio un riassunto strutturato del vostro contenuto: nome dell'azienda, prodotti, servizi, pagine chiave. Il formato è stato proposto nel settembre 2024 da Jeremy Howard su llmstxt.org. La sua lettura effettiva da parte dei crawler dei principali motori IA non è confermata pubblicamente a oggi.

Qual è la differenza tra llms.txt e robots.txt?

robots.txt controlla l'accesso dei crawler (autorizzare o bloccare). llms.txt propone un riassunto editoriale senza nozione di blocco. robots.txt è uno standard IETF rispettato da tutti i motori; llms.txt è una convenzione proposta, il cui uso da parte dei bot IA consumer resta da confermare.

Quanti link includere in llms.txt?

Le best practice raccomandano tra 20 e 50 link massimo. Privilegiate la qualità sulla quantità: includete solo le vostre pagine più strategiche, ben documentate e regolarmente aggiornate.

Con quale frequenza aggiornare llms.txt?

Una revisione trimestrale è raccomandata come minimo. Aggiornate anche dopo ogni pubblicazione di contenuto importante, ristrutturazione del sito o lancio di nuovi prodotti o servizi.

Quali attori utilizzano realmente llms.txt oggi?

Gli usi confermati riguardano gli IDE IA (Cursor), le piattaforme di documentazione (Mintlify) e i plugin SEO WordPress (Yoast, RankMath, che hanno aggiunto generatori nel 2025). Lato motori IA consumer (ChatGPT, Claude, Perplexity, Gemini), nessuno ha confermato che i suoi crawler sfruttano i llms.txt dei siti terzi; le misurazioni pubbliche di OtterlyAI e di Search Engine Land nel 2025 mostrano una frequentazione trascurabile del file da parte di questi bot.

Il llms.txt è obbligatorio per l'AEO?

No. Il suo impatto reale sulla visibilità IA non è dimostrato dalle misurazioni pubbliche del 2025. Da considerare come una scommessa a costo nullo sull'evoluzione dell'ecosistema, da conservare in una checklist GEO completa, ma senza presentarlo come una leva attiva. Le vere leve misurabili oggi sono i dati strutturati Schema.org, un HTML crawlabile senza JavaScript, il contenuto autorevole e FAQ in formato AQA.

Articolo riletto e aggiornato: maggio 2026 — verificato rispetto ai comportamenti attuali di ChatGPT, Claude, Gemini e Perplexity.

À propos de l’auteur

Davy Abderrahman

Fondateur & CEO de

Spécialiste en visibilité IA (AEO/GEO/LLMO), j’aide les agences et consultants à mesurer et optimiser la présence de leurs clients sur ChatGPT, Claude, Gemini, Perplexity et les autres moteurs de réponse IA. Pionnier de l’audit de visibilité IA depuis 2024.

AEO GEO LLMO Visibilité IA Audits IA
Nelle risposte AI, un brand appare solo 1 volta su 6. Il tuo compare?

Ogni domanda posta a ChatGPT senza il tuo nome nella risposta è un competitor raccomandato al posto tuo — misurato su 6.820 risposte AI reali.

Questo articolo ti è stato utile?

- (0 votes)