Cos'è llms.txt e come si scrive nel modo giusto
llms.txt è un file di testo che presenta un sito ai modelli di IA. Spieghiamo cosa fa e come costruirne uno correttamente.
Team rabbitclipPubblicato: 4 min di lettura
In breve
Llms.txt è un file di puro testo posizionato alla radice di un sito che elenca le sue pagine più importanti con brevi descrizioni. Il suo compito è rendere più facile per i grandi modelli linguistici capire cosa conta su un sito mentre lo scansionano.
Proposto nel 2024 da Jeremy Howard di Answer.AI, il formato non è uno standard ufficiale del W3C o dell'IETF, si è invece diffuso come proposta della comunità. Nonostante ciò, aziende come Anthropic, Stripe e Cloudflare lo usano sui propri siti, e la definizione canonica vive su llmstxt.org.
Quale problema risolve davvero llms.txt?
Un modello linguistico non naviga un sito attraverso un menu come farebbe una persona, prende l'HTML grezzo, con tutto l'ingombro di navigazione incluso. llms.txt gli offre una mappa dei contenuti semplificata a cui può accedere direttamente.
Nel principio somiglia a come robots.txt gestisce i permessi di scansione o a come sitemap.xml elenca le pagine, ma il suo compito è diverso: non dice cosa può essere scansionato, dice cosa conta e di cosa si tratta.
Come è strutturato il file?
La specifica definisce due file. /llms.txt è un breve riepilogo di navigazione in markdown: un titolo, una descrizione in una frase, poi link raggruppati sotto titoli di sezione. /llms-full.txt è la versione più completa, che raccoglie un'intera documentazione in un unico file.
Un piccolo sito aziendale in genere ha bisogno solo del primo. Un prodotto software con documentazione corposa può tenerli entrambi.
Come se ne scrive uno in pratica?
Il file è markdown puro, collocato alla radice. Il nome del sito o del marchio compare in alto come H1, seguito subito da una frase riassuntiva. Titoli di sezione che iniziano con «## » raggruppano poi le pagine più importanti, ciascuna con una descrizione breve e accurata.
- Un H1 con il nome del sito o del marchio
- Un paragrafo riassuntivo in una frase
- Titoli di sezione (## Servizi, ## Blog, e così via)
- Una descrizione breve e accurata per ogni link
- Solo pagine davvero importanti, non un'intera mappa del sito
Quali errori rendono il file inutile?
Il più comune è copiare per intero una sitemap automatica ed elencare centinaia di link, il che vanifica del tutto lo scopo della priorizzazione. Un altro è scrivere le descrizioni in linguaggio di marketing, un modello cerca una definizione breve e accurata, non uno slogan.
Scrivere il file una volta e poi dimenticarlo causa anche disallineamento. Man mano che il sito cambia, in particolare quando si aggiunge un nuovo servizio o prodotto, anche il file va aggiornato.
Un sito è compromesso senza questo file?
No. Non è un requisito ufficiale, è una proposta che sta ancora guadagnando adozione. Le funzioni di ricerca proprie di Google, OpenAI e Perplexity al momento non cercano specificamente llms.txt, i modelli continuano comunque a scansionare il contenuto standard delle pagine.
Resta comunque un passo a basso costo. Poche ore di lavoro danno a un sito ricco di documentazione o di molte pagine una mappa chiara da consegnare a un modello.
Errori frequenti
Un errore tipico, visto sul sito di documentazione di un prodotto software, è generare llms.txt automaticamente e pubblicarlo senza revisione. Il risultato è una copia quasi identica di sitemap.xml che perde completamente il senso della priorizzazione.
Un altro è copiare un modello senza adattarne la lingua; se il contenuto proprio di un marchio è scritto in una lingua e il file resta comunque in un'altra, si crea un'incoerenza che non aiuta nessuno.
Un test utile: ogni link nel file dovrebbe superare la domanda «questa pagina spiega davvero questo argomento a chi la visita». Se la risposta è no, dovrebbe uscire dall'elenco.
Come si imposta un llms.txt, passo dopo passo?
Costruire il file da zero non richiede più di un pomeriggio, a condizione che i passaggi seguano l'ordine giusto.
- Elencare le dieci-venti pagine più visitate e più richieste del sito.
- Scrivere per ciascuna una descrizione in una frase, senza linguaggio di marketing.
- Raggruppare le pagine sotto titoli di sezione sensati (## Servizi, ## Blog, ## Domande frequenti, e così via).
- Caricare il file alla radice come /llms.txt e verificare che si apra direttamente in un browser.
- Aggiungere un promemoria in calendario per rivedere il file ogni volta che si aggiunge un nuovo servizio o una nuova pagina.
llms.txt è un breve riassunto che un sito consegna a un modello piuttosto che a una persona. Scriverlo richiede un pomeriggio, ma costringe anche a una certa chiarezza sulla propria struttura del sito, ecco perché è una parte piccola ma reale del lavoro di GEO. Per un team che segue questi passaggi, il file smette di essere un progetto una tantum e diventa una piccola abitudine di manutenzione che cresce insieme al sito. rabbitclip può esaminare la struttura attuale di un sito e capire insieme cosa dovrebbe dire davvero quel file.
Domande frequenti
llms.txt è uno standard ufficiale?
No. Si è diffuso come proposta della comunità, la definizione canonica vive su llmstxt.org, senza approvazione del W3C o dell'IETF.
L'IA non può scansionare un sito senza llms.txt?
Può farlo comunque. Il file non condiziona la scansione, facilita solo la priorizzazione.
llms.txt fa lo stesso lavoro di sitemap.xml?
No. sitemap.xml elenca ogni pagina, llms.txt presenta solo le più importanti con una breve descrizione.
Con quale frequenza va aggiornato il file?
Ogni volta che la struttura del sito cambia in modo significativo, ad esempio con l'aggiunta di un nuovo servizio, prodotto o sezione.
