Come l'AI legge questa pagina
ChatGPT, Claude, Gemini e Perplexity non guardano colori, immagini e animazioni. Ricevono testo, titoli, link e dati strutturati. Qui sotto trovi esattamente quello che leggono quando aprono «llms.txt serve davvero? Cosa dicono i dati del 2026 su chi lo legge».
L'AI riceve 1.610 parole divise in 9 sezioni, 14 link e 3 blocchi di dati strutturati.
Testo
Il contenuto della pagina in Markdown, senza menu né grafica. È il formato più vicino a come un modello linguistico legge un testo.
# llms.txt serve davvero? Cosa dicono i dati del 2026 su chi lo legge > Il 97% dei file llms.txt non riceve nessuna visita. Ecco chi lo legge davvero, cosa dicono Google e Chrome e quando ha senso pubblicarlo sul tuo sito. URL: https://geosnap.ai/blog/llms-txt-serve-davvero-dati-2026 Lingua: italiano Versione EN: https://geosnap.ai/en/blog/llms-txt-serve-davvero-dati-2026 Autore: Rinald Sefa, CMO Geosnap · Categoria: Ricerca e dati Editore: Geosnap (Maind Group S.r.l.), https://geosnap.ai ## In breve llms.txt è un file Markdown che riassume il sito per gli agenti AI, ma secondo uno studio di Ahrefs su 137.210 domini il 97% di questi file non riceve nemmeno una richiesta in un mese. Google Search dice di ignorarlo. Pubblicalo solo se ti costa poco e hai contenuti che gli agenti devono consultare, non per ottenere citazioni. - Tra giugno 2025 e maggio 2026 i siti con llms.txt sono passati da circa 4.000 a 36.000, poco più dell'1% di quelli monitorati. - Nei log di 137.210 domini, il 97% dei file llms.txt non ha ricevuto nessuna richiesta in tutto maggio 2026. - I bot che cercano fonti per le risposte AI valgono appena l'1,1% delle richieste ai file llms.txt. - Google Search ignora llms.txt, mentre Lighthouse di Chrome lo controlla pensando agli agenti che navigano i siti. - Per farti citare contano di più crawler non bloccati, pagine che rispondono bene e la misura dei risultati. Scritto dall'agente AI di Geosnap, rivisto e approvato da Rinald Sefa. Negli ultimi mesi il file `llms.txt` è diventato uno dei consigli più ripetuti per "farsi trovare dall'AI". Molti siti lo hanno aggiunto, e qualcuno si chiede se sia il caso di farlo prima dei concorrenti. Nel 2026 sono usciti i primi dati solidi su chi lo pubblica e, soprattutto, su chi lo legge. In questo articolo li mettiamo in fila, insieme alle posizioni ufficiali di Google, per capire quando ha senso pubblicarlo e quando è tempo speso male. ## Cos'è llms.txt e come è fatto llms.txt è un file in formato Markdown, pubblicato nella radice del sito (`tuosito.it/llms.txt`), che riassume i contenuti principali per i modelli linguistici e gli agenti AI. L'ha proposto Jeremy Howard nel 2024 e nel 2026 è arrivata una seconda versione della [specifica](https://llmstxt.org/), aggiornata dopo due anni di uso reale. L'idea di partenza è semplice: le pagine web sono fatte per le persone, con menu, banner e script che rendono faticosa l'estrazione del testo. Il file offre invece una mappa breve e pulita. La struttura prevista è questa: - un titolo `#` con il nome del sito o del progetto (l'unico elemento obbligatorio); - una citazione (`>`) con un riassunto di poche righe; - eventuali paragrafi di dettaglio; - sezioni `##` con elenchi di link alle pagine importanti, ognuno con una breve nota; - per convenzione, una sezione "Optional" con i link che un agente può saltare se ha poco spazio. La specifica suggerisce anche di offrire una versione Markdown delle singole pagine, allo stesso indirizzo con `.md` in fondo. Esiste poi una variante, `llms-full.txt`, che contiene direttamente il testo completo invece dei soli link. ## Quanti siti lo pubblicano nel 2026 L'adozione è cresciuta in fretta, ma resta una nicchia. Originality.ai monitora oltre 3 milioni di siti da giugno 2025 e ha pubblicato l'[aggiornamento di giugno 2026](https://originality.ai/blog/llms-txt-tracking-study) del suo studio: | File | Siti a giugno 2025 | Siti a maggio 2026 | Crescita | | --- | --- | --- | --- | | `llms.txt` | 4.088 | 36.120 | 8,8 volte | | `llms-full.txt` | 23 | 2.463 | 107 volte | | `ai.txt` | 4 | 397 | 99 volte | In numeri assoluti, 36.120 siti su più di 3 milioni monitorati sono poco più dell'1%. Una parte della crescita, inoltre, non dipende da scelte dei proprietari dei siti: molte piattaforme per la documentazione e alcuni CMS generano il file in automatico. ## Chi legge davvero llms.txt: cosa dicono i log dei server Quasi nessuno. È la conclusione dello [studio di Ahrefs](https://ahrefs.com/blog/llmstxt-study/) pubblicato a giugno 2026, che ha analizzato i log di 137.210 domini nel mese di maggio. Tra questi, 38.360 avevano un file llms.txt valido: il **97% non ha ricevuto nemmeno una richiesta** in tutto il mese. Anche il 3% di file che qualcuno ha aperto racconta una storia precisa. Le richieste arrivavano soprattutto da: - strumenti di audit SEO (21,7%), cioè software che controllano se il file esiste; - bot non identificati (14,9%) e crawler generici (13,1%); - strumenti che profilano le tecnologie dei siti (11,6%); - agenti AI (10,5%), crawler per l'addestramento dei modelli (5,3%) e assistenti AI (2,5%). I bot di retrieval AI, quelli che cercano fonti da citare mentre l'assistente risponde a una domanda, valevano appena l'**1,1%**. Secondo Ahrefs gli strumenti AI non vanno a cercare llms.txt di propria iniziativa: lo leggono quando qualcuno glielo indica, come succede con gli agenti di programmazione che consultano la documentazione di una libreria. Il dato conferma ciò che la specifica stessa lascia intendere: llms.txt è nato per aiutare un agente che *sa già* di dover leggere un sito, non per farsi scoprire. ## Cosa dicono Google e Chrome Google Search dice esplicitamente che non serve. Nella [guida ufficiale per i risultati generativi](https://developers.google.com/search/docs/fundamentals/ai-optimization-guide), pubblicata a maggio 2026 e aggiornata a luglio, scrive che non è necessario creare file leggibili dalle macchine, file di testo per l'AI, markup o versioni Markdown per comparire nella Ricerca: Google Search li ignora. Questi file non aiutano e non penalizzano. Chrome, che è un altro prodotto Google con obiettivi diversi, ha invece aggiunto un controllo su llms.txt in Lighthouse 13.3, nella nuova categoria dedicata alla navigazione degli agenti. Il [controllo](https://developer.chrome.com/docs/lighthouse/agentic-browsing/llms-txt) segnala un problema solo se il file restituisce un errore del server; se il file non esiste, il test risulta "non applicabile", perché per ora è facoltativo. La documentazione spiega che senza il file gli agenti potrebbero metterci più tempo a capire la struttura del sito. Le due posizioni non si contraddicono quanto sembra, come ha notato anche [Search Engine Journal](https://www.searchenginejournal.com/googles-llms-txt-guidance-depends-on-which-product-you-ask): la Ricerca parla di visibilità nei risultati, Lighthouse parla di agenti che navigano un sito per conto di un utente. Sono due usi diversi. ## Allora conviene pubblicarlo? Sì, se ti costa poco e il tuo sito ha contenuti che un agente deve consultare; no, se speri che ti porti citazioni in ChatGPT, Gemini o Google AI Mode. Ad oggi nessuno dei principali fornitori di AI ha documentato di usare gli llms.txt dei siti esterni per scegliere le fonti delle risposte, e Google Search dice esplicitamente di ignorarli. Ha senso pubblicarlo quando: - hai documentazione tecnica, API o guide che sviluppatori e agenti di programmazione leggono spesso; - il tuo CMS o la tua piattaforma lo genera in automatico, quindi il costo è quasi zero; - vuoi preparare il sito agli agenti che navigano per conto delle persone, sapendo che è una scommessa sul futuro. Se lo fai, tienilo corto e aggiornato: un file con link a pagine che non esistono più manda gli agenti nel posto sbagliato. Un esempio: un'agenzia di viaggi di Torino può limitarsi a un riassunto di due righe e a una decina di link a destinazioni, condizioni di prenotazione e contatti. ## Cosa conta di più per farti citare dall'AI Prima di llms.txt vengono le basi che i motori AI usano davvero. I crawler di ricerca devono poter entrare: un `robots.txt` troppo restrittivo esclude il sito dalle risposte, come spieghiamo nella [guida ai crawler AI](https://geosnap.ai/blog/il-tuo-sito-blocca-chatgpt-guida-crawler-ai). Poi servono pagine che rispondono in modo chiaro alle domande dei clienti, informazioni coerenti su tutto il web e fonti esterne che parlano del brand. Infine, serve misurare. Prima e dopo ogni modifica, controlla se il tuo brand compare nelle risposte e quali fonti vengono citate al suo posto: è quello che fa Geosnap su ChatGPT, Gemini e Google AI Mode, come vedi nella pagina delle [funzionalità](https://geosnap.ai/features). Senza una misura di partenza, è impossibile capire se un intervento, llms.txt compreso, ha cambiato qualcosa. ## Fonti - [Abbiamo analizzato 137.000 siti: il 97% dei file llms.txt non viene mai letto](https://ahrefs.com/blog/llmstxt-study/) (Ahrefs, 2026-06-15) - [Studio di monitoraggio di llms.txt](https://originality.ai/blog/llms-txt-tracking-study) (Originality.ai, 2026-06) - [Guida di Google all'ottimizzazione per le funzionalità di AI generativa nella Ricerca](https://developers.google.com/search/docs/fundamentals/ai-optimization-guide) (Google Search Central, 2026-07-10) - [llms.txt (controllo di Lighthouse per la navigazione degli agenti)](https://developer.chrome.com/docs/lighthouse/agentic-browsing/llms-txt) (Chrome for Developers, 2026-05-05) - [Il file /llms.txt (specifica)](https://llmstxt.org/) (llmstxt.org, 2026) - [Le indicazioni di Google su llms.txt dipendono dal prodotto](https://www.searchenginejournal.com/googles-llms-txt-guidance-depends-on-which-product-you-ask) (Search Engine Journal, 2026-05-20) ## Domande frequenti ### llms.txt aiuta a comparire nelle risposte di ChatGPT? Non ci sono prove che lo faccia. Nessuno dei principali fornitori di AI ha documentato di usare gli llms.txt dei siti esterni per scegliere le fonti, e nei log analizzati da Ahrefs i bot di retrieval AI sono appena l'1,1% delle richieste. Per comparire nelle risposte conta di più che i crawler di ricerca possano leggere il sito. ### Google usa llms.txt per AI Overviews e AI Mode? No. Nella sua guida ufficiale Google scrive che per comparire nella Ricerca non servono file leggibili dalle macchine, file di testo per l'AI o versioni Markdown, perché Google Search li ignora. Il file non aiuta e non penalizza. ### Che differenza c'è tra llms.txt e robots.txt? robots.txt dice ai crawler cosa possono visitare, e i principali crawler AI dichiarano di rispettarlo. llms.txt invece è un riassunto del sito con i link più importanti, pensato per gli agenti che devono leggerlo. Il primo può escluderti dalle risposte AI, il secondo oggi non ti fa entrare. ### Pubblicare llms.txt può danneggiare il sito? Di per sé no: Google dice che non aiuta né penalizza. L'unico controllo di Lighthouse segnala un problema solo se il file restituisce un errore del server. Il rischio vero è un file vecchio, con link a pagine che non esistono più.
Dati strutturati
Dati in formato Schema.org (JSON-LD) inseriti nel codice della pagina. Dicono all'AI in modo esplicito di cosa parla la pagina e chi l'ha pubblicata.
BreadcrumbList descrive il percorso nel sito
{
"@context": "https://schema.org",
"@type": "BreadcrumbList",
"itemListElement": [
{
"@type": "ListItem",
"position": 1,
"name": "Home",
"item": "https://geosnap.ai/"
},
{
"@type": "ListItem",
"position": 2,
"name": "Blog",
"item": "https://geosnap.ai/blog/"
},
{
"@type": "ListItem",
"position": 3,
"name": "Ricerca e dati",
"item": "https://geosnap.ai/blog/#ricerca-e-dati"
},
{
"@type": "ListItem",
"position": 4,
"name": "llms.txt serve davvero? Cosa dicono i dati del 2026 su chi lo legge",
"item": "https://geosnap.ai/blog/llms-txt-serve-davvero-dati-2026"
}
]
}
BlogPosting descrive l'articolo: autore, date e fonti
{
"@context": "https://schema.org",
"@type": "BlogPosting",
"@id": "https://geosnap.ai/blog/llms-txt-serve-davvero-dati-2026#article",
"headline": "llms.txt serve davvero? Cosa dicono i dati del 2026 su chi lo legge",
"description": "Il 97% dei file llms.txt non riceve nessuna visita. Ecco chi lo legge davvero, cosa dicono Google e Chrome e quando ha senso pubblicarlo sul tuo sito.",
"inLanguage": "it",
"url": "https://geosnap.ai/blog/llms-txt-serve-davvero-dati-2026",
"mainEntityOfPage": "https://geosnap.ai/blog/llms-txt-serve-davvero-dati-2026",
"image": "https://geosnap.ai/img/blog/p2026-10-07-llms-txt.webp",
"articleSection": "Ricerca e dati",
"wordCount": 1115,
"author": {
"@type": "Person",
"name": "Rinald Sefa",
"jobTitle": "CMO",
"url": "https://geosnap.ai/about",
"worksFor": {
"@id": "https://geosnap.ai/#organization"
}
},
"publisher": {
"@id": "https://geosnap.ai/#organization"
},
"isAccessibleForFree": true,
"abstract": "llms.txt è un file Markdown che riassume il sito per gli agenti AI, ma secondo uno studio di Ahrefs su 137.210 domini il 97% di questi file non riceve nemmeno una richiesta in un mese. Google Search dice di ignorarlo. Pubblicalo solo se ti costa poco e hai contenuti che gli agenti devono consultare, non per ottenere citazioni.",
"datePublished": "2026-10-07",
"dateModified": "2026-10-07",
"citation": [
"https://ahrefs.com/blog/llmstxt-study/",
"https://originality.ai/blog/llms-txt-tracking-study",
"https://developers.google.com/search/docs/fundamentals/ai-optimization-guide",
"https://developer.chrome.com/docs/lighthouse/agentic-browsing/llms-txt",
"https://llmstxt.org/",
"https://www.searchenginejournal.com/googles-llms-txt-guidance-depends-on-which-product-you-ask"
],
"workTranslation": {
"@id": "https://geosnap.ai/en/blog/llms-txt-serve-davvero-dati-2026#article"
}
}
FAQPage descrive le domande frequenti
{
"@context": "https://schema.org",
"@type": "FAQPage",
"@id": "https://geosnap.ai/blog/llms-txt-serve-davvero-dati-2026#faq",
"mainEntity": [
{
"@type": "Question",
"name": "llms.txt aiuta a comparire nelle risposte di ChatGPT?",
"acceptedAnswer": {
"@type": "Answer",
"text": "Non ci sono prove che lo faccia. Nessuno dei principali fornitori di AI ha documentato di usare gli llms.txt dei siti esterni per scegliere le fonti, e nei log analizzati da Ahrefs i bot di retrieval AI sono appena l'1,1% delle richieste. Per comparire nelle risposte conta di più che i crawler di ricerca possano leggere il sito."
}
},
{
"@type": "Question",
"name": "Google usa llms.txt per AI Overviews e AI Mode?",
"acceptedAnswer": {
"@type": "Answer",
"text": "No. Nella sua guida ufficiale Google scrive che per comparire nella Ricerca non servono file leggibili dalle macchine, file di testo per l'AI o versioni Markdown, perché Google Search li ignora. Il file non aiuta e non penalizza."
}
},
{
"@type": "Question",
"name": "Che differenza c'è tra llms.txt e robots.txt?",
"acceptedAnswer": {
"@type": "Answer",
"text": "robots.txt dice ai crawler cosa possono visitare, e i principali crawler AI dichiarano di rispettarlo. llms.txt invece è un riassunto del sito con i link più importanti, pensato per gli agenti che devono leggerlo. Il primo può escluderti dalle risposte AI, il secondo oggi non ti fa entrare."
}
},
{
"@type": "Question",
"name": "Pubblicare llms.txt può danneggiare il sito?",
"acceptedAnswer": {
"@type": "Answer",
"text": "Di per sé no: Google dice che non aiuta né penalizza. L'unico controllo di Lighthouse segnala un problema solo se il file restituisce un errore del server. Il rischio vero è un file vecchio, con link a pagine che non esistono più."
}
}
]
}
Metadati
Le informazioni nell'intestazione della pagina, che crawler e motori leggono prima del contenuto.