Un llms.txt fatto male è peggio di nessun llms.txt

Berger+Team · 21 set 2026

Non avere un file llms.txt non ti costa nulla. Averne uno fatto male ti costa un punto rosso nello strumento di verifica di Google. Quindi: se lo pubblichi, fallo bene — oppure non pubblicarlo affatto.

Che cosa è cambiato nel 2026

Lighthouse, lo strumento dietro PageSpeed Insights, da quest'anno ha una categoria dedicata alla navigazione agentica. Contiene tre controlli, e uno di questi esamina il tuo llms.txt. Gira nella configurazione predefinita — quindi per chiunque inserisca il proprio sito in PageSpeed Insights. Il tuo cliente, il tuo concorrente, tu stesso.

Nello stesso anno Google dichiara, sul fronte della ricerca: llms.txt non è supportato. Gary Illyes lo ha detto così al Search Central Live nel luglio 2025, e non è previsto che cambi. A John Mueller è stato chiesto se il llms.txt di Google fosse una raccomandazione. La risposta: «to be direct, no.»

Sono entrambi Google. La ricerca nega la rotta, il browser la valuta.

Che cosa controlla esattamente lo strumento

È il punto che nella maggior parte degli articoli viene raccontato male, quindi eccolo preciso:

  • Il file non esiste (404) → nessuna penalizzazione, il controllo è considerato non applicabile
  • Il server risponde con errore o non risponde → punteggio 0
  • File presente, senza titolo → bocciato
  • File presente, più corto di 50 caratteri → bocciato
  • File presente, senza link Markdown → bocciato

Il titolo deve essere un vero titolo Markdown con il cancelletto, in cima. Il limite di lunghezza lo strumento stesso lo chiama «sospettosamente breve».

Nel report compare poi: «llms.txt does not follow recommendations.»

Rileggi la prima riga. L'assenza non viene punita. Chi non ha un llms.txt non viene toccato da questo controllo. Chi ce l'ha, viene misurato.

È tutto il senso di questo articolo, ed è il punto su cui noi stessi ci eravamo sbagliati: in una nostra nota precedente c'era scritto il contrario.

Lo strumento è giovane — e sbaglia

Che si venga misurati non sarebbe un problema, se il metro stesse fermo. Non sta fermo. Tre esempi dal registro pubblico degli errori di Lighthouse:

Nel giugno 2026 sono stati bocciati file llms.txt generati dal plugin WordPress Yoast. Il motivo era un carattere di controllo invisibile all'inizio del file. Nulla di sbagliato nel contenuto. Milioni di siti WordPress coinvolti.

Due settimane dopo sono stati bocciati file conformi alla specifica — a seconda della versione di Chrome usata per il controllo.

E da fine agosto 2026 è aperto un errore per cui PageSpeed Insights segnala titolo e link mancanti anche quando entrambi sono presenti nel file.

Non se ne ricava nulla di drammatico, ma qualcosa di pratico: chi pubblica un llms.txt viene misurato con un metro ancora in movimento. Chi non ce l'ha, no.

Chi preleva davvero il file

Sul nostro sito misuriamo chi richiede il file — su circa tre mesi, solo i due percorsi llms.

Il quadro a grandi linee: circa settecento prelievi, di cui meno di uno su dieci da un crawler la cui provenienza è tecnicamente verificabile. Googlebot e GPTBot lo prelevano in modo dimostrabile — con regolarità, ma in numeri contenuti. Il blocco più grande sono richieste senza mittente riconoscibile. Subito dopo: strumenti di verifica per llms.txt, mezza dozzina di diversi. Da un grande fornitore di IA, in quel periodo, non è arrivato un solo prelievo.

C'erano quindi più strumenti di verifica che fornitori di IA.

Quattro limiti, perché il dato non dica più di quanto può. È un sito su una finestra temporale — un rilievo di posizione, non un'affermazione sul web. Prelevare non è leggere: nessuno può vedere dall'esterno che cosa succede dopo al file. Il nostro sito scrive esso stesso di llms.txt e attira perciò strumenti di verifica in modo sproporzionato. E «non verificato» non significa «falso»: per alcuni fornitori la provenienza non è tecnicamente verificabile.

Quello che i numeri sostengono resta comunque netto: il file viene controllato. Se venga letto, non lo sappiamo.

Che cosa significa per te

Non avere un llms.txt è una condizione del tutto legittima. Nessuno strumento la penalizza, nessun motore di ricerca la pretende. Se non ce l'hai e non ti serve: archiviato, si va avanti.

Se ce l'hai, verifica cinque cose: un titolo con il cancelletto in cima, almeno un vero link Markdown, più di 50 caratteri di contenuto, nessun carattere di controllo invisibile all'inizio, e raggiungibilità senza catene di redirect. Poi passalo una volta in PageSpeed Insights.

Se te lo genera un plugin, controlla comunque il risultato. Il caso Yoast mostra che uno strumento può produrre un file che un altro strumento rifiuta — senza che tu abbia sbagliato nulla.

E consideralo per quello che oggi dimostrabilmente è: un segnale verso gli strumenti di verifica. Non un canale verso un modello linguistico. Che cosa viene dopo il file lo abbiamo descritto altrove: llms.txt è solo il primo passo.

La linea più grande

Un formato raramente si afferma perché il documento dietro è buono. Si afferma perché uno strumento lo genera o lo valuta. Fino al 2026 llms.txt non aveva un portatore simile. Adesso ce l'ha — e questo portatore è un verificatore, non un lettore.

Lo stesso strumento, tra l'altro, cerca anche una seconda rotta, /.well-known/ai-catalog.json. Nella nostra serie di misurazioni è ferma allo zero per cento di diffusione. Se basti un verificatore a smuovere un formato dallo zero, lo vedremo a ottobre.

Domande frequenti.

Ho assolutamente bisogno di un file llms.txt?

Non è un segnale di ranking per Google (lo dice Google stesso) — ma si crea in pochi minuti ed è utile come orientamento per gli agenti IA. Un'aggiunta economica, non un rimedio miracoloso.

Quanto sia davvero diffuso lo misuriamo noi stessi: a settembre 2026 lo espone il 13,5% dei domini verificati. La misurazione è pubblica nel radar ai-discovery.

Perché un buon contenuto per le persone non basta automaticamente per la visibilità nell'IA?

Un buon contenuto per le persone può essere piacevole, evocativo e scritto con un tono da marketing — «Da generazioni il tuo partner di fiducia per…» suona bene a un lettore umano. Un'IA, però, non sa cosa farsene di frasi del genere, perché non contengono informazioni verificabili.

Ciò che i sistemi IA prediligono è la densità informativa: affermazioni chiare, autosufficienti, con fatti, numeri e relazioni concrete, comprensibili anche senza il resto della pagina. Il trucco sta nel combinare le due cose — tono da marketing per le persone, ma con un nucleo fattuale che un'IA possa citare senza doverlo interpretare.

Prossimo passo

Diamo un’occhiata insieme?

Niente pitch, niente pacchetti standard — una valutazione onesta del tuo progetto. Risposta di norma entro 24 h.

Iniziamo a parlarne