Un sitemap elenca gli URL di un sito web in un file strutturato destinato ai motori di ricerca. Ma tra un sitemap correttamente configurato e un file XML generato per impostazione predefinita senza alcun controllo, il divario di efficienza nell’indicizzazione è reale. Questo articolo misura ciò che distingue un sitemap utile da un sitemap inutile, basandosi sui criteri tecnici documentati da Google.
Affidabilità di lastmod e ping HTTP: due segnali da confrontare
| Segnale tecnico | Stato attuale | Impatto sull’indicizzazione |
|---|---|---|
Tag lastmod affidabile (modifica reale del contenuto) |
Preso in considerazione da Google | Accelera il recrawl delle pagine modificate |
Tag lastmod artificiale (data rigenerata automaticamente) |
Ignorato o controproducente | Nessun beneficio, può ridurre la fiducia di Googlebot |
| Ping HTTP verso l’endpoint Google | Deprecato dal 2023 | Nessuno, gli script o i plugin che lo utilizzano sono obsoleti |
| Dichiarazione in robots.txt | Consigliato | Permette la scoperta automatica del sitemap |
| Invio tramite Google Search Console | Consigliato | Permette il diagnosticare (errori, data dell’ultima recupero) |
Questa tabella mette in evidenza un punto spesso trascurato: il tag lastmod ha valore solo se riflette una modifica significativa. La documentazione Google aggiornata l’8 luglio 2026 precisa che questa data deve corrispondere a un cambiamento del contenuto principale, dei dati strutturati o dei link. Rigenerare un sitemap ogni notte senza una modifica reale delle pagine non porta a nulla.
Il ping HTTP, a lungo utilizzato da plugin WordPress e script personalizzati, è stato deprecato da Google nel 2023. I siti che si basano ancora su questo metodo per segnalare nuovi URL non ottengono alcun vantaggio. Gli unici due canali di invio riconosciuti rimangono la riga Sitemap: nel file robots.txt e il rapporto Sitemaps di Search Console.
Per osservare come questa struttura si traduce concretamente su un sito online, la pagina sitemap di Espace Renaitre illustra un file XML accessibile direttamente dal browser, con i suoi URL elencati in modo gerarchico.

Sitemap XML come strumento di diagnostica SEO
La maggior parte degli articoli sul sitemap lo presenta come un leva di scoperta: si invia il file, Google esplora gli URL. Questa visione è incompleta. Il sitemap serve anche, e a volte soprattutto, a confrontare gli URL inviati con i problemi di indicizzazione rilevati in Search Console.
Il rapporto Sitemaps di Search Console mostra la data dell’ultima recupero del file da parte di Googlebot e gli eventuali errori di elaborazione. Un sitemap contenente URL con errore 404, reindirizzamenti 301 o pagine bloccate da robots.txt genera segnali contraddittori.
Ciò che un sitemap ben filtrato esclude
- Gli URL che restituiscono un codice HTTP 3xx, 4xx o 5xx, che ingombrano il budget di crawl senza risultati di indicizzazione
- Le pagine contrassegnate come
noindex, poiché la loro presenza nel sitemap contraddice la direttiva e crea un’incoerenza tecnica - Gli URL duplicati o le varianti di parametri non canonici, che diluiscono il segnale inviato ai motori di ricerca
Un sitemap deve contenere solo URL indicizzabili e canonici. Ogni voce superflua riduce la proporzione di pagine utili nel file, il che influisce sul modo in cui Googlebot assegna le sue risorse di crawl.
Sitemap XML e sitemap HTML: ruoli distinti per il SEO
Il sitemap XML si rivolge ai robot di esplorazione. Struttura gli URL con metadati tecnici (priorità, frequenza di modifica, data dell’ultima aggiornamento). Il sitemap HTML, invece, è una pagina di navigazione destinata ai visitatori umani.
D’altra parte, il sitemap HTML non sostituisce una rete interna coerente. Un piano di sito HTML senza link contestuali nei contenuti non migliora né il crawl né il SEO. Può invece aiutare gli utenti a localizzare una pagina profonda su un sito con una struttura ad albero complessa.
Per il SEO tecnico, il file XML rimane la priorità. Il formato HTML ha interesse solo se il sito presenta una navigazione complessa con più livelli di profondità. Su un sito di meno di un centinaio di pagine con una rete interna solida, il sitemap HTML offre poco valore aggiunto.

Sitemap index e segmentazione per siti voluminosi
Un file sitemap unico è adatto per siti di dimensioni modeste. Quando il numero di pagine supera diverse migliaia di URL, la segmentazione in sitemap index diventa pertinente. Il principio è semplice: un file genitore (sitemap index) fa riferimento a più file figli, ognuno dei quali raggruppa un tipo di contenuto o una sezione del sito.
Questa organizzazione offre un vantaggio concreto per la diagnostica. Isolando gli articoli del blog, le schede prodotto e le pagine categorie in sitemaps separati, diventa possibile misurare il tasso di indicizzazione per tipo di contenuto in Search Console. Un sitemap segmentato trasforma il monitoraggio dell’indicizzazione in un cruscotto: si identifica immediatamente quale sezione del sito presenta problemi.
Buone pratiche di invio
- Dichiarare l’URL del sitemap index nel file robots.txt con la direttiva
Sitemap:per garantire la sua scoperta automatica - Inviare lo stesso file nel rapporto Sitemaps di Google Search Console per accedere ai dati di recupero e agli errori
- Limitare ogni file figlio a URL realmente indicizzabili, escludendo le pagine reindirizzate, bloccate o con errori
- Aggiornare il tag lastmod solo in caso di modifiche significative al contenuto della pagina interessata
La tentazione di automatizzare tutto senza verifica porta spesso a sitemaps gonfiati di URL inutili. Un file sitemap ridotto ma preciso produce risultati migliori di un file esaustivo ma inquinato.
Il criterio più affidabile per valutare l’efficacia di un sitemap rimane il rapporto tra URL inviati e URL effettivamente indicizzati, visibile in Search Console. Un divario marcato tra questi due numeri segnala un problema di qualità del file o della struttura tecnica del sito, non una mancanza di invio.



