La SEO di un negozio online si gioca sulle pagine categoria e sulle schede prodotto, non sul blog. È la differenza che quasi nessuna guida italiana tiene in conto: quelle guide spiegano come si ottimizza un articolo, mentre in un catalogo il traffico commerciale arriva su pagine generate da un database, moltiplicate dai filtri e riscritte di continuo dal magazzino. Tre cose cambiano davvero.
- Il volume di URL è fuori scala. Un catalogo con sei filtri per categoria ne genera oltre centomila senza che nessuno abbia scritto una riga, e Google deve decidere quali valgono la scansione.
- Il contenuto non è tuo. Le descrizioni arrivano dal fornitore, identiche a quelle di altri trenta negozi.
- Le pagine nascono e muoiono da sole. Un prodotto esce dal catalogo e la sua URL resta lì, con i suoi link e la sua posizione.
Quello che segue è verificato sulla documentazione Google Search Central, con i link in fondo. Se stai ancora scegliendo l’infrastruttura, prima leggi come aprire un negozio online in Italia: alcune di queste scelte dipendono dalla piattaforma e dopo non si cambiano.
L’architettura: categorie, sottocategorie e URL
Google non ricostruisce la struttura del sito leggendo le URL, la ricostruisce seguendo i link: dal menu alle categorie, poi alle sottocategorie, poi a tutti i prodotti. La documentazione aggiunge un avvertimento che vale più di molte teorie sull’architettura: se le pagine categoria non contengono link diretti a tutti i prodotti, Googlebot potrebbe non trovarli, e il campo di ricerca interno non aiuta perché Googlebot in genere non prova a fare ricerche. Quindi veri tag <a href> e non eventi JavaScript, e se il catalogo è troppo grande per linkare tutto, una sitemap XML o un feed di Merchant Center.
Sulla profondità non esiste un numero documentato, esiste un criterio: il numero di link interni che una pagina riceve è uno dei segnali con cui Google ne stima l’importanza. Si scende di livello solo quando la sottocategoria ha una domanda di ricerca propria e abbastanza prodotti da giustificare una pagina. «Scarpe da running uomo» sì. «Scarpe da running uomo taglia 43 blu» quasi mai, ed è il punto in cui l’architettura sfuma nel problema dei filtri.
| Caso | Consigliato | Sconsigliato |
|---|---|---|
| Prodotto | /prodotto/felpa-cappuccio-grigia | /prodotto/3243 |
| Filtro come parametro | /t-shirt?colore=verde | /t-shirt?verde |
| Valori multipli | ?tipo=caramelle,dolci | ?tipo=caramelle&tipo=dolci |
| Separatore | & | virgole, punti e virgola, parentesi |
Il filtro come percorso (/t-shirt/verde) vale quanto il parametro, purché l’ordine logico dei filtri resti sempre lo stesso. Google chiede invece di non mettere mai nei link interni identificativi di sessione, codici di tracciamento, valori legati all’orario o riferimenti alla posizione del visitatore: producono URL duplicate e di vita breve.
Filtri e varianti, il problema tecnico centrale
Una categoria con sei filtri (colore con otto valori, taglia con sei, marca con venti, prezzo con cinque fasce, materiale con quattro, disponibilità con due) produce, contando anche lo stato «nessun valore selezionato», 9 × 7 × 21 × 6 × 5 × 3 combinazioni: 119.070 indirizzi da una sola categoria. Con la selezione multipla il solo colore passa da nove stati a 256 sottoinsiemi. Aggiungi ordinamenti e paginazione e sei nell’ordine dei milioni di URL che restituiscono griglie quasi identiche.
Non è un problema di penalizzazione ma di economia della scansione. La documentazione sul crawl budget lo formula così: consolidare i contenuti duplicati per concentrare la scansione sui contenuti unici, non sulle URL uniche.
| Strumento | Cosa fa | Cosa non fa |
|---|---|---|
robots.txt (disallow: /*?*colore=) | Impedisce la scansione. È la soluzione che Google mette per prima: non c’è una buona ragione per far scansionare gli elementi filtrati. | Non rimuove dall’indice quello che c’è già. |
Frammento (#colore=verde) | Elimina il problema alla radice: Google in genere non gestisce i frammenti in scansione e indicizzazione. | Va deciso quando si costruisce il tema, non dopo. |
| rel=”canonical” alla categoria pulita | Consolida i segnali e nel tempo riduce il volume di scansione. | Non è un ordine ma un segnale forte: Google decide da solo. |
| noindex | Toglie la pagina dai risultati a prescindere dai link esterni. | Non fa risparmiare crawl budget: Google richiede comunque la pagina e poi la scarta. Se la URL è bloccata da robots.txt non viene mai letto. |
| rel=”nofollow” sui link filtro | Riduce la scoperta di quelle URL. | Google lo giudica meno efficace a lungo termine: va messo su ogni link senza dimenticarne nessuno. |
| 404 sulle combinazioni vuote | Richiesto da Google quando una combinazione non produce risultati. | Non risolve le combinazioni che producono risultati identici. |
Da qui i due errori più diffusi. Mettere robots.txt e noindex sulla stessa URL: si annullano, perché il crawler non entra e quindi non legge il noindex. E bloccare via robots.txt delle URL già indicizzate sperando che spariscano: per farle uscire vanno prima lasciate scansionare con noindex, e bloccate solo dopo.
Quando conviene far indicizzare una faccetta
Google stesso prevede il caso, e intitola il capitolo «ottimizzare per la scansione» invece che «impedire la scansione». La domanda non è tecnica ma commerciale: quella combinazione corrisponde a qualcosa che le persone cercano con parole loro?
Ha senso indicizzarla se
- Esiste una query in italiano corrente che la descrive: «scarpe antinfortunistiche S3», «lavatrice slim 40 cm».
- Ha un numero stabile di prodotti, non tre pezzi che domani finiscono.
- Puoi darle title e testo propri, diversi dalla categoria madre.
- È raggiungibile da un link permanente, non solo da un checkbox.
Lascia perdere se
- Incrocia due o più filtri: la domanda crolla e le pagine si moltiplicano.
- Il filtro è un ordinamento o la disponibilità.
- È la griglia della categoria madre con due prodotti in meno.
- Non hai chi scriva i testi: mille faccette senza testo sono mille pagine sottili.
Il modo pulito è promuovere le poche faccette che meritano a vere sottocategorie con URL a percorso, e lasciare le altre come parametri gestiti con robots.txt o frammenti. La decisione così è esplicita e non dipende da cosa Google riesce a intuire.
Le pagine categoria sono pagine di atterraggio
Una categoria fatta di sola griglia compete con centinaia di griglie identiche. Chi cerca «scarpe da trail running» non ha ancora scelto un modello, sta cercando i criteri per scegliere, ed è ciò che alla griglia manca.
- Sopra la griglia, tre o quattro righe: cosa distingue i prodotti di questa categoria e quali due o tre criteri contano davvero.
- I filtri come contenuto: se il criterio che conta è il drop della suola, il filtro sul drop deve esistere ed essere spiegato in una riga.
- Link a sottocategorie e categorie sorelle con anchor descrittive.
- Sotto la griglia la guida all’acquisto vera: come si sceglie, gli errori tipici, le domande ricorrenti. Sotto, perché chi è pronto a comprare non deve scavalcarla.
- Breadcrumb visibile, l’unico dato strutturato che Google consiglia esplicitamente anche fuori dalle schede.
Sulla posizione del testo Google non dà una regola. Dà però un divieto che riguarda la scorciatoia più usata in Italia: le norme sullo spam definiscono testo nascosto la pratica di collocare contenuto in una pagina al solo scopo di manipolare i motori, in modo che non sia facilmente visibile ai visitatori umani. Un blocco leggibile e utile in fondo alla categoria non lo è. Duemila parole grigie in corpo 10 dentro un accordion chiuso lo sono nei fatti.
Sulla paginazione due indicazioni spesso disattese: ogni pagina della sequenza deve avere una URL propria, tipicamente ?page=n, perché Google le tratta come pagine separate; e non si usa la prima pagina come canonical delle successive, ognuna ha il proprio. I tag rel="next" e rel="prev" Google non li usa più.
Le schede prodotto, solo la parte SEO
Su cosa deve contenere una scheda per convertire, e sugli obblighi italiani da rispettare, c’è già la guida dedicata: come scrivere una scheda prodotto che vende. Qui restano tre questioni puramente SEO.
Il title. Quello generato dalla piattaforma è quasi sempre nome del prodotto più nome del negozio, e sbaglia due volte: ripete il codice interno del fornitore e omette l’attributo con cui le persone cercano. Lo schema che funziona è marca, modello, attributo distintivo, eventualmente misura; la categoria merceologica entra solo se il nome non la contiene. Su un catalogo grande si costruisce con un modello a campi, ma quel modello va scritto una volta con criterio invece di accettare il predefinito.
Le descrizioni copiate dal fornitore. Se importi un catalogo, la tua descrizione è identica a quella di ogni altro rivenditore che ha importato lo stesso file. Google non penalizza, ma sceglie una versione da mostrare e non c’è motivo perché scelga la tua. Il rimedio non è riscrivere ottomila schede: è aggiungere a ciascuna quello che il fornitore non ha, cioè tempi di consegna reali, compatibilità verificate, contenuto effettivo della confezione, cosa serve comprare a parte, per quale uso il prodotto non basta. Si comincia dalle schede che hanno già traffico o già vendite. Chi importa cataloghi in dropshipping ha il problema in forma acuta: ne parla la guida ai fornitori dropshipping in Italia.
Le varianti. Google chiede che ogni variante abbia una propria URL, con percorso o parametro, e per i parametri facoltativi indica di designare come canonical la URL base senza parametro. Tradotto: una scheda indicizzabile per prodotto, varianti raggiungibili con parametro e canonicalizzate sulla base, salvo quando una singola variante ha una domanda di ricerca sua, come accade per certe misure o certi codici colore ufficiali.
Prodotti esauriti o fuori catalogo: cosa fare con le URL
Qui circolano risposte sbagliate perché si mescolano situazioni diverse. Esaurito, fuori catalogo e sostituito da un successore non sono lo stesso caso.
| Situazione | Cosa fare | Perché |
|---|---|---|
| Esaurito, torna disponibile | Pagina online, HTTP 200, availability su OutOfStock e data di rientro se la conosci | La pagina ha ancora link, posizioni e cronologia |
| Esaurito senza data certa | Come sopra, più avviso di riassortimento e link ai simili | Una pagina vuota rischia la classificazione soft 404 |
| Sostituito da un successore | Redirect 301 al successore | Il 301 segnala che la destinazione deve diventare canonica. Vale solo se è lo stesso prodotto aggiornato |
| Fuori catalogo, nessun sostituto, nessun traffico | 404 o 410, e rimozione da link interni e sitemap | Il 404 è un segnale forte per non richiedere più quella URL |
| Fuori catalogo ma con traffico e link | Pagina online che spiega la fine produzione, con le alternative attuali | Sostituire con un errore una pagina che riceve visite è la scelta più costosa |
| Intera categoria dismessa | 301 alla categoria superiore, mai alla home | Il redirect ha senso se la destinazione risponde alla stessa intenzione. La home non risponde a nessuna |
Una precisazione, perché si legge spesso il contrario: il 410 non è più rapido del 404. La documentazione sugli errori HTTP afferma che i crawler trattano allo stesso modo tutti i codici 4xx tranne il 429.
Dati strutturati: cosa è richiesto e cosa è opzionale
Google separa due esperienze che usano lo stesso vocabolario Product: le merchant listing per le pagine dove si compra, i product snippet per quelle dove non si compra direttamente. Per un negozio la strada è la prima, ed è qui che cade la convinzione più diffusa, cioè che servano le stelline.
| Proprietà | Stato | Note |
|---|---|---|
name | richiesta | Nome del prodotto |
image | richiesta | Minimo 50.000 pixel, larghezza per altezza |
offers | richiesta | Di tipo Offer, non AggregateOffer |
offers.price | richiesta | Maggiore di zero |
offers.priceCurrency | richiesta | ISO 4217, quindi EUR |
offers.availability | consigliata | Un solo valore fra InStock, OutOfStock, Discontinued, PreOrder, BackOrder e gli altri previsti |
brand, sku, gtin, description | consigliate | Il gtin è l’EAN e aiuta l’abbinamento |
shippingDetails, hasMerchantReturnPolicy | consigliate | Spedizione e resi |
aggregateRating, review | consigliate | Non richieste. Servono solo con recensioni vere |
BreadcrumbList | da mettere | itemListElement con position, name e item; l’item non serve sull’ultimo |
Un dettaglio sui breadcrumb che quasi nessun tema rispetta: il percorso dovrebbe rappresentare un tipico percorso dell’utente verso la pagina, non rispecchiare la struttura delle URL. Se al prodotto si arriva da due strade, sono ammessi più percorsi sulla stessa pagina.
I rischi dei rich result sulle recensioni
Le stelline sono la cosa che tutti vogliono e quella che espone di più. Le linee guida sui review snippet vietano le recensioni false o incentivate senza dichiarazione, cioè scambiate con denaro, sconti o prodotti gratuiti; quelle che non nascono da un’esperienza reale; le valutazioni aggregate prese da altri siti. La sanzione non è teorica: Google scrive che in caso di violazione può applicare un’azione manuale, che toglie l’idoneità ai rich result senza toccare il posizionamento normale. Il traffico perso resta perso.
Due precisazioni. Il contenuto marcato deve essere visibile in pagina, quindi un aggregateRating con un 4,8 che in pagina non compare è una violazione, non una furbizia. E la restrizione sulle recensioni autoreferenziali, quelle in cui l’entità recensita controlla le recensioni su se stessa, è formulata per LocalBusiness e gli altri tipi di Organization: le recensioni dei clienti sui tuoi prodotti, marcate su Product, restano legittime. È una distinzione che in italiano viene riportata male molto spesso.
Cosa non fare
- Il muro di testo in fondo alla categoria scritto per il motore. Se è in corpo minuscolo, dello stesso colore dello sfondo o spostato fuori schermo con i CSS, è testo nascosto secondo le norme sullo spam, che citano proprio questi esempi.
- Il keyword stuffing nelle schede. Google lo definisce come riempire una pagina di parole chiave o numeri per manipolare il posizionamento, e cita la ripetizione innaturale di frasi e gli elenchi di località. La lista di quaranta città in fondo a ogni scheda rientra qui.
- Comprare link. Scambiare denaro, beni o servizi per link è una violazione dichiarata. Il link a pagamento è ammesso solo con
rel="nofollow"orel="sponsored", che è esattamente quello che chi vende link non vuole darti. - Generare una pagina per ogni combinazione di filtro. Migliaia di pagine costruite per query simili, che portano tutte alla stessa griglia, sono la definizione di doorway page.
- Misurare la SEO solo in posizioni. Una categoria che sale di tre posizioni e non vende non ha migliorato niente. Il numero che conta sta a valle: c’è la guida al ROAS e ai suoi limiti.
Domande frequenti
Serve un blog su un ecommerce?
Serve per le ricerche informative che precedono l’acquisto e per costruire link interni verso le categorie. Non sostituisce il lavoro su categorie e schede, che è quello che intercetta l’intenzione di acquisto. Con risorse per una cosa sola, si comincia dalle categorie.
Le stelline nei risultati fanno guadagnare posizioni?
No. I dati strutturati rendono una pagina idonea a un rich result, non la fanno salire, e Google precisa che il markup corretto non garantisce nemmeno il rich result. L’effetto reale è sul tasso di clic.
Quante parole deve avere una pagina categoria?
Non esiste una soglia documentata da Google, e le cifre che circolano in italiano non hanno una fonte. La domanda utile è se la pagina risponde alle domande che una persona si fa prima di scegliere. Se lo fa in duecento parole, duecento bastano.
Fonti
Tutte pagine di Google Search Central, salvo l’ultima che è la guida di Search Console. Verificate in risposta 200 ad agosto 2026.
- Navigazione a faccette
- Struttura delle URL per siti ecommerce
- Struttura di un sito ecommerce
- Paginazione e caricamento incrementale
- Dati strutturati rilevanti per l’ecommerce
- URL duplicate e rel canonical
- Bloccare l’indicizzazione con noindex
- Gestione del crawl budget
- Errori HTTP e di rete
- Redirect e Ricerca Google
- Dati strutturati merchant listing
- Dati strutturati product snippet
- Linee guida sui review snippet
- Dati strutturati BreadcrumbList
- Linee guida generali sui dati strutturati
- Norme sullo spam per la Ricerca Google
- Report Indicizzazione delle pagine
Come abbiamo scritto questa guida
Ogni indicazione tecnica è stata verificata aprendo la pagina corrispondente fra quelle elencate sopra, ad agosto 2026. Dove Google non dice niente, come sulla lunghezza dei testi di categoria o sulla profondità massima, è scritto che non lo dice invece di riempire il vuoto con una cifra plausibile. Non abbiamo eseguito test su un catalogo per misurare l’effetto di queste scelte, e nessun dato di traffico o posizionamento qui proviene da un caso reale: il conteggio delle URL generate dai filtri è aritmetica sui parametri, non una rilevazione.
Tre punti restano ambigui nella documentazione stessa. La pagina sulla navigazione a faccette raccomanda robots.txt e non nomina mai il noindex, mentre la pagina sul crawl budget dice di non usare il noindex per risparmiare scansione: la pratica italiana più diffusa, il noindex sui filtri, non è quindi la raccomandazione principale di Google. Sulle varianti, la pagina sulla struttura delle URL indica di canonicalizzare sulla URL base, mentre l’impianto dei dati strutturati per le varianti presuppone URL indicizzabili, e le due cose non sono conciliate in un unico punto. Infine la definizione ufficiale di soft 404 parla solo di un messaggio di errore restituito con codice diverso da 404, e non nomina i redirect verso pagine irrilevanti, che pure sono ovunque citati come causa di soft 404 nelle guide di settore.
La documentazione Google cambia senza preavviso: se trovi una divergenza fra quanto scritto qui e le fonti, fa fede la fonte.