Un errore 404 è un codice di stato HTTP restituito da un server quando non trova la risorsa richiesta all’URL indicato. Il browser riceve questo codice, visualizza un messaggio del tipo “pagina non trovata”, e il visitatore abbandona il sito. Per i motori di ricerca, la situazione è diversa: Googlebot registra questa risposta, la annota nei suoi rapporti, e adatta il suo comportamento di esplorazione di conseguenza.
Errore 404 e soft 404: due problemi, due correzioni
Google fa una netta distinzione tra un errore 404 classico e un soft 404. Il primo si verifica quando il server restituisce esplicitamente il codice HTTP 404 o 410: la pagina non esiste più, il server lo conferma. Il trattamento è chiaro.
Il soft 404, invece, presenta un problema più subdolo. La pagina restituisce un codice HTTP 200 (successo), ma il suo contenuto assomiglia a una pagina vuota, a un messaggio di errore o a un risultato senza dati. Google la classifica quindi come soft 404 nel rapporto di indicizzazione della Search Console, anche se tecnicamente il server non ha segnalato alcun errore.
Questa distinzione cambia la correzione da applicare. Per una pagina realmente rimossa, il codice 404 o 410 è la risposta corretta, basta decidere se una reindirizzazione 301 verso un contenuto pertinente sia giustificata. Per un soft 404, è necessario arricchire il contenuto affinché meriti di esistere, oppure restituire un vero codice 404.
Prima di qualsiasi azione, è utile comprendere l’errore 404 su Google per fare una diagnosi affidabile.

Soft 404 sui siti dinamici: il tranello del rendering JavaScript
I siti e-commerce e i media generano spesso pagine di risultati filtrati, di faccette prodotto o di categorie temporaneamente vuote. Queste pagine “zero risultati” sono una causa frequente di soft 404 su larga scala. Google le esplora, rileva un template quasi vuoto, e le segnala massivamente nella Search Console.
Un altro caso insidioso riguarda il rendering JavaScript. Una pagina può apparire correttamente in un browser, con tutto il suo contenuto caricato lato client, ma apparire vuota o incompleta per Googlebot se il rendering JS fallisce. La pagina funziona per un umano, non per il robot. Google la classifica quindi come soft 404 senza che il webmaster se ne accorga durante la navigazione normale.
La verifica avviene tramite lo strumento di ispezione URL nella Search Console, che mostra la versione della pagina così come Google la vede. Se il rendering visualizzato differisce da ciò che mostra il browser, il problema è lato JavaScript, non lato server.
Ordinare gli errori 404 prima di correggerli
Correggere tutte le 404 di un sito senza distinzione è una perdita di tempo. La buona pratica consiste nell’ordinare ogni URL segnalata in base al suo stato reale prima di agire. Quattro categorie si delineano:
- Le URL che corrispondono a contenuti rimossi volontariamente: il codice 404 o 410 è la risposta corretta. Nessuna azione necessaria, Google finirà per rimuoverle dal suo indice.
- Le URL che puntavano a contenuti spostati o rinominati: una reindirizzazione 301 verso la pagina equivalente è l’unica correzione pertinente. Reindirizzare verso la homepage è trattato da Google come un soft 404.
- Le URL generate da link interni rotti (errore di battitura, cambiamento di struttura): è necessario correggere il link alla fonte, nel contenuto o nel menu, piuttosto che creare una reindirizzazione permanente.
- Le URL provenienti da link esterni sui quali il webmaster non ha controllo: una reindirizzazione 301 verso il contenuto più vicino preserva il valore del link trasmesso da questi backlink.
Questa classificazione evita di creare decine di reindirizzazioni inutili che appesantiscono la configurazione del server e mascherano i veri problemi.
Rilevare le 404 in Google Search Console: lettura del rapporto di indicizzazione
Il rapporto “Pagine” della Search Console elenca le URL che Google non è riuscito a indicizzare, classificate per motivo. Gli errori 404 appaiono sotto l’etichetta “Non trovata (404)” e i soft 404 sotto “Soft 404”. Queste due categorie meritano una lettura separata.
Per ogni URL elencata, la Search Console indica la data dell’ultima esplorazione e la fonte di scoperta (sitemap, link interno, link esterno). La fonte di scoperta orienta la correzione: una 404 scoperta tramite la sitemap significa che il file XML fa riferimento a una pagina che non esiste più. Una 404 scoperta tramite un link interno segnala un collegamento rotto nel sito.
Un crawler esterno come Screaming Frog completa questa diagnosi esplorando l’intero sito dalla radice. Rileva i link interni che puntano a delle 404 anche se Google non li ha ancora segnalati, permettendo di agire prima che il problema emerga nella Search Console.
Monitorare le 404 nel tempo
Un audit occasionale non è sufficiente. Gli errori 404 appaiono ad ogni aggiornamento di contenuto, ogni rimozione di prodotto, ogni modifica della struttura dell’URL. Il monitoraggio regolare del rapporto di indicizzazione, combinato con una scansione mensile, consente di rilevare le nuove 404 prima che si accumulino.

Reindirizzazione 301 e codice 410: scegliere il segnale giusto
La reindirizzazione 301 indica a Google che il contenuto è stato spostato in modo permanente a un nuovo URL. Trasferisce una parte dell’autorità della vecchia pagina verso la nuova. È la correzione adatta quando un contenuto equivalente esiste altrove nel sito.
Il codice HTTP 410 (Gone) indica che la risorsa è stata rimossa definitivamente e che non è previsto alcun sostituto. Google tratta il 410 come un segnale più forte del 404 per rimuovere l’URL dal suo indice. Per contenuti obsoleti senza equivalente, il 410 è più esplicito.
Un errore comune consiste nel reindirizzare tutte le 404 verso la homepage. Google identifica questo schema e lo tratta come un soft 404: la reindirizzazione non porta alcun valore all’utente, e la homepage non corrisponde all’intenzione dell’URL originale. Ogni reindirizzazione deve puntare verso il contenuto più vicino all’argomento iniziale.
La gestione degli errori 404 non ha nulla di spettacolare, ma condiziona il modo in cui Google esplora e indicizza un sito. Una sitemap pulita, link interni verificati dopo ogni modifica della struttura, e una classificazione metodica delle URL segnalate sono sufficienti per mantenere un sito tecnicamente pulito su questo punto.



