Un error 404 es un código de estado HTTP enviado por un servidor cuando no encuentra el recurso solicitado en la URL indicada. El navegador recibe este código, muestra un mensaje del tipo “página no encontrada”, y el visitante abandona el sitio. Para los motores de búsqueda, la situación es diferente: Googlebot registra esta respuesta, la consigna en sus informes, y ajusta su comportamiento de rastreo en consecuencia.
Error 404 y soft 404: dos problemas, dos correcciones
Google hace una clara distinción entre un error 404 clásico y un soft 404. El primero ocurre cuando el servidor envía explícitamente el código HTTP 404 o 410: la página ya no existe, el servidor lo confirma. El tratamiento es claro.
El soft 404, por su parte, plantea un problema más insidioso. La página devuelve un código HTTP 200 (éxito), pero su contenido se asemeja a una página vacía, un mensaje de error o un resultado sin datos. Google la clasifica entonces como soft 404 en el informe de indexación de la Search Console, incluso si técnicamente el servidor no ha reportado ningún error.
Esta distinción cambia la corrección a aplicar. Para una página realmente eliminada, el código 404 o 410 es la respuesta correcta, solo hay que decidir si una redirección 301 hacia un contenido relevante está justificada. Para un soft 404, hay que enriquecer el contenido para que merezca existir o devolver un verdadero código 404.
Antes de cualquier acción, es útil entender el error 404 en Google para hacer un diagnóstico fiable.

Soft 404 en sitios dinámicos: la trampa del renderizado JavaScript
Los sitios de comercio electrónico y los medios a menudo generan páginas de resultados filtrados, de facetas de productos o de categorías temporalmente vacías. Estas páginas “cero resultados” son una causa frecuente de soft 404 a gran escala. Google las explora, observa una plantilla casi vacía, y las reporta masivamente en la Search Console.
Otro caso trampa se refiere al renderizado JavaScript. Una página puede mostrarse correctamente en un navegador, con todo su contenido cargado del lado del cliente, pero aparecer vacía o incompleta para Googlebot si el renderizado JS falla. La página funciona para un humano, no para el robot. Google la clasifica entonces como soft 404 sin que el webmaster se dé cuenta en la navegación clásica.
La verificación se realiza a través de la herramienta de inspección de URL en la Search Console, que muestra la versión de la página tal como la ve Google. Si el renderizado mostrado difiere de lo que muestra el navegador, el problema está del lado de JavaScript, no del lado del servidor.
Clasificar los errores 404 antes de corregirlos
Corregir todas las 404 de un sitio sin distinción es una pérdida de tiempo. La buena práctica consiste en clasificar cada URL reportada según su estado real antes de actuar. Se destacan cuatro categorías:
- Las URL que corresponden a contenido eliminado voluntariamente: el código 404 o 410 es la respuesta correcta. No se necesita ninguna acción, Google eventualmente las eliminará de su índice.
- Las URL que apuntaban a contenido movido o renombrado: una redirección 301 hacia la página equivalente es la única corrección pertinente. Redirigir a la página de inicio es tratado por Google como un soft 404.
- Las URL generadas por enlaces internos rotos (error tipográfico, cambio de estructura): hay que corregir el enlace en la fuente, en el contenido o en el menú, en lugar de crear una redirección permanente.
- Las URL provenientes de enlaces externos sobre los cuales el webmaster no tiene control: una redirección 301 hacia el contenido más cercano preserva el jugo de enlace transmitido por esos backlinks.
Esta clasificación evita crear decenas de redirecciones innecesarias que sobrecargan la configuración del servidor y ocultan los verdaderos problemas.
Detectar los 404 en Google Search Console: lectura del informe de indexación
El informe “Páginas” de la Search Console lista las URL que Google no ha podido indexar, clasificadas por motivo. Los errores 404 aparecen bajo la etiqueta “No encontrado (404)” y los soft 404 bajo “Soft 404”. Estas dos categorías merecen una lectura separada.
Para cada URL listada, la Search Console indica la fecha de última exploración y la fuente de descubrimiento (sitemap, enlace interno, enlace externo). La fuente de descubrimiento orienta la corrección: un 404 descubierto a través del sitemap significa que el archivo XML referencia una página que ya no existe. Un 404 descubierto a través de un enlace interno señala un enlace roto en el sitio.
Un crawler externo como Screaming Frog complementa este diagnóstico al recorrer la totalidad del sitio desde la raíz. Detecta los enlaces internos que apuntan a 404 incluso si Google aún no los ha reportado, lo que permite actuar antes de que el problema se eleve en la Search Console.
Monitorear los 404 a lo largo del tiempo
Una auditoría puntual no es suficiente. Los errores 404 aparecen en cada actualización de contenido, cada eliminación de producto, cada modificación de estructura de URL. La supervisión regular del informe de indexación, combinada con un rastreo mensual, permite detectar los nuevos 404 antes de que se acumulen.

Redirección 301 y código 410: elegir la señal correcta
La redirección 301 indica a Google que el contenido ha sido movido de forma permanente a una nueva URL. Transfiere parte de la autoridad de la antigua página a la nueva. Es la corrección adecuada cuando existe contenido equivalente en otro lugar del sitio.
El código HTTP 410 (Gone) indica que el recurso ha sido eliminado de forma definitiva y que no se prevé ningún reemplazo. Google trata el 410 como una señal más fuerte que el 404 para eliminar la URL de su índice. Para contenido obsoleto sin equivalente, el 410 es más explícito.
Un error frecuente consiste en redirigir todas las 404 a la página de inicio. Google identifica este patrón y lo trata como un soft 404: la redirección no aporta ningún valor al usuario, y la página de inicio no corresponde a la intención de la URL original. Cada redirección debe apuntar al contenido más cercano al tema inicial.
La gestión de errores 404 no tiene nada de espectacular, pero condiciona la forma en que Google explora e indexa un sitio. Un sitemap limpio, enlaces internos verificados después de cada modificación de estructura, y una clasificación metódica de las URL reportadas son suficientes para mantener un sitio técnicamente limpio en este aspecto.



