DICCIONARIO · E

Errores de rastreo

Los errores de rastreo son los fallos que impiden a un buscador como Google acceder a una web o a alguna de sus URL cuando intenta leerlas: problemas de DNS, servidor caído, robots.txt inaccesible, páginas 404, soft 404 o redirecciones rotas. Importan porque lo que Googlebot no puede rastrear no se indexa ni puede posicionar.

Raúl Aránega Segura Escrito por Raúl Aránega Segura 6 min de lectura
Ficha rápida
Tipo
Problemas técnicos de SEO que bloquean el acceso de los rastreadores
Niveles
De sitio (DNS, servidor, robots.txt) y de URL (404, soft 404, 5xx, redirecciones, 401/403)
Dónde verlos
Informes «Indexación de páginas» y «Estadísticas de rastreo» de Google Search Console
Informe antiguo
Google retiró el informe «Errores de rastreo» de la Search Console antigua, según anunció en enero de 2019
Redirecciones
Los rastreadores de Google siguen hasta 10 saltos de redirección

≡En resumen

  • Un error de rastreo impide que Googlebot lea una web entera o una URL concreta.
  • Los errores de sitio (DNS, servidor, robots.txt) son los más graves porque afectan a todas las páginas.
  • El antiguo informe «Errores de rastreo» ya no existe: hoy se revisan «Indexación de páginas» y «Estadísticas de rastreo».
  • Un robots.txt que responde 5xx puede frenar el rastreo de toda la web durante horas.
  • No todos los errores piden acción: los 404 de URL que nunca existieron son normales.

01 ¿Qué son los errores de rastreo?

Para entenderlos hay que situarlos en el proceso: primero Google rastrea (descarga la página), después la indexa (la analiza y la guarda) y solo entonces puede posicionarla. Un error de rastreo corta la cadena en el primer eslabón. Por eso aparecen en cualquier análisis técnico junto a la indexación y al uso que Google hace de su tiempo en tu web.

02 Tipos de errores de rastreo

Se dividen en dos grupos. Los errores de sitio impiden el acceso a toda la web y son urgentes. Los errores de URL afectan a páginas concretas y se priorizan según su tráfico y sus enlaces.

Error Nivel Qué ocurre
Resolución de DNS Sitio Google no consigue traducir el dominio a una IP
Conectividad del servidor Sitio El servidor no responde, rechaza la conexión o tarda demasiado
Obtención de robots.txt Sitio El archivo robots.txt devuelve 5xx o no se puede descargar
Error del servidor (5xx) URL La página falla al generarse; Google ralentiza el rastreo
No se ha encontrado (404) URL La URL no existe
Soft 404 URL La página parece un error pero responde 200
Error de redirección URL Cadena demasiado larga, bucle o URL de destino vacía o incorrecta
Bloqueada (401 / 403) URL Pide autenticación o prohíbe el acceso a Googlebot
Bloqueada por robots.txt URL Una regla Disallow impide rastrearla
Errores de sitio y de URL más habituales

03 Errores de sitio: DNS, servidor y robots.txt

01

DNS

El dominio no resuelve por un cambio de hosting, registros mal configurados o un proveedor caído. Google lo trata como un error de servidor.

02

Servidor

Tiempos de espera, conexiones rechazadas o caídas por picos de tráfico, bots agresivos o un plan de hosting insuficiente.

03

robots.txt

Si el archivo responde 5xx, Google deja de rastrear el sitio durante las primeras 12 horas y después usa la última versión válida durante 30 días.

Los fallos de resolución suelen tener su origen en la configuración del DNS del dominio, sobre todo durante una migración de hosting o de dominio.

04 Cómo ver los errores de rastreo en Search Console (2026)

  1. 1

    Indexación de páginas

    En Indexación > Páginas, la sección «Por qué no se indexan las páginas» agrupa los motivos: Error del servidor (5xx), Error de redirección, No se ha encontrado (404), Soft 404, bloqueos 401 y 403, y URL bloqueada por robots.txt.

  2. 2

    Estadísticas de rastreo

    En Ajustes > Estadísticas de rastreo, el apartado «Estado del host» indica si hubo problemas con la obtención de robots.txt, la resolución de DNS o la conectividad del servidor en los últimos 90 días.

  3. 3

    Desglose por respuesta

    En ese mismo informe verás las solicitudes de Googlebot agrupadas por código de respuesta: un aumento de 5xx o de 404 es la primera señal de alarma.

  4. 4

    Inspección de URLs

    Para una URL concreta, comprueba si Google puede rastrearla, qué código recibió y prueba la versión publicada.

  5. 5

    Validar corrección

    Tras arreglar un motivo del informe de indexación, pulsa «Validar corrección». Google avisa de que el proceso suele durar unas dos semanas.

Si todavía no la usas, la ficha de Google Search Console explica cómo dar de alta tu web y qué significa cada informe.

05 Cómo solucionar cada error de rastreo

Error Solución habitual
DNS Revisar los registros A/AAAA y los servidores de nombres con tu proveedor de dominio
Servidor o 5xx Revisar logs, recursos del hosting, plugins pesados y bloqueos del firewall o del CDN a Googlebot
robots.txt inaccesible Asegurar que responde 200 (o 404 si no quieres usarlo) y que no lo bloquea ninguna capa de seguridad
404 Redirigir con 301 si hay un contenido equivalente; si no, dejar el 404 y corregir los enlaces internos
Soft 404 Devolver 404 o 410 si la página no existe, o darle contenido real si debe indexarse
Error de redirección Eliminar bucles y cadenas, apuntando directamente a la URL final
401 / 403 Quitar la protección de las páginas públicas o dejar de enlazar las privadas
Diagnóstico y solución por tipo de error

Los errores 404 merecen un análisis aparte, porque la mayoría no son un problema y solo hay que actuar sobre los que tenían tráfico o enlaces. Si además has notado una bajada de visitas, sigue esta guía para saber por qué tu web ha perdido posiciones en Google.

06 Errores de rastreo y presupuesto de rastreo

Google ajusta cuánto rastrea tu web según la salud del servidor: los errores 5xx y 429 le piden que ralentice temporalmente, y los 404 hacen que visite esas URL cada vez menos. En sitios con miles de páginas, los errores repetidos, las cadenas de redirecciones y los soft 404 desperdician el presupuesto de rastreo y retrasan la indexación del contenido nuevo.

Ejemplo · Ejemplo: una tienda que dejó de indexar novedades

Un ecommerce con 20.000 fichas cambia de plataforma. Durante la migración, el servidor responde 503 en horas punta y el filtro de colores genera redirecciones en cadena. En Estadísticas de rastreo se ve una caída de solicitudes diarias y en Indexación de páginas crecen los «Descubierta: actualmente sin indexar». Tras ampliar recursos, dejar una sola redirección por URL y bloquear los filtros sin valor, el rastreo se recupera en pocas semanas.

07 Cómo prevenir los errores de rastreo

  • ✓Revisa cada semana «Indexación de páginas» y «Estadísticas de rastreo», no solo cuando cae el tráfico.
  • ✓Monitoriza la disponibilidad del servidor con alertas de caída.
  • ✓Comprueba que el robots.txt responde 200 tras cada cambio de CDN, firewall o plugin de seguridad.
  • ✓Prepara un mapa de redirecciones antes de cualquier migración o rediseño.
  • ✓Mantén el sitemap XML solo con URL canónicas que respondan 200.
  • ✓Rastrea tu web con una herramienta propia una vez al mes para detectar enlaces rotos y cadenas de redirecciones.
  • ✓Documenta los cambios técnicos para poder relacionarlos con los picos de errores.

Muchos de estos fallos aparecen en webs WordPress por plugins y plantillas; Marketing Directo recoge algunos en Los diez errores de SEO para WordPress que hay que evitar para aparecer en Google. Una auditoría SEO los detecta y prioriza de una vez, y el trabajo continuo de posicionamiento web en Google evita que reaparezcan.

Preguntas frecuentes sobre Errores de rastreo

Es un fallo que impide a Googlebot u otro rastreador acceder a tu web o a una URL concreta, por problemas de DNS, del servidor, del robots.txt o por códigos de error como 404 o 5xx.

Ya no existe con ese nombre: Google lo retiró de la Search Console antigua. Hoy se consultan el informe «Indexación de páginas» y el de «Estadísticas de rastreo», en Ajustes.

Sí, cuando afectan a páginas importantes o a toda la web: lo que Google no puede rastrear no se indexa ni posiciona. Los 404 de URL irrelevantes no perjudican.

El error de sitio (DNS, servidor, robots.txt) impide el acceso a toda la web; el error de URL afecta solo a páginas concretas, como un 404 o un soft 404.

Según la ayuda de Search Console, la validación suele tardar unas dos semanas, aunque puede alargarse; Google avisa por correo cuando termina.

Google deja de rastrear el sitio las primeras 12 horas y después usa la última versión válida del archivo durante 30 días, así que hay que corregirlo cuanto antes.

Fuentes consultadas

Raúl Aránega Segura

Sobre el autor

Raúl Aránega Segura

CEO y especialista SEO en appyweb

Fundador de appyweb. Más de una década posicionando webs y tiendas online en Google y, ahora, en las respuestas de la IA.

Ver perfil en LinkedIn ↗

Términos relacionados

Ver todos los términos →
C Crawl Budget El crawl budget (presupuesto de rastreo) es el conjunto de URLs que Googlebot puede y quiere rastrear de un sitio web en un periodo, según la capacidad del servidor y el interés que Google tiene en su contenido. Solo preocupa en webs grandes o que cambian a diario: si se desperdicia, las páginas nuevas tardan en indexarse. E Error 404 Un error 404 es la respuesta con la que un servidor indica que la URL solicitada no existe, aunque la web funcione. En SEO importa distinguirlo del soft 404 (una página de error que devuelve 200) y del 410 (eliminado para siempre), porque cada caso se gestiona de forma distinta y afecta al rastreo y a la indexación. S Search Console Search Console es la herramienta gratuita de Google que muestra cómo ve, rastrea e indexa Google tu web y con qué búsquedas apareces: clics, impresiones, CTR y posición media. Sirve para detectar errores técnicos, enviar sitemaps y medir el SEO con datos del propio Google, incluidos AI Overviews y el Modo IA. C Crawling El crawling (rastreo) es el proceso por el que un programa automático, llamado crawler, araña o bot, recorre la web siguiendo enlaces y descargando páginas para que un buscador o una IA pueda analizarlas. Es el primer paso del SEO: si Google no puede rastrear una URL, no la indexará ni la mostrará en sus resultados. I Indexación La indexación es el proceso por el que un buscador como Google analiza una página que ya ha rastreado y guarda su información en su índice, una enorme base de datos. Solo las páginas indexadas pueden aparecer en los resultados de búsqueda: si una URL no está en el índice, no existe para Google. A Araña web Una araña web (web spider, crawler o rastreador) es un programa automático que recorre Internet visitando páginas y siguiendo sus enlaces para descargar su contenido, normalmente con el fin de indexarlo en un buscador. Googlebot es la más conocida. Si una araña no puede rastrear tu web, esa web no aparecerá en Google ni en las respuestas de muchas IA.

Cuéntanos tu proyecto. Te respondemos en 48 h.

Auditoría gratuita de IA, campañas, web y SEO, con prioridades y cifras reales de tu negocio.

✓ Sin compromiso ✓ Respuesta en 48 h laborables ✓ Un consultor senior, no un bot
WA WhatsApp