SEO técnico

Auditoría SEO técnica: guía paso a paso (2026)

Una auditoría SEO técnica comprueba si Google puede rastrear, renderizar e indexar tu web. Revisa rastreo, indexación, robots.txt, sitemaps, canonicals, redirecciones y velocidad, y corrige por impacto.

Por Equipo de investigación de SEORecheck, auditores SEOPublicado 10 min de lectura

Una auditoría SEO técnica es una revisión estructurada para saber si los buscadores pueden descubrir, rastrear, renderizar e indexar las páginas que quieres posicionar, y si algo en la infraestructura de tu web se lo impide. Incluye rastreo, indexación, robots.txt, sitemaps, canonicals, redirecciones, códigos de estado, JavaScript, móvil, Core Web Vitals, datos estructurados y logs del servidor.

El contenido y los enlaces solo rinden cuando esta base funciona. Un artículo excelente que devuelve noindex, está detrás de una cadena de redirecciones o aparece en blanco sin JavaScript simplemente no compite.

Si es tu primera auditoría, empieza por qué es una auditoría SEO; para una lista más amplia que también cubre contenido y enlaces, consulta el checklist de auditoría SEO.

¿Qué incluye una auditoría SEO técnica?

Una auditoría completa responde cinco preguntas, en este orden:

  1. ¿Pueden los buscadores encontrar las páginas? (enlaces internos, sitemaps, robots.txt)
  2. ¿Pueden rastrearlas? (códigos de estado, redirecciones, errores de servidor, trampas de rastreo)
  3. ¿Pueden renderizarlas? (JavaScript, recursos bloqueados)
  4. ¿Las van a indexar? (noindex, canonicals, duplicados, calidad)
  5. ¿Ofrecen una buena experiencia? (móvil, Core Web Vitals, HTTPS, datos estructurados)

Cada capa depende de la anterior. No tiene sentido optimizar el LCP de una plantilla que Google no indexa.

Área Qué revisar
Rastreo Códigos de estado, profundidad, páginas huérfanas, trampas
Indexación Informe de indexación de páginas, URLs excluidas
robots.txt Secciones y recursos bloqueados
Sitemaps Solo URLs 200, indexables y canónicas
Canonicals Autorreferencia, señales coherentes
Redirecciones Cadenas, bucles, 302 en vez de 301
Renderizado Contenido y enlaces en el HTML renderizado
Móvil Paridad con escritorio, diseño usable
Core Web Vitals Datos de campo de LCP, INP y CLS
Datos estructurados Válidos y coherentes con el contenido visible
Logs Qué solicita realmente Googlebot

Paso 1: rastrea la web como un buscador

Empieza con un rastreo completo usando un crawler como Screaming Frog SEO Spider, Sitebulb o similar. Configura el user agent como Googlebot Smartphone, respeta robots.txt en la primera pasada y conecta Search Console y analítica si la herramienta lo permite.

Del rastreo, extrae:

  • Códigos de estado: todas las URLs 4xx y 5xx con enlaces internos.
  • Profundidad de clic: páginas importantes a más de tres o cuatro clics de la home.
  • Páginas huérfanas: URLs del sitemap o de analítica sin ningún enlace interno.
  • Trampas de rastreo: filtros, calendarios o parámetros de sesión que generan URLs infinitas como /zapatillas?color=rojo&talla=42&orden=precio&page=37.

Compara el número de URLs rastreables con el de páginas que de verdad quieres indexar. Si la web de una empresa con 400 páginas expone 12.000 URLs rastreables, hay un problema de parámetros o de paginación.

Paso 2: revisa la indexación en Google Search Console

El informe de Indexación de páginas de Google Search Console muestra cuántas URLs están indexadas y por qué el resto no. Es la pantalla más útil de toda la auditoría técnica.

¿Cómo se interpreta el informe de indexación de páginas?

Abre Indexación → Páginas y céntrate en la tabla de motivos por los que las páginas no se indexan. No todos son un problema: «Página alternativa con etiqueta canónica adecuada» y «Página con redirección» suelen ser esperables. Merecen investigación «Excluida por la etiqueta "noindex"» en páginas que quieres posicionar, «Duplicada: el usuario no ha indicado ninguna versión canónica», «Duplicada: Google ha elegido una versión canónica diferente a la del usuario», «Soft 404», «Bloqueada por robots.txt» en URLs importantes y los dos estados de descubrimiento: «Descubierta: actualmente sin indexar» y «Rastreada: actualmente sin indexar». El primero, en webs grandes, suele apuntar a presupuesto de rastreo o enlazado interno débil; el segundo indica que Google obtuvo la página, pero no la consideró lo bastante valiosa o distinta. Abre cada motivo, exporta ejemplos y pásalos por la Inspección de URLs para ver la canónica elegida por Google, la fecha del último rastreo y el HTML renderizado.

Paso 3: revisa el robots.txt

El robots.txt controla el rastreo, no la indexación. Una URL bloqueada puede aparecer en resultados (sin fragmento) si otras páginas la enlazan, y Google no puede ver una etiqueta noindex en una página que no tiene permitido rastrear.

Una configuración típica y segura:

User-agent: *
Disallow: /carrito/
Disallow: /checkout/
Disallow: /*?sessionid=

Sitemap: https://example.com/sitemap.xml

Errores frecuentes:

  • Un Disallow: / que se quedó del entorno de pruebas.
  • Carpetas de CSS o JavaScript bloqueadas que Google necesita para renderizar.
  • Intentar desindexar páginas con robots.txt en lugar de noindex o un 404/410.
  • Reglas para rastreadores de IA (GPTBot, ClaudeBot, PerplexityBot, Google-Extended) que bloquean también a Googlebot por error. Bloquear Google-Extended no afecta a la Búsqueda de Google; solo controla el uso de tu contenido en Gemini. Lo explicamos en cómo aparecer en AI Overviews.

Paso 4: valida los sitemaps XML

Un sitemap debe listar solo las URLs que quieres indexar: estado 200, indexables y con canonical a sí mismas. Todo lo demás envía señales contradictorias.

Comprueba que:

  • El sitemap está declarado en robots.txt y enviado en Search Console.
  • No contiene URLs redirigidas, 404, con noindex ni no canónicas.
  • <lastmod> refleja cambios reales de contenido, no la fecha en que se generó el archivo.
  • Cada archivo tiene como máximo 50.000 URLs y 50 MB sin comprimir; las webs grandes usan un índice de sitemaps.
  • En webs multilingües, todas las versiones de idioma están incluidas (opcionalmente con anotaciones hreflang; mira nuestra guía de hreflang).

Paso 5: audita canonicals y contenido duplicado

Cada página indexable debe tener un canonical autorreferente con URL absoluta:

<link rel="canonical" href="https://example.com/servicios/auditoria-seo/">

Los duplicados suelen venir de variantes de protocolo y host (http://, www), barras finales, mayúsculas, parámetros UTM, ordenaciones y filtros, o versiones para imprimir. El canonical, los enlaces internos, el sitemap y las redirecciones deben apuntar a la misma URL preferida.

Recuerda que el canonical es una sugerencia, no una directiva. Si la Inspección de URLs muestra una «canónica seleccionada por Google» distinta de la tuya, busca señales en conflicto: enlaces internos hacia la otra versión, contenido casi idéntico o un canonical que apunta a una página redirigida o con noindex.

Paso 6: corrige redirecciones, cadenas y códigos de estado

¿Qué es una cadena de redirecciones y por qué importa?

Una cadena de redirecciones se produce cuando una URL redirige a otra que vuelve a redirigir, por ejemplo http://example.com/pagina → https://example.com/pagina → https://www.example.com/pagina → https://www.example.com/pagina/. Cada salto añade latencia para el usuario y una petición extra para el rastreador, y Googlebot solo sigue un número limitado de saltos (Google Search Central habla de hasta 10) antes de abandonar. Las cadenas también enturbian las señales: el enlace interno, la entrada del sitemap y el canonical pueden apuntar cada uno a un paso distinto. La solución es sencilla: redirige cada URL antigua directamente a su destino final con una sola 301 (o 308) y actualiza enlaces internos y sitemaps para que usen la URL final; así la redirección queda solo como red de seguridad para enlaces externos y marcadores. Los bucles (A → B → A) son peores, porque la página nunca llega a cargarse, y suelen aparecer cuando se solapan reglas del CMS y del servidor.

Revisa también:

  • Redirecciones 302 para cambios permanentes (usa 301/308).
  • Soft 404: páginas de «no encontrado» que devuelven 200.
  • Errores 5xx en las Estadísticas de rastreo, que hacen que Google rastree más despacio.
  • Enlaces internos a URLs 3xx y 4xx: corrige el enlace, no solo la redirección.

Paso 7: comprueba el renderizado de JavaScript

Google renderiza JavaScript, pero lo hace después del rastreo y el proceso puede retrasarse o fallar. Otros buscadores y muchos rastreadores de IA directamente no ejecutan JavaScript.

Compara el HTML original (ver código fuente) con el renderizado (Inspección de URLs → «Ver página rastreada»). El título, la meta robots, el canonical, el contenido principal, los enlaces internos y los datos estructurados deben estar en la respuesta del servidor o, como mínimo, en la versión renderizada. Fallos habituales:

  • Enlaces hechos con <div onclick> en lugar de <a href>.
  • Contenido que solo carga tras una interacción (clic, scroll, pestañas que piden datos al abrirse).
  • Un noindex en el HTML inicial que JavaScript elimina después: Google puede no llegar a renderizar la página.
  • Scripts o APIs bloqueados en robots.txt.

Para webs con mucho contenido, el renderizado en servidor (SSR) o la generación estática siguen siendo la opción más segura.

Paso 8: revisa la experiencia móvil

Google aplica la indexación mobile-first a todas las webs, así que la versión que se indexa es la móvil. Verifica que las páginas móviles tengan el mismo contenido principal, encabezados, enlaces internos, datos estructurados y metaetiquetas que en escritorio. Un menú oculto está bien; contenido que falta, no. Revisa también el tamaño de los elementos táctiles, las fuentes, los intersticiales intrusivos y la etiqueta viewport:

<meta name="viewport" content="width=device-width, initial-scale=1">

Paso 9: mide las Core Web Vitals

Las Core Web Vitals miden la experiencia de usuarios reales: LCP (carga, bueno ≤ 2,5 s), INP (capacidad de respuesta, bueno ≤ 200 ms; sustituyó a FID en marzo de 2024) y CLS (estabilidad visual, bueno ≤ 0,1). Google las evalúa en el percentil 75 de los datos de campo del Chrome UX Report (CrUX).

Usa el informe Core Web Vitals de Search Console para localizar grupos de URLs (plantillas) que fallan y PageSpeed Insights para diagnosticar páginas concretas. Las puntuaciones de laboratorio de Lighthouse sirven para depurar, no son el veredicto. Las Core Web Vitals forman parte de las señales de experiencia en la página y funcionan más como criterio de desempate que como factor principal, aunque una plantilla lenta también reduce conversiones. En la guía de Core Web Vitals verás causas y soluciones por métrica.

Paso 10: valida los datos estructurados

Comprueba el JSON-LD con la Prueba de resultados enriquecidos de Google y el Schema Markup Validator. El marcado debe describir contenido visible en la página; las discrepancias pueden acabar en acciones manuales. Prioriza los tipos que aún generan funciones en la búsqueda: Product, fragmentos de reseñas, Article, BreadcrumbList, Organization, LocalBusiness, Event y Video. No añadas marcado FAQPage ni HowTo esperando resultados enriquecidos: Google eliminó los de HowTo en 2023 y retiró los de FAQ para todas las webs en mayo de 2026.

Paso 11: analiza los logs del servidor

Los logs muestran lo que los bots realmente solicitan, no lo que simula un crawler. Filtra el Googlebot verificado (con búsqueda DNS inversa, porque el user agent se puede falsificar) y busca:

  • Qué parte de las visitas del bot se va en URLs con parámetros, redirecciones y errores.
  • Secciones importantes que Googlebot apenas visita.
  • Picos de respuestas 5xx o tiempos de respuesta lentos.
  • Actividad de rastreadores de IA como GPTBot, OAI-SearchBot, ClaudeBot y PerplexityBot, si quieres saber cómo usan tu web.

¿Sin acceso a logs? El informe de Estadísticas de rastreo de Search Console (Ajustes → Estadísticas de rastreo) ofrece un buen resumen por código de respuesta, tipo de archivo y tipo de Googlebot.

¿Qué herramientas necesitas para una auditoría SEO técnica?

Herramienta Coste Ideal para
Google Search Console Gratis Indexación, sitemaps, datos de campo CWV, estadísticas de rastreo
PageSpeed Insights Gratis Rendimiento de campo y laboratorio por URL
Prueba de resultados enriquecidos Gratis Validez de los datos estructurados
Bing Webmaster Tools Gratis Segunda visión del índice, IndexNow
Screaming Frog / Sitebulb Freemium / de pago Rastreos completos, renderizado JS, redirecciones
Analizador de logs (p. ej. Screaming Frog Log File Analyser) De pago Comportamiento real de los bots

¿Cómo priorizar los problemas de SEO técnico?

Una auditoría técnica de una web real puede sacar cientos de avisos, y la mayoría no importan. Prioriza cada problema según tres factores: impacto (¿impide rastrear o indexar páginas, o solo debilita un poco una señal?), alcance (¿una URL o una plantilla entera?) y esfuerzo (¿una línea de configuración o una migración de plataforma?). Primero van los bloqueos en plantillas que generan ingresos: un noindex accidental, un Disallow en una carpeta clave, canonicals rotos, errores de servidor o contenido que no se renderiza. Después, las ineficiencias a nivel de plantilla, como cadenas de redirecciones en la navegación, variantes duplicadas de URL y Core Web Vitals que fallan en grupos con mucho tráfico. Los avisos cosméticos —alt vacío en imágenes decorativas, títulos largos en entradas archivadas— van al final. Agrupa las correcciones en un plan a 30/60/90 días, asigna un responsable a cada una y programa una nueva revisión para confirmar que todo se desplegó e indexó.

Puntos clave

  • Audita en orden de dependencia: descubrimiento → rastreo → renderizado → indexación → experiencia.
  • El informe de indexación de páginas y la Inspección de URLs son tu fuente de verdad sobre lo que Google indexa.
  • El robots.txt controla el rastreo, no la indexación; para desindexar usa noindex o 404/410.
  • Canonical, enlaces internos, sitemap y redirecciones deben coincidir en una única URL preferida.
  • No implementes marcado FAQ ni HowTo para conseguir resultados enriquecidos: ya no se muestran.
  • Prioriza por impacto × alcance ÷ esfuerzo y vuelve a comprobar después de desplegar.

Una auditoría técnica sin hacerlo todo tú

Si prefieres saber en qué punto está tu web antes de dedicar horas a rastreos y exportaciones, puedes solicitar una vista previa gratuita de la auditoría SEO: una puntuación SEO y varios problemas reales con ejemplos de tus propias páginas. ¿Quieres ver antes cómo es un informe completo? Echa un vistazo al informe de ejemplo.

Todos los artículos

SEO técnico

Core Web Vitals: qué son y cómo mejorar LCP, INP y CLS

Las Core Web Vitals son tres métricas de Google sobre la experiencia real: LCP (carga, ≤ 2,5 s), INP (respuesta, ≤ 200 ms) y CLS (estabilidad visual, ≤ 0,1), medidas en el percentil 75.

11 min de lectura

SEO internacional

Hreflang: qué es y cómo implementarlo sin errores

Hreflang es una señal que le indica a Google qué versión de idioma o región de una página mostrar a cada usuario. Se implementa con etiquetas HTML, cabeceras HTTP o un sitemap XML.

10 min de lectura

Auditoría SEO

Cuánto cuesta una auditoría SEO: precios y qué incluye

Una auditoría SEO puede ser gratis (herramientas automáticas) o costar desde unos cientos hasta varios miles de euros si es profesional y puntual. El tamaño de la web, su complejidad y la profundidad marcan el precio.

8 min de lectura