1 of 12

Clase 6: SEO Técnico I

Indexabilidad y Rastreabilidad

Robots.txt, Sitemap XML, etiquetas Canonical, directivas Noindex/Nofollow e inspección técnica en Google Search Console.

SEO Aplicado y Optimización Web

CEIPA Business Center

Duración: 120 Min (2 Horas)

Enfoque: Robots.txt, Sitemaps & GSC

2 of 12

Agenda & Objetivos de la Sesión (90 Minutos)

Universidad de Medellín

1. Rastreabilidad & Robots

30 Minutos

2. Sitemaps & Directivas

30 Minutos

3. Search Console & Workshop

30 Minutos

Rastreabilidad vs. Indexabilidad.

Control con el archivo Robots.txt.

Optimización de Crawl Budget.

Arquitectura de Sitemap XML.

Directivas Noindex / Nofollow.

Canonicals contra contenido duplicado.

Inspección de URLs e Informes de Cobertura.

Envío de Sitemaps en GSC.

Taller asistido en WordPress.

3 of 12

Rastreabilidad (Crawlability) vs. Indexabilidad (Indexability)

Pilares Técnicos del Rastreo y Almacenamiento en Buscadores

Rastreabilidad (Crawlability)

Capacidad de los motores de búsqueda (Googlebot) para acceder y recorrer el contenido de tu sitio web siguiendo enlaces hipertexto.

Indexabilidad (Indexability)

Capacidad de una página para ser analizada, aprobada y almacenada en la base de datos oficial (Índice) de Google para aparecer en la SERP.

Herramientas clave:

Herramientas clave:

4 of 12

El Archivo Robots.txt y el Control del Crawl Budget

Gestión del Presupuesto de Rastreo y Reglas de Bloqueo

¿Qué es el Robots.txt?

Archivo de texto situado en la raíz de tu dominio (midominio.com/robots.txt) que actúa como el "guardia de seguridad" para indicarle a los bots a qué zonas NO deben ingresar.

Anatomía del Robots.txt Optimizado

Ahorra Crawl Budget bloqueando zonas inútiles.

Protege carpetas de administración (`/wp-admin/`).

User-agent: *

Disallow: /wp-admin/

Disallow: /?s=

Allow: /wp-admin/admin-ajax.php

Sitemap: https://tusitio.com/sitemap_index.xml

5 of 12

Sitemap XML: La Guía Turística para Googlebot

Indexación Acelerada y Mapeo Estructurado de URLs

1. Estructura XML

Documento estructurado que enumera todas las URLs públicas e importantes del sitio web junto con su última fecha de modificación (`lastmod`).

2. Sitemaps en Módulo

Rank Math genera automáticamente un `sitemap_index.xml` subdividido en `post-sitemap.xml`, `page-sitemap.xml` y `category-sitemap.xml`.

3. Envíos Automáticos

Permite a Googlebot descubrir nuevas entradas o landings inmediatamente sin esperar a que encuentre enlaces de forma pasiva.

6 of 12

Directivas Meta Robots: Noindex y Nofollow

Control Fino de Indexación y Transferencia de Autoridad

Directiva `noindex`

Le ordena explícitamente a Googlebot: "Rastrea esta página pero NO la guardes en tu índice ni la muestres en la SERP."

Casos de Uso: Páginas de políticas de privacidad, páginas de confirmación ("Thank you pages"), filtros de e-commerce o resultados de búsqueda interna.

Directiva `nofollow`

Le indica al robot que no transfiera autoridad (Link Juice) a través de los enlaces contenidos en esa página o hipervínculo específico.

Casos de Uso: Enlaces pagados/patrocinados, comentarios en blogs o enlaces hacia sitios externos no verificados.

7 of 12

Etiquetas Canonical (`rel="canonical"`): La Cura al Contenido Duplicado

Consolidación de Señales Semánticas y Evitación de Penalizaciones

El Problema del Contenido Duplicado

Varias URLs mostrando exactamente el mismo contenido (ej: parámetros de campaña, variantes de color en e-commerce, HTTP vs HTTPS).

La Solución Canonical

Indica a Google cuál es la URL original maestra ("maestra") que debe indexar y posicionar.

8 of 12

Google Search Console (GSC): Tu Centro de Control Técnico

Diagnóstico Técnico Oficial de Google

Herramienta de Inspección de URLs

Informe de Cobertura e Indexación

Comprobar si una URL específica está en el Índice de Google.

Solicitar indexación acelerada para nuevas páginas o cambios.

Detectar errores de renderizado o bloqueos por Robots.txt.

Indexadas: URLs procesadas y listas para la SERP.

Excluidas: URLs noindex o canónicas alternativas.

Errores: Errores 404, 500 o fallos del servidor.

9 of 12

Los 5 Errores Técnicos de Indexación Más Frecuentes

Prevención de Fallos Técnicos de Rastreo e Indexación

100% OK

1. Casilla WP Marcada

Mantener activa la casilla "Disuadir a los motores de búsqueda" insertando `noindex` global.

2. Bloqueo en Robots.txt

Bloquear accidentalmente carpetas de CSS/JS imposibilitando el renderizado de Googlebot.

3. Páginas Huérfanas

Páginas publicadas sin ningún enlace interno entrante, imposibles de encontrar por rastreo.

META DEL WORKSHOP DE HOY

Sitemap XML Publicado + Robots.txt Validado en GSC

10 of 12

Ejercicio en Vivo: "Auditoría de Rastreabilidad e Inspección GSC"

Demostración y Validación en Tiempo Real

Clase 06 / 16

Reto 1: Verificación Robots.txt

Verifica la presencia del comando Disallow y el enlace al Sitemap XML.

Reto 2: Inspección Sitemap XML

Comprueba que la URL de tu Landing Page figura dentro del mapa técnico.

Reto 3: Inspección en GSC

Prueba la URL en directo para verificar si es apta para indexación sin errores.

11 of 12

Checklist de Verificación Técnica de Indexabilidad

Control de Calidad Técnico Previo al Taller Práctico

1. Ajustes & Robots.txt

2. Sitemap & Canonicals

3. Search Console

Casilla de disuadir desmarcada en Ajustes de Lectura.

Archivo Robots.txt accesible públicamente.

Enlace al Sitemap XML dentro de Robots.txt.

Sitemap XML generado con Rank Math.

Etiquetas `rel="canonical"` apuntando a la URL correcta.

Páginas privadas/agradecimiento en `noindex`.

Propiedad del sitio verificada en GSC.

Sitemap XML enviado e indexado con éxito.

Inspección de URL limpia sin errores de rastreo.

12 of 12

¿Preguntas o Dudas sobre SEO Técnico I?

¡Tiempo de receso de 30 minutos! Al regresar iniciaremos el Workshop Práctico de 90 Minutos: Generación y verificación de Sitemap XML, edición optimizada de Robots.txt e inspección técnica de URLs en Google Search Console.

RECESO

30 Minutos

SEGUNDO TIEMPO

90 Min de Workshop Técnico