Clase 6: SEO Técnico I
Indexabilidad y Rastreabilidad
Robots.txt, Sitemap XML, etiquetas Canonical, directivas Noindex/Nofollow e inspección técnica en Google Search Console.
SEO Aplicado y Optimización Web
CEIPA Business Center
Duración: 120 Min (2 Horas)
Enfoque: Robots.txt, Sitemaps & GSC
Agenda & Objetivos de la Sesión (90 Minutos)
Universidad de Medellín
1. Rastreabilidad & Robots
30 Minutos
2. Sitemaps & Directivas
30 Minutos
3. Search Console & Workshop
30 Minutos
Rastreabilidad vs. Indexabilidad.
Control con el archivo Robots.txt.
Optimización de Crawl Budget.
Arquitectura de Sitemap XML.
Directivas Noindex / Nofollow.
Canonicals contra contenido duplicado.
Inspección de URLs e Informes de Cobertura.
Envío de Sitemaps en GSC.
Taller asistido en WordPress.
Rastreabilidad (Crawlability) vs. Indexabilidad (Indexability)
Pilares Técnicos del Rastreo y Almacenamiento en Buscadores
Rastreabilidad (Crawlability)
Capacidad de los motores de búsqueda (Googlebot) para acceder y recorrer el contenido de tu sitio web siguiendo enlaces hipertexto.
Indexabilidad (Indexability)
Capacidad de una página para ser analizada, aprobada y almacenada en la base de datos oficial (Índice) de Google para aparecer en la SERP.
Herramientas clave:
Herramientas clave:
El Archivo Robots.txt y el Control del Crawl Budget
Gestión del Presupuesto de Rastreo y Reglas de Bloqueo
¿Qué es el Robots.txt?
Archivo de texto situado en la raíz de tu dominio (midominio.com/robots.txt) que actúa como el "guardia de seguridad" para indicarle a los bots a qué zonas NO deben ingresar.
Anatomía del Robots.txt Optimizado
Ahorra Crawl Budget bloqueando zonas inútiles.
Protege carpetas de administración (`/wp-admin/`).
User-agent: *
Disallow: /wp-admin/
Disallow: /?s=
Allow: /wp-admin/admin-ajax.php
Sitemap: https://tusitio.com/sitemap_index.xml
Sitemap XML: La Guía Turística para Googlebot
Indexación Acelerada y Mapeo Estructurado de URLs
1. Estructura XML
Documento estructurado que enumera todas las URLs públicas e importantes del sitio web junto con su última fecha de modificación (`lastmod`).
2. Sitemaps en Módulo
Rank Math genera automáticamente un `sitemap_index.xml` subdividido en `post-sitemap.xml`, `page-sitemap.xml` y `category-sitemap.xml`.
3. Envíos Automáticos
Permite a Googlebot descubrir nuevas entradas o landings inmediatamente sin esperar a que encuentre enlaces de forma pasiva.
Directivas Meta Robots: Noindex y Nofollow
Control Fino de Indexación y Transferencia de Autoridad
Directiva `noindex`
Le ordena explícitamente a Googlebot: "Rastrea esta página pero NO la guardes en tu índice ni la muestres en la SERP."
Casos de Uso: Páginas de políticas de privacidad, páginas de confirmación ("Thank you pages"), filtros de e-commerce o resultados de búsqueda interna.
Directiva `nofollow`
Le indica al robot que no transfiera autoridad (Link Juice) a través de los enlaces contenidos en esa página o hipervínculo específico.
Casos de Uso: Enlaces pagados/patrocinados, comentarios en blogs o enlaces hacia sitios externos no verificados.
Etiquetas Canonical (`rel="canonical"`): La Cura al Contenido Duplicado
Consolidación de Señales Semánticas y Evitación de Penalizaciones
El Problema del Contenido Duplicado
Varias URLs mostrando exactamente el mismo contenido (ej: parámetros de campaña, variantes de color en e-commerce, HTTP vs HTTPS).
La Solución Canonical
Indica a Google cuál es la URL original maestra ("maestra") que debe indexar y posicionar.
Google Search Console (GSC): Tu Centro de Control Técnico
Diagnóstico Técnico Oficial de Google
Herramienta de Inspección de URLs
Informe de Cobertura e Indexación
Comprobar si una URL específica está en el Índice de Google.
Solicitar indexación acelerada para nuevas páginas o cambios.
Detectar errores de renderizado o bloqueos por Robots.txt.
Indexadas: URLs procesadas y listas para la SERP.
Excluidas: URLs noindex o canónicas alternativas.
Errores: Errores 404, 500 o fallos del servidor.
Los 5 Errores Técnicos de Indexación Más Frecuentes
Prevención de Fallos Técnicos de Rastreo e Indexación
100% OK
1. Casilla WP Marcada
Mantener activa la casilla "Disuadir a los motores de búsqueda" insertando `noindex` global.
2. Bloqueo en Robots.txt
Bloquear accidentalmente carpetas de CSS/JS imposibilitando el renderizado de Googlebot.
3. Páginas Huérfanas
Páginas publicadas sin ningún enlace interno entrante, imposibles de encontrar por rastreo.
META DEL WORKSHOP DE HOY
Sitemap XML Publicado + Robots.txt Validado en GSC
Ejercicio en Vivo: "Auditoría de Rastreabilidad e Inspección GSC"
Demostración y Validación en Tiempo Real
Clase 06 / 16
Reto 1: Verificación Robots.txt
Verifica la presencia del comando Disallow y el enlace al Sitemap XML.
Reto 2: Inspección Sitemap XML
Comprueba que la URL de tu Landing Page figura dentro del mapa técnico.
Reto 3: Inspección en GSC
Prueba la URL en directo para verificar si es apta para indexación sin errores.
Checklist de Verificación Técnica de Indexabilidad
Control de Calidad Técnico Previo al Taller Práctico
1. Ajustes & Robots.txt
2. Sitemap & Canonicals
3. Search Console
Casilla de disuadir desmarcada en Ajustes de Lectura.
Archivo Robots.txt accesible públicamente.
Enlace al Sitemap XML dentro de Robots.txt.
Sitemap XML generado con Rank Math.
Etiquetas `rel="canonical"` apuntando a la URL correcta.
Páginas privadas/agradecimiento en `noindex`.
Propiedad del sitio verificada en GSC.
Sitemap XML enviado e indexado con éxito.
Inspección de URL limpia sin errores de rastreo.
¿Preguntas o Dudas sobre SEO Técnico I?
¡Tiempo de receso de 30 minutos! Al regresar iniciaremos el Workshop Práctico de 90 Minutos: Generación y verificación de Sitemap XML, edición optimizada de Robots.txt e inspección técnica de URLs en Google Search Console.
RECESO
30 Minutos
SEGUNDO TIEMPO
90 Min de Workshop Técnico