- Rastreo (Crawling): Googlebot explora la web.
- Indexación: Guarda las páginas en su índice.
- Ranking: Ordena los resultados en función de relevancia.
- Volumen de búsqueda
- Dificultad (competencia)
- Intención del usuario (informativa, transaccional, navegacional)
- Título (Title Tag): el texto más importante, debe incluir la palabra clave.
- Meta descripción: resumen que aparece en Google.
- Encabezados (H1, H2...): organizan el contenido.
- URL amigables: claras y con palabras clave. Ej: tusitio.com/como-hacer-seo
- Contenido: útil, original, bien estructurado.
- Imágenes: optimizadas, con atributo alt.
- Publicar contenido útil y que se comparta.
- Colaborar con otros sitios/blogs.
- Crear herramientas o recursos gratuitos.
- Estar en directorios relevantes o medios locales.
- Sitio responsive (se ve bien en móviles)
- Velocidad de carga (GTmetrix, PageSpeed Insights)
- Estructura de enlaces internos (ayuda a que Google entienda el sitio)
- Archivos: robots.txt, sitemap.xml
- Evitar contenido duplicado
- Indexación correcta
- Google Search Console
- Google Analytics
- Ahrefs Webmaster Tools
Sí. Aquí tienes las respuestas teóricas que suelen pedirse en un TP sobre Sitemap y robots.txt.
Sitemap y robot.txt
1. ¿Qué es un Sitemap XML?
Es un archivo en formato XML que contiene una lista de las páginas de un sitio web. Su función es ayudar a los motores de búsqueda a descubrir e indexar el contenido del sitio.
2. ¿Para qué sirve?
Facilita que Google y otros buscadores encuentren las páginas del sitio.
Ayuda a indexar contenido nuevo o actualizado más rápidamente.
Es especialmente útil en sitios grandes o con muchas páginas.
3. ¿Quién utiliza el Sitemap?
Principalmente los robots de los motores de búsqueda, como:
Googlebot (Google)
Bingbot (Bing)
Otros rastreadores de buscadores.
4. ¿Dónde se ubica?
Generalmente se coloca en la raíz del sitio web.
Ejemplo:
https://www.ejemplo.com/sitemap.xml
5. ¿Cómo se envía a Google?
Se puede enviar desde Google Search Console, agregando la URL del sitemap en la sección Sitemaps. También es recomendable incluir su dirección dentro del archivo robots.txt.
6. ¿Qué información contiene?
Contiene las URLs del sitio y puede incluir datos como:
Fecha de última modificación (
lastmod)Frecuencia de actualización (
changefreq)Prioridad (
priority)
1. ¿Qué es un robots.txt?
Es un archivo de texto que indica a los robots de los motores de búsqueda qué partes del sitio pueden rastrear y cuáles no.
2. ¿Qué significa User-agent?
Indica a qué robot van dirigidas las reglas.
Ejemplos:
User-agent: *
Significa que las reglas se aplican a todos los robots.
3. ¿Qué hace Disallow?
Impide que los robots rastreen una carpeta o página específica.
Ejemplo:
Disallow: /admin/
Indica que los robots no deben rastrear la carpeta admin.
4. ¿Qué hace Allow?
Permite el acceso a una carpeta o archivo, incluso si existen restricciones más generales.
Ejemplo:
Allow: /
Permite rastrear todo el sitio.
5. ¿Qué significa la línea Sitemap?
Indica a los buscadores dónde se encuentra el archivo sitemap.xml.
Ejemplo:
Sitemap: https://www.ejemplo.com/sitemap.xml
6. ¿Qué ocurre si escribimos?
User-agent: *
Disallow: /
Se solicita a todos los robots que no rastreen ninguna página del sitio. Esto puede impedir que el contenido sea descubierto e indexado correctamente.
7. ¿El robots.txt elimina páginas de Google?
No. El archivo robots.txt solo controla el rastreo de los robots. Si una página ya está indexada o es enlazada desde otros sitios, puede seguir apareciendo en los resultados de búsqueda. Para evitar la indexación se utilizan otras técnicas, como la etiqueta noindex o la eliminación mediante herramientas del buscador.
Diferencia entre Sitemap y robots.txt
| Sitemap XML | robots.txt |
|---|---|
| Indica qué páginas existen en el sitio. | Indica qué páginas o carpetas pueden rastrear los robots. |
| Ayuda a descubrir e indexar contenido. | Controla el acceso de los robots al contenido. |
| Se utiliza para facilitar la indexación. | Se utiliza para administrar el rastreo del sitio. |
Normalmente se llama sitemap.xml. | Normalmente se llama robots.txt. |
- 3 palabras clave principales relacionadas al tema del sitio.
- 2 palabras clave de cola larga.
- Anotar volumen de búsqueda aproximado y competencia.
- Indicar cuál es la intención de búsqueda para cada palabra.
- Subir las capturas de pantallas
- Etiqueta <title> con palabra clave principal.
- <meta name="description"> descriptiva y llamativa.
- Encabezados jerárquicos (H1, H2...) con palabras clave secundarias.
- Imagen optimizada con alt.
- URL amigable.

No hay comentarios:
Publicar un comentario