Búsqueda y SEO

¿Por qué un sitemap válido muestra «no se pudo recuperar»?

John Mueller, de Google, explica por qué Search Console indica «no se pudo recuperar» en un sitemap XML válido y qué aconseja para los rastreadores de IA.

Respuesta breve

El aviso «no se pudo recuperar» de Search Console puede aparecer aunque el archivo del sitemap sea válido. Según John Mueller, de Google, las causas son la carga del servidor y la demanda de rastreo, que suele depender de la calidad percibida del sitio. El problema no siempre es técnico. Para los rastreadores de IA, Mueller recomienda el nombre estándar.

Lo más destacado

  • Incluso un sitemap válido, de acceso público y enlazado desde robots.txt puede mostrar el error «no se pudo recuperar».
  • Destacan dos causas: que Google no tenga tiempo de rastrear el sitio (carga del servidor) y que la demanda de rastreo sea baja.
  • Mueller dijo que la mayoría de los rastreadores de entrenamiento de IA no permiten enviar un sitemap, por lo que sugiere el nombre sitemap.xml o un feed RSS.
Primer plano de código HTML en la pantalla de un ordenador
Foto: Bibek ghosh / Pexels

3 min de lecturaAutor: Editor de UNIT JournalDirector editorial: Uğur Deniz İlhan

En el pódcast de Google Search Off the Record, John Mueller y Martin Splitt explicaron por qué Search Console puede indicar «no se pudo recuperar» (couldn't fetch) incluso con un sitemap XML válido. Según Search Engine Journal, el personal de Google es consciente de la frustración de los usuarios.

¿Por qué no se puede recuperar un sitemap válido?

La primera causa que describió Mueller es la carga del servidor: si los sistemas de Google están ocupados rastreando otras páginas del sitio, quizá no tengan tiempo de recuperar el sitemap, y Search Console también lo notifica como «no se pudo recuperar». SEJ añade que un servidor que devuelve errores bajo mucho tráfico puede producir el mismo resultado.

La segunda causa es la demanda de rastreo. Según Mueller, si los sistemas de Google no ven necesidad de rastrear mucho más de un sitio, pueden omitir el sitemap. Esa demanda se basa a menudo en la calidad percibida del sitio, de modo que el asunto no es puramente técnico. Añadió que, si la calidad mejora de forma notable, Google empezará a usar el archivo.

¿Cómo encuentran un sitemap los rastreadores de IA?

Mueller dijo que la mayoría de los rastreadores de entrenamiento de IA no tienen una consola donde enviar un sitemap. En otra información de SEJ propone dos vías para los sitios que quieren que su contenido aparezca en sistemas de IA: publicar el archivo con su nombre genérico, sitemap.xml, o apostar por los feeds RSS. Dijo haber visto en sus propios registros del servidor que algunos rastreadores de IA acceden a su sitemap y a sus archivos RSS, pero no los nombró.

Se mostró prudente con llms.txt: Mueller comparó el archivo Markdown con un sitemap HTML y dijo que los sistemas de Google no pueden usarlo como sitemap. No ve inconveniente en probarlo, pero no aconseja depender de él.

¿Qué deberían hacer los sitios web?

Los comentarios muestran que un aviso en rojo de Search Console no debe tratarse automáticamente como un fallo técnico. Si el archivo valida y es accesible, hay que mirar los registros del servidor y la calidad del contenido del sitio.

  • Revise los registros del servidor en busca de respuestas de error a las solicitudes de Googlebot; si el servidor falla en horas de mucho tráfico, corrija primero la infraestructura.
  • Publique el sitemap como sitemap.xml e indíquelo en robots.txt; evite un nombre personalizado salvo que quiera mantenerlo privado.
  • En sitios con noticias o contenido de blog, enlace el feed RSS desde la cabecera de la página; ofrece a los rastreadores de IA una vía adicional para descubrir contenido.
  • No use llms.txt en lugar de un sitemap; si quiere probarlo, manténgalo junto al sitemap XML.

Preguntas frecuentes

¿El error «no se pudo recuperar» del sitemap perjudica el posicionamiento?
Las fuentes no establecen esa relación; el error indica que no se pudo recuperar el archivo. Sin embargo, si la causa es una demanda de rastreo baja, puede ser una señal sobre la calidad del sitio.

Fuentes

  1. Search Engine Journal — 'Google Explains Couldn't Fetch Sitemap Errors' ·
  2. Search Engine Journal — Mueller: AI crawlers and sitemaps ·

Siga a UNIT Journal

Las novedades en búsqueda, IA y tecnología, cada día en su feed.

Artículos relacionados

← Volver a UNIT Journal

Midamos hoy
su visibilidad.

Analizamos su visibilidad actual en buscadores y su posición en los motores generativos. Gratis, en una página y con datos reales.

Solicitar un análisis