El análisis de archivos de registro consiste en examinar los registros de acceso sin procesar de un servidor web para ver con exactitud cómo interactúan los rastreadores de los motores de búsqueda y los bots de compras con un sitio: qué páginas solicitan, con qué frecuencia y si encuentran errores durante el proceso. Para los catálogos basados ​​en feeds, es una de las pocas maneras de confirmar lo que Googlebot o un rastreador de marketplace realmente ven, en lugar de basarse en lo que indica el feed. Se diferencia de la mayoría de las herramientas de análisis porque captura todas las solicitudes que recibe un servidor, incluidas las de los bots que nunca aparecen en los informes de tráfico estándar.

Por qué es importante el análisis de archivos de registro

Un feed de productos puede estar perfectamente estructurado, pero las páginas de destino a las que enlaza son inaccesibles para los rastreadores, ya sea por una regla de robots.txt mal configurada, errores del servidor o redirecciones que los rastreadores abandonan a mitad de camino. El análisis de los archivos de registro es lo que revela estos problemas, pues muestra los códigos de estado HTTP reales y la frecuencia de rastreo que un servidor devuelve a un bot, independientemente de lo que indique un mapa del sitio o un feed. Esto afecta directamente al rendimiento de la búsqueda orgánica : una página de producto a la que un rastreador no puede acceder o que genera errores repetidamente acabará desapareciendo del índice, independientemente de la optimización de su contenido. En el caso de catálogos extensos, el análisis de registros también revela el desperdicio del presupuesto de rastreo: un bot dedica la mayor parte de sus visitas a URL filtradas de bajo valor en lugar de a las páginas de productos que realmente necesitan indexarse.

Cómo funciona el análisis de archivos de registro

Los registros del servidor registran cada solicitud con una marca de tiempo, el agente de usuario solicitante, la URL solicitada y el código de respuesta devuelto. Las herramientas de análisis de registros filtran estos datos brutos para obtener los agentes de usuario de rastreadores conocidos (Googlebot, Bingbot y bots específicos de marketplaces) y luego los agregan en patrones: qué rutas de URL se rastrean con mayor frecuencia, cuáles devuelven errores 404 o 500, y cómo ha cambiado la frecuencia de rastreo con el tiempo. Estos datos se comparan a menudo con los resultados de la evaluación comparativa de feeds para ver si los problemas de rastreo se correlacionan con las desaprobaciones o las caídas de clasificación en categorías de productos específicas, y se incorporan a paneles de análisis de feeds más amplios como un dato más junto con los datos de clics y conversiones.

Ejemplo

<item>
  <g:id>SKU-20956</g:id>
  <title>Merino Wool Hiking Socks - 2 Pack</title>
  <g:link>https://example-shop.com/products/merino-wool-hiking-socks</g:link>
  <g:availability>in stock</g:availability>
</item>

Análisis de archivos de registro en una URL como la que se encuentra en link mostraría si Googlebot realmente está llegando a esta página y obteniendo una 200 respuesta, o encontrarse repetidamente con una redirección o un error que explique por qué el listado no se posiciona a pesar de tener una entrada de feed bien construida.

Conceptos relacionados

El análisis de archivos de registro es más valioso combinado con la evaluación comparativa de feeds , ya que los errores de rastreo suelen explicar deficiencias de rendimiento que la evaluación comparativa por sí sola solo puede detectar, no diagnosticar. También es útil con un seguimiento más amplio de la búsqueda orgánica , dado que la accesibilidad al rastreo es un requisito previo para el posicionamiento. Integrado en la revisión periódica de análisis de feeds , permite detectar un tipo de problema —del lado del servidor, no del feed— que ninguna optimización de título o precio puede solucionar por sí sola.