Analiza plików dziennika to praktyka polegająca na badaniu surowych logów dostępu serwera WWW w celu dokładnego sprawdzenia, w jaki sposób roboty indeksujące wyszukiwarki i boty zakupowe wchodzą w interakcję z witryną – jakich stron żądają, jak często i czy napotykają po drodze błędy. W przypadku katalogów opartych na kanałach jest to jeden z niewielu sposobów potwierdzenia, co faktycznie widzi Googlebot lub robot indeksujący platformę, zamiast polegać na tym, co powinno się tam znaleźć według danych z kanału. Wyróżnia się ona na tle większości narzędzi analitycznych, ponieważ rejestruje każde żądanie otrzymywane przez serwer, w tym żądania od botów, które nigdy nie pojawiają się w standardowych raportach ruchu.
Dlaczego analiza plików dziennika jest ważna
Kanał produktowy może być idealnie ustrukturyzowany, podczas gdy strony docelowe, do których prowadzi, są niedostępne dla robotów indeksujących — zablokowane przez błędnie skonfigurowaną regułę robots.txt, zwracające błędy serwera lub przekierowujące przez łańcuchy, z których roboty rezygnują w połowie. Analiza plików dziennika ujawnia te problemy, ponieważ pokazuje rzeczywiste kody statusu HTTP i częstotliwość indeksowania, jakie serwer zwraca do bota, niezależnie od tego, co twierdzi mapa witryny lub kanał. Ma to bezpośrednie znaczenie dla wydajności organicznych wyników wyszukiwania : strona produktu, do której robot indeksujący nie może dotrzeć lub na której wielokrotnie pojawiają się błędy, ostatecznie wypadnie z indeksu, niezależnie od tego, jak dobrze zoptymalizowana jest jej zawartość. W przypadku dużych katalogów analiza dziennika ujawnia również marnotrawstwo budżetu indeksowania — bot spędza większość wizyt na filtrowanych adresach URL o niskiej wartości zamiast na stronach produktów, które faktycznie wymagają indeksowania.
Jak działa analiza plików dziennika
Dzienniki serwera rejestrują każde żądanie wraz ze znacznikiem czasu, żądającym agentem użytkownika, żądanym adresem URL i zwróconym kodem odpowiedzi. Narzędzia do analizy dzienników filtrują te surowe dane do znanych agentów użytkownika robota indeksującego (Googlebot, Bingbot i boty specyficzne dla Marketplace), a następnie agregują je we wzorce: które ścieżki URL są indeksowane najczęściej, które zwracają błędy 404 lub 500 oraz jak zmieniała się częstotliwość indeksowania w czasie. Dane te są często porównywane z wynikami testów porównawczych kanałów, aby sprawdzić, czy problemy z indeksowaniem korelują z odrzuceniami lub spadkami pozycji w rankingu dla określonych kategorii produktów. Są one również przekazywane do szerszych paneli analitycznych kanałów jako dodatkowy element danych wejściowych, obok danych o kliknięciach i konwersjach.
Przykład
<item>
<g:id>SKU-20956</g:id>
<title>Merino Wool Hiking Socks - 2 Pack</title>
<g:link>https://example-shop.com/products/merino-wool-hiking-socks</g:link>
<g:availability>in stock</g:availability>
</item>
Analiza pliku dziennika pod adresem URL takim jak ten w link pokaże, czy Googlebot faktycznie dociera do tej strony i otrzymuje 200 odpowiedź lub wielokrotne przekierowanie lub błąd, który mógłby wyjaśnić, dlaczego oferta nie jest wyświetlana w wynikach wyszukiwania, mimo że została poprawnie wpisana do kanału.
Powiązane pojęcia
Analiza plików dziennika jest najcenniejsza w połączeniu z benchmarkingiem kanałów , ponieważ błędy indeksowania często wyjaśniają luki w wydajności, które same testy porównawcze mogą jedynie sygnalizować, a nie diagnozować, a także z szerszym śledzeniem organicznych wyników wyszukiwania , ponieważ dostępność indeksowania jest warunkiem koniecznym do uzyskania jakiejkolwiek pozycji w rankingu. Włączona do regularnego przeglądu analityki kanałów , wykrywa problem – po stronie serwera, a nie kanału – którego nie rozwiąże żadna optymalizacja tytułu ani ceny.