Log pokazuje żądanie, nie ocenę treści

Log dostępu jest zapisem żądań obsłużonych przez określoną warstwę infrastruktury. Może pomóc ustalić, kiedy pobierano adres i jaką odpowiedź otrzymał klient. Nie jest jednak listą podstron zaakceptowanych do wyników wyszukiwania. Google zaznacza, że pobranie strony nie oznacza automatycznie jej indeksowania. Zanim rozpoczniesz analizę, zapisz pytanie, na które log ma odpowiedzieć.

Przykładowe pytanie brzmi: „czy po publikacji nowych poradników robot otrzymywał prawidłowe odpowiedzi, czy trafiał na błędy?”. To zadanie różne od ustalenia, dlaczego artykuł nie osiąga wysokiej pozycji. Log może wskazać przeszkodę techniczną, ale nie zastąpi oceny użyteczności treści i dopasowania do zapytań. Takie rozdzielenie chroni przed wyciąganiem daleko idących wniosków z samej częstotliwości odwiedzin robota.

Ustal, z której warstwy pochodzą dane

Poproś administratora o opis źródła logów: serwer aplikacji, proxy, CDN lub zapora. Jeśli część odpowiedzi jest obsługiwana z pamięci podręcznej przed dotarciem do hostingu, log aplikacji może nie przedstawiać wszystkich żądań. Nie łącz plików z kilku warstw bez sprawdzenia, czy opisują te same zdarzenia. W przeciwnym razie jedno pobranie zostanie policzone wielokrotnie.

Zanotuj przedział czasu, strefę czasową, zasady rotacji i brakujące okresy. Do analizy SEO zwykle potrzebujesz adresu, czasu, metody, statusu i informacji o kliencie; zakres zależy od konfiguracji serwera. Ogranicz dostęp do plików, ponieważ mogą zawierać dane niepotrzebne do raportu, np. identyfikatory i parametry żądań. Pracuj na kopii, a raport dla szerszego zespołu przygotuj jako zestawienie zagregowane.

Nie ufaj samemu napisowi Googlebot

User-Agent jest deklaracją klienta i może zostać podrobiony. Google opisuje weryfikację przez sprawdzenie reverse DNS i ponowne rozwiązanie otrzymanej nazwy do pierwotnego IP albo porównanie z publikowanymi zakresami adresów. Jeśli log ma służyć ważnej diagnozie, odróżnij żądania zweryfikowane od tych, które tylko przedstawiają się jako robot Google.

Zachowaj metodę i datę weryfikacji. Przy większym zbiorze zadanie powinno zostać wykonane przez osobę znającą konfigurację infrastruktury, zwłaszcza gdy oryginalny adres klienta przekazuje zaufane proxy. Nie przyjmuj dowolnego nagłówka z adresem IP jako pewnego dowodu pochodzenia. W raporcie może istnieć grupa „niezweryfikowane”; to uczciwsze niż przypisanie każdego podejrzanego żądania do wyszukiwarki i budowanie na tym całej strategii.

Pogrupuj adresy według funkcji

Podziel ścieżki na ofertę, poradniki, paginację, obrazy, zasoby techniczne oraz błędne adresy. Usuń z analizy duplikaty wynikające z nieistotnych wariantów tylko wtedy, gdy rozumiesz ich znaczenie. Nie obcinaj wszystkich parametrów mechanicznie: w niektórych serwisach mogą wskazywać odrębne treści. Zachowaj zarówno oryginalny URL do kontroli, jak i świadomie znormalizowaną grupę raportową.

Dla każdej grupy policz żądania, unikalne adresy i rozkład statusów. Przykładowo 300 pobrań jednej ilustracji nie jest tym samym co odwiedzenie 300 artykułów. Odróżnij również liczbę prób od liczby poprawnie obsłużonych odpowiedzi. Przy analizie nowego zestawu treści przygotuj listę docelowych URL-i i sprawdź je osobno, zamiast wyciągać wnioski z sumy całej domeny.

Szukaj wzorców błędów i rozbieżności

Zwróć uwagę na grupy adresów z błędami 5xx lub odpowiedziami 429. Google traktuje je jako sygnały problemów serwera i może ograniczać tempo pobierania. Sprawdź korelację z godzinami przeciążenia, wdrożeniem lub zmianą reguł zapory. Pojedynczy błąd i długotrwała seria to różne sytuacje, dlatego raport powinien pokazywać czas trwania, nie tylko łączny licznik.

Porównaj także odpowiedzi dla zwykłej przeglądarki i zweryfikowanych robotów. Jeżeli człowiek otrzymuje artykuł, a robot stronę blokady, sprawdź konfigurację ochrony zamiast od razu edytować treść. Nie wyłączaj całej zapory, aby usunąć jeden problem. Przygotuj precyzyjną diagnozę i uzgodnij bezpieczną poprawkę, a następnie potwierdź jej działanie w nowych logach.

Połącz logi z innymi źródłami

Zestaw datę pobrania z informacją o publikacji i stanem adresu w narzędziach wyszukiwarki. Brak odnotowanej wizyty może wynikać z niepełnych logów, a obecność wizyty nie daje gwarancji indeksacji. Sprawdź ważne strony indywidualnie. Nie buduj reguły, że poradnik musi być dobry, ponieważ Googlebot pobiera go często, albo zły, bo częstotliwość spadła.

Dane o linkowaniu wykorzystaj jako kontekst odkrywania treści. Jeżeli nowy artykuł nie ma połączeń z resztą serwisu, sprawdź nawigację i mapę strony. Nie próbuj wymuszać odświeżania przez masowe tworzenie nowych wariantów URL. Celem jest czytelna struktura i sprawne dostarczenie materiału, nie sztuczne zwiększenie liczby żądań widocznych w raporcie technicznym.

Zamknij analizę konkretnym zadaniem

Dobre podsumowanie logów wskazuje adres lub grupę, potwierdzony problem, zakres czasowy i sposób naprawy. Przykład: „nowe poradniki otrzymywały 403 z określonej reguły zapory; poprawiono regułę i potwierdzono prawidłowe odpowiedzi”. Taki wniosek można odebrać technicznie. Stwierdzenie „Google ma zły stosunek do domeny” nie wynika z logu i nie prowadzi do sprawdzalnej czynności.

Wyznacz termin ponownej kontroli oraz sposób ograniczonego przechowywania danych. Nie potrzebujesz bezterminowego archiwum wszystkich żądań do oceny każdego małego wydania bloga. Zachowaj metodę, zagregowany wynik i dowody istotnych ustaleń. Analiza logów ma uzupełniać pracę nad widocznością i autorytetem domeny, a nie zastępować ją obliczaniem liczby wizyt robota jako nowego celu marketingowego.

Czytaj dalej