Access logy: Co jsou, jak je číst a proč je každý SEO specialista potřebuje
Access logy jsou soubory, které váš webový server automaticky vytváří při každém požadavku – ať už ho posílá člověk v prohlížeči, nebo Googlebot při procházení webu. Jsou to nejpřesnější data o tom, co se na vašem serveru děje. A přesto je většina majitelů webů nikdy neotevřela.
Stručná definice: Access log (protokol přístupu) je soubor generovaný webovým serverem, který zaznamenává každý HTTP požadavek na jakýkoli soubor – stránku, obrázek, CSS soubor nebo skript. Každý řádek odpovídá jednomu požadavku a obsahuje informace o tom, kdo žádal, co žádal, kdy a s jakým výsledkem.
Co přesně access logy zaznamenávají?
Každý řádek access logu je záznam jednoho HTTP požadavku. Takto vypadá typická položka z Apache serveru:
66.249.66.1 - - [20/May/2026:09:14:32 +0200] "GET /blog/seo-audit/ HTTP/1.1" 200 14823 "-" "Mozilla/5.0 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)"
Rozpis jednotlivých polí:
| Pole | Hodnota v příkladu | Co znamená |
|---|---|---|
| IP adresa | 66.249.66.1 | Odkud přišel požadavek (IP Googlebotu) |
| Datum a čas | 20/May/2026:09:14:32 | Kdy přišel požadavek |
| HTTP metoda | GET | Typ požadavku (GET = načtení stránky) |
| URL | /blog/seo-audit/ | Která stránka nebo soubor byl požadován |
| HTTP protokol | HTTP/1.1 | Verze protokolu |
| Stavový kód | 200 | Výsledek požadavku (200 = OK) |
| Velikost odpovědi | 14823 | Počet bajtů odeslaných serverem |
| Referrer | - | Odkud přišel uživatel (pomlčka = přímý přístup) |
| User agent | Googlebot/2.1 | Kdo požadavek poslal (prohlížeč nebo bot) |
Kromě těchto základních polí mohou access logy obsahovat také čas zpracování požadavku, SSL protokol, nebo virtual host – záleží na konfiguraci serveru.

Typy access logů
V praxi nebo při optimalizaci se setkáte se třemi hlavními kategoriemi:
1) Webové access logy jsou nejdůležitější pro SEO. Zaznamenávají každý HTTP/HTTPS požadavek na webový server – stránky, obrázky, soubory ke stažení, API volání.
2) Error logy jsou oddělené soubory, kde server zaznamenává chyby – neúspěšné požadavky, konfigurační problémy nebo timeouty. Z pohledu SEO jsou důležité pro diagnostiku 5xx chyb.
3) FTP a databázové logy se týkají přístupu k souborům přes FTP nebo SQL dotazů na databázi. Pro SEO méně relevantní, ale užitečné při bezpečnostních auditech.
Kde access logy najdete?
Umístění souborů závisí na webovém serveru a hostingové platformě:
Apache (Linux, RHEL-based systémy):
/var/log/httpd/access_log
Apache (Debian/Ubuntu):
/var/log/apache2/access.log
Nginx:
/var/log/nginx/access.log
Windows Server (IIS):
C:\inetpub\logs\LogFiles\W3SVC\
Pokud nemáte přímý přístup na server přes SSH, access logy najdete přes:
- cPanel → sekce Logs → Raw Access (nebo Access Logs)
- Plesk → Websites & Domains → Logs
- FTP přístup → složka
/logs/nebo/var/log/ - Správce souborů hostingové platformy – většina poskytovatelů hostingu má tuto funkci v administračním panelu
Soubory mohou být komprimované (.gz). Pro jejich otevření použijte zcat v terminálu nebo je rozbalte lokálně.
Proč jsou access logy důležité pro SEO?
Google Analytics a Google Search Console jsou skvělé nástroje – ale mají slepá „místa“. Access logy je nemají.
1) Vidíte přesně, co dělá Googlebot
GSC ukazuje, co Google indexoval. Access logy ukazují, co Google navštívil – včetně stránek, které nakonec neindexoval, stránek s chybami, nebo URL, které jste ani nevěděli, že existují.
Z logů zjistíte:
- Jak často Googlebot chodí na jednotlivé sekce webu (crawl frekvence)
- Které stránky ignoruje přesto, že jsou v sitemapě
- Které stránky crawluje zbytečně – například parametrické URL, které byste měli blokovat v robots.txt
- Zda Googlebot naráží na chyby – 404, 500, přesměrování
- Jak rychle server odpovídá – pokud je response time příliš vysoký, Googlebot může omezit crawlování
2) Odhalíte crawl budget problémy
Crawl budget je počet stránek, které Googlebot za určité období na vašem webu obchází. Pokud ho plýtváte na stránky bez hodnoty (filtrované URL, parametry, session ID), méně důležité stránky se crawlují méně nebo vůbec.
Access logy jsou jediný způsob, jak crawl budget analyzovat přímo – nikoliv přes odhady nebo nepřímé signály.
Crawl budget vs. crawl demand – jaký je v tom rozdíl?
Crawl budget se často zjednodušuje na „kolik stránek Google za den navštíví“, ale ve skutečnosti je to výsledek dvou samostatných faktorů, které je užitečné rozlišovat:
- Crawl demand je, jak moc Google o váš obsah vůbec stojí – jinými slovy, jak často usoudí, že se na webu něco změnilo a stojí za to se vrátit. Weby s častými aktualizacemi obsahu nebo vysokou autoritou mají přirozeně vyšší crawl demand.
- Crawl budget (přesněji crawl rate limit) je technická kapacita, kterou je Googlebot ochoten na váš web investovat, aniž by ho přetížil – odvozuje se hlavně od toho, jak rychle a spolehlivě server odpovídá.
Rozdíl je důležitý prakticky – pokud máte pomalý server, crawl rate limit vás brzdí bez ohledu na to, jak zajímavý obsah publikujete (nízký budget, vysoký demand).
Pokud máte rychlý server, ale statický, neaktualizovaný obsah, Google prostě nemá důvod chodit často, i když by technicky mohl (vysoký budget, nízký demand).
V access lozích uvidíte hlavně důsledky prvního problému – odpovídá tomu vysoký response time a nízká frekvence návštěv i u důležitých, často aktualizovaných URL.
3) Vidíte ostatní boty, nejen Google
V access lozích jsou vidět všichni crawleři – Bingbot, Ahrefsbot, Semrushbot, Majestic, DotBot a desítky dalších. Pokud vás navštěvuje příliš mnoho agresivních botů, mohou zbytečně zatěžovat server a nepřímo ovlivňovat rychlost načítání pro reálné uživatele.
4) GA4 nezaznamenává vše
Google Analytics (a GA4) funguje na základě JavaScriptu v prohlížeči – takže nefunguje pro:
- Uživatele s blokovanými skripty (blokátory reklam)
- Požadavky přes API nebo automatizované nástroje
- Boty a crawlery
- Stránky, které se nenačetly kvůli serverové chybě
Access logy tyto mezery vyplňují – zaznamenávají absolutně vše, co server přijal.
Chcete vědět, jak Googlebot crawluje váš web a kde plýtváte crawl budgetem? Analýza access logů je součástí mého technického SEO auditu – napište mi na e-mail honzaschlemmer@gmail.com.
5) Access logy a AI crawlery – nová vrstva analýzy
Vedle Googlebota a klasických SEO botů (Ahrefsbot, Semrushbot) se v access lozích dnes objevuje ještě jedna kategorie, která před dvěma lety prakticky neexistovala – crawlery AI systémů.
Konkrétně GPTBot (OpenAI), ClaudeBot (Anthropic), PerplexityBot nebo Google-Extended (samostatný crawler pro trénování Google AI modelů, oddělený od klasického Googlebota).
Přítomnost, nebo naopak absence, těchto botů v logách je dnes stejně důležitý signál jako dřív byla přítomnost Googlebota. Pokud vás GPTBot nebo ClaudeBot nikdy nenavštívili, je prakticky nulová šance, že se váš obsah objeví jako zdroj v odpovědi ChatGPT nebo Claude – tyto systémy prostě nemají odkud brát data o vašem webu.
Praktický postup je stejný jako u Googlebota – filtrujte podle user agenta, sledujte frekvenci návštěv a porovnávejte ji mezi jednotlivými sekcemi webu. Pokud AI crawlery chodí jen na homepage a pár hlavních stránek, ale ignorují blog nebo produktové stránky, máte jasný signál, kam zacílit obsahovou nebo technickou práci, pokud vám jde o GEO viditelnost.
Zvláštní pozornost si zaslouží robots.txt – řada webů má AI crawlery zablokované, aniž by o tom majitel webu věděl (typicky zbytek konfigurace po předchozí agentuře nebo defaultní nastavení CMS).
Access log vám ukáže rozdíl mezi „bot se nesnaží“ a „bot se snaží, ale je odmítnutý“ – ve druhém případě uvidíte v logu požadavek se stavovým kódem 403, ne jeho absenci.
Jak číst access logy prakticky?
Nejrychlejší způsob, jak z access logů vytěžit hodnotu, je filtrovat podle HTTP stavových kódů:
- 200 OK – úspěšný požadavek. Normální stav pro indexované stránky.
- 301 a 302 – přesměrování. Vysoký podíl přesměrování pro Googlebot znamená, že interní linky nebo sitemap stále ukazují na staré URL. Každé přesměrování zpomalí crawl a může oslabit přenos odkazové síly.
- 404 Not Found – stránka neexistuje. Pokud Googlebot naráží na 404, ověřte, odkud na tuto URL přichází (referrer) – jsou to pravděpodobně zastaralé interní prolinkování nebo zpětné odkazy.
- 500 a 5xx – serverová chyba. Pokud Googlebot naráží na 5xx, crawlování se zpomaluje – Google si dá pozor, aby server dále nepřetěžoval. Opakující se 5xx chyby mohou vést k výpadkům z indexu.
- 403 Forbidden – přístup odepřen. Pokud se to děje pro URL, které má být přístupné, je problém v konfiguraci serveru nebo robots.txt.
TIP na čtení:
Nástroje pro analýzu access logů
Surový log soubor může mít stovky megabajtů – manuální čtení nedává smysl. Doporučuji používat tyto nástroje:
- Screaming Frog Log File Analyser je pravděpodobně nejpoužívanější SEO nástroj pro analýzu logů. Importujete soubor a dostanete přehledné filtry podle bota, URL, stavového kódu nebo data. Zdarma do 1 000 řádků, placená verze bez limitu – jedná se o samostatný nástroj nikoliv o Screaming Frog.
- Semrush Log File Analyzer je součástí předplatného Semrush. Přímá integrace s ostatními SEO daty – crawl vs. pozice vs. logy.
- GoAccess je open-source nástroj pro terminál nebo webové rozhraní. Rychlý, zvládne obrovské soubory, vhodný pro technicky zdatnější uživatele.
- Excel nebo Google Sheets pro menší soubory – importujte log jako CSV (s mezerou jako oddělovačem) a filtrujte přes pivot tabulky. Funguje pro rychlou orientaci, ne pro hloubkovou analýzu.
- Python (pandas) pro pokročilou analýzu – pokud zpracováváte logy pravidelně a automatizovaně, jednoduchý Python skript dokáže filtrovat, agregovat a exportovat výsledky rychleji než jakýkoli GUI nástroj.
Automatizace analýzy logů – kam dál od ručního exportu?
Ruční export a analýza v Screaming Frog Log Analyseru nebo Excelu funguje dobře pro jednorázový audit nebo menší web.
U větších e-shopů a webů s vysokou návštěvností, kde logy narůstají o gigabajty denně, se ale ruční přístup rychle stává neudržitelným.
Pro tyto případy má smysl přejít na automatizované řešení:
- Log streaming přímo do cloudového úložiště – server logy průběžně odesílá (typicky přes rsync nebo nativní logging integrace hostingu) do centrálního úložiště, odkud jdou analyzovat bez nutnosti ručního stahování.
- BigQuery nebo podobný analytický nástroj – u velkých objemů dat umožňuje spouštět SQL dotazy nad miliony řádků během vteřin, což ruční nástroje jednoduše nezvládají.
- Pravidelný cron skript (Python/pandas) – pro střední weby stačí naplánovaná úloha, která logy jednou denně nebo týdně zpracuje, agreguje klíčové metriky (crawl frekvence podle sekce, podíl chybových kódů, nové 404) a pošle přehled emailem nebo do Slacku.
Volba záleží hlavně na objemu dat a na tom, jak často potřebujete mít aktuální přehled. Pro většinu menších a středních klientů je dostatečná pravidelná ruční analýza jednou za měsíc až kvartál – automatizace dává smysl až tam, kde je crawl budget nebo indexace dlouhodobě citlivé téma (velké e-shopy, zpravodajské weby s vysokou frekvencí publikování).
Jak analyzovat logy z SEO pohledu? Postup krok za krokem
1. Exportujte log a očistěte data
Stáhněte log soubor ze serveru. Pokud je komprimovaný (.gz), rozbalte ho. Soubory za delší období (týden, měsíc) dávají lepší pohled než jeden den.
2. Filtrujte Googlebot
Izolujte pouze řádky, kde user agent obsahuje Googlebot. Pozor: existují i falešné Googleboty – IP adresy Googlebotu lze ověřit přes reverzní DNS lookup nebo seznam Googleových IP rozsahů.
3. Zjistěte crawl frekvenci
Jak často Googlebot navštívil váš web celkem? Jak se liší frekvence napříč sekcemi – blog vs. produktové stránky vs. kategorie? Stránky s nízkou crawl frekvencí nebo žádnou jsou signálem problému.
4. Identifikujte problematické URL
Hledejte:
- URL s opakujícími se 404 (→ opravte interní linky nebo nastavte přesměrování)
- URL s 5xx chybami (→ serverový problém k řešení)
- Parametrické URL (
?sort=,?page=,?color=), které by měly být blokovány (→ přidejte do robots.txt nebo nastavte canonical) - Stránky crawlované velmi často přesto, že nejsou důležité (→ plýtvání crawl budgetem)
5. Jak z logů poznat problém s renderováním JS stránek?
Tohle přímo navazuje na to, jak Googlebot crawluje moderní weby postavené na JavaScriptu. Google prochází stránky ve dvou vlnách – nejdřív si stáhne prvotní HTML bez vykonaného JS, teprve později se vrátí a stránku plně vyrenderuje.
V access lozích se to projeví jako dva samostatné požadavky na stejnou URL v různém čase – klidně s odstupem několika dní.
Pokud vidíte, že Googlebot danou URL navštívil jen jednou a nikdy se nevrátil pro renderovací průchod, je to signál, že stránka může mít problém s indexací obsahu, který se generuje až přes JavaScript.
Konkrétně hledejte:
- URL, které mají jen jeden záznam s user agentem Googlebot, ale žádný následný záznam v horizontu 1-2 týdnů
- Neobvykle dlouhý časový odstup mezi prvním a druhým průchodem u důležitých stránek (produkty, kategorie) – u velkých webů s omezeným rozpočtem na rendering to může trvat i týdny
- Kombinaci s vysokým response time – pomalu se renderující stránky mají menší šanci na rychlý druhý průchod
Pokud tohle chování vidíte u stránek, které stavíte na klíčovém obsahu generovaném přes JS, je to silný argument pro server-side rendering nebo aspoň pro prerendering klíčových částí stránky.
6. Porovnejte s indexací v GSC
Stránky, které Googlebot crawluje, ale GSC je neukazuje jako indexované – proč? Stránky, které jsou v sitemapě, ale Googlebot je nenavštívil – proč? Tato průsečíková analýza odhalí největší problémy.
Analýza access logů je komplexní práce. Pokud chcete konkrétní výstupy a doporučení bez toho, abyste se prokousávali gigabytovými soubory, ozvěte se mi na e-mail honzaschlemmer@gmail.com – tohle dělám pravidelně jako součást technických auditů.

Nejčastější otázky (FAQ)
1) Musím mít přístup na server, abych access logy získal?
Většinou ano – nebo alespoň přístup k hostingové administraci (cPanel, Plesk). Pokud jste na sdíleném hostingu bez přístupu k logům, požádejte svého poskytovatele – většina ho na vyžádání poskytne. Pokud ne, je to argument pro přechod na lepší hosting.
2) Jak velké access logy jsou?
Záleží na návštěvnosti. Malý web s tisícem návštěv denně generuje řádově desítky MB za měsíc. Větší e-shopy mohou mít gigabajty za den. Proto servery logy rotují (komprimují a archivují starší soubory) – obvykle denně nebo týdně.
4) Jsou access logy bezpečnostní riziko?
Logy obsahují IP adresy návštěvníků, takže v kontextu GDPR je třeba s nimi zacházet jako s osobními údaji. Ukládejte je na zabezpečeném místě, nesdílejte veřejně a dodržujte retenční politiku (typicky 30–90 dní).
5) Jak poznám, že Googlebot je skutečný a ne falešný?
Falešné Googleboty jsou reálný problém – každý může nastavit user agent na Googlebot. Ověření: proveďte reverzní DNS lookup pro IP adresu (host [IP]). Výsledek by měl končit na googlebot.com nebo google.com. Poté ověřte forwardní DNS – výsledek by měl odpovídat původní IP.
6) Jaký je rozdíl mezi access logem a error logem?
Access log zaznamenává každý požadavek – úspěšný i neúspěšný. Error log zaznamenává pouze chyby a problémy serveru s detailnějšími informacemi o příčině. Pro SEO analýzu začínáte u access logu, pro diagnostiku serverových problémů přejdete do error logu.
7) Je legální ukládat a analyzovat access logy s IP adresami bez souhlasu?
Ano, za splnění určitých podmínek. Na rozdíl od analytických nástrojů typu GA4, které obvykle vyžadují souhlas s cookies, u access logů se běžně opíráte o právní základ oprávněného zájmu provozovatele podle GDPR – logy potřebujete primárně z bezpečnostních a provozních důvodů (diagnostika chyb, ochrana proti útokům, zajištění dostupnosti služby), ne pro marketingové profilování.
To ale neznamená, že si s daty můžete dělat, co chcete.
V praxi to znamená tři konkrétní povinnosti:
- Zmínit ukládání logů v zásadách ochrany osobních údajů – i bez cookie souhlasu musí být zpracování transparentní.
- Nastavit přiměřenou retenční dobu – typicky 30-90 dní, delší uchovávání bez konkrétního důvodu je těžké obhájit.
- Zabezpečit přístup k logům – obsahují IP adresy, tedy osobní údaje, takže patří mezi soubory, ke kterým by měl mít přístup jen omezený okruh lidí.
Pokud logy sdílíte s externím SEO specialistou nebo agenturou kvůli auditu, jde technicky o zpracování osobních údajů třetí stranou – stojí za to mít to ošetřené aspoň základní smlouvou o zpracování (DPA), zejména u větších projektů.
Pár rad na závěr..
Access logy jsou jeden z nejpodceňovanějších zdrojů dat v SEO.
GA4 a GSC jsou skvělé nástroje, ale jsou závislé na JavaScriptu, souhlasu s cookies a interpretaci dat Googlem.
Access logy jsou přímý výstup serveru – nezkreslený, kompletní a nezávislý na jakémkoli měřicím kódu.
Pro technické SEO jsou klíčové zejména při analýze crawl budgetu, diagnostice indexačních problémů a ověření, jak Googlebot skutečně vnímá váš web.
Jeden správně provedený audit access logů může odhalit problémy, které žádný jiný nástroj nevidí.
Potřebujete technický SEO audit od SEO konzultanta, který zahrnuje i analýzu access logů a crawl budgetu? Podívejte se na mé SEO služby nebo mi napište přímo.
Nevíte kam dál? Podívejte se na můj SEO slovník pojmů.
📚 Zdroje:
- Google Search Central: Googlebot
- Google Search Central: Crawl budget
- Apache HTTP Server: Log Files documentation
- Nginx: Configuring Logging
- Screaming Frog: Log File Analyser
- Ahrefs Blog: Log File Analysis for SEO
Článek byl publikován: 20.5.2026. Autor článku: Jan Schlemmer.
Přečtěte si také:
- SEO vysvětlivky
- Black Hat SEO
- Alternativní stránka se správnou značkou kanonické stránky: Co tato hláška v GSC znamená?
- Interní prolinkování: návod, jak z něj vytěžit maximum - 28 července, 2026
- Drobečková navigace - 23 července, 2026
- Německo klasifikovalo AI Overviews jako mediální obsah – Co to znamená pro SEO? - 23 července, 2026
Jeden komentář