MartinPapež
Přehled v datech, ne hádání

Observability – přestaň hádat, co se v clusteru děje

Přestaň se ptát „proč to spadlo?" a začni to vědět dřív, než se tě na to zeptá šéf

Pro koho je tento kurz

Kurz je vhodný jak pro lidi, kteří s observabilitou teprve začínají, tak pro ty, kteří Prometheus nebo Grafanu už zapnuli podle návodu, ale chybí jim pochopení, proč a kdy který nástroj použít. Nemusíš mít žádnou předchozí zkušenost s monitoringem. Stačí základní orientace v Kubernetes.

Tenhle kurz je pro tebe, pokud:

  • pracuješ jako DevOps engineer, SRE, Platform Engineer nebo backend vývojář a Kubernetes už umíš nasadit a provozovat, ale ve chvíli, kdy něco přestane fungovat, se spoléháš na kubectl logs, náhodné restarty a intuici,
  • slyšíš kolem sebe pojmy Prometheus, Grafana, OpenTelemetry nebo distributed tracing, občas jsi je i zapnul podle návodu, ale nerozumíš pořádně tomu, co se pod kapotou děje a proč to nastavovat zrovna takhle,
  • máš pocit, že tvůj monitoring buď mlčí, když hoří, nebo tě zahltí desítkami alertů, ze kterých nepoznáš, který je opravdu důležitý,
  • chceš se posunout od reaktivního „hasím požár, až když si někdo stěžuje” k tomu, že problém uvidíš v datech dřív, než ho zaznamená uživatel,
  • uvažuješ o přechodu do DevOps/SRE role a víš, že observability je dovednost, kterou inzeráty čím dál častěji vyžadují, ale zatím sis na ni nesáhl v praxi.

Kurz je stavěný jako první pořádný krok k tomu, abys v týmu byl ten, kdo dokáže o incidentu říct „vidím přesně, kde a proč to selhalo” – ne ten, kdo čeká, až se problém vyřeší sám nebo ho vyřeší kolega.

Co si z kurzu odneseš

Kurz je koncipovaný jako srozumitelný úvod do observability – neprobereme každou funkci každého nástroje, ale postavíme pevné základy, na kterých budeš dál stavět. Cílem je, abys po jednom dni chápal principy natolik, že je dokážeš aplikovat i na nástroje a situace, které na kurzu neuvidíme.

Během jednoho dne projdeme mimo jiné:

  • Co observability vlastně je a proč monitoring nestačí – rozdíl mezi „vím, že něco nefunguje” (monitoring) a „vím proč to nefunguje” (observability), a proč tenhle rozdíl v praxi rozhoduje o tom, jak rychle incident vyřešíš.
  • Tři pilíře observability – metriky, logy a trace: k čemu je každý z nich dobrý, kdy sáhnout po kterém a jak se navzájem doplňují místo toho, aby ses u každého problému díval jen na jeden z nich.
  • Prometheus a jak funguje sběr metrik – pull model, exportery, scraping, základy PromQL – natolik, abys dokázal napsat dotaz, který ti řekne, co potřebuješ vědět, a ne jen kopíroval dotazy z internetu.
  • Grafana a stavba použitelných dashboardů – jak postavit dashboard, který ti při incidentu skutečně pomůže, místo hezké tabule plné grafů, kterým nikdo nerozumí ve tři ráno.
  • Alerting, který funguje – jak nastavit alerty tak, aby upozornily na skutečný problém a ne na šum, co je alert fatigue a proč je nebezpečnější než žádný monitoring.
  • Logging a jak v logách skutečně najít problém – strukturované logy, centralizace, na co se ptát, když prohledáváš tisíce řádků a hledáš jednu příčinu.
  • Distributed tracing a OpenTelemetry – proč u aplikací složených z více služeb nestačí logy a metriky, jak trace ukáže cestu requestu napříč systémem a kde přesně se zpomalil nebo spadl.
  • Propojení všeho dohromady na reálném scénáři – projdeme si simulovaný incident a společně si ukážeme, jak bys ho vystopoval pomocí metrik, logů a trace – přesně tak, jak by to probíhalo v produkci.
  • Časté chyby při zavádění observability – co lidi nejčastěji podcení (cardinality exploze v metrikách, přehlcení dashboardy, alerty na všechno) a jak se jim vyhnout hned od začátku.

Vše si vyzkoušíš na reálném prostředí s běžící aplikací, ne jen na slidech. Cílem je, abys po kurzu rozuměl principům observability natolik, že dokážeš sám vyhodnotit, co ve svém clusteru sledovat, jak si to nastavit a jak se v datech zorientovat, když něco přestane fungovat.

Proč tenhle kurz a ne další tutoriál

Nástrojů na observability existuje spousta a návody na ně taky. Problém je, že většina tě naučí nainstalovat Prometheus a Grafana a udělat jeden hezký dashboard – ale nevysvětlí ti, proč vůbec sledovat zrovna tyhle metriky, kdy sáhnout po tracingu místo logů, nebo proč tě po měsíci zahltí stovky zbytečných alertů.

Na tomto kurzu nejdřív pochopíš, proč observability funguje tak, jak funguje, a teprve pak se pustíš do praktických cvičení – v logické návaznosti, ne přeskakováním mezi pěti různými blogy a YouTube videi, z nichž každé řeší jen kousek problému.

A hlavně: neučí tě člověk z prezentace, ale konzultant, který observability roky nasazuje a provozuje v reálných produkčních firmách – takže se rovnou dozvíš, čeho se vyvarovat, než na to přijdeš sám a draze, uprostřed noci, když produkce padá a ty nevíš proč.

O lektorovi

Martin Papež

Martin Papež

Kubernetes konzultant / DevOps konzultant

Jmenuji se Martin Papež a v IT se pohybuji přes 15 let. Posledních 10 let se věnuji DevOps a SRE – mimo jiné jsem spolupracoval s firmami jako Seznam.cz, Zonky.cz nebo Phrase. Věnuji se školení a předávání zkušeností dál. Specializuji se na Kubernetes, CI/CD a cloud infrastrukturu, a to, co učím, jsem si odladil přímo v produkci, ne v tutoriálu. Například: jednou nám z ničeho nic přestala fungovat aplikace a server odpovídal se značným zpožděním – žádná chybová hláška, jen podezřele pomalá odezva. Po chvíli pátrání se ukázalo, že za tím stojí zahlcený etcd, kterému kvůli obrovskému množství objektů narostla databáze natolik, že přestal stíhat zpracovávat požadavky. Přesně tohle je typ situace, kdy nestačí znát příkazy – musíte rozumět tomu, co se děje pod kapotou. A to je to, co vás chci naučit.

Vyber si termín

Online

Observability – přestaň hádat, co se v clusteru děje

Jednodenní kurz v malé skupině, na kterém pochopíš základy observability – metriky, logy a distributed tracing – a naučíš se je prakticky používat při řešení problémů v Kubernetes. Vše si vyzkoušíš na reálném prostředí s běžící aplikací – odejdeš se znalostmi, které hned druhý den uplatníš při ladění vlastní produkce.

12.11.2026 · 11 500 Kč
Online

Observability – přestaň hádat, co se v clusteru děje

Jednodenní kurz v malé skupině, na kterém pochopíš základy observability – metriky, logy a distributed tracing – a naučíš se je prakticky používat při řešení problémů v Kubernetes. Vše si vyzkoušíš na reálném prostředí s běžící aplikací – odejdeš se znalostmi, které hned druhý den uplatníš při ladění vlastní produkce.

10.12.2026 · 11 500 Kč