Monitoring dostupnosti
Web spadne v pátek v 18:40 a vy se to dozvíte v pondělí ráno od naštvaného zákazníka. Monitoring stojí méně než jedna zmeškaná zakázka a rozdíl mezi čtyřmi minutami a čtyřiceti hodinami výpadku je jen v tom, kdo se to dozví první.
Hodina výpadku má konkrétní cenu, spočítejte si ji
Vezměte tržby za poslední tři měsíce a vydělte je počtem hodin, kdy reálně chodí objednávky. E-shop s obratem 400 000 korun měsíčně a špičkou mezi osmnáctou a dvaadvacátou hodinou nevydělá 555 korun za hodinu, ale skoro 2 000 korun v době, kdy lidé nakupují. Výpadek v úterý ve tři ráno je nepříjemnost, výpadek ve čtvrtek v devatenáct hodin je díra v kase.
U služeb je to horší, protože ztrátu nevidíte. Řemeslník s webem, který nese osm poptávek měsíčně, přijde při dvanáctihodinovém výpadku zhruba o čtvrtinu poptávky. Sama o sobě to není katastrofa. Katastrofa je, že ten člověk mezitím napsal konkurenci, dostal odpověď a vy se o něm nikdy nedozvíte. Tuhle ztrátu vám žádná analytika neukáže.
Přidejte k tomu reklamu. Když točíte 500 korun denně na kampaně a web je půl dne nedostupný, zaplatíte 250 korun za prokliky na stránku s chybou. Algoritmus si navíc zapamatuje horší výsledek a další dny doručuje dráž. Náklad výpadku tedy nekončí ve chvíli, kdy se web vrátí zpátky online.
Ping nestačí, kontrolujte to, na čem stojí obchod
Většina lidí si nastaví kontrolu, jestli server odpoví, a tím to hasne. Server ale může odpovídat vesele dál, zatímco databáze je mimo, košík hlásí chybu a formulář nikam neposílá. Viděl jsem web, který týden vracel status 200 a k tomu prázdnou bílou stránku. Monitoring byl celou dobu zelený a nikdo nic netušil.
Pořádná kontrola proto hledá konkrétní slovo v HTML. Na homepage třeba název firmy, v košíku slovo Objednávka, v detailu produktu cenu. Jakmile se slovo ztratí, něco se rozbilo, i když server stále odpovídá. Nastavení jedné takové kontroly zabere pět minut a chytí devět z deseti tichých poruch, které jinak běží týdny.
Zvlášť pozor na certifikáty. Automatické obnovení bezplatného certifikátu selže tiše, typicky po změně DNS nebo po migraci. Prohlížeč pak návštěvníkovi ukáže červenou stránku s varováním a devět z deseti lidí okamžitě odejde. Kontrola platnosti certifikátu je zdarma a ušetří vám nejtrapnější druh výpadku, ten, o kterém jste věděli dopředu.
- Dostupnost homepage plus kontrola klíčového slova v HTML
- Odpověď formuláře nebo API, které přijímá poptávky
- Platnost SSL certifikátu s upozorněním 14 dní předem
- Expirace domény a stav DNS záznamů
- Doba načtení s alarmem při překročení 3 sekund
- Doručitelnost mailů, tedy kontrola SPF, DKIM a DMARC
- Kontrola z více míst, minimálně z Evropy a z jednoho dalšího regionu
Nástroje a kolik reálně stojí
Nástrojů je přehršel a rozdíl mezi nimi je hlavně v intervalu kontroly a v tom, jak rychle vám dají vědět. Kontrola po pěti minutách znamená, že o výpadku víte v nejhorším případě za pět minut. Pro běžný prezentační web to stačí. Pro e-shop s reklamou za deset tisíc měsíčně chcete třicet sekund.
Zdarma se dá pokrýt překvapivě hodně. UptimeRobot v bezplatné verzi zvládne padesát kontrol po pěti minutách a pošle mail. Vlastní řešení postavené na cronu a webhooku do Slacku vás stojí hodinu práce a nic dalšího. Placený nástroj kupujete kvůli kratšímu intervalu, historii výpadků a slušnému hlášení, které ukážete klientovi.
Rozdíl mezi 190 korunami a 2 500 korunami měsíčně není v kvalitě kontroly. Je v reportech, v počtu členů týmu a v tom, jestli potřebujete stavovou stránku pro zákazníky. Sám provozuji kombinaci bezplatného nástroje a vlastního skriptu a u klientů, kteří platí Péči, mám kontrolu po minutě z pěti lokalit.
| Nástroj | Nejkratší interval | Cena měsíčně |
|---|---|---|
| UptimeRobot zdarma | 5 minut | 0 Kč |
| UptimeRobot placený | 1 minuta | kolem 190 Kč |
| Better Stack Basic | 30 sekund | kolem 700 Kč |
| Pingdom Standard | 1 minuta | kolem 2 500 Kč |
| Vlastní cron a webhook do Slacku | 1 minuta | 0 Kč a hodina práce |
| Webify Péče včetně řešení | 1 minuta | 2 990 Kč |
Upozornění, které vás opravdu vzbudí
Mail v půl třetí ráno nikoho nevzbudí. Když má monitoring smysl, musí mít eskalaci: první hlášku do Slacku nebo Telegramu, po pěti minutách SMS, po deseti minutách telefonát. Telefonát je jediný kanál, který spolehlivě probudí. Služby jako Better Stack nebo Pushover to umí a cena za jedno volání se pohybuje v korunách.
Druhá věc je potvrzení. Kontrola z jednoho místa vygeneruje falešný poplach zhruba jednou za dva týdny, typicky kvůli výpadku sítě na trase, ne u vás. Chcete tedy nastavení, kde se výpadek hlásí až po dvou neúspěšných kontrolách ze dvou různých lokalit. Jinak si notifikace za měsíc vypnete a monitoring přestane existovat.
Nastavte si taky práh, kdy se hlásí zpomalení, ne jen pád. Web, který se načítá devět sekund, je pro návštěvníka mrtvý stejně jako web, který nejede. Alarm na dobu odezvy nad tři sekundy vám odhalí přetíženou databázi nebo špatný deploy dřív, než se to zvrhne v úplný výpadek.
- Slack nebo Telegram okamžitě, pro tichý dohled přes den
- SMS po pěti minutách nepřetržitého výpadku
- Telefonát po deseti minutách, jen na jedno číslo
- Potvrzení výpadku ze dvou lokalit, aby nevznikaly plané poplachy
- Zpráva o obnovení provozu včetně délky výpadku
- Tichý režim na plánované odstávky, aby se neposílalo zbytečně
Kdo to řeší ve tři ráno
Tohle je otázka, kterou si nikdo nepoloží, dokud to nenastane. Monitoring vám pošle hlášku, tím jeho práce končí. Pak musí být někdo, kdo se probudí, přihlásí se k hostingu, pozná příčinu a opraví ji. To není software, to je pohotovost, a pohotovost stojí peníze u kohokoliv, kdo ji drží.
Budu upřímný: jsem jeden člověk se systémem, ne nonstop tým. Proto mám nastavené jasné pravidlo. Ve všední dny reaguji do hodiny v pracovní době, v noci a o víkendu do rána. Zároveň mám u kritických webů automatický návrat na poslední funkční verzi, takže většina problémů po nasazení se opraví bez mého zásahu.
Když někdo potřebuje reálnou nonstop pohotovost s garancí do třiceti minut, řeknu to rovnou: to není moje služba a stojí u specializovaných firem od patnácti tisíc měsíčně. Pro devadesát procent českých firem je to zbytečné. Pro e-shop, kde jde o statisíce v pátek večer, to zbytečné rozhodně není.
Co zvládnete sami a kdy má smysl to předat
Základ si nastavíte za odpoledne. Založíte účet v bezplatném nástroji, přidáte kontrolu homepage s klíčovým slovem, kontrolu formuláře, hlídání certifikátu a domény a propojíte to s telefonem. Náklad nula korun, čas dvě hodiny. Tímhle pokryjete většinu situací, kdy web spadne a vy o tom nemáte tušení.
Předat to dává smysl ve chvíli, kdy vám výpadek stojí víc, než kolik stojí dohled. U mě je Provoz za 990 korun měsíčně hosting, doména, certifikát a monitoring s reakcí v pracovní době. Péče za 2 990 korun přidává úpravy, aktualizace, zálohy a rychlejší reakci včetně večerů. Nový web dodám do sedmi dní od 19 990 korun.
Ať to řešíte jakkoliv, sepište si krizový postup na jednu stránku. Kam se přihlásit, kdo je poskytovatel hostingu, kde je poslední záloha, komu volat. Až budete v jednu ráno ospalý hledat heslo do administrace, budete si ten papír chválit. Bez něj se z desetiminutového výpadku stane tříhodinový.
- Kontrola homepage s hledáním názvu firmy v HTML
- Kontrola stránky s formulářem nebo košíkem
- Hlídání SSL certifikátu a expirace domény
- Upozornění na telefon, ne jen na mail
- Zapsaný postup, co dělat při výpadku, včetně přístupů
Časté otázky
Stačí mi bezplatný monitoring?
Pro prezentační web ano. Kontrola po pěti minutách a upozornění mailem pokryje běžné situace a nestojí nic. Jakmile přes web tečou objednávky nebo za reklamu utrácíte víc než pět tisíc měsíčně, chcete kratší interval a upozornění na telefon. Rozdíl v ceně je zhruba dvě stě korun měsíčně, takže se o tom nemá cenu dlouho rozmýšlet.
Jak poznám, že hosting výpadky zamlčuje?
Podle vlastních dat. Vlastní monitoring měří nezávisle na poskytovateli, takže máte historii, kterou lze doložit. Když hosting slibuje dostupnost 99,9 procenta, znamená to maximálně 43 minut výpadku měsíčně. Pokud vám nástroj ukazuje trojnásobek, máte v ruce podklad k reklamaci nebo pádný důvod k migraci jinam.
Kolik výpadků je ještě normální?
Krátký pád na jednu až dvě minuty jednou za měsíc je běžný, typicky při restartu serveru nebo nasazení aktualizace. Problém začíná u opakovaných výpadků delších než deset minut nebo u pravidelných pádů ve stejnou denní dobu, což obvykle znamená přetížení sdíleného hostingu. Pak pomůže přesun na lepší tarif, ne další nástroj.
Chcete web, který přivádí zákazníky?
Postavím vám ho na míru, s měřením a připravený na reklamy. Návrh dostanete zdarma a nezávazně.
Vybrat si termín hovoru →