techone --service=cloud-management
Správa cloudu a infrastruktury
Měsíční profylaxe, monitoring, zálohy s testy obnovy. Převzetí existující infrastruktury nebo dlouhodobý provoz pro Azure, AWS i vlastní servery.
Výzvy, které řešíme
Kdy firmy řeší správu cloudu a infrastruktury
Na provoz chybí interní kapacita
Produkční systém potřebuje monitoring, kontrolu záloh a pravidelné aktualizace, ale interní tým se věnuje jiným prioritám.
Cloudové prostředí nemá jasnou správu
Aplikace běží v Azure nebo AWS, ale chybí pravidelná kontrola výkonu, nákladů, platnosti certifikátů a úspěšnosti záloh.
Opakované incidenty bez dohledatelné příčiny
Výpadky se vracejí, zásahy nejsou dostatečně zdokumentované a není jasné, kdo, kdy a proč konfiguraci změnil.
Naše řešení
Co může pravidelná správa zahrnovat
Měsíční profylaxe
Pravidelně kontrolujeme stav prostředí, aktualizace, zálohy a testy obnovy. Provedené práce a doporučení shrnujeme písemně.
- Bezpečnostní záplaty operačního systému a aplikací
- Test obnovy ze záloh podle dohodnutého plánu
- Revize konfigurace a certifikátů
- Měsíční přehled provedených prací a doporučení
Monitoring a upozornění
Sledujeme výkon, dostupnost, chybovost a podle potřeby také náklady. Upozornění směrujeme podle závažnosti a dohodnutého režimu podpory.
- Přehledy klíčových metrik v Prometheu a Grafaně
- Upozornění na využití prostředků, latenci a chybovost
- Sledování cloud nákladů a anomálií
- Pohotovostní reakce na kritické incidenty podle SLA
Převzetí existující infrastruktury
Audit aktuálního prostředí, dokumentace, postupné převzetí provozu od původního dodavatele nebo interního týmu.
- Vstupní audit konfigurace a zabezpečení
- Architektonická dokumentace a provozní postupy
- Plán postupného převzetí s řízením provozních rizik
- Převzetí přístupů a potřebných znalostí
Obnova po havárii a kontinuita
Připravíme plán obnovy, postup jeho ověřování a cílové hodnoty RTO a RPO podle kritičnosti jednotlivých systémů.
- Definice RTO a RPO podle kritičnosti aplikací
- Prakticky ověřovaný postup obnovy
- Geograficky oddělené zálohy
- Pravidelné nácviky a aktualizace plánu
Profylaxe IT: prevence místo hašení požárů
Řada incidentů má předem viditelné signály: disk se postupně plní, certifikát se blíží expiraci nebo záloha začne selhávat. Pravidelná kontrola zvyšuje šanci zachytit tyto změny v plánovaném okně; nemůže ale odstranit všechna provozní rizika.
Při měsíční profylaxi prostředí kontrolujeme systematicky, nejen po upozornění z monitoringu. Rozsah může zahrnovat bezpečnostní záplaty, aktualizace databáze, kontrolu záloh včetně testu obnovy a revizi konfigurace. Provedené práce, zjištění a doporučení zaznamenáváme do měsíčního přehledu.
Rozsah profylaxe a monitoringu podrobněji popisuje průvodce správou cloudu a serveru.
Řízené převzetí infrastruktury
Při změně dodavatele nebo převzetí nedostatečně zdokumentovaného prostředí nestačí jen předat přístupové údaje. Nejdřív zmapujeme komponenty, závislosti, provozní rizika a chybějící dokumentaci. Doplníme architektonický přehled a postupy pro důležité situace.
Pak následuje postupné převzetí přístupů, monitoringu a operativy. Kde je to možné, běží paralelně s původním dodavatelem. Harmonogram, rizika a případná servisní okna určíme podle stavu prostředí a dokumentace.
Po převzetí pokračujeme v měsíční profylaxi a monitoringu. Pokud potřebujete také rozvoj nebo nové projekty, propojíme to s projektovým týmem.
Po migraci do cloudu přichází provoz
Po přesunu aplikací a dat do cloudu je potřeba určit odpovědnost za monitoring, náklady, aktualizace, zálohy a obnovu po havárii. Tyto činnosti pokračují po celou dobu provozu systému.
Na dokončenou migraci do cloudu můžeme navázat dlouhodobou správou. Znalost prostředí a dokumentace z migrace zkracují předávání, rozsah podpory se však vždy stanoví samostatně.
Reference: spolupráce s Helvetií trvá přes 3 roky. Po 18 měsících přepisu a migrace pokračujeme v monitoringu, podpoře a rozvoji systému pro 7 zemí.
Dohledatelné změny a předatelná dokumentace
Změny v prostředí evidujeme včetně důvodu a výsledku. Měsíční přehled shrnuje provedené práce, otevřená rizika a doporučené další kroky.
Architektonickou dokumentaci a provozní postupy vedeme tak, aby jim rozuměl také interní tým klienta nebo případný další dodavatel. Klient má mít přístup k informacím potřebným pro vlastní rozhodování a převzetí provozu.
Jak pracujeme
Nejdřív pochopíme vaše procesy. Pak navrhneme postup.
Vstupní audit
Zmapujeme prostředí, jeho vlastníky, závislosti, dostupnou dokumentaci a hlavní provozní rizika. Zjištění a doporučené priority předáme písemně.
Nastavení monitoringu a provozních postupů
Nastavíme přehledy, upozornění, frekvenci kontrol a provozní postupy. Zároveň určíme komunikační kanály, odpovědnosti a parametry SLA.
Měsíční provoz
Provádíme pravidelné kontroly, vyhodnocujeme monitoring a řešíme incidenty v dohodnutém režimu. Každý měsíc shrneme provedené práce, zjištění a doporučení.
Pravidelná revize
V dohodnutých intervalech vyhodnotíme vývoj metrik, nákladů a plánovaných změn. Zvlášť ověřujeme zabezpečení a připravenost obnovy.
Případová studie
Helvetia: pokračující provoz a rozvoj na Azure
Helvetia
E-commerce3+ roky
Délka spolupráce
7
Země
Často kladené otázky
Jaký je rozdíl mezi vstupním auditem a měsíční profylaxí?
Vstupní audit jednorázově mapuje prostředí, dokumentaci a hlavní rizika. Měsíční profylaxe je opakovaná kontrola a údržba: aktualizace, ověřování záloh, revize konfigurace a vyhodnocení monitoringu. Konkrétní rozsah navazuje na zjištění z auditu.
Jak funguje převzetí existující infrastruktury od jiného dodavatele?
Začneme auditem, doplníme architektonickou dokumentaci a provozní postupy. Přístupy, monitoring a operativu přebíráme postupně, podle možností souběžně s původním dodavatelem. Harmonogram a případný dopad na provoz stanovíme podle stavu dokumentace a prostředí.
Pokrýváte i vlastní servery, nebo jen cloud?
Spravujeme prostředí v Azure a AWS, hybridní infrastrukturu i servery provozované u klienta. Konkrétní rozsah popisujeme také v průvodci správou cloudu a serveru.
Jak vypadá komunikace a reporting?
Každý měsíc předáváme písemný přehled provedených prací, zjištění a doporučení. Pro běžnou komunikaci lze použít Teams, Slack nebo klientův servisní nástroj. Upozornění z monitoringu a eskalace kritických incidentů směrujeme podle dohodnutých odpovědností a SLA.
Co když máme vlastní DevOps tým?
Ano. Můžeme převzít jen vybranou část prostředí, provádět nezávislou profylaxi nebo doplnit kapacitu pro monitoring a řešení incidentů. Rozdělení odpovědností se zapíše do provozního modelu, aby nevznikala nejasná místa.
Kolik to stojí?
Cenu ovlivňuje velikost a členitost prostředí, rozsah sledovaných služeb a požadovaná doba reakce. Jiný režim má profylaxe v pracovní době a jiný nepřetržitá pohotovost. Konkrétní nabídku připravíme po vstupním auditu.
Co s incidenty mimo SLA?
Záleží na sjednané úrovni služby. Základní profylaxe probíhá v pracovní době; nepřetržitá pohotovost má vlastní reakční časy a eskalační pravidla. Při incidentu postupujeme podle dohodnutého provozního postupu a zapojujeme odpovědné osoby na straně klienta. Konkrétní režim se vždy řídí SLA.
Probereme váš projekt? Ozveme se do 24 hodin.
Od analýzy po dlouhodobý provoz. Lagardère: pětiměsíční EDI analýza. Helvetia a Tecam: pokračující rozvoj a podpora.
Nezávazná konzultace