Přejít na obsah

techone --service=cloud-management

Správa cloudu a infrastruktury

Měsíční profylaxe, monitoring, zálohy s testy obnovy. Převzetí existující infrastruktury nebo dlouhodobý provoz pro Azure, AWS i vlastní servery.

Výzvy, které řešíme

Kdy firmy řeší správu cloudu a infrastruktury

Na provoz chybí interní kapacita

Produkční systém potřebuje monitoring, kontrolu záloh a pravidelné aktualizace, ale interní tým se věnuje jiným prioritám.

Cloudové prostředí nemá jasnou správu

Aplikace běží v Azure nebo AWS, ale chybí pravidelná kontrola výkonu, nákladů, platnosti certifikátů a úspěšnosti záloh.

Opakované incidenty bez dohledatelné příčiny

Výpadky se vracejí, zásahy nejsou dostatečně zdokumentované a není jasné, kdo, kdy a proč konfiguraci změnil.

Naše řešení

Co může pravidelná správa zahrnovat

Měsíční profylaxe

Pravidelně kontrolujeme stav prostředí, aktualizace, zálohy a testy obnovy. Provedené práce a doporučení shrnujeme písemně.

  • Bezpečnostní záplaty operačního systému a aplikací
  • Test obnovy ze záloh podle dohodnutého plánu
  • Revize konfigurace a certifikátů
  • Měsíční přehled provedených prací a doporučení

Monitoring a upozornění

Sledujeme výkon, dostupnost, chybovost a podle potřeby také náklady. Upozornění směrujeme podle závažnosti a dohodnutého režimu podpory.

  • Přehledy klíčových metrik v Prometheu a Grafaně
  • Upozornění na využití prostředků, latenci a chybovost
  • Sledování cloud nákladů a anomálií
  • Pohotovostní reakce na kritické incidenty podle SLA

Převzetí existující infrastruktury

Audit aktuálního prostředí, dokumentace, postupné převzetí provozu od původního dodavatele nebo interního týmu.

  • Vstupní audit konfigurace a zabezpečení
  • Architektonická dokumentace a provozní postupy
  • Plán postupného převzetí s řízením provozních rizik
  • Převzetí přístupů a potřebných znalostí

Obnova po havárii a kontinuita

Připravíme plán obnovy, postup jeho ověřování a cílové hodnoty RTO a RPO podle kritičnosti jednotlivých systémů.

  • Definice RTO a RPO podle kritičnosti aplikací
  • Prakticky ověřovaný postup obnovy
  • Geograficky oddělené zálohy
  • Pravidelné nácviky a aktualizace plánu

Profylaxe IT: prevence místo hašení požárů

Řada incidentů má předem viditelné signály: disk se postupně plní, certifikát se blíží expiraci nebo záloha začne selhávat. Pravidelná kontrola zvyšuje šanci zachytit tyto změny v plánovaném okně; nemůže ale odstranit všechna provozní rizika.

Při měsíční profylaxi prostředí kontrolujeme systematicky, nejen po upozornění z monitoringu. Rozsah může zahrnovat bezpečnostní záplaty, aktualizace databáze, kontrolu záloh včetně testu obnovy a revizi konfigurace. Provedené práce, zjištění a doporučení zaznamenáváme do měsíčního přehledu.

Rozsah profylaxe a monitoringu podrobněji popisuje průvodce správou cloudu a serveru.

Řízené převzetí infrastruktury

Při změně dodavatele nebo převzetí nedostatečně zdokumentovaného prostředí nestačí jen předat přístupové údaje. Nejdřív zmapujeme komponenty, závislosti, provozní rizika a chybějící dokumentaci. Doplníme architektonický přehled a postupy pro důležité situace.

Pak následuje postupné převzetí přístupů, monitoringu a operativy. Kde je to možné, běží paralelně s původním dodavatelem. Harmonogram, rizika a případná servisní okna určíme podle stavu prostředí a dokumentace.

Po převzetí pokračujeme v měsíční profylaxi a monitoringu. Pokud potřebujete také rozvoj nebo nové projekty, propojíme to s projektovým týmem.

Po migraci do cloudu přichází provoz

Po přesunu aplikací a dat do cloudu je potřeba určit odpovědnost za monitoring, náklady, aktualizace, zálohy a obnovu po havárii. Tyto činnosti pokračují po celou dobu provozu systému.

Na dokončenou migraci do cloudu můžeme navázat dlouhodobou správou. Znalost prostředí a dokumentace z migrace zkracují předávání, rozsah podpory se však vždy stanoví samostatně.

Reference: spolupráce s Helvetií trvá přes 3 roky. Po 18 měsících přepisu a migrace pokračujeme v monitoringu, podpoře a rozvoji systému pro 7 zemí.

Dohledatelné změny a předatelná dokumentace

Změny v prostředí evidujeme včetně důvodu a výsledku. Měsíční přehled shrnuje provedené práce, otevřená rizika a doporučené další kroky.

Architektonickou dokumentaci a provozní postupy vedeme tak, aby jim rozuměl také interní tým klienta nebo případný další dodavatel. Klient má mít přístup k informacím potřebným pro vlastní rozhodování a převzetí provozu.

Jak pracujeme

Nejdřív pochopíme vaše procesy. Pak navrhneme postup.

01

Vstupní audit

Zmapujeme prostředí, jeho vlastníky, závislosti, dostupnou dokumentaci a hlavní provozní rizika. Zjištění a doporučené priority předáme písemně.

Podle rozsahu
02

Nastavení monitoringu a provozních postupů

Nastavíme přehledy, upozornění, frekvenci kontrol a provozní postupy. Zároveň určíme komunikační kanály, odpovědnosti a parametry SLA.

Po auditu
03

Měsíční provoz

Provádíme pravidelné kontroly, vyhodnocujeme monitoring a řešíme incidenty v dohodnutém režimu. Každý měsíc shrneme provedené práce, zjištění a doporučení.

Průběžně
04

Pravidelná revize

V dohodnutých intervalech vyhodnotíme vývoj metrik, nákladů a plánovaných změn. Zvlášť ověřujeme zabezpečení a připravenost obnovy.

V dohodnutém intervalu

Případová studie

Helvetia: pokračující provoz a rozvoj na Azure

Často kladené otázky

Jaký je rozdíl mezi vstupním auditem a měsíční profylaxí?

Vstupní audit jednorázově mapuje prostředí, dokumentaci a hlavní rizika. Měsíční profylaxe je opakovaná kontrola a údržba: aktualizace, ověřování záloh, revize konfigurace a vyhodnocení monitoringu. Konkrétní rozsah navazuje na zjištění z auditu.

Jak funguje převzetí existující infrastruktury od jiného dodavatele?

Začneme auditem, doplníme architektonickou dokumentaci a provozní postupy. Přístupy, monitoring a operativu přebíráme postupně, podle možností souběžně s původním dodavatelem. Harmonogram a případný dopad na provoz stanovíme podle stavu dokumentace a prostředí.

Pokrýváte i vlastní servery, nebo jen cloud?

Spravujeme prostředí v Azure a AWS, hybridní infrastrukturu i servery provozované u klienta. Konkrétní rozsah popisujeme také v průvodci správou cloudu a serveru.

Jak vypadá komunikace a reporting?

Každý měsíc předáváme písemný přehled provedených prací, zjištění a doporučení. Pro běžnou komunikaci lze použít Teams, Slack nebo klientův servisní nástroj. Upozornění z monitoringu a eskalace kritických incidentů směrujeme podle dohodnutých odpovědností a SLA.

Co když máme vlastní DevOps tým?

Ano. Můžeme převzít jen vybranou část prostředí, provádět nezávislou profylaxi nebo doplnit kapacitu pro monitoring a řešení incidentů. Rozdělení odpovědností se zapíše do provozního modelu, aby nevznikala nejasná místa.

Kolik to stojí?

Cenu ovlivňuje velikost a členitost prostředí, rozsah sledovaných služeb a požadovaná doba reakce. Jiný režim má profylaxe v pracovní době a jiný nepřetržitá pohotovost. Konkrétní nabídku připravíme po vstupním auditu.

Co s incidenty mimo SLA?

Záleží na sjednané úrovni služby. Základní profylaxe probíhá v pracovní době; nepřetržitá pohotovost má vlastní reakční časy a eskalační pravidla. Při incidentu postupujeme podle dohodnutého provozního postupu a zapojujeme odpovědné osoby na straně klienta. Konkrétní režim se vždy řídí SLA.

Probereme váš projekt? Ozveme se do 24 hodin.

Od analýzy po dlouhodobý provoz. Lagardère: pětiměsíční EDI analýza. Helvetia a Tecam: pokračující rozvoj a podpora.

Nezávazná konzultace