ISO/IEC 20000-1 u praksi — deo 9 od 10
Incident INC-2026-0142 iz prethodnog teksta je pokazao runbook u akciji tokom stvarnog ispada. Ovaj deo standarda pita nešto što prethodi tom trenutku: da li je taj runbook uopšte bio testiran pre nego što je zaista zatrebao, koliko vremena i podataka firma sme da izgubi pre nego što to postane neprihvatljivo, i da li je bezbednost nešto što se radi posle incidenta ili unapred. Tri dokumenta u ovom delu — politika dostupnosti, plan kontinuiteta i politika bezbednosti — postoje upravo da 18. mart 2026. ne bude prvi put da neko proba failover proceduru.
8.7.1 — Politika dostupnosti
Nimbus Ops d.o.o. — interni dokument sistema upravljanja uslugama
Politika dostupnosti
| Šifra dokumenta: NO-SMS-DOC-019 |
Verzija: 1.0 |
Status: Aktivan |
| Vlasnik dokumenta: Nikola Erić |
Odobrio: Marko Jovanović |
Ciklus pregleda: Godišnje |
1. Svrha
Definiše princip po kojem Nimbus Ops projektuje, prati i održava dostupnost Nimbus Watch platforme, kako bi se ciljevi definisani u SLA dokumentu (NO-SMS-DOC-011) mogli realno ispuniti, a ne samo obećati.
2. Arhitektonski principi
- Sve produkcione komponente rade u multi-AZ konfiguraciji unutar primarnog regiona (eu-central-1).
- Kritične komponente (API, baza podataka) imaju standby okruženje u sekundarnom regionu (eu-west-1), spremno za failover.
- Nijedna promena sa oznakom "visok rizik" (videti Politiku upravljanja promenama, NO-SMS-DOC-014) ne implementira se bez definisanog rollback plana.
- Dostupnost se meri nezavisnim eksternim monitoring servisom, ne samo internim AWS metrikama — da bi se izbegla situacija u kojoj AWS i Nimbus Ops "ne vide" isti problem.
3. Praćenje i izveštavanje
Dostupnost se prati u realnom vremenu i izveštava mesečno klijentima (deo 6 ove serije) i interno na kvartalnom pregledu rukovodstva. Svako odstupanje ispod cilja automatski generiše stavku za analizu korenog uzroka.
4. Planirano održavanje
Održavanje koje zahteva prekid rada izvodi se isključivo u definisanom prozoru (nedeljom 02:00–04:00 CET), najavljeno klijentima najmanje 5 radnih dana unapred, u skladu sa SLA tačkom 5.
5. Odgovornost
Nikola Erić je vlasnik ove politike i odgovoran za arhitektonske odluke koje utiču na dostupnost. Rizik zavisnosti od jednog regiona/dobavljača vodi se u registru rizika (R01) i preispituje kvartalno.
8.7.2 — Plan kontinuiteta usluge
Ovo je namerno kratak dokument — dovoljno da bude stvarno čitan i testiran, umesto opsežnog priručnika koji niko ne otvara dok ne bude prekasno. Cilj za 2026. (deo 3 ove serije) je bio najmanje dva formalna testa godišnje — prvi je već sproveden.
Nimbus Ops d.o.o. — interni dokument sistema upravljanja uslugama
Plan kontinuiteta usluge
| Šifra dokumenta: NO-SMS-DOC-020 |
Verzija: 1.1 |
Status: Aktivan |
| Vlasnik dokumenta: Nikola Erić |
Odobrio: Marko Jovanović |
Poslednje ažuriranje: 20.03.2026. |
1. Pokriveni scenariji
Plan pokriva: (a) ispad AWS regiona eu-central-1, (b) oštećenje ili nedostupnost primarne baze podataka, (c) bezbednosni incident koji zahteva izolaciju dela infrastrukture. Ne pokriva scenarije van tehničke infrastrukture (npr. finansijski gubitak klijenta) — ti scenariji se rešavaju kroz poslovnu strategiju, ne SMS.
2. Ciljevi oporavka po komponenti
| Komponenta |
RTO |
RPO |
Napomena |
| Nimbus Watch platforma (API, ingestion, web) | 30 min | 5 min | Failover na standby u eu-west-1 |
| nimbus-watch-db (CI-004) | 30 min | 5 min | Kontinualna replikacija ka standby regionu |
| billing-legacy modul (CI-007) | 4 h | 24 h | Niži prioritet, dnevni backup dovoljan (videti KE-2026-004) |
| Jira / Confluence (interni alati) | 24 h | Prema Atlassian politici | Van kontrole Nimbus Ops-a — upravlja se kroz dobavljača |
| Kancelarija Beograd (fizički pristup) | N/A | N/A | Hibridni model rada — gubitak kancelarije ne prekida uslugu |
3. Uloge tokom aktivacije plana
Incident komandant (po dežurstvu, obično Nikola Erić) koordiniše tehnički odgovor i odlučuje o pokretanju failover procedure (runbook, deo 4 ove serije). Milica Đorđević vodi komunikaciju sa klijentima. Ana Ristić dokumentuje vremensku liniju za post-incident izveštaj. Marko Jovanović se obaveštava odmah za P1 scenarije i uključuje se direktno ako je potrebna odluka van tehničkog domena (npr. javna izjava, ugovorne posledice).
4. Raspored i rezultati testiranja
| Datum |
Scenario |
Cilj (RTO) |
Ostvareno |
Nalaz |
| 14.02.2026. | Simulirani ispad eu-central-1 (planiran test, van produkcionog saobraćaja) | 30 min | 24 min | Uspešno; ručna provera replication lag-a trajala duže nego očekivano — kandidat za automatizaciju |
| 18.03.2026. | Stvaran ispad eu-central-1 (INC-2026-0142, nije bio test) | 30 min | 38 min* | *Uključuje 6 min detekcije/odlučivanja koje planirani test ne meri; videti post-incident izveštaj, deo 8 |
| Planirano Q4 2026. | Simulacija oštećenja baze podataka (restore iz backupa) | — | — | Zakazano, nosilac Nikola Erić |
8.7.3 — Politika informacione bezbednosti
Nimbus Ops d.o.o. — interni dokument sistema upravljanja uslugama
Politika informacione bezbednosti
| Šifra dokumenta: NO-SMS-DOC-021 |
Verzija: 1.0 |
Status: Aktivan |
| Vlasnik dokumenta: Stefan Vuković |
Odobrio: Marko Jovanović |
Ciklus pregleda: Godišnje |
1. Svrha i obim
Definiše osnovne bezbednosne principe koje Nimbus Ops primenjuje na infrastrukturu, kod i podatke obuhvaćene Izjavom o obimu SMS-a (NO-SMS-DOC-001), uključujući podatke klijenata iz EU koji podležu GDPR-u.
2. Kontrola pristupa
- Princip najmanjih privilegija — pristup produkcionim sistemima dodeljuje se prema ulozi, ne po difoltu za sve inženjere.
- Obavezna dvofaktorska autentifikacija (MFA) za AWS nalog, GitHub, Jira/Confluence i sve sisteme koji čuvaju podatke klijenata.
- Pristup se pregleda kvartalno; pristup bivših zaposlenih se ukida u roku od 24h od prestanka radnog odnosa.
3. Zaštita podataka
- Enkripcija podataka u mirovanju (at rest) i u tranzitu (in transit) za sve produkcione baze i komunikaciju.
- Podaci klijenata iz EU čuvaju se u EU regionu (eu-central-1 / eu-west-1), u skladu sa GDPR zahtevima za rezidenciju podataka.
- Ugovori o obradi podataka (DPA) potpisuju se sa svim klijentima čiji podaci potpadaju pod GDPR.
4. Upravljanje ranjivostima
Godišnji penetracioni test sprovodi SecuraLab d.o.o. (Registar imovine, A009); nalazi visokog rizika se rešavaju u roku od 30 dana, srednjeg u roku od 90 dana. Automatizovano skeniranje zavisnosti (dependency scanning) deo je CI/CD procesa za svaki deploy.
5. Bezbednosni incidenti
Bezbednosni incidenti (npr. sumnja na neovlašćen pristup, curenje podataka) tretiraju se kao P1 nezavisno od uticaja na dostupnost i eskaliraju se direktno Stefanu Vukoviću i Marku Jovanoviću. U slučaju potvrđenog curenja podataka koje uključuje lične podatke, primenjuje se zakonska obaveza obaveštavanja nadležnog organa u Srbiji i, gde je primenjivo, EU regulatora u zakonski propisanom roku.
6. Odgovornost zaposlenih
Svi zaposleni prolaze obaveznu GDPR i bezbednosnu obuku (Plan obuke, NO-SMS-DOC-008, deo 4 ove serije). Deljenje kredencijala, isključivanje MFA ili instalacija neodobrenog softvera na uređajima sa pristupom produkciji nisu dozvoljeni.
Kako se ovo koristi u svakodnevnom radu
Plan kontinuiteta se ne čuva za "kad zatreba" — februarski test je namerno otkrio manji problem (spora ručna provera replication lag-a) mesec dana pre nego što je isti korak morao da se izvede pod pravim pritiskom 18. marta. Da testa nije bilo, taj gubitak vremena bi se prvi put desio tokom stvarnog incidenta, a ne tokom vežbe gde nema klijenata koji čekaju.
Politika bezbednosti se najkonkretnije oseti kod onboardinga — svaki novi zaposleni dobija pristup tačno onome što mu treba za ulogu, ne "svemu da bude lakše", i to je često prva stvar koju primete kad dođu iz firme gde je bilo drugačije.
Poslednji tekst u seriji zatvara ceo krug — mesečni/kvartalni izveštaj o performansama usluga, agenda kvartalnog pregleda rukovodstva, registar prilika za unapređenje i primer zapisa korektivne mere koja proizlazi direktno iz incidenta opisanog u prethodnom delu.
Comments
Post a Comment