Smanjenje troškova Kubernetes i Azure infrastrukture: vodič za hrvatske tvrtke
Praktičan vodič zašto računi za cloud rastu i pet konkretnih koraka koje hrvatske tvrtke mogu napraviti ovaj mjesec da smanje troškove Kubernetes i Azure infrastrukture.
Smanjenje troškova Kubernetes i Azure infrastrukture: vodič za hrvatske tvrtke
Računi za cloud infrastrukturu rijetko rastu naglo. Rastu tiho, mjesec za mjesec, dok jednog dana netko iz financija ne pita zašto Azure košta dvostruko više nego prošle godine, a broj korisnika je isti. Odgovor je gotovo uvijek isti: nitko ne mjeri gdje novac odlazi. Ovo je praktičan vodič za hrvatske tvrtke koje voze Kubernetes ili Azure u produkciji i žele smanjiti trošak bez da razbiju nešto što radi.
Zašto računi rastu
Tri uzroka pokrivaju najveći dio prekomjernih troškova, i sva tri su nevidljiva dok ih ne izmjerite.
Over-provisioning, odnosno preveliko rezerviranje resursa. U Kubernetesu je resource request rezervacija: scheduler odvoji taj CPU i memoriju za pod bez obzira koristi li ih pod ili ne. Kada tim kopira iste brojke s jednog servisa na drugi, redovito se dogodi da je CPU rezerviran višestruko iznad stvarne potrošnje. Plaćate kapacitet koji stoji prazan, i pritom na node stane manje podova nego što bi moglo, pa vam treba više nodova. Na Azureu je isti obrazac: VM veličine odabrane “da bude sigurno” koje nikad ne pređu 20 posto iskorištenosti.
Zaboravljeni resursi. Dev okruženje koje se diglo za jedan test i nikad ugasilo. Disk koji je ostao nakon obrisanog VM-a. Public IP koji nitko ne koristi. Staro okruženje koje radi 24 sata dnevno iako ga tim koristi samo u radno vrijeme. Svaki od njih je mala stavka, ali skupljaju se, i nitko ih ne primijeti jer nitko ne gleda.
Nema mjerenja. Ovo je korijenski uzrok ostalih dvaju. Ako ne uspoređujete rezervirano prema stvarno potrošenom, ne možete znati što je preveliko. Podaci to potvrđuju: prema CNCF istraživanju o troškovima Kubernetesa iz 2024. godine, 68 posto organizacija ili uopće ne prati Kubernetes trošak ili se oslanja na ručne procjene (CNCF, “The FinOps for Kubernetes microsurvey”, 2024). A veličina gubitka je poznata: u istraživanju FinOps Foundation State of FinOps 2025, praktičari i menadžeri procjenjuju da je otprilike 30 posto troška na compute bačeno (FinOps Foundation, State of FinOps 2025).
Pet koraka koje možete napraviti ovaj mjesec
Ništa od ovoga ne traži novi alat ni veliki projekt. Sve se može napraviti s postojećim pristupom i malo pažnje.
1. Izmjerite rezervirano prema stvarnoj potrošnji
Prvo mjerenje, tek onda rezanje. Na Kubernetesu usporedite kube_pod_container_resource_requests sa stvarnom potrošnjom iz container_cpu_usage_seconds_total i container_memory_working_set_bytes. Gdje je CPU request višestruko veći od stvarne potrošnje, imate kandidata za rezanje. Na Azureu Cost Analysis i Azure Advisor pokazuju nedovoljno iskorištene VM-ove i diskove. Ovaj korak sam po sebi obično otkrije gdje je pola gubitka.
2. Ugasite idle okruženja izvan radnog vremena
Dev, test i staging okruženja rijetko trebaju raditi noću i vikendom. Ako tim radi u standardno radno vrijeme, ta okruženja rade otprilike 168 sati tjedno, a koriste se možda 45. Automatsko gašenje izvan radnog vremena reže trošak tih okruženja za više od pola, a jutrom su opet gore prije nego itko dođe. Na Azureu to riješite auto-shutdown rasporedom ili automatizacijom, na Kubernetesu skaliranjem replika na nulu po rasporedu.
3. Iskoristite rezervacije i savings planove na Azureu
Za sve što stvarno mora raditi non-stop, pay-as-you-go je najskuplja opcija koju možete odabrati. Za stabilan, predvidiv workload Azure Reserved Instances i savings planovi donose značajnu uštedu u zamjenu za obvezu na jednu ili tri godine. Ključno je da ovo radite tek nakon koraka 1: prvo rightsizing, pa tek onda rezervirate ispravnu veličinu. Rezervirati preveliki VM na tri godine znači zaključati grešku.
4. Rightsizing najvećih deploymenta
Ne trebate optimizirati sve. Trošak je gotovo uvijek koncentriran u nekoliko najvećih stavki. Uzmite pet do deset najvećih deploymenta ili VM-ova po trošku i posložite njihove resurse prema izmjerenoj potrošnji iz koraka 1. Na Kubernetesu tu spada i uključivanje autoscalinga ako je isključen: redovito nalazimo Helm chartove kojima je horizontalno skaliranje ugašeno po defaultu, pa servisi voze fiksan broj replika dimenzioniran za vršno opterećenje koje traje par sati dnevno. Nekoliko najvećih stavki sredi najveći dio računa.
5. Postavite mjesečni pregled
Optimizacija nije jednokratni događaj. Bez redovnog pregleda infrastruktura se vrati u nered za nekoliko mjeseci: dignu se nova okruženja, kopiraju se stari resource requesti, zaboravi se ugašeni disk. Jednom mjesečno prođite iste signale: rezervirano prema potrošnji, idle resursi, najveće stavke troška. Pola sata mjesečno čuva ono što ste ostalim koracima uštedjeli.
Kada zvati vanjsku pomoć
Ovih pet koraka većina tehničkih timova može napraviti sama. Vanjsku pomoć ima smisla zvati kada nemate posvećen platform tim, kada infrastrukturni posao pada na backend inženjera koji ga radi između ostalog, ili kada sumnjate da gubitak postoji ali nemate vremena ni mjerne podatke da ga dokažete. Vanjski pogled tu vrijedi jer je vidio isti obrazac na više okruženja i zna gdje gledati prvo.
Mi taj posao pakiramo kao fiksni audit troškova i pouzdanosti: fiksna cijena unaprijed, u rasponu od 3 do 6 tisuća eura ovisno o veličini okruženja, s konkretnim popisom nalaza i točnih izmjena koje treba napraviti. Nema sata naplaćenog na neodređeno, znate cijenu prije nego počnemo. Ako želite prvo razgovarati o tome odgovara li vašem okruženju, javite nam se.
Platform, SRE, and AI infrastructure for production systems. Delivery partner for ID Shield Protect, running the LureLab and Nexably security platforms across a multi-tenant Kubernetes estate.