Pet područja djelovanja. Jedan operatorski način razmišljanja.
Platform engineering, site reliability, cloud i AI infrastruktura, CI/CD i sigurnost. Preuzimamo ono što je pokvareno ili gradimo ono što nedostaje.
- 01
Platform Engineering
Multi-tenant Kubernetes platforme, interne razvojne platforme i standardizirani obrasci isporuke koji omogućuju da jedan tim podržava mnogo tenanata.
- Jedan platformski tim podržava 10+ tenanata bez zasebnih snowflake postavki po tenantu
- Svaki deploy je pull request, a ne ritual: standardizirani Helm chartovi i GitOps
- Čvrsta izolacija tenanata s RBAC-om, kvotama, mrežnim politikama i ambient mTLS-om
▸ Potpuni popis mogućnosti
- Multi-tenant Kubernetes arhitektura s namespaceovima, RBAC-om, resource kvotama i mrežnim politikama
- Standardizacija Helm chartova kroz servise, okruženja i tenante
- Istio service mesh, uključujući ambient mode za transparentni mTLS
- GitOps tokovi rada i deployi vođeni pull requestovima
- Izolacija resursa po tenantu i kontrola noisy-neighbour problema
- Self-service razvojne platforme povrh Kubernetesa
Kubernetes Helm Istio VMware Tanzu GitOps Multi-tenancy - 02
Site Reliability & Observability
Observability produkcijske razine i SRE discipline. Od health ocjena po tenantu do DORA metrika, dizajnirano za timove koji moraju biti na dežurstvu.
- Nadzorne ploče i alarmi kojima vaše dežurstvo stvarno vjeruje u 3 ujutro
- SLO-ovi i error budgeti koji vam govore kada isporučiti, a kada stati
- DORA metrike povezane sa stvarnim deployima, a ne s tablicama
- Vremenske crte incidenata koje koreliraju deployie, događaje i logove
▸ Potpuni popis mogućnosti
- Postavljanje Prometheus i Grafana stacka te izrada nadzornih ploča
- ELK logging pipeline (Filebeat prema Logstashu pa prema Elasticsearchu i Kibani)
- Slack alarmiranje, usmjeravanje dežurstva i integracija runbookova
- Definiranje SLO-ova, praćenje i izvještavanje o error budgetu
- DORA metrike (učestalost deploya, lead time, change failure rate, MTTR)
- Korelacija vremenske crte incidenata kroz deployie, događaje i logove
- TV-mode nadzorne ploče za ops prostore i standupove timova
Prometheus Grafana ELK OpenTelemetry SLOs DORA - 03
Cloud & AI Infrastructure
Dubok, praktičan Azure i AWS engineering, s namjenski građenim GPU platformama za LLM i VLM workloadove te AI integracijama u produkcijskim aplikacijama.
- Produkcijsko posluživanje LLM-a i VLM-a na vlastitim GPU-ovima, a ne na tuđem API računu
- Azure i AWS landing zone ojačane za regulirane klijente
- GPU platforme dovedene od zahtjeva za kvotom do vLLM posluživanja u produkciji
- Upravljanje troškovima s budžetima, right-sizingom i DR-om koji preživi reviziju
▸ Potpuni popis mogućnosti
- Azure landing zone, AKS i Container Apps za produkcijske workloadove
- Event-driven sustavi na Azure Service Busu, Storage Queuesima i Functionsima
- Azure Monitor i Application Insights iza AMPLS private linka
- Azure Key Vault, managed identity i Microsoft Entra ID
- Azure GPU compute (NCASv3_T4, ND-serija) kroz više regija
- AWS S3 lifecycle tiering (Standard, Glacier Flexible, Deep Archive) za backup i arhiviranje
- AWS EC2, Route 53, CloudFront i IAM za globalnu isporuku i kontrolu pristupa
- NVIDIA GPU Operator, KAITO na AKS-u i vLLM za posluživanje LLM-a i VLM-a
- DGX Spark (Grace Blackwell GB200) na Azure Arcu s K3s-om i ARM64 kontejnerima
- Anthropic Claude i OpenAI integracije u produkcijskim aplikacijama
- VMware Tanzu Kubernetes platforma za on-prem i hibridne deployie
- Upravljanje troškovima, budžetski alarmi, right-sizing i disaster recovery kroz više regija
Azure AKS AWS NVIDIA GPU Operator KAITO vLLM Anthropic Claude VMware Tanzu -
Niste sigurni koje područje odgovara? Opišite sustav, mi ćemo vam reći gdje boli.
Započnite razgovor - 04
DevOps & CI/CD
Pipelinei, infrastruktura kao kod i automatizacija izdavanja. Popratni zanat koji omogućuje platform engineering i SRE rad.
- Pipelinei koji svaku granu automatski isporučuju u pravo okruženje
- Infrastruktura kao kod: pregledna, ponovljiva, oporaviva
- Ocjena pouzdanosti izdanja umjesto tjeskobe zbog petkom deploya
▸ Potpuni popis mogućnosti
- Jenkins multibranch pipelinei s webhook okidačima
- GitHub Actions tokovi rada za buildove, testove i deployie
- Infrastruktura kao kod s Terraformom, Bicepom i Ansibleom
- Buildovi kontejnera i upravljanje Harbor registryjem
- Strategije deploya kroz više okruženja (dev, staging, prototype, prod)
- Strategije grananja za okruženja koja su stvarno bitna
- Praćenje izdanja s ocjenom pouzdanosti deploya
Jenkins GitHub Actions Terraform Bicep Ansible Harbor - 05
Security & Compliance
Defense-in-depth kroz Kubernetes, tajne, identitet i certifikate. Usklađeno s onim što regulirani SaaS klijenti stvarno zahtijevaju.
- Tajne izvan gita i u Vaultu, s rotacijom koja se stvarno događa
- mTLS posvuda bez diranja koda aplikacije
- Revizijski tragovi i potpisivanje imagea koji prolaze due diligence klijenta
▸ Potpuni popis mogućnosti
- Kubernetes RBAC i Pod Security Standards
- HashiCorp Vault za upravljanje tajnama
- Istio mTLS za enkripciju servis-servis
- cert-manager za automatizaciju SSL/TLS-a
- OIDC, LDAP i MFA integracija
- AMPLS private link za sigurnu telemetriju
- Revizijsko logiranje za destruktivne i važne akcije
- Skeniranje i potpisivanje kontejnerskih imagea
Vault Istio mTLS cert-manager OIDC LDAP MFA
Recite nam što je pokvareno.
Radimo u definiranim kvartalnim angažmanima. Donesite sustav, ograničenja i rok.
Započnite razgovor