Co pokrýváme

Kompletní systém — protože drahé problémy žijí mezi jeho částmi.

Cluster vespod, architektura, služby, které dělají práci, data, která jimi protékají, integrace ven a provoz, který to celé drží. Rozdělit to mezi dodavatele je spolehlivá cesta k drahým selháním.

01 — Infrastruktura

Cluster a platforma

Kubernetes na tolika strojích, kolik zátěž vyžaduje, propojený do jednoho clusteru a kompletně popsaný v kódu. Základy — metriky, logy, plánování, izolace — dává platforma, nestaví se pro každý projekt znovu.

01

Základ clusteru

Síť, ingress, storage, node pooly podle zátěže a izolace, aby jedna hladová služba nevyhladověla ostatní.

02

Více strojů, jeden celek

Libovolný počet strojů — cloud, on-premise nebo obojí — spojený do jednoho clusteru, který se chová jako jeden systém.

03

Nasazení podle šablony

Stejný tvar nasazení pro jakýkoli typ produktu; nový systém startuje z ověřeného základu, ne z prázdné stránky.

04

Doručování přes GitOps

Každé prostředí žije v repozitáři a průběžně se srovnává. Rollback je revert; staging se nemůže tiše rozjet.

05

Škálování a náklady

Autoscaling laděný podle skutečného provozu — a na rovinu řečeno, co cluster stojí a co s tím.

06

Bezpečnost

RBAC podle skutečných rolí, tajemství mimo manifesty, síťové politiky, původ image a auditní stopa.

02 — Architektura

Návrh mikroslužeb

Část, která rozhoduje, jestli váš systém zůstane změnitelný. Hranice vedené podle skutečných švů v byznysu, verzované a testované kontrakty a tvar, který jde později upravit bez přepisu.

Co navrhujeme

  • Hranice služeb — podle domény, ne podle organigramu nebo databázových tabulek.
  • Verzované kontrakty — ověřované v CI na straně producenta i konzumenta.
  • Komunikační vzory — synchronní volání, fronty nebo eventy, volené podle vztahu, ne jako firemní styl.
  • Idempotence — protože at-least-once doručení je jediné, které v praxi dostanete.
  • Chování při selhání — co každá služba dělá, když je závislost pomalá, nedostupná nebo odpovídá špatně.

Co vám to dává

  • Přidávat beze strachu — nová schopnost je nová malá služba, ne operace na stávající.
  • Odebírat bez archeologie — smazání části odečte přesně to, co její přidání stálo.
  • Nasazovat nezávisle — jedna oprava jede ven sama, nečeká na vlak releasů.
  • Rychlý onboarding — nový inženýr se učí jednu službu, ne celý systém.
  • Svoboda implementace — kontrakty skrývají vnitřek, takže každá služba používá jazyk a nástroje, které jí sedí nejlépe.
03 — Data

Datový tok a pipeline úloh

Hlavním uzlům datového toku je potřeba rozumět předem. Vše ostatní jde přidat později; proud, který se zadrhává nebo tiše ztrácí záznamy, se zalepit nedá.

01

Ingest

Konektory na zdroje, dodavatele a vaše stávající systémy — s backpressure, bezpečnými retry a detekcí děr, kterých by si jinak nikdo nevšiml.

02

Volba úložiště

Relační, time-series, sloupcové, dokumentové — vybrané pro tento produkt a tato data. Rozhodnutí, které je nejdražší vracet.

03

Deploymenty a joby

Průběžné služby pro stálý proud, plánované joby pro periodickou práci — každý s vlastními zdroji a vlastním selháváním.

04

Pipeline úloh

Vícekrokové zpracování řetězené tak, aby selhání skončilo u svého kroku, jasně se ohlásilo a pokračovalo bez přepočítání všeho před ním.

05

Komunikace služeb

Cesty mezi částmi — fronty, streamy, přímá volání — dimenzované tak, aby propustnost vydržela nejhorší hodinu měsíce.

06

Správnost

Validace schémat s alarmem na drift, přehratelná historie tam, kde na ní záleží, a jasná čára mezi daty, která jdou dopočítat, a daty, která ne.

04 — AI

AI integrovaná do nástrojů, které už používáte

Mikroslužba je pro model přirozený domov: má data, kontrakt i monitoring. Užitečný krok pak většinou není další dashboard — je to odpověď tam, kde vaši lidé už pracují.

Kam ji dáváme

  • Vlastní modely nad živým proudem — ML vyvíjené jako kontejnery, průběžně trénované a predikující v reálném čase nad daty protékajícími systémem.
  • Chatovací boti a asistenti — ve firemním chatu, kde tým žije; odpovídají ze systému, ne z fantazie obecného modelu.
  • Do vašich produktů — napojená do nástrojů, které dnes používají zákazníci nebo zaměstnanci.
  • Do datového toku — predikce, klasifikace a detekce anomálií jako běžné služby v pipeline.
  • Na provozní straně — hlídání rozbitých zdrojů a neobvyklého chování; často nejužitečnější a nejméně efektní model v budově.

Jak ji držíme poctivou

  • Ukotvená ve vašich datech — odpovědi dohledatelné k záznamům, ze kterých vznikly.
  • Monitorovaná jako každá služba — vstupy, výstupy a drift jako metriky první třídy na stejném alertingu.
  • Vratná — verzovaná, testovaná ve stínu a vypnutelná jedním příkazem.
  • Člověk ve smyčce — všude, kde by sebejistá chyba byla drahá.
05 — Produkt

Produkt samotný, včetně rozhraní

Služby, které dělají skutečnou práci, plus rozhraní, které produkt potřebuje. UI stavíme jako součást systému — a nebereme zakázky na rozhraní odtržené od systému, který stavíme.

01

Služby, které pracují

Každá v jazyce, který jí sedí — Go, Python, TypeScript nebo co úloha vyžaduje — s malým rozsahem, explicitním kontraktem, vlastními testy a metrikami.

02

Rozhraní

Dashboardy, interní nástroje a operátorské obrazovky, stavěné podle tvaru dat, ne naopak.

03

Integrace s vašimi produkty

Systémy, které už provozujete, napojíme — nenahrazujeme je zbytečně.

04

Testování kvality

Kontraktní testy na každém švu, integrační testy nad toky, zátěžové testy na nejhorší hodinu a akceptace s vašimi lidmi, než se čemukoli řekne hotovo.

06 — Provoz

Monitoring, alerting a předání

Nemůžete provozovat, co nevidíte. Observabilita se navrhuje spolu s funkcí, ne dodatečně po prvním nevysvětlitelném incidentu.

Telemetrie

Metriky, logy a trasování se společnými korelačními ID napříč všemi službami v clusteru.

Alerting

Alerty, které něco znamenají, vedou na runbook a dorazí k člověku dřív než k zákazníkovi.

Předání

Cluster, kód, dokumentace i zdůvodnění — předané kompletní a vaše.

Podpora

Další provoz a rozvoj, pokud chcete. Nikdy nic, na čem bychom vás udělali závislými.

Nástroje

Po čem saháme

Výchozí volby, ne dogma. Stack se řídí produktem a jazyk se volí pro každou službu zvlášť, ne pro celou firmu — kontejnery to umožňují zadarmo. Pokud už vám něco funguje, raději se to naučíme, než abychom to měnili.

Jazyky

  • Go
  • Python
  • TypeScript
  • SQL

Runtime

  • Kubernetes
  • Docker
  • Helm
  • Argo CD
  • Terraform

Messaging

  • Kafka
  • NATS
  • Redis Streams
  • gRPC
  • REST / WebSocket

Data

  • PostgreSQL
  • ClickHouse
  • TimescaleDB
  • S3-kompatibilní
  • Parquet

AI / ML

  • PyTorch
  • scikit-learn
  • XGBoost
  • MLflow
  • LLM API

Provoz

  • Prometheus
  • Grafana
  • OpenTelemetry
  • Loki
  • GitHub Actions
Modely spolupráce

Tři způsoby, jak s námi pracovat

MODEL 01

Architektonická revize

Krátká soustředěná zakázka. Přečteme systém, infrastrukturu i historii incidentů a písemně řekneme, co se rozbije jako první, co stojí oprava a co ignorovat.

  • 2–4 týdny
  • pevný rozsah
MODEL 02

Postavíme systém

Celá cesta — otázky, stack, architektura, služby, datový tok, integrace, cluster a předání. Ručíme za výsledek, ne za počet hodin.

  • od A do Z
  • plná odpovědnost
MODEL 03

Provozujeme s vámi

Po předání: provoz, monitoring a další rozvoj clusteru, který vlastníte — aby se váš tým mohl věnovat věcem, které umí jen on.

  • paušál
  • volitelné

Nevíte, kterou část potřebujete?

To je normální výchozí stav — a zjistit to je naše práce. Popište byznys a symptom; řekneme, co z toho platí, včetně případu, kdy nic.