Základ clusteru
Síť, ingress, storage, node pooly podle zátěže a izolace, aby jedna hladová služba nevyhladověla ostatní.
Cluster vespod, architektura, služby, které dělají práci, data, která jimi protékají, integrace ven a provoz, který to celé drží. Rozdělit to mezi dodavatele je spolehlivá cesta k drahým selháním.
Kubernetes na tolika strojích, kolik zátěž vyžaduje, propojený do jednoho clusteru a kompletně popsaný v kódu. Základy — metriky, logy, plánování, izolace — dává platforma, nestaví se pro každý projekt znovu.
Síť, ingress, storage, node pooly podle zátěže a izolace, aby jedna hladová služba nevyhladověla ostatní.
Libovolný počet strojů — cloud, on-premise nebo obojí — spojený do jednoho clusteru, který se chová jako jeden systém.
Stejný tvar nasazení pro jakýkoli typ produktu; nový systém startuje z ověřeného základu, ne z prázdné stránky.
Každé prostředí žije v repozitáři a průběžně se srovnává. Rollback je revert; staging se nemůže tiše rozjet.
Autoscaling laděný podle skutečného provozu — a na rovinu řečeno, co cluster stojí a co s tím.
RBAC podle skutečných rolí, tajemství mimo manifesty, síťové politiky, původ image a auditní stopa.
Část, která rozhoduje, jestli váš systém zůstane změnitelný. Hranice vedené podle skutečných švů v byznysu, verzované a testované kontrakty a tvar, který jde později upravit bez přepisu.
Hlavním uzlům datového toku je potřeba rozumět předem. Vše ostatní jde přidat později; proud, který se zadrhává nebo tiše ztrácí záznamy, se zalepit nedá.
Konektory na zdroje, dodavatele a vaše stávající systémy — s backpressure, bezpečnými retry a detekcí děr, kterých by si jinak nikdo nevšiml.
Relační, time-series, sloupcové, dokumentové — vybrané pro tento produkt a tato data. Rozhodnutí, které je nejdražší vracet.
Průběžné služby pro stálý proud, plánované joby pro periodickou práci — každý s vlastními zdroji a vlastním selháváním.
Vícekrokové zpracování řetězené tak, aby selhání skončilo u svého kroku, jasně se ohlásilo a pokračovalo bez přepočítání všeho před ním.
Cesty mezi částmi — fronty, streamy, přímá volání — dimenzované tak, aby propustnost vydržela nejhorší hodinu měsíce.
Validace schémat s alarmem na drift, přehratelná historie tam, kde na ní záleží, a jasná čára mezi daty, která jdou dopočítat, a daty, která ne.
Mikroslužba je pro model přirozený domov: má data, kontrakt i monitoring. Užitečný krok pak většinou není další dashboard — je to odpověď tam, kde vaši lidé už pracují.
Služby, které dělají skutečnou práci, plus rozhraní, které produkt potřebuje. UI stavíme jako součást systému — a nebereme zakázky na rozhraní odtržené od systému, který stavíme.
Každá v jazyce, který jí sedí — Go, Python, TypeScript nebo co úloha vyžaduje — s malým rozsahem, explicitním kontraktem, vlastními testy a metrikami.
Dashboardy, interní nástroje a operátorské obrazovky, stavěné podle tvaru dat, ne naopak.
Systémy, které už provozujete, napojíme — nenahrazujeme je zbytečně.
Kontraktní testy na každém švu, integrační testy nad toky, zátěžové testy na nejhorší hodinu a akceptace s vašimi lidmi, než se čemukoli řekne hotovo.
Nemůžete provozovat, co nevidíte. Observabilita se navrhuje spolu s funkcí, ne dodatečně po prvním nevysvětlitelném incidentu.
Metriky, logy a trasování se společnými korelačními ID napříč všemi službami v clusteru.
Alerty, které něco znamenají, vedou na runbook a dorazí k člověku dřív než k zákazníkovi.
Cluster, kód, dokumentace i zdůvodnění — předané kompletní a vaše.
Další provoz a rozvoj, pokud chcete. Nikdy nic, na čem bychom vás udělali závislými.
Výchozí volby, ne dogma. Stack se řídí produktem a jazyk se volí pro každou službu zvlášť, ne pro celou firmu — kontejnery to umožňují zadarmo. Pokud už vám něco funguje, raději se to naučíme, než abychom to měnili.
Krátká soustředěná zakázka. Přečteme systém, infrastrukturu i historii incidentů a písemně řekneme, co se rozbije jako první, co stojí oprava a co ignorovat.
Celá cesta — otázky, stack, architektura, služby, datový tok, integrace, cluster a předání. Ručíme za výsledek, ne za počet hodin.
Po předání: provoz, monitoring a další rozvoj clusteru, který vlastníte — aby se váš tým mohl věnovat věcem, které umí jen on.
To je normální výchozí stav — a zjistit to je naše práce. Popište byznys a symptom; řekneme, co z toho platí, včetně případu, kdy nic.