Begleitung zur Kubernetes-Consulting-Page.
10 Architekturentscheidungen, die zählen
- Distribution (vanilla / OpenShift / Cozystack / vendor-led)
- Multi-Tenancy (soft, hard via Tenant CRD, cluster pro tenant)
- Networking / CNI (Cilium ist 2026 Standard)
- Storage (LINSTOR, Ceph, vendor SAN)
- Identität und Secrets
- GitOps-Engine (Argo CD oder Flux)
- Observability-Stack (VictoriaMetrics + VictoriaLogs)
- Backup und DR (Velero + per-app PITR)
- Ingress und Load Balancing
- Lifecycle-Management
Operative Praktiken
- SLOs und Error Budgets
- Dokumentierte Runbooks
- Capacity Planning
- Upgrade-Disziplin (Kubernetes minor jedes Quartal)
- Incident Response
- Sicherheitsposture (Pod Security Standards, Network Policies)
Häufige Fehler
- Dev-Cluster auf Prod skaliert
- Kein Observability-Budget
- Sicherheit als Nachgedanke
- Upgrade-Schulden
- Kein Plattform-Team
Ænix ist das Team hinter Cozystack.
Wissens-Check: Produktions-Kubernetes-Cluster
5 questions · ~2 min
Question 1 / 5
Wie viele Architekturentscheidungen benennt der Artikel als die entscheidenden?
Why: Zehn Entscheidungen: (1) Distribution, (2) Mandantenfähigkeit, (3) Networking und CNI, (4) Storage, (5) Identität und Secrets, (6) GitOps-Engine, (7) Observability-Stack, (8) Backup und Disaster Recovery, (9) Ingress und Lastverteilung, (10) Lifecycle-Management.
Question 2 / 5
Welches CNI ist 2026 der Standard für neue Umgebungen?
Why: Cilium hat sich als Standard für 2026 durchgesetzt: eBPF-basiert, mit nativen L4/L7-Policies, eingebauter Observability und Service-Mesh-Funktionen in einem. Calico ist seit Langem stark bei BGP, Flannel ist einfacher, aber funktionsarm. In Cozystack steht Cilium neben Kube-OVN, das die VM-nahen Netzwerkfunktionen übernimmt.
Question 3 / 5
Was ist der häufigste Fehler beim Cluster-Lifecycle?
Why: Häufige Fehler: ein Dev-Cluster wird zum Produktivsystem hochskaliert, für Observability ist kein Budget eingeplant, Sicherheit kommt als Nachgedanke, Upgrade-Schulden häufen sich, weil die Upgrade-Praxis fehlt, und es gibt kein verantwortliches Plattformteam.
Question 4 / 5
Welche Betriebspraktiken empfiehlt der Artikel für Produktionscluster?
Why: Betriebspraktiken: SLOs und Fehlerbudgets, dokumentierte Runbooks, Kapazitätsplanung, Upgrade-Disziplin mit einem Kubernetes-Minor-Release je Quartal, geübte Incident Response und eine gepflegte Sicherheitslage mit Pod Security Standards und Network Policies.
Question 5 / 5
Welche GitOps-Engines sind produktionsreife Optionen?
Why: Sowohl Argo CD als auch Flux sind produktionsreif und CNCF-graduiert. Argo CD bietet eine reichhaltige Oberfläche, ein großes Plugin-Ökosystem und Mandantenfähigkeit über Projects. Flux liegt näher am Upstream-Kubernetes, ist eng mit dem Helm-Controller verzahnt und hat einen leichteren Betriebsaufwand. In Cozystack ist Flux der Standard.
0 / 5