Article by Aenix Team

Sieben Entscheidungen beim Entwurf einer Sovereign-AI-Architektur

Sieben Architekturentscheidungen hinter einem souveränen AI-Stack, wie sie ineinandergreifen und welche Kombinationen in realen Deployments immer wiederkehren.

DoraNis2SovereigntyAi MlMulti TenancyFinancial Services
Sieben Entscheidungen beim Entwurf einer Sovereign-AI-Architektur

Die sieben Entscheidungen

1. Auslöserprofil

Was treibt Sie in Richtung Souveränität? (Regulierte Datenklasse / Wirtschaftlichkeit der Inference / Prüfbarkeit / Air-Gap-Anforderung)

2. Regulatorischer Rahmen

Welche Aufsicht bindet Sie? (DORA, NIS2, sektorale Vorgaben, Vorgabe einer souveränen Cloud, grenzüberschreitende Übermittlung nach DSGVO)

3. Modellauswahl

Open-Weight oder proprietär. Gängige Open-Weight-Modelle 2026: Llama, Mistral, Qwen, DeepSeek, Phi, Gemma. Die Wahl hängt ab von:

  • Sprachanforderung (mehrsprachig oder Englisch)
  • Workload-Typ (Chat / RAG / Code / Vision / Embedding)
  • Lizenz (kommerzielle Nutzung, Namensnennung, Weitergabe)
  • Angestrebter Leistungsfähigkeit

4. Hardware-Dimensionierung

  • NVIDIA H100/H200 — das Arbeitspferd für Fine-Tuning und Inference mit hohem Durchsatz
  • NVIDIA Blackwell — neuer, höchste Speicherbandbreite
  • NVIDIA L40S — 48 GB, mandantenfähige Inference-Flotte
  • NVIDIA A100 — kosteneffizient, Gebrauchtmarkt
  • AMD MI300/MI325 — Alternative, wenn das Ökosystem passt

5. Mandantenmodell

  • Single-Tenant: Labor / einzelnes Team / PoC
  • Mandantenfähig über das Tenant CRD: Unternehmensplattform / kundenseitiges Angebot
  • Ein Cluster je Tenant: höchste Isolation, im Betrieb teuer

6. Souveränitätskontrollen

  • Kundenkontrollierte Verschlüsselungsschlüssel (HSM)
  • Transparenz der Lieferkette bis zur zweiten Stufe
  • Vollständige Audit-Trails in Formaten, die die Aufsicht auswerten kann
  • Air-Gap-Option für die sensibelsten Workloads

7. Betriebsmodell

  • Betrieb durch den Kunden (Sie betreiben die Plattform)
  • Betrieb durch den Anbieter (Ænix oder ein vergleichbarer Anbieter betreibt sie)
  • Hybrid (Sie betreiben; der Anbieter übernimmt den Second-Level-Support)

Wie die Entscheidungen ineinandergreifen

Die sieben Entscheidungen sind nicht unabhängig voneinander. Das Auslöserprofil prägt den regulatorischen Rahmen; der regulatorische Rahmen prägt die Souveränitätskontrollen; die Souveränitätskontrollen prägen das Betriebsmodell; das Betriebsmodell beeinflusst, welche Modellauswahl überhaupt machbar ist.

Häufige Kombinationen

Muster 1: Regulierte Finanzbranche + dauerhafte Inference + mandantenfähig DORA + Kontrollen nach Artikel 28 + mandantenfähiges Tenant CRD + kundenkontrollierte Schlüssel + von Ænix verwalteter Betrieb + Open-Weight-Modell (Klasse Llama 70B) auf einer H100/L40S-Flotte.

Muster 2: Öffentlicher Sektor + Air-Gap + eingestufte Daten Vorgabe einer souveränen Cloud + Air-Gap + Betrieb durch den Kunden + Open-Weight-Modell (Llama / Phi) auf Hardware des Kunden.

Muster 3: AI-Startup + dauerhafte Inference rund um die Uhr + kundenseitiges Angebot Keine spezifische Aufsicht + Kostenwirtschaftlichkeit als Auslöser + mandantenfähig + Betrieb durch den Kunden + Open-Weight-Modell + GPU-Mix passend zum Workload.

So nutzen Sie den Entscheidungsleitfaden

Beantworten Sie die Fragen oben der Reihe nach und notieren Sie Ihre Antworten; die Architekturoptionen grenzen sich dabei von selbst ein. Der Sovereign-AI-Architektur-Leitfaden geht dieselben Entscheidungen ausführlicher durch.

Zur konkreten Zusammenarbeit siehe Sovereign AI.

Wissens-Check: sieben Entscheidungen für Sovereign AI

5 questions · ~2 min