Die sieben Entscheidungen
1. Auslöserprofil
Was treibt Sie in Richtung Souveränität? (Regulierte Datenklasse / Wirtschaftlichkeit der Inference / Prüfbarkeit / Air-Gap-Anforderung)
2. Regulatorischer Rahmen
Welche Aufsicht bindet Sie? (DORA, NIS2, sektorale Vorgaben, Vorgabe einer souveränen Cloud, grenzüberschreitende Übermittlung nach DSGVO)
3. Modellauswahl
Open-Weight oder proprietär. Gängige Open-Weight-Modelle 2026: Llama, Mistral, Qwen, DeepSeek, Phi, Gemma. Die Wahl hängt ab von:
- Sprachanforderung (mehrsprachig oder Englisch)
- Workload-Typ (Chat / RAG / Code / Vision / Embedding)
- Lizenz (kommerzielle Nutzung, Namensnennung, Weitergabe)
- Angestrebter Leistungsfähigkeit
4. Hardware-Dimensionierung
- NVIDIA H100/H200 — das Arbeitspferd für Fine-Tuning und Inference mit hohem Durchsatz
- NVIDIA Blackwell — neuer, höchste Speicherbandbreite
- NVIDIA L40S — 48 GB, mandantenfähige Inference-Flotte
- NVIDIA A100 — kosteneffizient, Gebrauchtmarkt
- AMD MI300/MI325 — Alternative, wenn das Ökosystem passt
5. Mandantenmodell
- Single-Tenant: Labor / einzelnes Team / PoC
- Mandantenfähig über das Tenant CRD: Unternehmensplattform / kundenseitiges Angebot
- Ein Cluster je Tenant: höchste Isolation, im Betrieb teuer
6. Souveränitätskontrollen
- Kundenkontrollierte Verschlüsselungsschlüssel (HSM)
- Transparenz der Lieferkette bis zur zweiten Stufe
- Vollständige Audit-Trails in Formaten, die die Aufsicht auswerten kann
- Air-Gap-Option für die sensibelsten Workloads
7. Betriebsmodell
- Betrieb durch den Kunden (Sie betreiben die Plattform)
- Betrieb durch den Anbieter (Ænix oder ein vergleichbarer Anbieter betreibt sie)
- Hybrid (Sie betreiben; der Anbieter übernimmt den Second-Level-Support)
Wie die Entscheidungen ineinandergreifen
Die sieben Entscheidungen sind nicht unabhängig voneinander. Das Auslöserprofil prägt den regulatorischen Rahmen; der regulatorische Rahmen prägt die Souveränitätskontrollen; die Souveränitätskontrollen prägen das Betriebsmodell; das Betriebsmodell beeinflusst, welche Modellauswahl überhaupt machbar ist.
Häufige Kombinationen
Muster 1: Regulierte Finanzbranche + dauerhafte Inference + mandantenfähig DORA + Kontrollen nach Artikel 28 + mandantenfähiges Tenant CRD + kundenkontrollierte Schlüssel + von Ænix verwalteter Betrieb + Open-Weight-Modell (Klasse Llama 70B) auf einer H100/L40S-Flotte.
Muster 2: Öffentlicher Sektor + Air-Gap + eingestufte Daten Vorgabe einer souveränen Cloud + Air-Gap + Betrieb durch den Kunden + Open-Weight-Modell (Llama / Phi) auf Hardware des Kunden.
Muster 3: AI-Startup + dauerhafte Inference rund um die Uhr + kundenseitiges Angebot Keine spezifische Aufsicht + Kostenwirtschaftlichkeit als Auslöser + mandantenfähig + Betrieb durch den Kunden + Open-Weight-Modell + GPU-Mix passend zum Workload.
So nutzen Sie den Entscheidungsleitfaden
Beantworten Sie die Fragen oben der Reihe nach und notieren Sie Ihre Antworten; die Architekturoptionen grenzen sich dabei von selbst ein. Der Sovereign-AI-Architektur-Leitfaden geht dieselben Entscheidungen ausführlicher durch.
Zur konkreten Zusammenarbeit siehe Sovereign AI.
Wissens-Check: sieben Entscheidungen für Sovereign AI
5 questions · ~2 min



