Machen Sie aus Ihren NVIDIA-Servern eine GPU-Cloud, die Sie verkaufen können. Tenants bestellen GPU-VMs, Kubernetes-Cluster mit GPU-Nodes, verwaltete Datenbanken und S3-Storage aus Ihrem eigenen Portal in Ihrer Marke. Jeder Tenant bleibt isoliert, und seine Nutzung fließt in WHMCS oder Ihr eigenes Billing-System. Alles läuft auf Hardware, die Ihnen gehört, mit einem Open-Source-CNCF-Projekt als Fundament.
Passt zu: Ænix Public Cloud Platform, der Plattform für Organisationen, die Cloud verkaufen, und Ænix AI Platform für Model Serving und KI-Dienste darüber. Probieren Sie das Kundenportal in der Live-Demo aus.
Für wen ist das gedacht?
- Rechenzentren mit GPU-Racks, die GPU-Cloud verkaufen wollen, nicht nur Colocation oder dedizierte Server.
- Neue GPU-Clouds (Neoclouds) mit einigen hundert bis einigen tausend NVIDIA-GPUs und Kunden, die Self-Service erwarten.
- Hosting-Anbieter und Telcos, die ein bestehendes Cloud-Produkt um GPUs erweitern.
- Nationale und regionale Cloud-Programme, deren GPU-Kapazität im Land bleiben muss.
Wenn Sie nur ganze Server mit langen Verträgen an eine Handvoll Kunden vermieten, reicht womöglich ein Werkzeug zur Bare-Metal-Bereitstellung. Diese Plattform ist für den Fall gedacht, dass Kunden GPUs selbst bestellen, skalieren und bezahlen.
Was braucht eine GPU-Cloud außer den GPUs?
Tenants und Isolation Jeder Kunde ist ein Tenant mit eigenen Quotas, Zugriffsrechten, Netzwerkisolation und eigenem Monitoring. Reseller erhalten verschachtelte Tenants für ihre eigenen Kunden.
Bestellung im Self-Service Ein Kundenportal in Ihrer Marke mit Registrierung, Teamverwaltung und Support-Tickets. Kunden legen GPU-VMs, Kubernetes-Cluster und Datenbanken an, ohne YAML zu schreiben oder ein Ticket zu eröffnen.
Abrechenbare Nutzung Die Nutzung wird pro Tenant erfasst und an Ihre Abrechnung übergeben. Tenants mit offenen Rechnungen lassen sich automatisch sperren, ohne Ticket an das Engineering.
Dienste neben der GPU Kunden, die Modelle trainieren oder bereitstellen, brauchen auch Storage, Datenbanken und Queues. Wer sie auf derselben Plattform verkauft, steigert den Umsatz pro GPU-Kunde.
Wie werden GPUs den Tenants zugeteilt?
Jeder Modus bietet ein anderes Maß an Isolation — wählen Sie ihn daher pro Produkt, nicht pro Cluster.
| Modus | Funktionsweise | Isolation | Status |
|---|---|---|---|
| Ganze GPU an eine VM | Eine oder mehrere GPUs per Passthrough (VFIO) an die KubeVirt-VM eines Tenants | Der Tenant hat die Karte für sich allein | Verfügbar |
| NVIDIA vGPU an eine VM | Eine Karte, aufgeteilt in vGPU-Profile für mehrere VMs | Eigene vGPU pro VM; erfordert Ihre NVIDIA-vGPU-Lizenz | Verfügbar |
| GPU-Nodes im Tenant-Kubernetes | Kubernetes-Node-Gruppen mit GPUs, Treiber verwaltet vom NVIDIA GPU Operator | Pro Tenant-Cluster | Verfügbar |
| Anteiliges Sharing in Kubernetes | HAMi lässt mehrere Container eine GPU mit Grenzen für Speicher und Rechenleistung teilen | Geteilte Karte; Grenzen für die Rechenleistung erfordern Container-Images mit glibc älter als 2.34 | Verfügbar (optional) |
| MIG-Partitionen | Hardware-Partitionen einer Karte | Auf Hardware-Ebene | Roadmap |
| Time-Slicing | Container nutzen eine Karte abwechselnd | Keine zwischen Workloads | Roadmap |
Unterstützt werden NVIDIA-GPUs für Rechenzentren über den NVIDIA GPU Operator. Ænix hat den GPU-Operator-Stack im Oktober 2026 zur Partner-Validierung bei NVIDIA eingereicht; die Prüfung steht noch aus. Für andere Beschleuniger ist PCI-Passthrough an VMs der unterstützte Weg.
Was bekommen Ihre Kunden?
- GPU-VMs mit Linux oder Windows, auch mit eigenen Images und Templates.
- Managed Kubernetes mit GPU-Node-Gruppen. Jeder Tenant-Cluster hat eine eigene Control Plane.
- Verwaltete Datenbanken und Queues: PostgreSQL, MariaDB, Valkey, Kafka, ClickHouse, RabbitMQ, NATS, MongoDB, OpenSearch und Qdrant als Vektordatenbank.
- S3-kompatibler Object Storage für Datensätze und Modell-Checkpoints.
- KI-Dienste mit der Ænix AI Platform: Model Serving und der KI-Stack drumherum. Die Plattform eines Telekommunikationsbetreibers und Integrators etwa betreibt NVIDIA-Dynamo-Inferenz und RAG auf Qdrant, paketiert als Cozystack-Dienste (Fallstudie).
Kubernetes für KI, von Dritten bestätigt
Cozystack ist eine CNCF Certified Kubernetes Distribution. Im September 2026 wurde es für Kubernetes v1.35 in das Programm CNCF Kubernetes AI Conformance aufgenommen, das prüft, ob eine Plattform KI-Workloads so ausführt, wie es die Kubernetes-Community festlegt. Details zur Conformance und wie sich die Prüfläufe nachvollziehen lassen, finden Sie auf der Seite zur Kubernetes Conformance.
Wie funktionieren Abrechnung und Portal?
- WHMCS. Die Ænix-WHMCS-Integration, ein proprietäres Ænix-Modul, verkauft GPU-VMs, Kubernetes, Datenbanken und Storage als WHMCS-Produkte. Sie arbeitet in zwei Modi: WHMCS als Storefront für Kunden oder das Ænix-Portal als Storefront mit WHMCS als Billing-Backend. Mehr zu WHMCS →
- Eigenes Billing. Anbieter mit eigenem System übernehmen die Nutzung pro Tenant aus der Plattform. Ein Schweizer Anbieter auf Cozystack rechnet dedizierte Ressourcen stundengenau aus seinem hauseigenen System ab (Fallstudie).
- Ænix-Billing. Die Ænix Public Cloud Platform enthält außerdem ein Billing-Backend und -Frontend mit Zahlungsabwicklung für Anbieter, die weder das eine noch das andere haben.
Sie legen den Preis pro GPU, pro Stunde oder pro Paket fest. Die Plattform liefert die Nutzung pro Tenant; Ihre Preisliste gibt sie nicht vor.
Souveränität und Kontrolle
- Ihre Hardware, Ihre Rechtsordnung. Die Plattform läuft auf Ihren Servern. Kundendaten und Modell-Weights bleiben in Ihrem Rechenzentrum.
- Air-Gap-Installation wird unterstützt, und Telemetrie ist ausgeschaltet, solange Sie sie nicht einschalten.
- Open Source als Fundament. Cozystack steht unter Apache 2.0. Wenn Sie das Ænix-Abonnement beenden, läuft die Plattform weiter.
- Ænix als Lieferant: Die AENIX s.r.o. ist nach ISO/IEC 27001:2022 zertifiziert.
Wie läuft ein Start ab?
Discovery-Gespräch
30 Minuten, kostenlos. Ihr GPU-Bestand, Ihre Kunden, was Sie heute verkaufen.
Platform Readiness Assessment
Festpreis, 14 oder 28 Tage. Zielarchitektur, Netzwerk- und Storage-Design, GPU-Produktmodi, Risikoregister.
Installation
Produktisierter Installer: live innerhalb weniger Wochen, sobald die Hardware bereitsteht. Multi-Region-Programme beginnen mit einem Pilot von 3–6 Monaten.
Erste Tenants
Portal-Branding, Servicekatalog, Anbindung an die Abrechnung, danach Onboarding.
Betreiben und wachsen
Support mit SLA. Multi-Region-Programme erreichen den vollen Umfang 9–18 Monate nach dem Pilot.
Das Design der Netzwerk-Fabric für Training über mehrere Nodes (InfiniBand, RoCE) wird im Assessment für Ihre Hardware ausgearbeitet und nicht als fertiges Paket verkauft.
Wo läuft das bereits?
Diese Projekte sind vollständig dokumentiert, die Kunden anonymisiert, wie es ihre Verträge verlangen:
- Eine souveräne Public Cloud auf Bare Metal: Ein Schweizer Anbieter verkauft VMs, Kubernetes und GPUs aus drei Rechenzentren und rechnet aus seinem eigenen System ab.
- 8×H100-Inferenz auf eigenem Bare Metal: alle acht GPUs per Passthrough an eine isolierte Tenant-VM, rund zwei Monate bis zum Produktivbetrieb.
- Cozystack als universeller Installer: Ein Telekommunikationsbetreiber und Integrator betreibt GPU-Passthrough in VMs und Cluster, NVIDIA Dynamo und geografisch verteilte GPUs.
- Von der Public Cloud auf Bare Metal, Bursting bei Bedarf: anteiliges GPU-Sharing und GPU-Kosten rund fünfmal niedriger als im vorherigen Hyperscaler-Setup.
Das größte hier dokumentierte GPU-Projekt ist ein einzelner 8×H100-Node. Für einen größeren Bestand planen wir einen Proof of Concept auf Ihrer eigenen Hardware.
Preise
Ænix verkauft ein Abonnement (Support, kommerzielle Module und Services), keine Lizenz. Für die Public Cloud Platform gelten die veröffentlichten Support-Stufen, bepreist pro 10 physische Nodes und Monat; Support für GPU-Sharing ist ab der Stufe Standard enthalten, Plus und Enterprise ergänzen Support rund um die Uhr und ein vollständiges Proof-of-Concept-Paket. KI-Dienste wie Model Serving sowie Multi-Region-Programme von Betreibern werden per RFP angeboten. Leistungen außerhalb des vereinbarten Umfangs berechnen wir mit 150 USD pro Stunde. Alle Details zu den Stufen finden Sie auf der Preisseite.
Beginnen Sie mit einem Gespräch
Bringen Sie Anzahl und Modelle Ihrer GPUs mit, Ihren aktuellen Stack und das, was Sie heute verkaufen. Ein Ænix-Engineer sagt Ihnen, welche GPU-Modi zu Ihrem Produkt passen und was ein Start erfordern würde.
Ænix hat Cozystack entwickelt und pflegt es gemeinsam mit Maintainern anderer Unternehmen. Cozystack ist ein CNCF-Sandbox-Projekt unter Apache 2.0; der Antrag auf CNCF Incubation befindet sich in der Due-Diligence-Prüfung. Ænix liefert es als drei Plattformen auf einer Engine (Public Cloud, Private Cloud und AI), die sich kombinieren lassen, statt einander auszuschließen.