Reservierte GPUs.
Für den Stack, den du betreibst.

NVIDIA RTX PRO 6000 Blackwell mit 96 GB pro GPU, für dich in Deutschland reserviert und pro GPU und Monat abgerechnet. Modelle, Trainingsjobs und Container bringst du mit. Hardware und Netz betreiben wir.

Auf Anfrage verfügbar. Kapazität und Starttermin bestätigen wir dir pro Anfrage.

NVIDIA RTX PRO 6000 Blackwell · reserviert
96 GB pro GPU
Frankfurt, Deutschland · auf Anfrage

Nur für dich.

Deine GPUs sind für die gesamte Vertragslaufzeit für dich reserviert und exklusiv: Kein anderer Kunde betreibt darauf Workloads, und ein Trainingslauf wartet nie auf freie Kapazität.

Fester Betrag pro Monat.

Abgerechnet pro GPU und Monat. Die Rechnung hängt nicht davon ab, wie viele Stunden oder Tokens du verbrauchst.

Als VM oder Kubernetes-Node.

Du bekommst die GPUs als VMs mit Root-Zugang oder als GPU-Nodes in deinem enum Kubernetes-Cluster, direkt neben deinem Object Storage. Beides auf Anfrage.

Ein GPU-Typ.
Passend für offene Modelle.

Wir bieten eine GPU an: die NVIDIA RTX PRO 6000 Blackwell. Mit 96 GB pro Karte laufen gpt-oss-120b, Mistral Small und Qwen3 32B jeweils auf einer einzigen GPU.

GrößeGPU-SpeicherPreis
1 GPU96 GBAuf Anfrage
2 GPUs192 GBAuf Anfrage
4 GPUs384 GBAuf Anfrage
8 GPUs768 GBAuf Anfrage
Mehr als 8Auf AnfrageAuf Anfrage

Richtwerte, jeweils als VM oder als GPU-Nodes in deinem enum Kubernetes-Cluster, alle mit NVIDIA RTX PRO 6000 Blackwell (96 GB GDDR7 mit ECC). Laufzeit, Kapazität und Starttermin bestätigen wir pro Anfrage. Preise auf Anfrage.

Dein Stack.
Auf einer VM oder auf Kubernetes.

Du nimmst die GPUs als VMs mit Root-Zugang und installierst, was du brauchst, oder als GPU-Node-Pool in deinem enum Kubernetes-Cluster. Dort fordern Workloads sie über die Standard-Ressource nvidia.com/gpu an, vLLM, Ollama, PyTorch-Jobs und deine Helm-Charts laufen ohne Anpassung. Beides gibt es auf Anfrage, und wir richten es gemeinsam mit deinem Team ein.

# vllm.yaml (excerpt)
containers:
  - name: vllm
    image: vllm/vllm-openai
    args: ["--model", "openai/gpt-oss-120b"]
    resources:
      limits:
        nvidia.com/gpu: 1

Was Teams darauf betreiben.
Eigene Modelle, nach eigenen Regeln.

Inferenz in eigener Regie.

Offene oder hauseigene Modelle mit vLLM, TGI oder Triton ausliefern, mit deinem eigenen Scaling und Monitoring.

Fine-Tuning.

Offene Modelle per LoRA an deine Daten anpassen, kleinere Modelle auch vollständig. Die Trainingsdaten bleiben in deinem Object Storage in Deutschland.

Batch-Jobs.

Embeddings für große Dokumentbestände, Transkription, Klassifizierung: Arbeit, die stundenlang läuft, auf einer GPU, die nur dir zur Verfügung steht.

→Den Stack lieber nicht selbst betreiben? Dann betreibt enum die Modelle. Bei Models as a Service betreibt enum gpt-oss, Llama, Mistral oder deine eigenen Gewichte auf denselben reservierten GPUs, und du bekommst eine private, OpenAI-kompatible API. Abgerechnet wird genauso: pro GPU und Monat.Zu Models as a Service

Die Hardware.
In Zahlen.

0196 GBSpeicher pro GPU.GDDR7 mit ECC, genug für ein 120B-Modell in MXFP4 auf einer Karte.
02BlackwellArchitektur.Tensor Cores der fünften Generation mit FP4- und FP8-Unterstützung.
031-8Klein anfangen.Richtwerte: 1, 2, 4 oder 8 GPUs, größere Setups auf Anfrage.
04MonatlichAbrechnung.Pro GPU und Monat, in Euro. Preise auf Anfrage.
05DEStandort.In Frankfurt, bereitgestellt von der enum GmbH, einem deutschen Unternehmen ohne US-Mutterkonzern.
06VM / K8sBereitstellung.GPU-VMs mit Root-Zugang oder GPU-Nodes in deinem enum Kubernetes-Cluster.

Vertrag und Compliance.
Wo wir stehen.

VorhandenISO 27001 und EN 50600 (Rechenzentrum)Zertifikate des Rechenzentrumsbetreibers in Frankfurt.
In jedem VertragAuftragsverarbeitungsvertrag nach DSGVONach deutschem Recht, mit einem deutschen Unternehmen ohne US-Mutterkonzern.
Q4 2026ISO 27001 für enumIn Arbeit, Ziel ist Q4 2026.
2027BSI C5Für 2027 auf der Roadmap.
NIS2 oder DORA stehen an? Was sie von deinem Anbieter verlangen

Anfrage senden

GPU-Anzahl, Kapazität und Starttermin bestätigen wir nach einem kurzen Abstimmungsgespräch. Preise auf Anfrage.

Wir verwenden deine Angaben nur, um deine Anfrage zu beantworten und ein Angebot vorzubereiten (Art. 6 Abs. 1 lit. b DSGVO). Mehr dazu in unserer Datenschutzerklärung.

Fragen.
Zu reservierten GPUs.

Welche GPUs bietet enum an?

Die NVIDIA RTX PRO 6000 Blackwell mit 96 GB GDDR7-Speicher pro GPU. Reservieren kannst du ab einer GPU.

Wie schnell können wir starten?

Reservierte GPUs gibt es auf Anfrage. Sag uns, wie viele GPUs du ab wann brauchst, dann bestätigen wir Kapazität und Starttermin für deine Anfrage.

Was kostet das?

Du zahlst pro GPU und Monat, in Euro. Den Preis nennen wir dir zusammen mit Kapazität und Starttermin, er ist also auf Anfrage.

Ist das dedizierte Hardware?

Deine GPUs sind für die Vertragslaufzeit für dich reserviert und exklusiv: Kein anderer Kunde betreibt darauf Workloads. Netz, Speicher und Kubernetes Control Planes drumherum laufen auf der gemeinsam genutzten Public-Cloud-Plattform von enum.

Wie nutzen wir die GPUs?

Als GPU-VMs oder als GPU-Nodes in deinem enum Kubernetes-Cluster, beides auf Anfrage. Auf einer VM hast du Root-Zugang und installierst deinen eigenen Stack. Auf Kubernetes fordern Pods die GPUs über nvidia.com/gpu an, deinen Inferenz-Server oder Trainingsjob deployst du wie jeden anderen Workload.

Welche Modelle passen auf eine GPU?

Mit 96 GB passen gpt-oss-120b (MXFP4), gpt-oss-20b, Mistral Small 24B und Qwen3 32B jeweils auf eine GPU. Llama 3.3 70B läuft in FP8 mit begrenztem Kontext auf einer GPU, für längeren Kontext oder mehr Nutzer planst du zwei. Das sind Richtwerte: Kontextlänge und Zahl paralleler Anfragen verändern den Bedarf.

Wo stehen die GPUs?

In Frankfurt. Das Rechenzentrum ist nach ISO 27001 und EN 50600 zertifiziert. Diese Zertifikate hält der Betreiber des Rechenzentrums. Die enum GmbH ist ein deutsches Unternehmen ohne US-Mutterkonzern, der US CLOUD Act erstreckt sich deshalb nicht auf die Daten darauf.

Gibt es eine Mindestlaufzeit?

Die Laufzeit stimmen wir pro Anfrage ab. Sag uns, wie lange du die GPUs brauchst, und das Angebot deckt genau diese Laufzeit ab.

Kann enum die Modelle auch für uns betreiben?

Ja. Bei Models as a Service betreibt enum den Inferenz-Stack auf denselben reservierten GPUs, mit privater, OpenAI-kompatibler API und derselben Abrechnung pro GPU.

GPUs in Deutschland gesucht?
Erzähl uns, was du betreibst.

Schick uns GPU-Anzahl, Zeitplan und was du darauf betreiben willst. Wir bestätigen Kapazität, Starttermin und Preis.