gpu-vps-ai-training_hero-background-image_alt
icon-gpu_f_white_alt
GPU VPS

Dedizierte GPU VPS für KI und Inferenz

Betreiben Sie eigene LLMs und KI-Modelle auf einer dedizierten NVIDIA RTX PRO 6000 mit 96 GB VRAM. Trainieren Sie ein Modell mit Fine-Tuning, stellen Sie Inferenz bereit oder bauen Sie wenige Minuten nach Bestellung eine RAG-Pipeline auf. CUDA ist vorinstalliert, und die gesamte GPU gehört Ihnen: kein Sharing, kein GPU-Slicing.


Dedizierte GPU-Ressourcen. Monatliche Abrechnung. Keine versteckten Kosten. NVMe-Speicher.


Object Storage
GPU VPS
999,00 €
799
20 / Monat
 

Dedizierte NVIDIA RTX PRO 6000

CUDA-kompatibel · NVMe-Speicher

Unbegrenzter Traffic*

DEDIZIERTE NVIDIA RTX 6000 PRO
FÜR JEDEN KI-WORKLOAD

Performance VPS kombiniert NVIDIA-GPU-Leistung mit der neuesten Blackwell-Architektur

und nativem FP4 für quantisierte Modelle. Gehen Sie über Consumer-Karten hinaus.

Mit genug Ressourcen für anspruchsvolle LLMs.

gpu animation
96 GB
GDDR7 VRAM
24.064
CUDA CORES
120
FP32 TFLOPS
1.597
Bandbreite in GB/s

In wenigen Minuten startklar

Keine manuelle Treiberinstallation. Kein langes Warten auf die Bereitstellung. Eine fertige CUDA-Umgebung, sofort einsatzbereit.

Schritt 1: Standort auswählen

Wählen Sie Ihre GPU VPS-Region (Europa oder US Central).

Schritt 2: Bestellung abschließen

Ihre Instanz wird automatisch auf Ubuntu 24.04 bereitgestellt - mit CUDA-Treibern, dem CUDA-Toolkit und vorintegriertem nvidia-container-toolkit.

Schritt 3: Verbinden und loslegen

Per SSH einloggen und starten. Die Grundkonfiguration ist bereits erledigt - starten Sie ein beliebiges CUDA-kompatibles Framework direkt nach dem Verbinden.

Darum ist Contabos GPU VPS die perfekte Wahl für KI-Training und Inferenz-Workloads

background-image_gpu-vps-why-run-ai-training_alt
icon-dedicated-servers_f_alt
100 % dedizierte GPU-Ressourcen

Sie bekommen die volle RTX PRO 6000 – kein vGPU-Slicing, keine geteilte Karte. Die vollen 96 GB stehen Ihnen dauerhaft zur Verfügung, vom ersten Trainingsschritt bis zum letzten mit stabilem Durchsatz.

icon-platform_f_alt
CUDA-kompatible Infrastruktur

Jeder GPU VPS kommt mit Ubuntu 24.04, CUDA und nvidia-container-toolkit vorinstalliert. Einfach PyTorch oder vLLM Container starten und direkt loslegen.

icon-enlarge_f_alt
Für große Modelle ausgelegt

Mit Blackwell-Architektur, nativem FP4 und 96 GB VRAM laufen Modelle, an denen Consumer-Karten scheitern. Ein 70B-Modell läuft in FP8 komplett auf einer Karte.

icon-wallet_f_alt
Transparente Preise

Ein fester Monatspreis, unbegrenzter Traffic inklusive. Keine Abrechnung pro Sekunde, keine Extrakosten pro Token – die Rechnung bleibt immer gleich.

icon-access_f_alt
Ihre Infrastruktur, Ihre Regeln

Root-Zugriff und gewohntes Linux-Tooling geben Ihnen die volle Kontrolle. Wählen Sie ein Rechenzentrum in Europa oder den USA und behalten Sie Ihre Daten dort, wo es darauf ankommt.

icon-support_f_alt
24/7 Support

Ausgezeichneter Support aus menschlicher Fachkompetenz und hochwertigen KI-gestützten Antworten. Schnelle Hilfe, wenn ein Trainingslauf hängt oder ein Endpoint Probleme bereitet.

So schneidet der Contabo GPU VPS ab

FP32 misst die Single-Precision-Leistung – also den Rohdurchsatz, der 3D-Rendering, Videoverarbeitung und wissenschaftliche Simulationen antreibt. Mehr TFLOPS bedeuten kürzere Renderzeiten und schnellere Simulationsläufe. Mit 120 TFLOPS liegt die RTX PRO 6000 Server Edition vor jeder Rechenzentrums- und Profi-GPU im Vergleich.
RTX PRO 6000
120
Blackwell Server Edition · 96 GB GDDR7 ECC · 24.064 CUDA Cores
L40S
91.6
Ada Lovelace · 48 GB GDDR6 · 18.176 CUDA Cores
H100
67
Hopper · 80 GB HBM3 · 16.896 CUDA cores · für Multi-Node-Training konzipiert
H200
67
Hopper · 141 GB HBM3e · 16.896 CUDA cores · für Multi-Node-Training konzipiert
A100
19.5
Ampere · 80 GB HBM2e · 6.912 CUDA cores · vorherige Generation
FP32-Rechenleistung (TFLOPS) – höher ist besser

GPU VPS Anwendungsfälle für KI-Teams

Vier KI-Workloads, die auf eine einzige 96-GB-Karte passen.
icon-ai_f_alt
LLM-Inferenz mit eigenem Modell

Betreiben Sie eigene Weights und behalten Sie jeden Prompt auf Ihrer eigenen Infrastruktur. Ein 70B-Modell passt in FP8, mit genug Reserve für Kontext.

icon-configuration_f_alt
Fine-Tuning und LoRA-Training

LoRA und Full-Parameter-Fine-Tuning auf einer einzigen Karte. Mit 96 GB VRAM laden Sie Basismodelle, die auf einer 24 GB Consumer-GPU nicht laufen würden.

icon-merge_f_alt
Skalierbare RAG-Pipelines

Embedder, Vektor-Store und Generierungsmodell laufen auf einer GPU. Kein Netzwerkwechsel dazwischen und Ihre Daten bleiben in Ihrer Umgebung.

icon-team_f_alt
Dev- und Test-Umgebungen für KI-Teams

Eine dauerhaft verfügbare GPU-Box für das ganze Team, mit CUDA vorkonfiguriert. Keine Cold Starts, kein Neuaufsetzen zwischen den Sitzungen.

Ihr GPU VPS ganz nach Ihren Vorstellungen: Apps und Deployment-Optionen

Der GPU VPS wird mit Ubuntu 24.04 und vorinstalliertem CUDA ausgeliefert. Über das Customer Control Panel können Sie im Handumdrehen weitere Apps und Panels hinzufügen.

vps-page-tab-1-click-openclaw
OpenClaw
vps-page-tab-1-click-openclaw
n8n
logo-small-hermes_alt
Hermes Agent
logo_small_ollama
Ollama
logo-small-dokploy_alt
Dokploy
logo-small-paperclip_alt
Paperclip
logo-small-coolify_alt
Coolify
Logo cPanel small

cPanel

vps-page-tab-panel-plesk
Plesk
vps-page-tab-panel-docker
Docker
vps-page-tab-panel-webmin
Webmin
vps-page-tab-panel-proxmox
Proxmox
icon-custom-images_f_alt

Installieren Sie Ihr perfektes Custom Image

Mit  Custom Images können Sie Ihr .iso- oder .qcow2-Image sofort über die Web-UI oder API bereitstellen.

image-hugging-face_alt

Auf der Suche nach Inspiration? Entdecken Sie
KI-Modelle und Apps auf Hugging Face.

FAQ

Häufige Fragen zu unserem GPU VPS
Was ist ein GPU VPS?

Ein GPU VPS ist ein Virtual Private Server mit einer dedizierten NVIDIA GPU, die über PCI-Passthrough angebunden ist. Anders als bei geteilten GPU-Instanzen ist die vollständige GPU inklusive VRAM, CUDA-Kernen und Speicherbandbreite allein für Ihren Workload reserviert.

Welche GPU steckt im Contabo GPU VPS?

In jedem GPU VPS arbeitet eine NVIDIA RTX PRO 6000 Blackwell Server Edition mit 96 GB GDDR7 ECC VRAM, 24.064 CUDA-Kernen, 120 TFLOPS FP32-Rechenleistung und 1.597 GB/s Speicherbandbreite.

Ist die GPU dediziert oder wird sie geteilt?

Die GPU ist dediziert. Die komplette RTX PRO 6000 wird Ihrem VPS über 1:1-PCI-Passthrough zugewiesen, ohne vGPU-Slicing.

Eignet sich das GPU VPS für Training oder nur für Inferenz?

Beides. Eine dedizierte RTX PRO 6000 mit 96 GB VRAM und Tensor Cores der 5. Generation bewältigt Training, Fine-Tuning und Inferenz. Den größten Mehrwert bietet sie beim Fine-Tuning und der Anpassung bestehender Modelle, was den Großteil realer Trainingsaufgaben abdeckt.


Kann ich LLM-Inferenz und Fine-Tuning auf demselben GPU VPS betreiben?

Ja. Der typische Workflow: Modell auf dem GPU VPS fine-tunen, dann auf derselben dedizierten RTX PRO 6000 für Inferenz betreiben. Beide Schritte sind Single-GPU-Workloads – mit 96 GB VRAM ist genug Spielraum, um nahtlos von einem Schritt zum nächsten zu wechseln.

Kann ich Multi-GPU- oder Multi-Node-KI-Training auf einem Contabo GPU VPS betreiben?

Nicht bei diesem Plan. GPU VPS ist ausschließlich Single-GPU und Single-Node, ohne NVLink-Interconnect und ohne vGPU-Slicing über mehrere VMs. Für Workloads, die über eine einzelne RTX PRO 6000 hinausgehen, bietet unsere Schwesterfirma vshosting dedizierte Multi-GPU-Server mit NVLink, H200- und B300-Konfigurationen

Läuft ein Modell mit 70B Parametern wirklich auf diesem GPU VPS?

Ja, mit FP8-Präzision. Die Weights eines Modells der 70B-Klasse belegen bei FP8 rund 70 GB, also ein Byte pro Parameter. Innerhalb der 96 GB VRAM bleibt damit Reserve für Kontext und den Overhead der Inferenz.

Welche KI-Modelle laufen bestätigt auf GPU VPS?

Stable Diffusion, Qwen3-14B, Nemotron-Nano-3-30B, Devstral-2-123B, Qwen-Image-2512 und Coqui TTS sind bestätigt. Jedes weitere CUDA-kompatible Modell, das in 96 GB VRAM passt, läuft ebenfalls.

Ist CUDA vorinstalliert?

Ja. Jeder GPU VPS kommt mit Ubuntu 24.04, CUDA und nvidia-container-toolkit vorinstalliert.

Welche Betriebssysteme werden unterstützt?

Im Bestellprozess ist Ubuntu 24.04 LTS mit vorinstalliertem CUDA das einzige unterstützte Image für den GPU VPS. Windows lässt sich bei Bedarf im Nachgang über das Customer Control Panel installieren. In diesem Fall müssen Sie CUDA selbst einrichten.

Wo stehen die GPU VPS Rechenzentren?

Zum Start sind ausschließlich Europa und US Central verfügbar. Der Start in zwei Regionen ist ein bewusster erster Schritt: GPU-Kapazität lässt sich schwerer planen als bei einem Standard-VPS, weshalb wir den Launch fokussiert halten, um Verfügbarkeit und Performance zu schützen. Weitere Regionen sind geplant.

Der angezeigte Preis ist der effektive Monatsbeitrag für ein 12-monatiges Abonnement inklusive aller anfallenden Steuern.

Mindestvertragslaufzeit: 1 Monat | Nachfolgende Vertragslaufzeit: Identisch mit Ihrer initial gewählten Vertragslaufzeit. | Kündigungsfrist: keine (pre-paid) oder 4 Wochen (post-paid).

Eingehender Traffic: Unbegrenzt und nicht gemessen. Es entstehen keine zusätzlichen Kosten. | Ausgehender Traffic: Unbegrenzt. Es gilt eine Fair Use Policy basierend auf der durchschnittlichen Serverauslastung. Um eine faire Netzwerkleistung für alle Kunden zu gewährleisten, behält sich Contabo das Recht vor, Server mit außergewöhnlich hoher oder störender Nutzung zu drosseln.

Anwendungen und Add-ons: Contabo bietet umfassenden technischen Support für den Contabo-eigenen VPS, einschließlich Netzwerk, Hardware und Erstkonfiguration aller 1-Klick-Add-ons. Alle zusätzlichen Open-Source-Softwareprogramme, die in den Anwendungen enthalten sind, sind Eigentum des jeweiligen Anbieters; Wartung, Aktualisierung und Fehlerbehebung liegen in der Verantwortung des Endnutzers.

Tragen Sie hier Ihre Daten ein und wir informieren Sie, sobald GPU VPS verfügbar ist.

Ihre Interesse wurde aufgenommen. Wir benachrichtigen Sie, sobald GPU VPS wieder verfügbar ist.
Etwas ist schiefgelaufen. Bitte versuchen Sie es erneut.