all systems operational
Get started
/ gpu vps · kvm + pci passthrough

GPU VPS.Trainieren. Rendern. Streamen.

KVM virtuelle Maschinen mit vollem PCI-Passthrough zu NVIDIA RTX PRO 4500 und RTX PRO 6000 Blackwell. Die gesamte GPU geht an Ihre VM — kein vGPU-Slicing, keine geteilten CUDA-Kerne. Startet in Minuten. Fester monatlicher Preis. Keine überraschende Stundenabrechnung.

  • 100%GPU an Ihre VM durchgereicht
  • PCIe 5Passthrough mit voller Bandbreite
  • 10 Gbit/sUplink, unlimitiert
  • ~5 minBereitstellung · auf Lager
live · gpu-7
RTX PRO 6000 Blackwell
läuft
CUDA-Auslastung62%
VRAM
71.4 / 96 GB
Temp.
62 °C
Leistung
412 W
SM-Takt
2.61 GHz
Aktive Workload
PID 8421llama-3.1-70b · vLLM68 GB
PID 8422whisper-large-v33.4 GB
/ Hardware

Zwei Karten. Beide Workstation-Klasse.

Profi-GPUs an Ihre VM über PCIe Gen 5 Passthrough durchgereicht. ECC VRAM, angemessene Rechenzentrums-Kühlung. Kein Gaming-Silizium, keine Consumer-Treiber, kein vGPU-Slicing.

entry

RTX PRO 4500 Blackwell

32 GB GDDR7 ECC

Generation: Blackwell · 10.496 CUDA-Kerne

  • VRAM32 GB GDDR7 · ECC
  • CUDA cores10,496
  • Tensor cores328 (5th gen)
  • RT cores82 (4th gen)
  • FP32 compute49.8 TFLOPS
  • TDP200 W
  • Memory bus256-bit · 672 GB/s
  • NVENC / NVDEC3 / 3 (AV1)
Ideal für
  • LLM-Inferenz bis zu 30B Parameter
  • Stable Diffusion / Flux
  • Echtzeit-Kodierung (12+ Streams)
  • 3D-Rendering · Blender / Octane
flagship

RTX PRO 6000 Blackwell

96 GB GDDR7 ECC

Generation: Blackwell · 24.064 CUDA-Kerne

  • VRAM96 GB GDDR7 · ECC
  • CUDA cores24,064
  • Tensor cores752 (5th gen)
  • RT cores188 (4th gen)
  • FP32 compute125.5 TFLOPS
  • TDP600 W
  • Memory bus512-bit · 1.79 TB/s
  • NVENC / NVDEC4 / 4 (AV1)
Ideal für
  • LLM-Inferenz 70B+ auf einer einzelnen GPU
  • Fine-Tuning · LoRA / QLoRA
  • Leistungsstarkes 8K-Rendering · DCC-Pipelines
  • Video-KI · Upscaling, Generierung
/ Pläne

Slice auswählen. Startet in Minuten.

Ideal für Inferenz
/ gpu

GPU VPS · RTX PRO 4500

32 GBVRAM
$550/mo
  • GPU1× RTX PRO 4500 Blackwell · 32 GB · full passthrough
  • CPU16 vCPU · EPYC 9354 (3.25 GHz)
  • RAM128 GB DDR5
  • Speicher1 TB NVMe Gen5
  • Netzwerk10 Gbit/s · unlimitiert
  • DDoS1.6 Tbit/s inklusive
KVM · cloud-initSnapshots kostenlosNatives IPv6API / Web-Panel
Jetzt bestellen
Auf Lager · Kiew, UA · ~5 Min. Bereitstellung
Flaggschiff · 70B auf einer Karte
/ gpu

GPU VPS · RTX PRO 6000

96 GBVRAM
$1200/mo
  • GPU1× RTX PRO 6000 Blackwell · 96 GB · full passthrough
  • CPU32 vCPU · EPYC 9354 (3.25 GHz)
  • RAM256 GB DDR5
  • Speicher2 TB NVMe Gen5
  • Netzwerk10 Gbit/s · unlimitiert
  • DDoS1.6 Tbit/s inklusive
KVM · cloud-initSnapshots kostenlosNatives IPv6API / Web-Panel
Jetzt bestellen
Auf Lager · Kiew, UA · ~5 Min. Bereitstellung

Benötigen Sie Multi-GPU? Wir können 2× / 4× Karten in eine VM durchreichen, oder ein dediziertes Bare-Metal-Rig bauen — sprechen Sie mit der Technik.

/ Workloads

Gemacht für das, was Menschen tatsächlich mit GPUs tun.

Wenn Ihre Arbeit CUDA, einen Encoder oder eine Renderfarm umfasst – wir haben bereits die passende Hardware bereitgestellt.

01

KI / LLM-Inferenz

Führen Sie Llama 3.1 70B in einer einzelnen Blackwell VM aus, oder Modelle der 8B/13B-Klasse auf einem 4500 Slice. vLLM, llama.cpp, TGI – alles natives CUDA innerhalb der VM.

vLLMTGITritonCUDA 12.5
02

Diffusion / generatives Video

Flux, SD3, AnimateDiff, Video-Upscaling. 96 GB VRAM ermöglicht es Ihnen, große Checkpoints und ControlNets resident zu halten – kein Swapping pro Anfrage.

ComfyUIAuto1111SD3Flux
03

3D-Rendering · DCC-Pipelines

Blender · Cycles, Octane, Redshift, V-Ray RT. Ein professioneller Treiber-Stack bedeutet, dass Szenen, die auf Consumer-Karten abstürzen, einfach funktionieren. Lange Renderings zum Festpreis – keine Abrechnung pro Minute.

BlenderOctaneHoudiniRedshift
04

Video-KI · Streaming

Echtzeit-AV1-Encoding (NVENC), Upscaling, Frame-Interpolation, automatische Untertitelung (Whisper). Kombinieren Sie dies mit unseren 100/400 G-Knoten für die Distribution.

NVENC AV1WhisperRIFETopaz
05

Fine-Tuning · LoRA

Trainieren Sie Ihre eigenen 7B–13B LoRAs in wenigen Stunden auf der 6000. Volles PCIe Gen 5 + 1.79 TB/s Speicher bedeutet weniger Epochen, die durch Bandbreite verloren gehen.

LoRAQLoRAPEFTAxolotl
06

CUDA / wissenschaftliche Berechnungen

Full-Passthrough VM. ECC VRAM. Kein störender Nachbar auf der GPU. Führen Sie Ihre eigenen MPI-Jobs, OptiX Raytracing, CFD-Solver aus – Root-Zugriff, keine Sandbox.

CUDAOptiXcuDNNTensorRT
/ Software

Wählen Sie ein Image. Booten. Starten Sie Jobs.

Vorgefertigte Images ersparen Ihnen den ersten Tag im Kampf mit Treibern. Oder bringen Sie Ihre eigenen mit – Bare-Metal bedeutet Root-Zugriff.

Treiber & Laufzeit
  • CUDA 12.5
  • cuDNN 9
  • TensorRT 10
  • NCCL 2.22
  • NVIDIA 555+ Treiber
Frameworks (vorgefertigte Images)
  • PyTorch 2.5
  • TensorFlow 2.17
  • JAX 0.4
  • vLLM
  • TGI
  • ComfyUI
Container & Orchestrierung
  • Docker + nvidia-runtime
  • Podman
  • k3s bereit
  • Slurm-kompatibel
OS-Auswahl
  • Ubuntu 22.04 / 24.04 LTS
  • Debian 12
  • Rocky 9
  • Benutzerdefiniertes ISO
/ FAQ

Häufig gestellte Fragen.

Mehr? Kontaktieren Sie uns auf Telegram oder erreichen Sie das NOC unter noc@hostfory.com.

  • Genau. KVM-Virtualisierung für die OS-Ebene, aber die gesamte GPU wird direkt über den PCIe-Bus an Ihre VM durchgereicht. Jeder CUDA-Kern, der gesamte VRAM, kein vGPU-Slicing, kein geteilter Treiber. CPU und RAM sind dedizierte Slices eines EPYC-Hosts – keine Überbelegung bei GPU-Plänen.

/ loslegen

Starten Sie einen GPU VPS. Jetzt.

550 $ für die 32 GB RTX PRO 4500. 1.200 $ für die 96 GB Blackwell. Fester Monatspreis. Volles GPU-Passthrough, unmetered 10G Netzwerk, echte Ingenieure auf Telegram.

Chat with us@hostfory