all systems operational
Get started
/ gpu vps · kvm + pci passthrough

GPU VPS.Entraînez. Rendez. Diffusez.

Machines virtuelles KVM avec passthrough PCI complet vers NVIDIA RTX PRO 4500 et RTX PRO 6000 Blackwell. L'intégralité du GPU est dédiée à votre VM — pas de découpage vGPU, pas de cœurs CUDA partagés. Démarre en quelques minutes. Prix mensuel fixe. Pas de facture horaire surprise.

  • 100%GPU dédié à votre VM
  • PCIe 5passthrough pleine bande passante
  • 10 Gbit/sliaison montante, illimitée
  • ~5 minprovisionnement · en stock
en direct · gpu-7
RTX PRO 6000 Blackwell
actif
Utilisation CUDA72%
VRAM
71.4 / 96 Go
Température
62 °C
Puissance
412 W
Fréquence SM
2.61 GHz
Charge de travail active
PID 8421llama-3.1-70b · vLLM68 Go
PID 8422whisper-large-v33.4 Go
/ matériel

Deux cartes. Les deux de classe station de travail.

GPU de qualité professionnelle dédiés à votre VM via passthrough PCIe Gen 5. VRAM ECC, refroidissement adapté aux datacenters. Pas de silicium de jeu, pas de pilotes grand public, pas de découpage vGPU.

entry

RTX PRO 4500 Blackwell

32 GB GDDR7 ECC

Génération : Blackwell · 10 496 cœurs CUDA

  • VRAM32 GB GDDR7 · ECC
  • CUDA cores10,496
  • Tensor cores328 (5th gen)
  • RT cores82 (4th gen)
  • FP32 compute49.8 TFLOPS
  • TDP200 W
  • Memory bus256-bit · 672 GB/s
  • NVENC / NVDEC3 / 3 (AV1)
Idéal pour
  • Inférence LLM jusqu'à 30B paramètres
  • Stable Diffusion / Flux
  • Encodage en temps réel (12+ flux)
  • Rendu 3D · Blender / Octane
flagship

RTX PRO 6000 Blackwell

96 GB GDDR7 ECC

Génération : Blackwell · 24 064 cœurs CUDA

  • VRAM96 GB GDDR7 · ECC
  • CUDA cores24,064
  • Tensor cores752 (5th gen)
  • RT cores188 (4th gen)
  • FP32 compute125.5 TFLOPS
  • TDP600 W
  • Memory bus512-bit · 1.79 TB/s
  • NVENC / NVDEC4 / 4 (AV1)
Idéal pour
  • Inférence LLM 70B+ sur un seul GPU
  • Fine-tuning · LoRA / QLoRA
  • Rendu 8K intensif · Pipelines DCC
  • IA vidéo · upscaling, génération
/ offres

Choisissez une tranche. Démarrez en quelques minutes.

Idéal pour l'inférence
/ gpu

GPU VPS · RTX PRO 4500

32 GBVRAM
$550/mo
  • GPU1× RTX PRO 4500 Blackwell · 32 GB · full passthrough
  • CPU16 vCPU · EPYC 9354 (3.25 GHz)
  • RAM128 GB DDR5
  • Disque1 TB NVMe Gen5
  • Réseau10 Gbit/s · illimité
  • DDoS1,6 Tbit/s inclus
KVM · cloud-initSnapshots gratuitsIPv6 natifAPI / panneau web
Commander
En stock · Kyiv, UA · ~5 min de provisionnement
Haut de gamme · 70B sur une carte
/ gpu

GPU VPS · RTX PRO 6000

96 GBVRAM
$1200/mo
  • GPU1× RTX PRO 6000 Blackwell · 96 GB · full passthrough
  • CPU32 vCPU · EPYC 9354 (3.25 GHz)
  • RAM256 GB DDR5
  • Disque2 TB NVMe Gen5
  • Réseau10 Gbit/s · illimité
  • DDoS1,6 Tbit/s inclus
KVM · cloud-initSnapshots gratuitsIPv6 natifAPI / panneau web
Commander
En stock · Kyiv, UA · ~5 min de provisionnement

Besoin de multi-GPU ? Nous pouvons dédier 2× / 4× cartes à une seule VM, ou construire une configuration bare-metal dédiée — contactez l'ingénierie.

/ charges de travail

Conçu pour ce que les gens font réellement avec les GPU.

Si votre travail implique CUDA, un encodeur ou une ferme de rendu — nous avons déjà le bon matériel.

01

Inférence IA / LLM

Exécutez Llama 3.1 70B dans une seule VM Blackwell, ou des modèles de classe 8B/13B sur une tranche 4500. vLLM, llama.cpp, TGI — tout en CUDA natif à l'intérieur de la VM.

vLLMTGITritonCUDA 12.5
02

Diffusion / vidéo générative

Flux, SD3, AnimateDiff, mise à l'échelle vidéo. 96 Go de VRAM vous permettent de conserver de grands checkpoints et ControlNets résidents — pas d'échange par requête.

ComfyUIAuto1111SD3Flux
03

Rendu 3D · Pipelines DCC

Blender · Cycles, Octane, Redshift, V-Ray RT. La pile de pilotes pro signifie que les scènes qui plantent sur les cartes grand public fonctionnent. Les rendus longs sont facturés à plat — pas de compteur à la minute.

BlenderOctaneHoudiniRedshift
04

IA vidéo · streaming

Encodage AV1 en temps réel (NVENC), mise à l'échelle, interpolation d'images, sous-titrage automatique (Whisper). Associez-le à nos nœuds 100/400 G pour la distribution.

NVENC AV1WhisperRIFETopaz
05

Réglage fin · LoRA

Entraînez vos propres LoRA 7B–13B en quelques heures sur le 6000. PCIe Gen 5 complet + 1.79 To/s de mémoire signifie moins d'époques perdues à cause de la bande passante.

LoRAQLoRAPEFTAxolotl
06

CUDA / Calcul scientifique

VM full-passthrough. VRAM ECC. Pas de voisin bruyant sur le GPU. Exécutez vos propres tâches MPI, ray tracing OptiX, solveurs CFD — accès root, pas un bac à sable.

CUDAOptiXcuDNNTensorRT
/ logiciels

Choisissez une image. Démarrez. Lancez des tâches.

Les images pré-configurées vous évitent de passer la première journée à lutter avec les pilotes. Ou apportez les vôtres — bare-metal signifie root.

Pilotes & runtime
  • CUDA 12.5
  • cuDNN 9
  • TensorRT 10
  • NCCL 2.22
  • Pilote NVIDIA 555+
Frameworks (images prédéfinies)
  • PyTorch 2.5
  • TensorFlow 2.17
  • JAX 0.4
  • vLLM
  • TGI
  • ComfyUI
Conteneurs et orchestration
  • Docker + nvidia-runtime
  • Podman
  • k3s prêt
  • Compatible Slurm
Choix de l'OS
  • Ubuntu 22.04 / 24.04 LTS
  • Debian 12
  • Rocky 9
  • ISO personnalisé
/ FAQ

Questions fréquentes.

Plus ? Contactez-nous sur Telegram ou contactez le NOC à l'adresse noc@hostfory.com.

  • Exactement. Machine virtuelle KVM pour la couche OS, mais l'intégralité du GPU est passée directement à votre VM via le bus PCIe. Chaque cœur CUDA, toute la VRAM, pas de découpage vGPU, pas de pilote partagé. Le CPU et la RAM sont des tranches dédiées d'un hôte EPYC — pas de surabonnement sur les plans GPU.

/ démarrer

Lancez un VPS GPU. Maintenant.

550 $ pour la RTX PRO 4500 de 32 Go. 1 200 $ pour la Blackwell de 96 Go. Prix mensuel forfaitaire. Passthrough GPU complet, réseau 10G non mesuré, de vrais ingénieurs sur Telegram.

Chat with us@hostfory