all systems operational
Get started
/ gpu vps · kvm + pci passthrough

GPU VPS.Treine. Renderize. Transmita.

Máquinas virtuais KVM com passthrough PCI completo para NVIDIA RTX PRO 4500 e RTX PRO 6000 Blackwell. A GPU inteira vai para sua VM — sem fatiamento vGPU, sem núcleos CUDA compartilhados. Inicializa em minutos. Preço mensal fixo. Sem surpresas na conta por hora.

  • 100%GPU passada para sua VM
  • PCIe 5passthrough de largura de banda total
  • 10 Gbit/suplink, ilimitado
  • ~5 minprovisionamento · em estoque
ao vivo · gpu-7
RTX PRO 6000 Blackwell
em execução
Utilização CUDA80%
VRAM
71.4 / 96 GB
Temp.
62 °C
Potência
412 W
Clock SM
2.61 GHz
Carga de trabalho ativa
PID 8421llama-3.1-70b · vLLM68 GB
PID 8422whisper-large-v33.4 GB
/ hardware

Duas placas. Ambas de classe workstation.

GPUs de nível profissional passadas para sua VM via passthrough PCIe Gen 5. VRAM ECC, resfriamento adequado de datacenter. Não é silício para jogos, não são drivers de consumidor, não é fatiamento vGPU.

entry

RTX PRO 4500 Blackwell

32 GB GDDR7 ECC

Geração: Blackwell · 10.496 núcleos CUDA

  • VRAM32 GB GDDR7 · ECC
  • CUDA cores10,496
  • Tensor cores328 (5th gen)
  • RT cores82 (4th gen)
  • FP32 compute49.8 TFLOPS
  • TDP200 W
  • Memory bus256-bit · 672 GB/s
  • NVENC / NVDEC3 / 3 (AV1)
Melhor para
  • Inferência LLM até 30B params
  • Stable Diffusion / Flux
  • Codificação em tempo real (12+ streams)
  • Renderização 3D · Blender / Octane
flagship

RTX PRO 6000 Blackwell

96 GB GDDR7 ECC

Geração: Blackwell · 24.064 núcleos CUDA

  • VRAM96 GB GDDR7 · ECC
  • CUDA cores24,064
  • Tensor cores752 (5th gen)
  • RT cores188 (4th gen)
  • FP32 compute125.5 TFLOPS
  • TDP600 W
  • Memory bus512-bit · 1.79 TB/s
  • NVENC / NVDEC4 / 4 (AV1)
Melhor para
  • Inferência LLM 70B+ em uma única GPU
  • Fine-tuning · LoRA / QLoRA
  • Renderização 8K pesada · pipelines DCC
  • IA de Vídeo · upscaling, geração
/ planos

Escolha um slice. Inicializa em minutos.

Melhor para inferência
/ gpu

GPU VPS · RTX PRO 4500

32 GBVRAM
$550/mo
  • GPU1× RTX PRO 4500 Blackwell · 32 GB · full passthrough
  • CPU16 vCPU · EPYC 9354 (3.25 GHz)
  • RAM128 GB DDR5
  • Disco1 TB NVMe Gen5
  • Rede10 Gbit/s · ilimitado
  • DDoS1.6 Tbit/s incluído
KVM · cloud-initSnapshots grátisIPv6 NativoAPI / painel web
Pedir agora
Em estoque · Kyiv, UA · ~5 min de provisionamento
Carro-chefe · 70B em uma placa
/ gpu

GPU VPS · RTX PRO 6000

96 GBVRAM
$1200/mo
  • GPU1× RTX PRO 6000 Blackwell · 96 GB · full passthrough
  • CPU32 vCPU · EPYC 9354 (3.25 GHz)
  • RAM256 GB DDR5
  • Disco2 TB NVMe Gen5
  • Rede10 Gbit/s · ilimitado
  • DDoS1.6 Tbit/s incluído
KVM · cloud-initSnapshots grátisIPv6 NativoAPI / painel web
Pedir agora
Em estoque · Kyiv, UA · ~5 min de provisionamento

Precisa de multi-GPU? Podemos passar 2× / 4× placas para uma VM, ou construir um rig bare-metal dedicado — fale com a engenharia.

/ cargas de trabalho

Feito para o que as pessoas realmente fazem com GPUs.

Se o seu trabalho envolve CUDA, um encoder ou uma render farm — nós já temos o hardware certo.

01

Inferência de IA / LLM

Execute Llama 3.1 70B em uma única VM Blackwell, ou modelos de classe 8B/13B em um slice 4500. vLLM, llama.cpp, TGI — tudo CUDA nativo dentro da VM.

vLLMTGITritonCUDA 12.5
02

Difusão / vídeo generativo

Flux, SD3, AnimateDiff, upscaling de vídeo. 96 GB de VRAM permitem manter grandes checkpoints e ControlNets residentes — sem troca por solicitação.

ComfyUIAuto1111SD3Flux
03

Renderização 3D · pipelines DCC

Blender · Cycles, Octane, Redshift, V-Ray RT. A pilha de drivers Pro significa que cenas que travam em placas de consumo simplesmente funcionam. Renders longos com preço fixo — sem medidor por minuto.

BlenderOctaneHoudiniRedshift
04

IA de Vídeo · streaming

Codificação AV1 em tempo real (NVENC), upscaling, interpolação de quadros, legendagem automática (Whisper). Combine com nossos nós de 100/400 G para distribuição.

NVENC AV1WhisperRIFETopaz
05

Fine-tuning · LoRA

Treine seus próprios LoRAs de 7B–13B em poucas horas no 6000. PCIe Gen 5 completo + memória de 1.79 TB/s significa menos épocas perdidas devido à largura de banda.

LoRAQLoRAPEFTAxolotl
06

CUDA / computação científica

VM com passthrough completo. ECC VRAM. Sem vizinho barulhento na GPU. Execute seus próprios trabalhos MPI, ray tracing OptiX, solvers CFD — acesso root, não um sandbox.

CUDAOptiXcuDNNTensorRT
/ software

Escolha uma imagem. Inicialize. Inicie trabalhos.

Imagens pré-configuradas evitam que você gaste o primeiro dia lutando com drivers. Ou traga as suas — bare-metal significa root.

Drivers e runtime
  • CUDA 12.5
  • cuDNN 9
  • TensorRT 10
  • NCCL 2.22
  • driver NVIDIA 555+
Frameworks (imagens predefinidas)
  • PyTorch 2.5
  • TensorFlow 2.17
  • JAX 0.4
  • vLLM
  • TGI
  • ComfyUI
Contêineres e orquestração
  • Docker + nvidia-runtime
  • Podman
  • k3s pronto
  • Compatível com Slurm
Opções de SO
  • Ubuntu 22.04 / 24.04 LTS
  • Debian 12
  • Rocky 9
  • ISO Personalizado
/ faq

Perguntas frequentes.

Mais? Fale conosco em Telegram ou entre em contato com o NOC em noc@hostfory.com.

  • Exatamente. Máquina virtual KVM para a camada do SO, mas a GPU inteira é passada diretamente para sua VM através do barramento PCIe. Cada núcleo CUDA, toda a VRAM, sem fatiamento vGPU, sem driver compartilhado. CPU e RAM são fatias dedicadas de um host EPYC — sem oversubscription em planos de GPU.

/ começar

Ative um GPU VPS. Agora.

$550 para a RTX PRO 4500 de 32 GB. $1.200 para a Blackwell de 96 GB. Preço mensal fixo. Passthrough completo de GPU, rede 10G unmetered, engenheiros reais no Telegram.

Chat with us@hostfory