Inférence IA / LLM
Exécutez Llama 3.1 70B dans une seule VM Blackwell, ou des modèles de classe 8B/13B sur une tranche 4500. vLLM, llama.cpp, TGI — tout en CUDA natif à l'intérieur de la VM.
Machines virtuelles KVM avec passthrough PCI complet vers NVIDIA RTX PRO 4500 et RTX PRO 6000 Blackwell. L'intégralité du GPU est dédiée à votre VM — pas de découpage vGPU, pas de cœurs CUDA partagés. Démarre en quelques minutes. Prix mensuel fixe. Pas de facture horaire surprise.
GPU de qualité professionnelle dédiés à votre VM via passthrough PCIe Gen 5. VRAM ECC, refroidissement adapté aux datacenters. Pas de silicium de jeu, pas de pilotes grand public, pas de découpage vGPU.
Génération : Blackwell · 10 496 cœurs CUDA
Génération : Blackwell · 24 064 cœurs CUDA
Besoin de multi-GPU ? Nous pouvons dédier 2× / 4× cartes à une seule VM, ou construire une configuration bare-metal dédiée — contactez l'ingénierie.
Si votre travail implique CUDA, un encodeur ou une ferme de rendu — nous avons déjà le bon matériel.
Exécutez Llama 3.1 70B dans une seule VM Blackwell, ou des modèles de classe 8B/13B sur une tranche 4500. vLLM, llama.cpp, TGI — tout en CUDA natif à l'intérieur de la VM.
Flux, SD3, AnimateDiff, mise à l'échelle vidéo. 96 Go de VRAM vous permettent de conserver de grands checkpoints et ControlNets résidents — pas d'échange par requête.
Blender · Cycles, Octane, Redshift, V-Ray RT. La pile de pilotes pro signifie que les scènes qui plantent sur les cartes grand public fonctionnent. Les rendus longs sont facturés à plat — pas de compteur à la minute.
Encodage AV1 en temps réel (NVENC), mise à l'échelle, interpolation d'images, sous-titrage automatique (Whisper). Associez-le à nos nœuds 100/400 G pour la distribution.
Entraînez vos propres LoRA 7B–13B en quelques heures sur le 6000. PCIe Gen 5 complet + 1.79 To/s de mémoire signifie moins d'époques perdues à cause de la bande passante.
VM full-passthrough. VRAM ECC. Pas de voisin bruyant sur le GPU. Exécutez vos propres tâches MPI, ray tracing OptiX, solveurs CFD — accès root, pas un bac à sable.
Les images pré-configurées vous évitent de passer la première journée à lutter avec les pilotes. Ou apportez les vôtres — bare-metal signifie root.
Plus ? Contactez-nous sur Telegram ou contactez le NOC à l'adresse noc@hostfory.com.
Exactement. Machine virtuelle KVM pour la couche OS, mais l'intégralité du GPU est passée directement à votre VM via le bus PCIe. Chaque cœur CUDA, toute la VRAM, pas de découpage vGPU, pas de pilote partagé. Le CPU et la RAM sont des tranches dédiées d'un hôte EPYC — pas de surabonnement sur les plans GPU.
550 $ pour la RTX PRO 4500 de 32 Go. 1 200 $ pour la Blackwell de 96 Go. Prix mensuel forfaitaire. Passthrough GPU complet, réseau 10G non mesuré, de vrais ingénieurs sur Telegram.