all systems operational
Get started
IA / processamento de mídia
apps › processamento de IA / mídia › comfyui

Hospedagem ComfyUI em GPUs RTX PRO Blackwell.

Stable Diffusion e Flux baseados em nós em uma GPU dedicada que é só sua — até 96 GB de VRAM para os maiores modelos, NVMe para carregamento instantâneo de checkpoints e LoRAs, e uma API para integrar o ComfyUI ao seu pipeline. Sem taxas por imagem, sem fila atrás de outros inquilinos.

gpu
RTX PRO Blackwell
vram
até 96 GB
tenancy
dedicado
deploy
2–6 h
/ por que precisa de hardware de verdade

Por que uma GPU dedicada supera um endpoint serverless.

96 GB VRAM, tudo seu

Flux, SDXL e grandes modelos de vídeo precisam de VRAM real. Uma RTX PRO 6000 Blackwell oferece até 96 GB sem que ninguém mais a compartilhe — carregue grandes checkpoints, altas resoluções e longos lotes sem erros de falta de memória.

Sem cobrança por imagem

APIs de imagem serverless cobram por geração e o custo aumenta rapidamente. Uma GPU dedicada tem um preço mensal fixo — execute-a 24/7, renderize milhões de imagens, o custo não muda.

NVMe para carregamento instantâneo de modelos

Checkpoints, LoRAs, VAEs e ControlNets têm dezenas de gigabytes cada. O NVMe empresarial os carrega e troca em segundos, para que a mudança de fluxos de trabalho não paralise sua fila.

Seus fluxos de trabalho, sua API

Os grafos de nós e a API REST/websocket do ComfyUI rodam em uma máquina que você controla totalmente — conecte-a ao seu aplicativo, processe trabalhos em lote de uma fila ou exponha uma UI privada. A largura de banda ilimitada puxa modelos e envia saídas gratuitamente.

/ configurações recomendadas

Dimensionado para ComfyUI.

Inicial / Produção / Alta carga — com capacidade nas métricas que importam para este aplicativo.

KyivAmsterdamWarsawMiami
Creator
SDXL / Flux · 32 GB VRAM · artista único
  • CPUEPYC + RTX PRO 4500
  • RAM128 GB
  • Armazenamento4 TB NVMe
  • Porta10 Gbit/s
  • Tráfegounmetered
$550/mo
Implantar Creator →
Recomendado
Studio
modelos grandes · 96 GB VRAM · pipelines em lote
  • CPUEPYC + RTX PRO 6000
  • RAM256 GB
  • Armazenamento8 TB NVMe
  • Porta10 Gbit/s
  • Tráfegounmetered
$990/mo
Implantar Studio →
Farm
multi-GPU · API de geração de alta taxa de transferência
  • CPU2× RTX PRO 6000
  • RAM512 GB
  • Armazenamento16 TB NVMe
  • Porta25 Gbit/s
  • Tráfegounmetered
$1890/mo
Implantar Farm →
/ o que está incluído

Ativado por padrão.

ComfyUI pré-instalado

ComfyUI com CUDA, PyTorch e os nós personalizados comuns configurados, atrás de um proxy reverso HTTPS — mais a API habilitada para trabalhos programáticos.

GPU RTX PRO Dedicada

Uma RTX PRO 4500 ou 6000 Blackwell completa — não uma fatia compartilhada — com até 96 GB VRAM para os maiores modelos de imagem e vídeo.

Armazenamento de modelos NVMe

NVMe de vários terabytes para checkpoints, LoRAs, VAEs e ControlNets, para que o carregamento de modelos e as trocas de fluxo de trabalho aconteçam em segundos.

Porta ilimitada

10 / 25 Gbit/s com preço fixo — puxe modelos enormes e envie saídas renderizadas sem cobrança por GB de egresso.

Pronto para API

API REST/websocket do ComfyUI exposta para trabalhos em lote e integração de aplicativos; enfileire o trabalho do seu próprio backend.

Acesso root

Acesso SSH/root completo — instale qualquer nó personalizado, modelo ou extensão, fixe versões de CUDA e driver, crie scripts para o que precisar.

Hospedagem ComfyUI — GPUs RTX PRO dedicadas para Stable Diffusion & Flux

ComfyUI é o front-end baseado em nós que usuários avançados procuram para executar Stable Diffusion, SDXL, Flux e modelos de vídeo — fluxos de trabalho visuais, controle preciso e uma API REST/websocket para automatizar tudo. O que ele exige é uma GPU real com muita VRAM e armazenamento local rápido para a pilha de checkpoints e LoRAs de vários gigabytes que um fluxo de trabalho sério utiliza.

A Hostfory executa o ComfyUI em GPUs RTX PRO Blackwell dedicadas — não em um "slice" serverless compartilhado — com até 96 GB de VRAM, para que os maiores modelos e altas resoluções se encaixem sem erros de falta de memória, e ninguém mais esteja na fila atrás de você. Por ser um servidor mensal fixo, em vez de um endpoint por imagem, você pode executá-lo 24 horas por dia e renderizar em volume sem uma conta "metered", e a porta "unmetered" puxa modelos e "pusha" saídas gratuitamente. O NVMe "enterprise" mantém os "checkpoints" e "LoRA loads" instantâneos, para que a troca de "workflows" nunca "stalle" a fila.

Você obtém acesso "root" completo para instalar qualquer "node", modelo ou extensão personalizada e fixar suas versões de CUDA e "driver", além da API configurada para "batch jobs" e integração de aplicativos. Os servidores são provisionados em poucas horas com ComfyUI, CUDA e PyTorch prontos — "pareie-o" com a "box" de GPU Whisper / ffmpeg para um "pipeline" completo de mídia AI.

GPURTX PRO 4500 / 6000 Blackwell
VRAMaté 96 GB
StackComfyUI · CUDA · PyTorch
ModelosNVMe multi-TB · "checkpoints" / LoRAs
Acesso"root" · API habilitada
LocalizaçõesAmsterdam · Warsaw · Kyiv · Miami
/ faq

Perguntas sobre ComfyUI, respondidas.

A GPU é dedicada ou compartilhada?
Dedicada — você obtém uma RTX PRO 4500 ou 6000 Blackwell inteira, não uma parte "time-sliced". Toda a VRAM (até 96 GB) e todo o "compute" são seus, sem fila atrás de outros "tenants".
Como isso é mais barato do que uma API de imagem "serverless"?
"Endpoints serverless" cobram por geração. Uma GPU dedicada tem um preço mensal fixo, então se você gera em qualquer volume real — "batch jobs", um recurso de produto, experimentação constante — executar sua própria "box" é dramaticamente mais barato e o custo é previsível.
Quais modelos ele pode executar?
SD 1.5, SDXL, Flux e grandes modelos de vídeo e "upscaling". A RTX PRO 6000 com 96 GB de VRAM lida com os maiores "checkpoints", altas resoluções e "batches" longos; a 4500 é dimensionada para trabalho de "single-artist" SDXL/Flux.
Posso usar a API do ComfyUI para automatizar tarefas?
Sim — a API REST/websocket está habilitada para que você possa enfileirar fluxos de trabalho do seu próprio backend, construir um recurso de produto em cima ou executar renderizações em lote agendadas. Acesso root completo permite que você programe o resto.
Posso instalar nós e modelos personalizados?
Sim — você tem acesso root. Instale qualquer nó personalizado, checkpoint, LoRA ou extensão, e fixe as versões de CUDA e driver para corresponder ao seu fluxo de trabalho.
A largura de banda é medida?
Não — a porta é ilimitada, então baixar dezenas de gigabytes de modelos e enviar saídas renderizadas não custa nada extra além do preço mensal fixo.
Quanto tempo leva para configurar?
Algumas horas — o servidor é provisionado com ComfyUI, CUDA e PyTorch instalados e a API pronta por trás de HTTPS.

Implante ComfyUI hoje.

Configurações em estoque são provisionadas em 1–3 horas. A migração de outro host é por nossa conta.

Chat with us@hostfory