all systems operational
Get started
IA / traitement multimédia
applications › traitement IA / média › whisper

Ferme de GPU Whisper + ffmpeg sur bare-metal illimité.

Transcription vocale et transcodage vidéo à l'échelle sur un GPU RTX PRO dédié — exécutez Whisper large-v3 pour les sous-titres et les transcriptions, et NVENC ffmpeg pour l'échelle d'encodage, sur un serveur à prix fixe mensuel au lieu d'une API facturée à la minute. Trafic illimité pour le transfert des médias.

gpu
RTX PRO · NVENC
stt
Whisper large-v3
trafic
illimité
déploiement
2–6 h
/ pourquoi il a besoin de vrai matériel

Pourquoi un serveur GPU surpasse l'API de transcription.

Pas de facturation à la minute

Les services de transcription vocale cloud facturent à la minute d'audio ; une API de transcodage facture à la minute de sortie. Un GPU dédié a un prix mensuel fixe — transcrivez et encodez une archive entière 24h/24 et le coût ne change pas.

STT et transcodage sur un seul serveur

Le même GPU exécute Whisper large-v3 pour des transcriptions et sous-titres précis et NVENC ffmpeg pour l'échelle d'encodage H.264/H.265 — une seule machine couvre l'ensemble du pipeline de traitement média.

Trafic illimité pour le transfert de médias

Les tâches par lot extraient de gros fichiers source et poussent les transcriptions, les sous-titres et les vidéos réencodées. Le port illimité signifie que toutes ces E/S ne coûtent rien en plus du prix fixe.

Vos données restent les vôtres

Les fichiers audio et vidéo sensibles ne quittent jamais un serveur que vous contrôlez. Monotennant, dans la juridiction que vous choisissez, avec accès root et sans tiers conservant votre contenu.

/ configurations recommandées

Dimensionné pour Whisper / ffmpeg farm.

Démarrage / Production / Haute charge — avec la capacité dans les métriques qui comptent pour cette application.

KyivAmsterdamWarsawMiami
Lot
Whisper + NVENC · file d'attente de lots stable
  • CPUEPYC + RTX PRO 4500
  • RAM128 GB
  • Stockage4 TB NVMe
  • Port10 Gbit/s
  • Traficunmetered
$550/mo
Déployer Lot →
Recommandé
Pipeline
large-v3 + 4K NVENC · haut débit
  • CPUEPYC + RTX PRO 6000
  • RAM256 GB
  • Stockage8 TB NVMe
  • Port10 Gbit/s
  • Traficunmetered
$990/mo
Déployer Pipeline →
Ferme
multi-GPU · ferme de STT + transcodage de production
  • CPU2× RTX PRO 6000
  • RAM512 GB
  • Stockage16 TB NVMe
  • Port25 Gbit/s
  • Traficunmetered
$1890/mo
Déployer Ferme →
/ ce qui est inclus

Activé par défaut.

Whisper + ffmpeg prêts

Whisper (ou faster-whisper / whisper.cpp) et ffmpeg compatible NVENC installés avec CUDA et PyTorch, prêts pour les tâches par lots et une file d'attente.

GPU RTX PRO dédié

Un RTX PRO 4500 ou 6000 Blackwell complet — toute la VRAM et les moteurs NVENC sont à vous, pas de tranche partagée, pas de file d'attente derrière d'autres locataires.

Port illimité

10 / 25 Gbit/s à prix fixe — téléchargez de gros fichiers source et poussez les transcriptions et les ré-encodages sans frais d'égresse par Go.

NVMe scratch

NVMe de plusieurs téraoctets pour les médias source et les fichiers intermédiaires, afin que les tâches par lots ne soient pas limitées par le disque.

Storage Vault pour les archives

Connectez un Storage Vault pour la bibliothèque source et les sorties finalisées — faites évoluer l'archive jusqu'à des centaines de téraoctets.

Accès root + API

Accès root complet pour scripter les pipelines, plus facile à interfacer avec un petit service REST/queue pour votre application.

Hébergement de transcodage Whisper & GPU — reconnaissance vocale et NVENC à l'échelle

Whisper d'OpenAI est le modèle open source de reconnaissance vocale qui produit des transcriptions et des sous-titres précis dans des dizaines de langues, et NVENC ffmpeg est le moyen standard de transcoder efficacement la vidéo sur un GPU. Exécutez à n'importe quel volume réel — une archive média, un réseau de podcasts, un pipeline de sous-titrage, un flux de travail de conformité — et les API cloud qui facturent à la minute deviennent rapidement coûteuses. Un GPU dédié transforme cela en un coût fixe et prévisible.

Hostfory exécute Whisper et NVENC ffmpeg sur des GPU dédiés RTX PRO Blackwell. La même machine transcrit avec Whisper large-v3 et encode votre échelle H.264/H.265, de sorte qu'une seule machine couvre l'ensemble du pipeline de traitement multimédia, et comme il s'agit d'un serveur mensuel à prix fixe, vous pouvez le faire fonctionner à plein régime 24h/24 sans compteur à la minute. Le port est illimité, donc le téléchargement de fichiers source volumineux et l'envoi de transcriptions, de sous-titres et de vidéos ré-encodées ne coûtent rien de plus, et le NVMe de plusieurs téraoctets évite aux tâches par lots d'utiliser un disque lent.

Votre audio et votre vidéo ne quittent jamais une machine que vous contrôlez — mono-locataire, dans la juridiction de votre choix, avec un accès root complet pour scripter le pipeline et un Storage Vault pour l'archive source et de sortie. Les serveurs sont provisionnés en quelques heures avec Whisper, CUDA, PyTorch et NVENC ffmpeg prêts ; associez-le au boîtier GPU ComfyUI pour une pile multimédia IA complète.

GPURTX PRO 4500 / 6000 Blackwell + NVENC
STTWhisper large-v3 / faster-whisper
Transcodageffmpeg + NVENC (H.264 / H.265)
PileCUDA · PyTorch
StockageNVMe scratch + Storage Vault
LocalisationsAmsterdam · Varsovie · Kyiv · Miami
/ faq

Questions sur Whisper / ffmpeg farm, réponses.

Pourquoi est-ce moins cher qu'une API de transcription ?
Les API STT cloud facturent à la minute d'audio et les API de transcodage facturent à la minute de sortie. Un GPU dédié a un prix mensuel fixe, donc une fois que vous traitez un volume réel — une archive, un réseau, un pipeline stable — faire fonctionner votre propre machine est bien moins cher et le coût est prévisible.
Quels modèles Whisper puis-je exécuter ?
Tous, y compris large-v3, plus faster-whisper et whisper.cpp pour la vitesse. Le RTX PRO 6000 gère large-v3 avec un débit élevé ; le 4500 convient aux files d'attente de lots stables.
Puis-je transcoder de la vidéo sur la même machine ?
Oui — ffmpeg compatible NVENC est installé, donc le même GPU qui transcrit encode également votre échelle H.264/H.265. Une seule machine couvre le STT et le transcodage.
La bande passante est-elle mesurée ?
Non — le port est non mesuré, donc le téléchargement de fichiers source volumineux et l'envoi de transcriptions, de sous-titres et de sorties ré-encodées n'entraînent aucun coût supplémentaire en plus du prix mensuel fixe.
Mes données sont-elles privées ?
Oui — il s'agit d'un serveur à locataire unique dans la juridiction de votre choix, avec un accès root complet. Vos fichiers audio et vidéo ne touchent jamais l'infrastructure d'un tiers.
Puis-je l'intégrer à mon application ?
Oui — vous avez l'accès root, donc vous pouvez placer Whisper et ffmpeg derrière un petit service REST ou de file d'attente et l'appeler depuis votre backend, ou déposer des tâches dans un dossier surveillé pour un traitement par lots.
Où sont stockées les grandes archives ?
Sur un Storage Vault attaché au serveur — les médias source et les sorties finales peuvent atteindre des centaines de téraoctets tandis que le NVMe reste libre pour un espace de travail rapide.

Déployez Whisper / ffmpeg farm dès aujourd'hui.

Les configurations en stock sont provisionnées en 1 à 3 heures. La migration depuis un autre hébergeur est à notre charge.

Chat with us@hostfory