Inférence dédiée
La passerelle mutualise des GPU entre tous les clients : c’est le meilleur rapport coût-usage tant que la file reste courte. Un point de service dédié réserve des cartes pour vous seul — latence stable, débit garanti, facturé à l’heure de GPU et non au jeton.
Points de service
GPU réservés
H100, L40S, L40S
Coût horaire cumulé
Les points en veille ne sont pas facturés
Occupation moyenne
Sous 30 %, une carte de moins suffirait
Réserver des GPU
Le modèle détermine la carte : un 70 milliards de paramètres ne tient pas dans 48 Go de mémoire vidéo.
Type de carte
Autoriser la mise en veille hors trafic
Estimé à 42 % du coût plein sur un profil de charge en heures ouvrées. Premier appel après une veille : une à trois minutes selon la taille du modèle.
Impact sur votre prochaine facture
- L40S réservés × 22 réplica(s) × 5 400 FCFA l’heure3 265 920 FCFA
- Stockage des poids du modèleRéplication sur les deux sites12 000 FCFA
Prorata du mois en cours : 1 622 042 FCFA, ajouté à votre prochaine facture. La facturation complète démarre au 1er du mois suivant.
Comparez avant de réserver