whisper-appels

Whisper large-v3 servi sur L40S ×1 par réplica, à Abidjan · Synertech Vallon. Facturé à l’heure de GPU, pas au jeton.

whisper-appels

Whisper large-v3 servi sur L40S ×1 par réplica, à Abidjan · Synertech Vallon.

Modèle servi
synelia/whisper-large-v3
Matériel
L40S — 1 carte(s) par réplica
Réplicas
1 en service, entre 0 et 4
Site
Abidjan · Synertech Vallon
Mise en veille
Autorisée — 65 s de démarrage à froid
Créé le
9 juin 2026
Coût horaire actuel
Non facturé (en veille)

Mise à l’échelle

Un réplica se réserve entier : les GPU ne se partagent pas à la demi-carte.

Réplicas minimum0 réplica(s)
Réplicas maximum4 réplica(s)

Autoriser la mise en veille

À zéro réplica, plus rien n’est facturé, mais la première requête attend 65 secondes le temps de charger les poids en mémoire vidéo. À éviter sur un chemin utilisateur.

Occupation observée

18 % en moyenne sur sept jours. Un réplica de moins tiendrait la charge et économiserait un tiers de la facture.

Occupation des cartes

18.00 %SLA 80 %

GPU

68.00 %SLA 90 %

Mémoire vidéo

Inférence dédiée