whisper-appels
Whisper large-v3 servi sur L40S ×1 par réplica, à Abidjan · Synertech Vallon. Facturé à l’heure de GPU, pas au jeton.
whisper-appels
Whisper large-v3 servi sur L40S ×1 par réplica, à Abidjan · Synertech Vallon.
- Modèle servi
- synelia/whisper-large-v3
- Matériel
- L40S — 1 carte(s) par réplica
- Réplicas
- 1 en service, entre 0 et 4
- Site
- Abidjan · Synertech Vallon
- Mise en veille
- Autorisée — 65 s de démarrage à froid
- Créé le
- 9 juin 2026
- Coût horaire actuel
- Non facturé (en veille)
Mise à l’échelle
Un réplica se réserve entier : les GPU ne se partagent pas à la demi-carte.
Réplicas minimum0 réplica(s)
Réplicas maximum4 réplica(s)
Autoriser la mise en veille
À zéro réplica, plus rien n’est facturé, mais la première requête attend 65 secondes le temps de charger les poids en mémoire vidéo. À éviter sur un chemin utilisateur.
Occupation observée
18 % en moyenne sur sept jours. Un réplica de moins tiendrait la charge et économiserait un tiers de la facture.
Occupation des cartes
18.00 %SLA 80 %
GPU
68.00 %SLA 90 %
Mémoire vidéo