Tester le pipeline, pas seulement le modèle
Pour une application multimodale, retenez des fichiers qui représentent vos usages : formats, dimensions et durées variés. Chronométrez lecture, préparation, calcul et export. Une étape de décodage ou de transformation CPU peut limiter l’ensemble même lorsque le GPU termine rapidement sa partie.
Définissez également ce qui constitue une sortie valide : nombre de résultats, format, dimensions et association avec l’entrée. Vous obtiendrez une mesure utile au déploiement plutôt qu’un temps de calcul isolé.
Garder de la marge dans 48 Go
Réservez de la place aux entrées et aux états temporaires en plus des poids. Pour un service qui traite plusieurs requêtes, faites monter la concurrence progressivement et observez le pic mémoire. Testez séparément un grand fichier et plusieurs fichiers ordinaires ; les deux cas peuvent produire des contraintes différentes.
Validez la pile PyTorch/CUDA et les bibliothèques médias réellement utilisées. Le L40S ne propose pas NVLink : pour multiplier les cartes, prévoyez un logiciel qui distribue explicitement le travail sans supposer une mémoire fusionnée.
Choisir selon le chemin d’application
Le L4 à 24 Go mérite un essai si votre modèle et vos entrées y tiennent. Le RTX 6000 Ada offre également 48 Go et peut être comparé lorsque votre projet associe calcul et outils de visualisation. Si le besoin de mémoire dépasse cette capacité, examinez les offres de 80 Go avant de compliquer le découpage.
Un forfait pour qualifier votre service
Consacrez 3 jours à la chaîne minimale, 7 jours aux formats difficiles et aux essais de concurrence, ou 30 jours à une campagne répétée avec des configurations archivées. Conservez les exemples qui ont révélé une erreur : ils deviendront vos tests de non-régression.
Choisissez votre préparation, les lots et la durée, puis complétez les coordonnées de commande. Vous gérez vos logiciels et vos traitements de façon autonome ; Kernodeck n’inspecte pas le contenu de vos fichiers, prompts ou calculs. Le transfert crypto se signale ensuite par « J’ai payé ».