AWS Trainium · Inferentia · 32 GB HBM2e · Inferentia · 2023
1 fournisseurs · 6 configurations · prix au 27 sept. 2026, 02:01 UTC
Prix quotidiens du Inferentia2 par heure GPU. La période grisée est reconstituée à partir de l'historique des versions des catalogues de prix publics de SkyPilot (moins de fournisseurs que les données en direct) ; ensuite, il s'agit du suivi propre de PetaPrice.
Offre Inferentia2 À la demande la moins chère chez chaque fournisseur, par heure GPU. Plus la barre est courte et verte, moins c'est cher.
Fine ligne verticale = médiane entre fournisseurs ($0.76).
1 fournisseurs · 6 configurations
GPU aux performances de calcul et à la mémoire similaires, avec leur prix à la demande le plus bas actuel.
Les prix à la demande du Inferentia2 commencent à $0.76 par heure GPU (AWS). La médiane sur 1 fournisseurs est de $0.76, et le plus cher est à $0.76. Faire tourner un GPU en continu coûte environ $553 par mois au prix le plus bas.
Oui. La capacité Inferentia2 spot (interruptible) commence à $0.08 par heure GPU, soit 90 % de moins que le prix à la demande le plus bas. Les instances spot peuvent être préemptées à tout moment : utilisez-les pour de l'entraînement avec checkpoints ou des traitements par lots.
À $0.76 de l'heure et 0.19 PF en FP16/BF16 dense, le Inferentia2 coûte $3.99 par PFLOP-heure. Il se classe ainsi 50 sur 60 GPU disposant de prix à la demande sur PetaPrice. Ces chiffres sont des valeurs crêtes des fiches techniques ; l'utilisation réelle se situe généralement entre 30 et 60 %.
32 GB de HBM2e avec 820 GB/s de bande passante mémoire, architecture Inferentia (2023), format Inferentia. Crête dense : 0.19 PF FP16 / BF16, 0.19 PF FP8, 0.38 PF INT8, 0.0475 PF FP32.
Les prix ont été collectés le 27 sept. 2026, 02:01 UTC via les API des fournisseurs et des catalogues publics, et sont actualisés environ toutes les 2 heures. Ce sont des prix catalogue indicatifs ; vérifiez toujours sur le site du fournisseur avant de réserver.