AWS Trainium · Inferentia · 32 GB HBM2e · Inferentia · 2023
1 provider · 6 configurazioni · prezzi al 27 set 2026, 01:12 UTC
Prezzi giornalieri della Inferentia2 per GPU-ora. Il periodo ombreggiato è ricostruito dalla cronologia delle versioni dei cataloghi prezzi pubblici di SkyPilot (meno provider rispetto ai dati in tempo reale); in seguito, dal monitoraggio di PetaPrice.
Offerta On demand più economica per Inferentia2 presso ciascun provider, per GPU-ora. Più corta e più verde significa più economica.
Linea verticale sottile = mediana tra i provider ($0.76).
1 provider · 6 configurazioni
GPU con capacità di calcolo e memoria simili e il loro prezzo on demand più basso in questo momento.
I prezzi on demand della Inferentia2 partono da $0.76 per GPU-ora (AWS). La mediana su 1 provider è $0.76, mentre il più alto è $0.76. Far girare una GPU 24 ore su 24 costa circa $553 al mese al prezzo più basso.
Sì. La capacità spot (interrompibile) della Inferentia2 parte da $0.08 per GPU-ora, il 90% in meno del prezzo on demand più basso. Le istanze spot possono essere revocate in qualsiasi momento, quindi usale per training con checkpoint o job batch.
A $0.76 all'ora e con 0.19 PF in FP16/BF16 denso, la Inferentia2 costa $3.99 per PFLOP-ora. È al 58° posto su 70 GPU con prezzi on demand su PetaPrice. I valori sono picchi da scheda tecnica; l'utilizzo reale è in genere del 30–60%.
32 GB di HBM2e con 820 GB/s di banda di memoria, architettura Inferentia (2023), form factor Inferentia. Picco denso: 0.19 PF FP16 / BF16, 0.19 PF FP8, 0.38 PF INT8, 0.0475 PF FP32.
I prezzi sono stati raccolti il 27 set 2026, 01:12 UTC dalle API e dai cataloghi pubblici dei provider e si aggiornano circa ogni 2 ore. Sono prezzi di listino indicativi; verifica sempre sul sito del provider prima di prenotare.