AWS Trainium · Inferentia · 32 GB HBM2e · Inferentia · 2023
1 proveedores · 6 configuraciones · precios a 27 sept 2026, 01:12 UTC
Precios diarios de la Inferentia2 por hora de GPU. El periodo sombreado se ha reconstruido a partir del historial de versiones de los catálogos públicos de precios de SkyPilot (menos proveedores que los datos en tiempo real); a partir de ahí, seguimiento propio de PetaPrice.
Oferta Bajo demanda más barata de la Inferentia2 en cada proveedor, por hora de GPU. Cuanto más corta y más verde, más barata.
Línea vertical fina = mediana entre proveedores ($0.76).
1 proveedores · 6 configuraciones
GPU con cómputo y memoria similares, y su precio bajo demanda más bajo ahora mismo.
Los precios bajo demanda de la Inferentia2 parten de $0.76 por hora de GPU (AWS). La mediana entre 1 proveedores es $0.76, y el más caro es $0.76. Mantener una GPU funcionando las 24 horas cuesta unos $553 al mes al precio más bajo.
Sí. La capacidad spot (interrumpible) de la Inferentia2 parte de $0.08 por hora de GPU, un 90% por debajo del precio bajo demanda más barato. Las instancias spot pueden ser reclamadas en cualquier momento, así que conviene usarlas para entrenamientos con checkpoints o trabajos por lotes.
A $0.76 por hora y con 0.19 PF de FP16/BF16 denso, la Inferentia2 cuesta $3.99 por PFLOP-hora. Eso la sitúa en el puesto 58 de 70 GPU con precios bajo demanda en PetaPrice. Las cifras son picos de ficha técnica; la utilización real suele ser del 30–60%.
32 GB de HBM2e con 820 GB/s de ancho de banda de memoria, arquitectura Inferentia (2023), formato Inferentia. Pico denso: 0.19 PF FP16 / BF16, 0.19 PF FP8, 0.38 PF INT8, 0.0475 PF FP32.
Los precios se recopilaron el 27 sept 2026, 01:12 UTC de las API de los proveedores y de catálogos públicos, y se actualizan aproximadamente cada 2 horas. Son precios de lista orientativos; conviene confirmarlos siempre en la web del proveedor antes de contratar.