…
Precio de alquiler en la nube, cómputo por dólar y especificaciones, lado a lado.
Abrir en el comparador interactivo →| Especificación / precio | T4 | L4 |
|---|---|---|
| Memoria | 16 GB GDDR6 | 24 GB GDDR6mejor |
| Ancho de banda de memoria | 320 GB/smejor | 300 GB/s |
| FP16 / BF16 (denso) | 0.065 PF | 0.121 PFmejor |
| FP8 (denso) | — | 0.242 PF |
| FP4 (denso) | — | — |
| INT8 (denso) | 0.13 PF | 0.242 PFmejor |
| TF32 (denso) | — | 0.06 PF |
| FP32 (denso) | 0.0081 PF | 0.0303 PFmejor |
| FP64 (denso) | 0.0003 PF | 0.0005 PFmejor |
| Consumo | 70 W | 72 W |
| Arquitectura | Turing (2018) | Ada Lovelace (2023) |
| Mínimo bajo demanda | $0.34 | $0.27mejor |
| Mediana bajo demanda | $0.35mejor | $0.56 |
| Mínimo spot | $0.07mejor | $0.08 |
| FP16/BF16 $ por PFLOP·h | $5.28 | $2.23mejor |
| Proveedores | 3 | 7 |
La L4 tiene 1.9× más cómputo FP16/BF16 denso que la T4. La T4 tiene 1.1× más ancho de banda de memoria que la L4. La aceleración real depende de la carga de trabajo: el entrenamiento y el prefill escalan con el cómputo, mientras que la decodificación de LLM escala sobre todo con el ancho de banda de memoria.
Ahora mismo la L4 es más barata por unidad de cómputo: $2.23 vs $5.28 por PFLOP-hora con los precios bajo demanda más bajos.
Mantener una GPU funcionando las 24 horas al precio bajo demanda más bajo cuesta unos $250 al mes con la T4 y $197 con la L4.
La L4 tiene más memoria: 24 GB vs 16 GB.