…
Precio de alquiler en la nube, cómputo por dólar y especificaciones, lado a lado.
Abrir en el comparador interactivo →| Especificación / precio | A10 | L4 |
|---|---|---|
| Memoria | 24 GB GDDR6 | 24 GB GDDR6 |
| Ancho de banda de memoria | 600 GB/smejor | 300 GB/s |
| FP16 / BF16 (denso) | 0.125 PFmejor | 0.121 PF |
| FP8 (denso) | — | 0.242 PF |
| FP4 (denso) | — | — |
| INT8 (denso) | 0.25 PFmejor | 0.242 PF |
| TF32 (denso) | 0.0625 PFmejor | 0.06 PF |
| FP32 (denso) | 0.0312 PFmejor | 0.0303 PF |
| FP64 (denso) | 0.0005 PF | 0.0005 PF |
| Consumo | 150 W | 72 W |
| Arquitectura | Ampere (2021) | Ada Lovelace (2023) |
| Mínimo bajo demanda | $1.00 | $0.27mejor |
| Mediana bajo demanda | $1.65 | $0.56mejor |
| Mínimo spot | $0.59 | $0.08mejor |
| FP16/BF16 $ por PFLOP·h | $8.00 | $2.23mejor |
| Proveedores | 4 | 7 |
La A10 tiene 1.0× más cómputo FP16/BF16 denso que la L4. La A10 tiene 2.0× más ancho de banda de memoria que la L4. La aceleración real depende de la carga de trabajo: el entrenamiento y el prefill escalan con el cómputo, mientras que la decodificación de LLM escala sobre todo con el ancho de banda de memoria.
Ahora mismo la L4 es más barata por unidad de cómputo: $2.23 vs $8.00 por PFLOP-hora con los precios bajo demanda más bajos.
Mantener una GPU funcionando las 24 horas al precio bajo demanda más bajo cuesta unos $730 al mes con la A10 y $197 con la L4.
Ambas tienen 24 GB de VRAM; la A10 tiene más ancho de banda.