Prix de location cloud, calcul par dollar et caractéristiques, côte à côte.
Ouvrir dans le comparateur interactif →| Caractéristique / prix | L40S | RTX 6000 Ada |
|---|---|---|
| Mémoire | 48 GB GDDR6 | 48 GB GDDR6 |
| Bande passante mémoire | 864 GB/s | 960 GB/smeilleur |
| FP16 / BF16 (dense) | 0.362 PF | 0.364 PFmeilleur |
| FP8 (dense) | 0.733 PFmeilleur | 0.729 PF |
| FP4 (dense) | — | — |
| INT8 (dense) | 0.733 PFmeilleur | 0.729 PF |
| TF32 (dense) | 0.183 PFmeilleur | 0.182 PF |
| FP32 (dense) | 0.0916 PFmeilleur | 0.0911 PF |
| FP64 (dense) | 0.0014 PF | 0.0014 PF |
| Consommation | 350 W | 300 W |
| Architecture | Ada Lovelace (2023) | Ada Lovelace (2022) |
| Le plus bas à la demande | $0.60 | $0.60meilleur |
| Médiane à la demande | $1.50 | $0.86meilleur |
| Le plus bas en spot | $0.38meilleur | $0.58 |
| FP16/BF16 $ par PFLOP·h | $1.66 | $1.65meilleur |
| Fournisseurs | 17 | 6 |
Le L40S et le RTX 6000 Ada sont à égalité en calcul FP16/BF16 dense. Le RTX 6000 Ada offre 1.1× plus de bande passante mémoire que le L40S. Les gains réels dépendent de la charge de travail : l'entraînement et le prefill évoluent avec la puissance de calcul, tandis que le décodage des LLM dépend surtout de la bande passante mémoire.
Actuellement, le RTX 6000 Ada est le moins cher par unité de calcul : $1.65 vs $1.66 par PFLOP-heure aux prix à la demande les plus bas.
Faire tourner un GPU en continu au prix à la demande le plus bas coûte environ $440 par mois pour le L40S et $438 pour le RTX 6000 Ada.
Les deux ont 48 GB de VRAM ; le RTX 6000 Ada dispose de plus de bande passante.