Virgola mobile a 8 bit per training e inferenza, con un throughput circa doppio rispetto a FP16. Nativo su Hopper, Ada, Blackwell e AMD CDNA 3 e successive.
GPU con FP8, dal miglior rapporto qualità/prezzo
Ordinate per $ per PFLOP-ora di FP8 denso al prezzo on demand più basso di ogni GPU.