Des unités qui multiplient de petites matrices en une seule étape, d'où provient la quasi-totalité du débit IA d'un GPU. NVIDIA les appelle tensor cores, AMD matrix cores.
Meilleur rapport qualité-prix du moment
Classés par $ par PFLOP-heure en FP16 / BF16 dense, au prix à la demande le plus bas de chaque GPU.