AWS Trainium · Inferentia · 32 GB HBM2e · Inferentia · 2023
1 Anbieter · 6 Konfigurationen · Preise vom 27. Sept. 2026, 02:01 UTC
Tägliche Inferentia2-Preise pro GPU-Stunde. Der schattierte Zeitraum ist aus der Versionshistorie der öffentlichen Preiskataloge von SkyPilot rekonstruiert (weniger Anbieter als bei den Live-Daten); danach folgt die eigene Erfassung von PetaPrice.
Günstigstes Inferentia2-Angebot (On-Demand) je Anbieter, pro GPU-Stunde. Kürzer und grüner ist günstiger.
Dünne senkrechte Linie = Median über alle Anbieter ($0.76).
1 Anbieter · 6 Konfigurationen
GPUs mit ähnlicher Rechenleistung und ähnlichem Speicher und ihr aktuell niedrigster On-Demand-Preis.
On-Demand-Preise für die Inferentia2 beginnen bei $0.76 pro GPU-Stunde (AWS). Der Median über 1 Anbieter liegt bei $0.76, das teuerste Angebot liegt bei $0.76. Eine GPU rund um die Uhr kostet zum niedrigsten Preis etwa $553 pro Monat.
Ja. Spot-Kapazität (unterbrechbar) für die Inferentia2 gibt es ab $0.08 pro GPU-Stunde, 90 % unter dem günstigsten On-Demand-Preis. Spot-Instanzen können jederzeit entzogen werden; sie eignen sich daher für Training mit Checkpoints oder Batch-Jobs.
Bei $0.76 pro Stunde und 0.19 PF dense FP16/BF16 kostet die Inferentia2 $3.99 pro PFLOP-Stunde. Damit liegt sie auf Rang 50 von 60 GPUs mit On-Demand-Preisen auf PetaPrice. Die Werte sind Datenblatt-Spitzenwerte; die reale Auslastung liegt meist bei 30–60 %.
32 GB HBM2e mit 820 GB/s Speicherbandbreite, Inferentia-Architektur (2023), Formfaktor Inferentia. Dichte Spitzenwerte: 0.19 PF FP16 / BF16, 0.19 PF FP8, 0.38 PF INT8, 0.0475 PF FP32.
Die Preise wurden am 27. Sept. 2026, 02:01 UTC aus Anbieter-APIs und öffentlichen Katalogen erfasst und werden etwa alle 2 Stunden aktualisiert. Es sind unverbindliche Listenpreise; vor der Buchung immer auf der Website des Anbieters prüfen.