PetaPrice

Häufige Fragen

Wie PetaPrice funktioniert, woher die Zahlen stammen und wie Sie eine GPU auswählen.

Preise und Kennzahlen

Was bedeutet $ pro PFLOP-Stunde?

Es ist der Mietpreis einer GPU für eine Stunde, geteilt durch ihre Spitzenrechenleistung in PetaFLOPS bei der gewählten Präzision. So sieht man, wie viel Rechenleistung jeder Dollar kauft, und kann eine günstige langsame GPU direkt mit einer teuren schnellen vergleichen. Niedriger ist besser.

Welche GPU bietet derzeit die meiste Rechenleistung pro Dollar?

Bei dense FP16/BF16 liegt aktuell die RTX 4070 SUPER mit $0.97 pro PFLOP-Stunde vorn ($0.07 pro GPU-Stunde bei Vast.ai). Die Rangfolge ändert sich mit den Preisen; die Tabelle oben wird alle 2 Stunden aktualisiert.

Was kostet eine H100 pro Stunde?

On-Demand-Preise für die H100 SXM beginnen derzeit bei $1.82 pro GPU-Stunde, der Median über 22 Anbieter liegt bei $3.52. Spot-Kapazität gibt es ab $1.22.

Warum dense FLOPS statt der Werte aus NVIDIAs Datenblättern?

Die beworbenen Tensor-Werte setzen oft 2:4-Structured-Sparsity voraus, was sie verdoppelt, in der Praxis aber kaum genutzt wird. PetaPrice verwendet immer den dichten Durchsatz, damit GPUs und Hersteller fair verglichen werden.

Woher stammen die Preisdaten?

Direkt von den Anbietern, wo immer sie Preise veröffentlichen (öffentliche APIs, offizielle Preislisten und Preisseiten); Lücken füllen die Multi-Cloud-API von Shadeform und die Kataloge von SkyPilot: 941 Angebote von 32 Anbietern, aktualisiert etwa alle 2 Stunden. Die Preise sind unverbindliche Listenpreise; vor der Buchung beim Anbieter bestätigen.

Was ist der Unterschied zwischen On-Demand, Spot und reserviert?

On-Demand wird stundenweise ohne Bindung abgerechnet. Spot-Kapazität (unterbrechbar) ist günstiger, kann aber jederzeit entzogen werden. Reservierte Preise setzen eine Bindung voraus, meist 1 bis 3 Jahre. PetaPrice vermischt sie nie; standardmäßig wird On-Demand angezeigt.

Die richtige GPU wählen

Welche GPU sollte ich für LLM-Inferenz mieten?

Stellen Sie zuerst sicher, dass das Modell hineinpasst: Gewichte plus KV-Cache müssen in den VRAM passen (ein 70B-Modell in FP16 braucht allein für die Gewichte etwa 140 GB). Vergleichen Sie dann nach Speicherbandbreite, denn die Token-Generierung ist meist durch die Bandbreite begrenzt; stellen Sie dazu auf der Startseite „Optimieren für“ auf Bandbreite. Für Training und das Prefill langer Prompts vergleichen Sie stattdessen die FLOPS.

Welche GPU eignet sich am besten für Training?

Vergleichen Sie $ pro PFLOP-Stunde in der Präzision, in der Sie trainieren (meist BF16, oder FP8 ab Hopper). Für Training auf mehreren GPUs sind SXM-GPUs mit NVLink vorzuziehen; über mehrere Server hinweg brauchen Sie zusätzlich InfiniBand. Spot-Kapazität ist deutlich günstiger, wenn Ihr Job regelmäßig Checkpoints schreibt.

Zu den Daten

Warum zeigt die Website eines Anbieters einen anderen Preis?

Preise ändern sich, unterscheiden sich je nach Region, und manche Anbieter berechnen CPU, RAM oder Speicher separat. PetaPrice aktualisiert etwa alle 2 Stunden und zeigt die günstigste Region; maßgeblich bei der Buchung ist die Website des Anbieters. Wenn ein Preis dauerhaft falsch ist, melden Sie ihn bitte.

Warum sehe ich keine MIG-Slices oder GPU-Bruchteile?

Ein Teil einer GPU ist mit einer ganzen nicht vergleichbar, daher sind MIG-Slices, vGPUs und zeitlich geteilte GPUs überall ausgeschlossen. Jeder Preis auf PetaPrice gilt für eine vollständige GPU.

Was bedeutet „Community“?

Community-Hosts vermieten Rechner über Peer-to-Peer-Marktplätze wie Vast.ai oder RunPod Community Cloud. Sie sind oft am günstigsten, Zuverlässigkeit und Sicherheit schwanken aber je nach Host. Mit dem Host-Filter können Sie nur Managed Clouds anzeigen.

Was zeigt der EU-Filter?

Anbieter mit Hauptsitz in einem EU-Mitgliedstaat. Gefiltert wird nach dem Sitz des Unternehmens, nicht nach dem Standort seiner GPUs; prüfen Sie daher die Regionen des Anbieters, wenn Datenresidenz wichtig ist.

Gibt es eine API?

Ja. /api/offers liefert alle normierten Angebote plus das GPU-Datenblatt als JSON, mit aktiviertem CORS. /llms.txt fasst die Website für KI-Assistenten zusammen.

Ich habe einen falschen Preis gefunden. Wie melde ich ihn?

Schicken Sie uns die GPU, den Anbieter und einen Link zu dessen Preisseite. Auf der Seite „Korrekturen“ steht, wie das geht und was wir bisher korrigiert haben.