Questions fréquentes
Comment fonctionne PetaPrice, d'où viennent les chiffres et comment choisir un GPU.
Prix et chiffres
Qu'est-ce que le $ par PFLOP-heure ?
C'est le prix de location d'un GPU pendant une heure, divisé par sa puissance de calcul crête en PetaFLOPS dans la précision choisie. Il indique la quantité de calcul que chaque dollar vous achète, ce qui permet de comparer directement un GPU lent et bon marché à un GPU rapide et cher. Plus c'est bas, mieux c'est.
Quel GPU offre le plus de calcul par dollar en ce moment ?
En FP16/BF16 dense, le RTX 4070 SUPER est actuellement en tête avec $0.97 par PFLOP-heure ($0.07 par heure GPU chez Vast.ai). Le classement évolue avec les prix ; le tableau ci-dessus est mis à jour toutes les 2 heures.
Combien coûte un H100 à l'heure ?
Les prix à la demande du H100 SXM commencent actuellement à $1.82 par heure GPU, avec une médiane de $3.52 sur 22 fournisseurs. La capacité spot commence à $1.22.
Pourquoi des FLOPS denses plutôt que les chiffres des fiches techniques NVIDIA ?
Les chiffres tensor mis en avant supposent souvent une sparsité structurée 2:4, qui les double mais est rarement utilisée en pratique. PetaPrice utilise toujours le débit dense afin de comparer équitablement GPU et fabricants.
D'où viennent les données de prix ?
Directement des fournisseurs lorsqu'ils publient leurs prix (API publiques, grilles tarifaires officielles et pages de tarifs), complétés par l'API multi-cloud de Shadeform et les catalogues de SkyPilot : 941 offres de 32 fournisseurs, actualisées environ toutes les 2 heures. Les prix sont des prix catalogue indicatifs ; vérifiez auprès du fournisseur avant de réserver.
Quelle différence entre à la demande, spot et réservé ?
L'offre à la demande est facturée à l'heure, sans engagement. La capacité spot (interruptible) est moins chère mais peut être récupérée à tout moment. Les prix réservés exigent un engagement, généralement de 1 à 3 ans. PetaPrice ne les mélange jamais ; la vue par défaut est à la demande.
Choisir un GPU
Quel GPU louer pour l'inférence de LLM ?
Vérifiez d'abord que le modèle tient : les poids plus le KV cache doivent tenir dans la VRAM (un modèle de 70B en FP16 nécessite environ 140 GB rien que pour les poids). Comparez ensuite la bande passante mémoire, car la génération de tokens est généralement limitée par la bande passante ; réglez « Optimiser pour » sur Bande passante sur la page d'accueil. Pour l'entraînement et le prefill de longs prompts, comparez plutôt les FLOPS.
Quel est le meilleur GPU pour l'entraînement ?
Comparez le $ par PFLOP-heure dans la précision de votre entraînement (généralement BF16, ou FP8 sur Hopper et plus récent). Pour l'entraînement multi-GPU, privilégiez les GPU SXM avec NVLink ; sur plusieurs serveurs, il vous faut aussi InfiniBand. La capacité spot est bien moins chère si votre tâche enregistre régulièrement des checkpoints.
À propos des données
Pourquoi le site d'un fournisseur affiche-t-il un prix différent ?
Les prix changent, varient selon la région, et certains fournisseurs facturent séparément le CPU, la RAM ou le stockage. PetaPrice s'actualise environ toutes les 2 heures et affiche la région la moins chère ; seul le site du fournisseur fait foi au moment de la réservation. Si un prix est systématiquement faux, merci de nous le signaler.
Pourquoi ne vois-je ni partitions MIG ni fractions de GPU ?
Une fraction de GPU n'est pas comparable à un GPU entier : les partitions MIG, les vGPU et les GPU en temps partagé sont donc exclus partout. Chaque prix sur PetaPrice correspond à un GPU complet.
Que signifie « communautaire » ?
Les hébergeurs communautaires louent des machines via des places de marché pair-à-pair comme Vast.ai ou RunPod Community Cloud. Ils sont souvent les moins chers, mais la fiabilité et la sécurité varient selon l'hébergeur. Utilisez le filtre Hébergeur pour n'afficher que les clouds gérés.
Qu'affiche le filtre UE ?
Les fournisseurs dont le siège est dans un État membre de l'UE. Il filtre selon l'implantation de l'entreprise, pas selon l'emplacement de ses GPU : vérifiez les régions du fournisseur si la localisation des données compte pour vous.
Existe-t-il une API ?
Oui. /api/offers renvoie toutes les offres normalisées ainsi que la fiche technique des GPU en JSON, avec CORS activé. /llms.txt résume le site pour les assistants IA.
J'ai trouvé un prix erroné. Comment le signaler ?
Envoyez-nous le GPU, le fournisseur et un lien vers sa page de tarifs. La page Corrections explique la marche à suivre et liste ce que nous avons corrigé jusqu'ici.