PetaPrice

Preguntas frecuentes

Cómo funciona PetaPrice, de dónde salen las cifras y cómo elegir una GPU.

Precios y cifras

¿Qué es $ por PFLOP-hora?

Es el precio de alquiler de una GPU durante una hora dividido entre su cómputo pico en PetaFLOPS con la precisión elegida. Indica cuánto cómputo se obtiene por cada dólar, de modo que una GPU barata y lenta puede compararse directamente con una cara y rápida. Cuanto menor, mejor.

¿Qué GPU ofrece más cómputo por dólar ahora mismo?

En FP16/BF16 denso, la RTX 4070 SUPER lidera actualmente con $0.97 por PFLOP-hora ($0.07 por hora de GPU en Vast.ai). La clasificación cambia con los precios; la tabla anterior se actualiza cada 2 horas.

¿Cuánto cuesta una H100 por hora?

Los precios bajo demanda de la H100 SXM parten actualmente de $1.82 por hora de GPU, con una mediana de $3.52 entre 22 proveedores. La capacidad spot parte de $1.22.

¿Por qué FLOPS densos en lugar de las cifras de las fichas técnicas de NVIDIA?

Las cifras tensoriales destacadas suelen suponer dispersión estructurada 2:4, lo que las duplica, pero en la práctica rara vez se usa. PetaPrice utiliza siempre el rendimiento denso para comparar GPU y fabricantes de forma justa.

¿De dónde proceden los datos de precios?

Directamente de los proveedores siempre que publican sus precios (API públicas, listas de precios oficiales y páginas de precios), con la API multinube de Shadeform y los catálogos de SkyPilot cubriendo los huecos: 941 ofertas de 32 proveedores, actualizadas aproximadamente cada 2 horas. Los precios son precios de lista orientativos; conviene confirmarlos con el proveedor antes de contratar.

¿Qué diferencia hay entre bajo demanda, spot y reservado?

Bajo demanda se factura por horas sin compromiso. La capacidad spot (interrumpible) es más barata, pero puede ser reclamada en cualquier momento. Los precios reservados exigen un compromiso, normalmente de 1 a 3 años. PetaPrice nunca los mezcla; la vista predeterminada es bajo demanda.

Cómo elegir una GPU

¿Qué GPU debo alquilar para inferencia de LLM?

Primero asegúrate de que el modelo cabe: los pesos más la KV cache tienen que caber en la VRAM (un modelo de 70B en FP16 necesita unos 140 GB solo para los pesos). Después compara por ancho de banda de memoria, porque la generación de tokens suele estar limitada por el ancho de banda; cambia «Optimizar por» a Ancho de banda en la página de inicio. Para entrenamiento y para el prefill de prompts largos, compara en cambio los FLOPS.

¿Qué GPU es mejor para entrenar?

Compara el $ por PFLOP-hora en la precisión con la que entrenas (normalmente BF16, o FP8 en Hopper y posteriores). Para entrenar con varias GPU, elige GPU SXM con NVLink; si usas varios servidores, también necesitas InfiniBand. La capacidad spot es mucho más barata si tu trabajo guarda checkpoints con regularidad.

Sobre los datos

¿Por qué la web de un proveedor muestra un precio distinto?

Los precios cambian, varían según la región y algunos proveedores cobran aparte la CPU, la RAM o el almacenamiento. PetaPrice se actualiza aproximadamente cada 2 horas y muestra la región más barata; al contratar, prevalece la web del proveedor. Si un precio es erróneo de forma sistemática, avísanos, por favor.

¿Por qué no veo particiones MIG ni fracciones de GPU?

Una parte de una GPU no es comparable con una GPU completa, así que las particiones MIG, las vGPU y las GPU de tiempo compartido se excluyen en todo el sitio. Todos los precios de PetaPrice son de una GPU completa.

¿Qué significa «comunidad»?

Los hosts comunitarios alquilan máquinas a través de marketplaces P2P como Vast.ai o RunPod Community Cloud. Suelen ser los más baratos, pero la fiabilidad y la seguridad varían según el host. Usa el filtro Host para mostrar solo nubes gestionadas.

¿Qué muestra el filtro UE?

Proveedores con sede en un Estado miembro de la UE. Filtra por dónde tiene su sede la empresa, no por dónde funcionan sus GPU, así que consulta las regiones del proveedor si te importa la residencia de los datos.

¿Hay una API?

Sí. /api/offers devuelve todas las ofertas normalizadas y la hoja de especificaciones de las GPU en JSON, con CORS habilitado. /llms.txt resume el sitio para asistentes de IA.

He encontrado un precio erróneo. ¿Cómo lo notifico?

Envíanos la GPU, el proveedor y un enlace a su página de precios. En la página de Correcciones se explica cómo hacerlo y se enumera lo que hemos corregido hasta ahora.