Résumé

  • Le tarif des GPU préemptibles de Nebius varie désormais selon la plateforme et la région, en fonction de la capacité et de la demande, avec des changements possibles toutes les quinze minutes.
  • Le prix maximal choisi par le client est une condition d’arrêt, non une réservation de capacité. Suivre le tarif évite l’arrêt déclenché par le plafond, mais expose à une facture variable et au retrait de capacité.

Analyse

La nouveauté tient moins au mot « spot » qu’à la façon dont il répartit la décision. Nebius indique que son algorithme combine capacité disponible et signaux de demande issus de ses clients pour établir le tarif d’un type de GPU dans une région. Le plafond tarifaire se situe un cent en dessous du prix GPU horaire à la demande. Dans son annonce du 22 septembre, l’entreprise fixe l’entrée en vigueur au 8 octobre ; son guide d’exploitation précise que le tarif applicable peut changer pendant l’utilisation.

La page publique affiche actuellement des prix « à partir de » 0,99 dollar par GPU-heure pour les HGX B300 et B200, et de 0,79 dollar pour les H200, H100 et RTX PRO 6000. Ce sont des prix de départ, pas une garantie pour chaque région ni chaque heure. Les GPU préemptibles L40S restent facturés à un tarif fixe, hors du dispositif dynamique. Nebius annonce un historique de trente jours dans sa console ; le public ne dispose pas d’une série historique indépendante de l’entreprise.

Le client peut suivre le tarif courant ou définir un maximum. Avec cette politique, il paie le cours spot, pas son plafond. Si le cours le dépasse, la VM est arrêtée. Le plafond porte donc sur le prix par GPU-heure, et non sur la dépense totale du projet ; il ne réserve pas non plus la capacité. L’estimation horaire de la console suppose que le tarif ne bouge pas, alors que la documentation prévoit des prix successifs par intervalle de quinze minutes. Le nombre de GPU et le temps d’exécution restent déterminants.

Un arrêt a des conséquences hors facture. Nebius conserve les données des volumes attachés, mais libère les adresses IP publiques dynamiques et précise que le stockage SSD local est éphémère ; la VM reçoit un signal d’arrêt soixante secondes avant une coupure forcée. Une VM autonome ne redémarre pas seule : il faut la relancer manuellement ou l’automatiser. Nebius dit que Kubernetes redémarre les VM préemptibles d’un cluster, sans annuler le coût des points de reprise, de l’ordonnancement ni du délai de fin. L’entreprise affirme qu’une « petite fraction » des charges préemptibles a été interrompue, mais ne donne ni dénominateur ni période.

Ce chiffre ne peut donc pas être reproduit indépendamment.

Sources