Zusammenfassung

  • Nebius setzt den Preis unterbrechbarer GPU-Ressourcen jetzt dynamisch je Plattform und Region; Grundlage sind Kapazitäts- und Nachfragesignale, eine Anpassung ist im 15-Minuten-Takt möglich.
  • Der kundenseitige Höchstpreis ist eine Stoppbedingung, keine Kapazitätsreservierung. Wer dem laufenden Preis folgt, vermeidet einen preisbedingten Stopp, akzeptiert aber eine schwankende Rechnung und mögliche Kapazitätsrücknahmen.

Analyse

Ein niedriger GPU-Stundenpreis ist keine Zusage für eine durchgehende Stunde. Entscheidend ist, wer Preis- und Verfügbarkeitsrisiko trägt. Nebius erklärt, sein Algorithmus berücksichtige verfügbare Kapazität und Echtzeit-Nachfragesignale seiner Kunden, um für einen GPU-Typ und eine Region einen Spotpreis festzulegen. Die Obergrenze liegt einen US-Cent unter dem jeweils aktuellen GPU-Stundensatz für On-Demand-Kapazität. In der Ankündigung vom 22. September nennt das Unternehmen den 8. Oktober als Starttermin; die Betriebsdokumentation sagt, dass sich der Preis auch während der Nutzung ändern kann.

Die öffentliche Preisseite zeigte am 8. Oktober „ab“-Preise von 0,99 US-Dollar je GPU-Stunde für HGX B300 und B200 sowie 0,79 US-Dollar für H200, H100 und RTX PRO 6000. Das sind Einstiegspreise, keine Zusage für jede Region oder jeden Abrechnungszeitraum. Unterbrechbare L40S-Instanzen sind laut Preisseite von der dynamischen Preisgestaltung ausgenommen und werden pauschal abgerechnet. Nebius bietet nach eigener Aussage in der Konsole bis zu 30 Tage Preisverlauf; eine offene historische Datenreihe gibt es auf den öffentlichen Seiten nicht.

Kunden können dem aktuellen Preis folgen oder einen Höchstpreis setzen. Mit einer Preisrichtlinie zahlen sie den tatsächlichen Spotpreis, nicht ihren Grenzwert. Liegt der Spotpreis darüber, wird die VM gestoppt. Der Höchstpreis deckelt daher den Betrag pro GPU-Stunde, nicht das Gesamtbudget des Projekts und auch nicht die verfügbare Kapazität. Die Stundenkalkulation in der Konsole unterstellt einen unveränderten Preis; die Dokumentation beschreibt dagegen Abrechnung nach jeweils 15 Minuten. GPU-Zahl und Laufzeit bleiben für die Rechnung maßgeblich.

Ein Stopp verändert mehr als die Rechnung. Nebius erhält Daten auf angehängten Volumes, gibt aber dynamische öffentliche IP-Adressen frei und bezeichnet lokale SSD-Daten als flüchtig. Vor dem erzwungenen Herunterfahren wird 60 Sekunden vorher ein SIGTERM gesendet. Einzelne VMs starten nicht selbstständig neu; ein Neustart muss manuell oder automatisiert erfolgen. Nebius sagt, Kubernetes starte unterbrechbare VMs in einem Cluster neu. Checkpoint-Verluste, Neuplanung und zusätzliche Laufzeit verschwinden dadurch nicht.

Das Unternehmen berichtet, nur ein „kleiner Anteil“ der PVM-Workloads sei durch Kapazitätsrücknahmen unterbrochen worden, nennt aber weder Zeitraum noch Nenner. Eine überprüfbare Unterbrechungsquote ergibt sich daraus nicht.

Quellen