要約

  • 10月8日からNebiusは、中断可能なGPUの価格をプラットフォームと地域ごとに設定し、空き容量と需要を反映して最大15分間隔で更新する。
  • 利用者の上限価格は容量を確保する契約ではなく、VMを止める境界にもなる。現行価格への追随は価格起因の停止を避けるが、請求額の変動と容量回収の可能性を受け入れる選択だ。

分析

「スポット」という名称より重要なのは、価格変動と稼働継続のリスクをどう分けるかだ。Nebiusによれば、アルゴリズムは利用可能な容量と自社ユーザーのリアルタイム需要シグナルを読み、GPUの種類と地域ごとの価格を算出する。価格の上限は、同じGPUのオンデマンド時間単価より1セント低い。価格変更の発表では10月8日が適用日とされ、運用文書は稼働中にも価格が変わり得ると説明している。

10月8日時点の公開料金表は、HGX B300とB200をGPU時間あたり0.99ドルから、H200、H100、RTX PRO 6000を0.79ドルからとしている。いずれも「から」の価格で、全地域や全時間帯に適用される保証ではない。L40Sの中断可能VMは動的価格の対象外で、固定料金とされる。Nebiusはコンソールで最大30日分の履歴を確認できるとしているが、一般公開ページには独立検証できる価格系列がない。

選択肢は、現在価格に追随するか、上限を置くかだ。上限を使っても支払額は上限価格ではなく、その時点のスポット価格である。価格が上限を超えるとVMは停止する。したがって、上限が抑えるのはGPU時間単価であり、プロジェクト全体の支出ではない。容量予約にもならない。コンソールの1時間見積もりは価格が変わらない前提だが、料金は15分ごとの価格で計算される。GPU台数と稼働時間が総額を左右する点は変わらない。

停止は請求だけの問題ではない。Nebiusは接続ボリュームのデータを保持する一方、動的パブリックIPは維持せず、ローカルSSDは一時的な保存先だと説明する。強制停止の60秒前にはSIGTERMが送られる。単独VMは自動で再起動せず、手動または自動化した再起動が必要だ。NebiusはKubernetes内のプリエンプティブルVMは自動再起動されるとしているが、チェックポイントからの再実行や再配置に伴う時間は残る。同社は容量回収で中断されたPVM負荷は「少数」と述べるが、期間も分母も公表していないため、独立に再計算できる停止率ではない。

出典