要約

  • Parallel WorksとCoreWeaveは9月9日、DARPAのNODES計画向けの運用管理付き計算環境を発表した。専用予約枠の中で各チームに利用枠を保証する。
  • 追加の共有資源は空きがある場合に使える。無制限のGPU利用や、既に実証された費用削減を意味するものではない。

全体の確保と個別の順番は別の問題

計算資源を予約すれば、顧客は供給の見通しを立てやすくなる。しかし、同じ顧客の複数チームが同時に仕事を増やした場合、誰が先に使えるのかは別途決めなければならない。Parallel WorksがCoreWeaveと組む今回のサービスは、この配分を運用の中心に置く。

両社によれば、環境はDARPAの生物学研究計画NODES向けに既に導入されている。Parallel WorksのACTIVATEは、CoreWeave経由で供給されるNVIDIA HGX H100システム、ストレージ、InfiniBandネットワークの専用予約資源をチームに配分する。保証枠に加え、空きがあれば共有分も利用できる。GPU台数、契約金額、契約期間は公表されていない。

チームにとって、保証された枠と一時的な余力は同じ計画上の権利ではない。全員が自分の枠を超えて使おうとすれば、外部顧客との競争を避けても内部の競合は残る。借用した資源をいつ戻すか、競合時に何を優先するかという具体的な規則は発表されていない。待ち時間ゼロや、チームごとの固定機器の独占を読み込むことはできない。

Parallel Worksは利用開始、アクセス、ジョブの調整、報告を運営し、アプリケーションも含めて専門家が常時支援する。CoreWeaveは基盤となる機器群の状態を監視する。ただし、これは運用上の分担であり、中断時の法的責任や補償条件の公開ではない。購入者には、障害を解決まで引き受ける主体の確認がなお必要だ。

稼働率だけでは成果を測れない

CoreWeaveのSUNK文書は、SlurmとKubernetesの処理を調整し、同じ計算資源を使う仕組みを説明する。今回の環境では、ACTIVATEからSUNKとCoreWeave Kubernetes Serviceを共通の入口で利用する。道具ごとに資源を分断しないことは効率改善につながりうるが、この導入で一定の稼働率や単位費用の低下が既に達成された証拠ではない。

顧客側の条件もある。最終更新が2025年8月とされるDARPAの計画FAQは、政府のGPU資源を無料・オンデマンドで使えても、その量は有限と説明する。チーム自身の計算資源の利用は認める一方、最終成果物と能力実証は政府の高性能計算環境で動作することを求めている。この以前の指針は、今回のクラウドがその最終環境だという確認でも、引き渡し完了の証明でもない。

枠を説明し、使用状況を見せ、アプリケーションを使い続けられるよう支えることには、機器の供給とは別の価値がある。ただし購入者はチーム単位で確認すべきだ。機器が忙しくても、あるチームは待ち、別の処理は再実行を必要としているかもしれない。資源の使用と有用な仕事の完了は、同じ指標ではない。

出典と確認範囲

9月9日の企業発表が導入内容を説明する。DARPAのNODESページと以前のFAQは計画上の条件を示す。SUNK公式文書は構造の説明であり、この環境の性能を独立測定した資料ではない。