Кратко

  • 9 сентября Parallel Works и CoreWeave объявили о развертывании управляемой вычислительной среды для программы NODES агентства DARPA с гарантированными квотами команд.
  • Дополнительная общая мощность доступна при наличии свободных ресурсов. Это не неограниченное право на GPU и не доказательство уже полученной экономии.

Резервирование не отменяет внутреннюю очередь

Команда может строить рабочий план вокруг гарантированной квоты. На временно свободную мощность соседей нельзя рассчитывать с той же уверенностью. Новый сервис Parallel Works на инфраструктуре CoreWeave объединяет эти два вида доступа, а различие между ними становится самостоятельной задачей управления.

По сообщению компаний, среда развернута для биологической исследовательской программы NODES агентства DARPA. Платформа ACTIVATE от Parallel Works распределяет выделенный резерв систем NVIDIA HGX H100, хранения данных и сети InfiniBand, предоставляемый через CoreWeave. Командам гарантированы квоты; при наличии свободной общей мощности они могут использовать и ее. Число GPU, стоимость договора и срок не раскрыты.

Резерв помогает заказчику уменьшить неопределенность, связанную с другими покупателями облачного провайдера. Но если несколько его команд одновременно хотят выйти за свои квоты, внутренний спрос по-прежнему требует очередности. В объявлении нет подробных правил возврата заимствованной мощности или разрешения конфликтующих запросов. Нельзя обещать отсутствие очередей или заключать, что каждой команде выделено фиксированное эксклюзивное оборудование.

Parallel Works отвечает за подключение пользователей, доступ, планирование задач и отчеты, предоставляя круглосуточную экспертную поддержку, в том числе по приложениям. CoreWeave следит за состоянием базовой инфраструктуры. Это распределение эксплуатационных функций, а не опубликованные условия юридической ответственности или компенсации за перерывы. Покупателю еще нужно выяснить, кто ведет инцидент до полного разрешения.

Загрузка оборудования и результат работы различаются

Документация SUNK объясняет, как согласованное планирование позволяет задачам Slurm и Kubernetes использовать общие вычислительные ресурсы. В объявленной среде ACTIVATE дает единый доступ к SUNK и CoreWeave Kubernetes Service. Отказ от изолированных аппаратных пулов для разных инструментов может повысить эффективность. Сам по себе он не доказывает достигнутую здесь загрузку или снижение удельной стоимости.

Есть и ограничение со стороны заказчика. В FAQ DARPA, последняя указанная дата обновления которого — август 2025 года, государственные GPU названы ограниченным ресурсом, хотя доступ может быть бесплатным и по запросу. Команды могут использовать собственные мощности, но конечные продукты и демонстрации должны исполняться в государственной среде высокопроизводительных вычислений. Это более раннее правило программы, а не подтверждение, что новый облачный сервис является конечной средой или что передача уже испытана.

Понятные квоты, видимый расход и работоспособные приложения — отдельная услуга сверх поставки машин. Проверять ее стоит на уровне команд. Резерв может быть почти полностью занят, пока одна группа ожидает, а другая повторяет неудачный запуск. Загрузка аппаратуры не равнозначна полезной завершенной работе.

Источники и границы утверждений

Сообщение компаний от 9 сентября описывает развертывание. Страница NODES и более ранний FAQ DARPA задают условия программы. Официальная документация SUNK объясняет архитектуру. Независимых измерений производительности этой установки данные источники не приводят.