Кратко

  • Анонс 10 сентября добавляет модели и приложения, доступные по HTTP в течение оплаченной сессии, в отличие от разовых вычислительных задач.
  • По описанию поставщика, оператор получает право на оплату всего забронированного окна, а не только времени активных запросов.

Забронировать GPU и занять её полезной работой — разные действия. Новый Inference от Ocean Network позволяет заранее увидеть цену выделенного периода. Но экономичность такого периода зависит от того, что покупатель успеет получить за оплаченное время.

В анонсе от 10 сентября описаны модели и приложения ИИ, остающиеся доступными по HTTP в течение сессии. Документация отличает этот режим от задач, которые выполняются один раз и завершаются. Готовые пакеты соединяют модель, настройки движка и требования к оборудованию; индивидуальная конфигурация оставляет больше параметров пользователю. Для моделей заявлен OpenAI-совместимый API, а сервисы и шаблоны могут предоставлять интерфейс в браузере. Это описание поставщика, не проверка всех моделей и клиентских программ.

Единица покупки — временное окно. Компания пишет, что общая стоимость показывается до подтверждения, средства помещаются в эскроу до запуска контейнера, а оператор узла может получить оплату за весь забронированный период. Сессию можно продлить. На главной странице также сказано об оплате окна и прекращении начислений по его окончании. Это нельзя пересказывать как оплату лишь во время активных запросов или автоматический возврат за простой. Приведённые материалы не устанавливают здесь правило возврата при досрочной остановке и точную границу начислений во время запуска.

Рекламируемая цена H200 начинается от 2,16 доллара США в час. Она не равна исполненному предложению со всеми расходами и не подтверждает наличие любой нужной конфигурации. Даже сравнительная таблица поставщика предупреждает о различиях характеристик инстансов. Бесплатные часы при запуске — продвижение, а не доказательство регулярной себестоимости. По этим данным нельзя объявить почасовую аренду безусловно выгоднее API с оплатой за токены.

Ещё одна часть предложения — контроль выбора. Ocean Network утверждает, что выбранная модель работает на выделенном оборудовании в течение сессии, без центрального маршрутизатора, который незаметно подставляет другую модель. В описании управления есть журналы, оставшееся оплаченное время, продление и перезапуск. Такая наблюдаемость может помогать эксплуатации, но не является тестом производительности, аудитом изоляции или гарантией одинаковых ответов. На сайте сохраняется отметка Beta.

Непрерывность требует отдельного подтверждения. Инженерный материал от 25 мая посвящён наблюдению за вычислительными задачами, обнаружению сбоев и повторному запуску разработчиком на другом узле. Для долгих задач рекомендованы контрольные точки. Пример отсутствия списания при недоступности узла до начала исполнения не доказывает возврат денег при сбое внутри сессии Inference. Возможность повторить пакетную задачу также не подтверждает прозрачное восстановление работающего HTTP-эндпоинта, его состояния и незавершённых запросов.

В рамках этого материала не использовались аккаунт, кошелёк или модельный эндпоинт. Полезное время доступности, досрочное завершение, компенсации и восстановление работающего сервиса остаются вопросами для проверки на предполагаемой нагрузке.