摘要
- Ocean Network 在 9 月 10 日发布 Inference,让模型和应用在付费会话内持续通过 HTTP 提供服务,区别于运行完即退出的计算任务。
- 供应商称节点运营者可就整段预订时间收款。账单变得明确,并不等于闲置分钟自动退款。
预订到一张 GPU,不意味着它已经有活干。Ocean Network 新推出的 Inference 把一段专用硬件时间变成可事先计价的商品,却没有替购买者消除另一个问题:这段时间最终能交付多少有用结果。
按照9 月 10 日的官方公告,模型或 AI 应用可在已支付的会话内保持 HTTP 可访问状态。产品文档将它与一次运行、随后结束的计算任务分开。预配置套餐组合模型、引擎设置与硬件要求,自定义路径则开放更多参数。模型路径提供兼容 OpenAI 的 API,服务和应用模板可以给出浏览器界面。这些是供应商描述,并非本文对所有模型、客户端和配置做过兼容性测试。
采购时需要看清的是计费单位。公告说,总价会在确认前展示,资金在容器启动前进入托管,节点可领取整个预订时段对应的款项,会话也可以延长。官网首页同样写明按预订窗口计费,并在该窗口结束后停止收费。因此,不能把它改写成“只在处理请求时收费”,也不能推断空闲分钟会自动退还。现有材料没有在这里明确提前结束的退款规则,或启动过程与计费起点之间的具体边界。
首页宣传的 H200 起价为每小时 2.16 美元。这是公开报价,不是实际成交的全包价格,更不是某一配置随时有货的证据。官网的供应商比较表也提醒,实例规格存在差异。发布时赠送的算力时长属于推广安排,不能证明应用长期运行的单位成本。仅凭起价和赠送额度,无法断言按小时租用总比按 token 付费便宜。
控制权是另一层主张。Ocean Network 称,会话使用专用硬件,所选模型就是实际运行的模型,没有中央路由层暗中改选其他模型。它还描述了日志、剩余付费时间、延长和重新启动等管理功能。这些可见性可能有助于运营,但不等于吞吐量测试、隔离审计或相同输出保证;网站仍保留 Beta 标识。
连续性则需要单独找证据。5 月 25 日的工程说明讨论的是计算任务监测、故障识别,以及开发者在其他节点重新提交任务,并建议长任务设置检查点。其中“节点在开始执行前不可用则不收费”的例子,不是 Inference 会话中途退款的承诺。一次批处理任务可以重跑,也不能证明在线端点能无感切换、保住状态并继续处理未完成请求。
本文没有注册账户、连接钱包或调用模型端点。可用服务时间、提前终止、故障补偿与在线推理恢复,仍是具体工作负载需要核验的项目,而非已经证实的产品结果。
会员简报
档案背景详情
使用相应会员等级登录,即可解锁完整简报与来源注释。
仅限 Strategic Circle
Strategic Circle
所有读者均可浏览。加入并登录后可解锁档案简报。
加入 Strategic Circle仅限 Leadership Alliance
Leadership Alliance
符合条件的 IP 资产所有者和管理层可登录查看 Leadership Alliance 简报。
加入 Leadership Alliance
