摘要

  • SEMIFIVE 已开始采用 Samsung Foundry 的 4nm 工艺量产 HyperAccel 的 Bertha AI 推理加速器
  • 首份生产合同已落实;随着 HyperAccel 扩展服务,预计还会有更多订单

事实

SEMIFIVE 于 9 月 8 日表示,已开始采用 Samsung Foundry 的 4nm 工艺量产 HyperAccel 的 Bertha AI 推理加速器。该芯片面向大语言模型推理设计,裸片面积超过 500 平方毫米。

SEMIFIVE 提供从设计、验证到封装、测试和批量生产供货的服务。两家公司于 2024 年 10 月首次宣布达成生产协议。SEMIFIVE 表示,目前已获得首份生产合同,并预计随着 HyperAccel 扩展服务,将收到更多采购订单。SEMIFIVE 尚未披露正在生产的芯片数量、出货量或定期生产安排。

评估

HyperAccel 现在不仅有开发计划,也已有 Bertha 的量产硬件。这让客户可以用这款芯片评估自身的推理工作负载,也使该项目离部署到数据中心系统更近一步。

此次量产公告尚未说明将有多少硬件可供使用。SEMIFIVE 已获得首份订单,但后续生产取决于 HyperAccel 随着服务扩张下达更多采购订单。因此,计划围绕 Bertha 规划容量的客户既需要了解芯片性能,也需要了解 HyperAccel 能保障多大供应量。

对 BTW 读者而言,Bertha 现在更接近成为可用的 AI 基础设施,但部署规模仍不清楚。追加生产订单和已披露客户名称的部署将表明,首轮生产是否正在转化为持续产能。

关注重点

关注后续采购订单、已披露的出货量,以及采用 Bertha 且已披露客户名称的部署。客户工作负载的实际运行结果可为芯片安装后的性能提供证据,而追加生产订单则可表明 HyperAccel 是否正在首轮生产之后进一步扩大规模。