Resumo

  • A SEMIFIVE iniciou a produção em massa do acelerador de inferência de IA Bertha, da HyperAccel, usando o processo de 4 nm da Samsung Foundry
  • O primeiro contrato de produção foi garantido, e novos pedidos são esperados à medida que a HyperAccel amplia seus serviços

O fato

A SEMIFIVE informou em 8 de setembro que havia iniciado a produção em massa do acelerador de inferência de IA Bertha, da HyperAccel, usando o processo de 4 nm da Samsung Foundry. O chip foi projetado para inferência de modelos de linguagem de grande porte e tem área de pastilha superior a 500 milímetros quadrados.

A SEMIFIVE presta serviços de projeto e verificação, encapsulamento e testes, além do fornecimento em escala industrial. As empresas anunciaram pela primeira vez seu acordo de produção em outubro de 2024. A SEMIFIVE afirma que um contrato inicial de produção já foi garantido e espera pedidos de compra adicionais à medida que a HyperAccel amplia seus serviços. A SEMIFIVE não divulgou o número de chips em produção, os volumes de remessas nem um cronograma recorrente de produção.

A avaliação

A HyperAccel agora conta com hardware do Bertha em produção, em vez de apenas um plano de desenvolvimento. Isso oferece aos clientes um chip que podem avaliar em suas próprias cargas de trabalho de inferência e aproxima o projeto da implantação em sistemas de data centers.

O anúncio da produção ainda não mostra quanto hardware estará disponível. A SEMIFIVE garantiu o pedido inicial, mas a produção adicional depende de a HyperAccel fazer novos pedidos de compra à medida que seus serviços se expandem. Portanto, um cliente que planeje capacidade baseada no Bertha precisaria entender tanto o desempenho do chip quanto o volume de fornecimento que a HyperAccel consegue garantir.

Para os leitores da BTW, o Bertha está mais perto de se tornar uma infraestrutura de IA utilizável, mas a escala dessa implantação ainda não está clara. Pedidos recorrentes de produção e implantações em clientes identificados mostrariam se o lote inicial de fabricação está se transformando em capacidade sustentada.

O que acompanhar

Acompanhe pedidos de compra subsequentes, volumes de remessas divulgados e implantações identificadas que usem o Bertha. Os resultados das cargas de trabalho dos clientes forneceriam evidências do desempenho do chip após a instalação, enquanto pedidos recorrentes de fabricação mostrariam se a HyperAccel está avançando além do lote inicial de produção.