Resumen

  • SEMIFIVE ha iniciado la producción en serie del acelerador de inferencia de IA Bertha de HyperAccel mediante el proceso de 4 nm de Samsung Foundry
  • Ya se ha asegurado el primer contrato de producción, y se esperan más pedidos a medida que HyperAccel amplíe sus servicios

Los hechos

SEMIFIVE informó el 8 de septiembre de que había iniciado la producción en serie del acelerador de inferencia de IA Bertha de HyperAccel mediante el proceso de 4 nm de Samsung Foundry. El chip está diseñado para la inferencia de grandes modelos de lenguaje y tiene una superficie de más de 500 milímetros cuadrados.

SEMIFIVE presta servicios que abarcan desde el diseño y la verificación hasta el encapsulado, las pruebas y el suministro para la producción a gran escala. Las empresas anunciaron por primera vez su acuerdo de producción en octubre de 2024. SEMIFIVE afirma que ya ha asegurado un contrato inicial de producción y espera recibir pedidos de compra adicionales a medida que HyperAccel amplíe sus servicios. SEMIFIVE no ha revelado el número de chips en producción, los volúmenes de envío ni un calendario recurrente de producción.

Evaluación

HyperAccel ya dispone de hardware de producción para Bertha, en lugar de contar únicamente con un plan de desarrollo. Esto ofrece a los clientes un chip que pueden evaluar con sus propias cargas de inferencia y acerca el proyecto al despliegue en sistemas de centros de datos.

El anuncio de producción todavía no indica qué volumen de hardware estará disponible. SEMIFIVE ha asegurado el pedido inicial, pero la producción posterior depende de que HyperAccel realice más pedidos de compra a medida que amplíe sus servicios. Por tanto, un cliente que planifique su capacidad en torno a Bertha tendría que conocer tanto el rendimiento del chip como el volumen de suministro que HyperAccel puede asegurar.

Para los lectores de BTW, Bertha está ahora más cerca de convertirse en una infraestructura de IA utilizable, pero la escala de ese despliegue sigue sin estar clara. Los pedidos recurrentes de producción y los despliegues con clientes identificados mostrarían si el lote inicial de fabricación se está convirtiendo en capacidad sostenida.

Qué vigilar

Conviene seguir los pedidos de compra posteriores, los volúmenes de envío que se hagan públicos y los despliegues de clientes identificados que utilicen Bertha. Los resultados de las cargas de trabajo de los clientes aportarían evidencia sobre el rendimiento del chip tras su instalación, mientras que los pedidos recurrentes de fabricación mostrarían si HyperAccel se está expandiendo más allá del lote inicial de producción.