- O cluster de 5MW utiliza sistemas Nvidia HGX B300, refrigeração líquida direta e rede Quantum-X800
- A Visionbay.ai afirma ter clientes de longo prazo contratados e que a utilização excede 90%, mas não publicou dados de carga de trabalho comprobatórios.
O fato
A Visionbay.ai, subsidiária da Foxconn, lançou um cluster de computação de IA de 5MW em Taiwan utilizando sistemas Nvidia HGX B300. A empresa afirma que a infraestrutura está disponível comercialmente para treinamento e inferência de IA em grande escala e que mais de 90% de sua capacidade já está em uso. Não divulgou a localização do cluster.
A Visionbay.ai foi lançada em 2025 como negócio da Foxconn para supercomputação e serviços de IA em nuvem. A Foxconn afirma que o novo cluster utiliza refrigeração líquida direta, um design de infraestrutura 2N e rede Nvidia Quantum-X800. A Nvidia lista a Visionbay.ai como provedora em seu programa Exemplar Cloud, que avalia a infraestrutura participante em relação a critérios de desempenho de carga de trabalho, segurança e confiabilidade.
A avaliação
A Visionbay.ai está levando a Foxconn de fornecedora de sistemas de IA para operar o serviço de computação construído com eles. A empresa agora precisa alocar capacidade de GPU, manter os trabalhos de clientes em execução sob carga sustentada e garantir acesso confiável ao cluster. A principal incerteza é o que a taxa de utilização reportada representa. Pode se referir à capacidade reservada, sistemas atribuídos ou GPUs que estão processando cargas de trabalho pagas ativamente.
Essas métricas não são intercambiáveis, e a Visionbay.ai não publicou detalhes suficientes para mostrar qual está usando ou como o cluster se comporta quando a demanda é alta. Para os leitores da BTW, a alegação de 90% só se torna útil quando vinculada a evidências operacionais. Disponibilidade do serviço, tempos de fila e cargas de trabalho concluídas mostrariam se a Foxconn construiu um serviço de IA em nuvem confiável, em vez de apenas um cluster bem especificado.
O que observar
A Visionbay.ai não divulgou a quantidade de GPUs instaladas, o perfil de clientes ou o método de cálculo da utilização. Disponibilidade do serviço, tempos de fila, cargas de trabalho concluídas e renovações de clientes dariam uma imagem mais clara de como o cluster se comporta. Qualquer expansão além de 5MW deve ser avaliada com base nesses resultados operacionais.

