• A COREWEAVE colocou em operação um cluster NVIDIA Vera Rubin NVL72 com vários racks, interligando centenas de GPUs Rubin via Spectrum-X Ethernet
  • A empresa também adicionou aceleração de gravação entre regiões e uma camada Archive ao AI Object Storage

O fato

A COREWEAVE informou, em 16 de setembro, que havia colocado em operação um cluster NVIDIA Vera Rubin NVL72 com vários racks na CoreWeave Cloud, conectando centenas de GPUs Rubin por meio da NVIDIA Spectrum-X Ethernet. Cada rack NVL72 combina 72 GPUs Rubin com 36 CPUs Vera, além de NVLink 6, ConnectX-9 SuperNICs e BlueField-4 DPUs.

A COREWEAVE também anunciou duas mudanças no AI Object Storage. A aceleração de gravação entre regiões permite que as aplicações concluam as gravações localmente enquanto a replicação para outra região continua em segundo plano. Uma nova camada Archive destina-se a dados que precisam ser mantidos, mas acessados com menos frequência.

A empresa descreveu uma validação automatizada dos racks que abrange detecção de hardware, firmware, energia, refrigeração e testes de cargas de trabalho antes que os sistemas entrem em produção. Ela não divulgou o número de clusters Rubin implantados, a capacidade total disponível de GPUs nem quanto dessa capacidade os clientes podem reservar atualmente.

A avaliação

Reunir centenas de GPUs em um único cluster aumenta a capacidade computacional que um cliente pode destinar a uma carga de trabalho, mas essa capacidade só é útil se os dados conseguirem chegar até ela com rapidez suficiente. Aplicações voltadas a treinamento e inferência, assim como aplicações baseadas em agentes, podem ler, gravar e movimentar grandes conjuntos de dados repetidamente, por isso atrasos de armazenamento e rede podem deixar aceleradores caros ociosos.

A aceleração de gravação entre regiões altera uma parte desse fluxo. Uma carga de trabalho pode concluir sua gravação local sem esperar que a cópia remota seja concluída, enquanto a COREWEAVE realiza a replicação depois. Isso pode reduzir o tempo que uma aplicação passa à espera de operações de armazenamento entre regiões, embora os clientes ainda precisem entender quando a segunda cópia ficará disponível e onde será armazenada.

Para os leitores da BTW, o anúncio do Rubin é, portanto, mais do que um marco em GPUs. A COREWEAVE também está trabalhando no fluxo de armazenamento que atende esses aceleradores, porque uma computação mais rápida oferece menos valor quando as tarefas são interrompidas repetidamente para movimentar dados.

O que acompanhar

Acompanhe implantações de clientes que divulguem a capacidade Rubin reservada e o desempenho em cargas de trabalho específicas. Os resultados de armazenamento devem incluir a latência de gravação entre regiões, o tempo de replicação e os preços da nova camada Archive. Esses números mostrariam se as mudanças no armazenamento reduzem o tempo de espera e os custos em paralelo ao aumento da capacidade computacional disponível.