Google lançou recentemente seu mais recente chip de IA, o TPU v5e, e apresentou o 'supercomputador A3', alimentado por GPUs NVIDIA H100. As instâncias A3 VM devem ser lançadas no próximo mês, representando um avanço significativo na infraestrutura de IA. Google também anunciou uma parceria expandida com a principal fabricante de chips de IA, NVIDIA.

Desempenho de treinamento duplicado, inferência 2,5 vezes mais rápida e redução de 50% nos custos

Google busca liderança em treinamento de IA com sua mais recente TPU de 5ª geração. Aqui estão alguns pontos notáveis:

A TPU v5e foi projetada para melhorar o desempenho de treinamento e inferência, bem como a eficiência de custos. O desempenho de treinamento foi duplicado em comparação com a TPU v4 e o desempenho de inferência aumentou 2,5 vezes.

A TPU v5e oferece esses avanços por menos da metade do custo, permitindo treinamento e implantação econômicos de modelos de IA maiores. Além disso, Google aposta em escalabilidade com configurações que suportam até 256 chips e alcançam desempenho de computação INT8 de até 100 PetaOps.

As configurações de VM da TPU v5e atendem às diversas necessidades dos usuários. Esta versão inclui um novo recurso chamado 'Multislice'. Multislice é um serviço para usuários que precisam de ainda mais poder de computação, distribuindo os cálculos do modelo em dezenas de milhares de chips TPU.

Google também está colaborando com a NVIDIA para lançar o supercomputador virtual A3. Esta máquina foi projetada para atender às crescentes demandas computacionais geradas pela inteligência artificial generativa e grandes modelos de linguagem. Com esses avanços, o próximo passo é previsível: o Google Cloud integrou mais 20 modelos de IA, elevando o número total de modelos suportados para 100. Este novo portfólio de IA oferece aos clientes flexibilidade para escolher entre uma ampla variedade de modelos para atender às suas necessidades operacionais.