Google hat kürzlich seinen neuesten KI-Chip, die TPU v5e, auf den Markt gebracht und den „A3-Supercomputer“ vorgestellt, der von NVIDIA H100 GPUs betrieben wird. Die A3-VM-Instanzen sollen nächsten Monat starten, was einen bedeutenden Fortschritt in der KI-Infrastruktur darstellt. Google hat außerdem eine erweiterte Partnerschaft mit dem führenden KI-Chip-Hersteller NVIDIA bekannt gegeben.

Verdoppelte Trainingsleistung, 2,5-mal schnellere Inferenz und 50 % Kostensenkung

Google strebt mit seiner neuesten TPU der 5. Generation die Führung im KI-Training an. Hier sind einige bemerkenswerte Punkte hervorzuheben:

Die TPU v5e wurde entwickelt, um die Trainings- und Inferenzleistung sowie die Kosteneffizienz zu verbessern. Die Trainingsleistung wurde im Vergleich zur TPU v4 verdoppelt und die Inferenzleistung um das 2,5-fache gesteigert.

Die TPU v5e bietet diese Fortschritte zu weniger als der Hälfte der Kosten und ermöglicht so kostengünstiges Training und Deployment größerer KI-Modelle. Darüber hinaus setzt Google auf Skalierbarkeit mit Konfigurationen, die bis zu 256 Chips unterstützen und eine INT8-Rechenleistung von bis zu 100 PetaOps erreichen.

Die VM-Konfigurationen der TPU v5e erfüllen die unterschiedlichen Anforderungen der Nutzer. Diese Version enthält eine neue Funktion namens „Multislice“. Multislice ist ein Dienst für Nutzer, die noch mehr Rechenleistung benötigen, indem die Modellberechnungen auf Zehntausende von TPU-Chips verteilt werden.

Google arbeitet außerdem mit NVIDIA zusammen, um den virtuellen Supercomputer A3 auf den Markt zu bringen. Diese Maschine ist darauf ausgelegt, die wachsenden Rechenanforderungen zu erfüllen, die durch generative künstliche Intelligenz und große Sprachmodelle entstehen. Mit solchen Fortschritten ist der nächste Schritt absehbar: Google Cloud hat 20 weitere KI-Modelle integriert, womit die Gesamtzahl der unterstützten Modelle auf 100 steigt. Diese neue KI-Palette bietet Kunden die Flexibilität, aus einer Vielzahl von Modellen zu wählen, um ihre betrieblichen Anforderungen zu erfüllen.