Google は最近、最新の AI チップ「TPU v5e」を発表し、NVIDIA H100 GPU を搭載した「A3 スーパーコンピュータ」を披露しました。A3 VM インスタンスは来月に提供開始予定であり、AI インフラにおける重要な進展を示しています。Google はまた、AI チップのリーダーである NVIDIA とのパートナーシップの拡大を明らかにしました。

トレーニング性能は 2 倍、推論は 2.5 倍高速化、コストは 50%削減

Google は最新の第 5 世代 TPU で AI トレーニングのリーダーシップを目指しています。以下に注目すべきポイントをいくつか挙げます。

TPU v5e は、トレーニング、推論のパフォーマンス、そして費用対効果の向上を目的として設計されました。TPU v4 と比較して、トレーニング性能は 2 倍、推論性能は 2.5 倍に向上しています。

TPU v5e はこれらの進歩を半分以下のコストで提供し、より大規模な AI モデルの費用対効果の高いトレーニングと展開を可能にします。さらに Google はスケーラビリティに注力しており、最大 256 チップを搭載可能な構成と、100 PetaOps に達する INT8 計算能力を実現します。

TPU v5e の仮想マシン構成は、多様なユーザーニーズに対応します。このバージョンには「Multislice」と呼ばれる新機能が含まれています。Multislice は、さらに高い計算能力を必要とするユーザー向けのサービスで、モデル計算を数万の TPU チップに分散させます。

Google はまた、NVIDIA と協力して仮想スーパーコンピュータ A3 を発表します。このマシンは、生成 AI や大規模言語モデルによってもたらされる増大する計算需要に対応するために設計されています。このような進歩に伴い、次のステップは予想可能です。Google Cloud は新たに 20 の AI モデルを統合し、サポートされるモデルの総数を 100 に拡大しました。この新しい AI ラインナップにより、顧客は運用ニーズに合わせてさまざまなモデルから柔軟に選択できます。