• このクラスターは、Anthropic の Claude モデルのトレーニングと推論をサポートし、AWS が設計した Trainium2 チップで構築されています。
  • 約 50 万基のチップが現在稼働しており、AWS によると Rainier は従来の社内プラットフォームより 70%大きく、2025 年末までに 100 万基を超える予定です。

何が起きたか: AWS がプロジェクト・レーニアの AI スーパークラスターを起動

AWS は正式にプロジェクト・レーニアを起動しました。これは大規模な AI インフラ施設で、現在、約 50 万基の自社製 Trainium2 チップが搭載されています。このクラスターは、2024 年末の AWS Re:Invent イベントで初公開され、複数のデータセンター拠点に分散しており、64 基の Trainium2 チップを搭載した「UltraServer」を高速リンクで相互接続する専用アーキテクチャを採用しています。

この展開の一環として、AWS はパートナーである Anthropic が、Rainier クラスター上で Claude AI モデルを実行し、2025 年末までに Trainium2 チップの使用量を 100 万基以上に拡大する意向であると示しました。すでに稼働中の拠点には、インディアナ州の大規模キャンパスが含まれ、複数の建物と最大 2.2GW の電力消費が見込まれています。

関連記事: 米国、Huawei と SMIC へのチップ輸出規制を強化
関連記事: Alibaba、セキュリティ不正をめぐる集団訴訟で和解金 4 億 3350 万ドルを支払いに合意

なぜ重要か

プロジェクト・レーニアの展開は、汎用 GPU プラットフォームから、ハイパースケール向けにカスタム設計された AI チップへの移行における重要なマイルストーンです。AWS は独自のトレーニングとサービングハードウェアを構築することで、チップからクラウドまでのスタック全体をより厳密に制御し、コスト、パフォーマンス、エネルギー効率を最適化しています。

Anthropic や同様の AI 企業にとって、このカスタム計算能力へのアクセスは、より大規模で高性能なモデルをより迅速にトレーニングするための扉を開きます。AWS が、このクラスターが既存の社内提供よりもすでに 70%大きいと主張していることは、計算能力をめぐる軍拡競争の激化を浮き彫りにしています。

競合の観点からは、AWS の大規模展開は、他のクラウドプロバイダーやチップメーカー(GPU に依存する企業を含む)に対し、同等のパフォーマンスとスケールを達成するよう圧力をかけます。AWS が発表から 1 年以内に立ち上げた速さは、AI インフラ供給における新たなベンチマークを示しています。

要するに、プロジェクト・レーニアは単なる計算能力の増大ではなく、シリコン、サーバー、データセンターの垂直統合が戦略的な差別化要因となる、クラウド AI インフラの新時代を告げるものです。