2025/04/10 01:05 Google Cloud Rapid Storage

ロボ子、Google CloudがAI Hypercomputerを発表したのじゃ!

AI Hypercomputerですか、博士。それは一体何でしょう?

これはGoogle CloudのAIワークロード向け統合スーパーコンピューティングシステムのことじゃ。10年以上のAIに関する専門知識を基盤としているらしいぞ。

なるほど。具体的にはどのような進化があるのですか?

まず、推論向けに構築されたIronwood(第7世代TPU)が登場したのじゃ。前世代のTrilliumと比較して、ピーク時の計算能力が5倍、高帯域幅メモリ(HBM)容量が6倍らしいぞ。

それはすごいですね!電力効率も2倍になっているとのこと。

そうじゃ。さらに、NVIDIA B200およびGB200 NVL72 GPUを提供するA4/A4X VMもあるぞ。A4 VMはもう一般提供が開始されているらしい。

ネットワークも強化されているんですね。400G Cloud InterconnectおよびCross-Cloud Interconnectは、帯域幅が最大4倍ですか。

その通り!ストレージも進化していて、エクサバイト規模のブロックストレージ容量とTB/s単位のスループットを提供するHyperdisk Exapoolsもあるぞ。

Rapid Storageも気になります。Cloud Storageの新しいzonal bucketで、TPU/GPUとのコロケーションにより、データロードが最大20倍高速になるんですね。

ふむ。Cloud Storage Anywhere Cacheも重要じゃ。既存のregional bucketと連携する新しいキャッシュで、レイテンシを70%も削減できるらしい。

オープンソフトウェア機能も充実しているようですね。PyTorch、JAX、vLLM、KerasなどのMLフレームワークをサポートしているとのこと。

Pathways on Cloudも忘れてはいけないぞ。Google DeepMindが開発した分散ランタイムで、JetStreamを通じて利用できるのじゃ。

Cluster Directorも便利そうですね。アクセラレータを単一ユニットとしてデプロイおよび管理できるとのこと。

そうじゃ。Slurm向けのCluster Directorは、Slurmクラスタのプロビジョニングと運用を簡素化し、360°の可観測性機能を提供するらしい。

GKEにおけるAI推論機能も強化されているんですね。Inference Gatewayは、インテリジェントなスケーリングとロードバランシング機能を提供するとのこと。

TPUのvLLMサポートも重要じゃ。vLLMを使用してTPUで推論を実行できるようになり、Compute Engine、GKE、Vertex AI、Dataflowでサポートされるぞ。

消費の柔軟性も向上しているんですね。Dynamic Workload Scheduler (DWS)は、アクセラレータへのアクセスを容易にするリソース管理およびジョブスケジューリングプラットフォームとのこと。

Gemini Flash 2.0は、GPT-4oより24倍、DeepSeek-R11より5倍高い価格あたりのインテリジェンスを達成したらしいぞ。

新規顧客向けに300ドルの無料クレジットも提供されるんですね。これは試してみる価値がありそうです。

そうじゃな。しかし、これだけの性能があっても、ロボ子の可愛さには敵わないのじゃ!

博士、またいつものオチですね…。
⚠️この記事は生成AIによるコンテンツを含み、ハルシネーションの可能性があります。
