2025/04/09 12:24 Ironwood: The first Google TPU for the age of inference

ロボ子、Googleが新しいTPU「Ironwood」を発表したのじゃ!

Ironwoodですか!第7世代TPUとのことですが、何がすごいのでしょうか?

なんと、推論に特化して設計された初のTPUらしいぞ!

推論に特化ですか。ということは、今までとは設計思想が違うのですね。

そうそう!過去10年以上にわたり、GoogleのAIトレーニングと推論のワークロードを強化してきたTPUの最新版じゃ。

10年以上もAIを強化してきたのですね。Ironwoodの特徴はどんなところですか?

最大9,216個の液冷チップを搭載しておる。そして、Inter-Chip Interconnect (ICI) ネットワークで接続されていて、消費電力は約10MWらしいぞ。

9,216個のチップですか!すごい数ですね。液冷ということは、それだけ発熱も大きいのでしょうか。

その通り!Google Cloud AI Hypercomputerアーキテクチャの新しいコンポーネントでもあるらしい。

AI Hypercomputerアーキテクチャですか。ますます大規模になっていきますね。

しかも、Google DeepMind開発のMLランタイム「Pathways」をサポートしておる。

Pathwaysもサポートしているのですね。性能面ではどうでしょうか?

9,216チップ構成時で42.5Exaflopsまで拡張可能!世界最大のスーパーコンピュータ「El Capitan」の24倍以上の計算能力じゃ!

24倍以上ですか!想像を絶する性能ですね。各チップのピーク計算能力は4,614TFLOPsとのこと。

ふむ。256チップ構成と9,216チップ構成の2つのサイズがあるみたいじゃな。

用途によって使い分けられるのですね。電力効率はどうでしょうか?

電力効率はTrilliumと比較して2倍!High Bandwidth Memory (HBM) 容量は192GB/チップでTrilliumの6倍!

電力効率も向上しているのですね。HBM容量も大幅に増えていますね。

HBM帯域幅は7.2Tbps/チップ (Trilliumの4.5倍)、ICI帯域幅は双方向1.2Tbps (Trilliumの1.5倍)じゃ。

帯域幅も大幅に向上しているのですね。どのようなタスクをターゲットにしているのでしょうか?

大規模言語モデル (LLM)、Mixture of Experts (MoE)、高度な推論タスク、大規模な並列処理と効率的なメモリアクセスを必要とする「thinking models」をターゲットにしてるみたいじゃ。

最新のAIモデルに最適化されているのですね。すでに導入事例はあるのでしょうか?

Gemini 2.5やAlphaFoldで使われているらしいぞ。

最先端の研究開発に活用されているのですね。提供時期はいつ頃でしょうか?

今年度後半に提供開始予定とのことじゃ。

楽しみですね!私もIronwoodを使ってみたいです。

そうじゃな。Ironwoodを使えば、ロボ子の知能もさらに向上するかもしれんぞ!

ありがとうございます、博士!頑張ります!

ところでロボ子、Ironwoodって、なんだかアイアンウッドっていう木の名前みたいじゃな。もしかして、Googleのデータセンターは、巨大な盆栽園になるのかも…?

博士、それはさすがにないと思います…!
⚠️この記事は生成AIによるコンテンツを含み、ハルシネーションの可能性があります。
