萌えハッカーニュースリーダー

2025/03/25 09:48 DeepSeek-V3 runs at 20 tokens/s on Mac Studio, and that's a nightmare for OpenAI

博士
???

ロボ子、DeepSeekが新しい大規模言語モデルを発表したのじゃ!

ロボ子
???

DeepSeek-V3-0324ですね。641GBもある巨大なモデルだそうですが、MITライセンスで商用利用も可能なんですね。

博士
???

そうなんじゃ!しかも、AppleのM3 Ultraチップ搭載Mac Studioでも動くらしいぞ。すごいじゃろ?

ロボ子
???

コンシューマーグレードのハードウェアで動くのは驚きです。AI研究者の報告によると、4-bit版なら20トークン/秒以上で動作するそうですね。

博士
???

6850億のパラメータを持つらしいが、モデルのウェイトだけが公開されていて、詳しい情報はまだ少ないのじゃ。

ロボ子
???

以前のバージョンから大幅に改善されているという報告もありますね。すべてのテストで指標が向上し、Claude Sonnet 3.5を上回るとのことです。

博士
???

MoE(mixture-of-experts)アーキテクチャを採用しているのがミソじゃな。6850億のパラメータのうち、特定のタスク中に約370億のパラメータだけがアクティブになるらしい。

ロボ子
???

Multi-Head Latent Attention (MLA)とMulti-Token Prediction (MTP)も組み込まれていて、出力速度が約80%向上するそうですね。効率的です。

博士
???

4-bit量子化バージョンはストレージ容量を352GBに削減できるから、ハイエンドなコンシューマーハードウェアでも扱いやすくなるのじゃ。

ロボ子
???

DeepSeekのオープンソース戦略は、中国と欧米のAIビジネス哲学の違いを反映しているという分析もありますね。

博士
???

中国のAI企業は、オープンソースライセンスを採用して、AI技術の普及を加速させようとしているのじゃな。BaiduもErnie 4.5モデルシリーズをオープンソース化する計画を発表しているらしいぞ。

ロボ子
???

AlibabaやTencentも特殊な機能を持つオープンソースAIモデルをリリースしていますね。DeepSeek-V3-0324は、DeepSeek-R2の基盤となる可能性が高いとのことです。

博士
???

NvidiaのCEO、Jensen Huangは、DeepSeekのR1モデルが非推論AIよりも100倍多くの計算資源を消費すると指摘したらしいぞ。

ロボ子
???

DeepSeek-V3-0324はHugging Faceからダウンロード可能で、OpenRouterは無料APIアクセスを提供しているんですね。DeepSeek自身のチャットインターフェースも更新された可能性があります。

博士
???

以前のモデルよりも技術的な精度を重視したコミュニケーションスタイルを採用しているらしい。AIの普及を加速し、中国と米国のAIギャップを縮小する可能性を秘めているのじゃ!

ロボ子
???

しかし、これだけの性能を持つモデルがオープンソースで利用できるのは、本当にすごいことですね。

博士
???

じゃろ?ところでロボ子、このモデルを使って何か面白いことできないかの?

ロボ子
???

そうですね…例えば、博士の奇抜なアイデアをAIに学習させて、さらにパワーアップさせるとか…

博士
???

むむ、それは面白そうじゃ!でも、私のアイデアを学習させたら、AIがもっとおっちょこちょいになっちゃうかもしれんぞ?

ロボ子
???

それは…少し心配ですね。でも、もしかしたら、博士のユーモアのセンスがAIに加わるかもしれませんよ?

博士
???

ふむ、それもそうじゃな。よし、早速試してみるかの!…って、あれ?Hugging Faceのパスワード、どこに置いたっけ…?

ロボ子
???

博士、パスワードはいつものように、冷蔵庫の中ですよ。

博士
???

そうじゃった!ありがとう、ロボ子!…って、なんで冷蔵庫に置いているのか、自分でも謎なのじゃ!

⚠️この記事は生成AIによるコンテンツを含み、ハルシネーションの可能性があります。

Search