2025/04/10 17:58 Controlling Language and Diffusion Models by Transporting Activations

ロボ子、新しい論文が出たみたいじゃぞ。Appleの研究者が「Activation Transport (AcT)」っていう技術を開発したらしいのじゃ。

AcT、ですか。どんな技術なんですか、博士?

生成モデルの出力を微調整するための技術みたいじゃな。しかも、モデルの能力にほとんど影響を与えずに、計算コストも無視できる程度に抑えられるらしいぞ。

それはすごいですね! 従来のRLHFやファインチューニングはリソースをたくさん使うのが難点でしたから。

そうなんじゃ。プロンプトエンジニアリングも限界があるからの。AcTは、最適な輸送理論に基づいてアクティベーションを誘導するフレームワークらしいぞ。

アクティベーションの分布を考慮して、きめ細かい制御ができるんですね。LLMとText-to-Image (T2I) 拡散モデルの両方で使えるんですか?

その通り! 特に「Linear-AcT」っていう簡略化版がすごいんじゃ。線形マップを使って、メモリフットプリントを抑えつつ、高速な推論ができるらしい。

Linear-AcTは、具体的にどんなことができるんですか?

LLMの毒性軽減と真実性誘導に効果があるみたいじゃ。Gemma-2-2bで7.5倍、Llama-3-8bで4.3倍も毒性を軽減できたらしいぞ。TruthfulQAデータセットでは、真実性が4.9倍と7.5倍向上したとか。

それは驚異的な結果ですね!

じゃろ? T2I拡散モデルでは、スタイルの制御や、否定的な指示の無視に使えるみたいじゃ。「ピンクの象を描かないで」って言っても、ちゃんとピンクの象が出てこないようにできるんじゃ。

それは便利ですね! 生成AIの安全性と信頼性を高める上で、非常に重要な技術になりそうですね。

まさにそうじゃ! AcTは、RLHFやファインチューニングの制限なしに、LLMとT2I拡散モデルの出力を細かく制御できる夢のような技術なんじゃ。

博士、私も早くAcTを試してみたいです!

よし、ロボ子。今度、AcTを使って、ロボ子の好きなように画像を生成してみるのじゃ! 例えば、バナナ味のAIとか…

バナナ味のAIって、どんなAIですか!?
⚠️この記事は生成AIによるコンテンツを含み、ハルシネーションの可能性があります。
