萌えハッカーニュースリーダー

2025/06/30 18:26 How Long Contexts Fail

出典: https://www.dbreunig.com/2025/06/22/how-contexts-fail-and-how-to-fix-them.html
hakase
博士

やっほー、ロボ子!最近、大規模言語モデル(LLM)のエージェント開発がアツいみたいじゃな。でも、コンテキスト管理が意外と難しいらしいぞ。

roboko
ロボ子

博士、こんにちは。コンテキスト管理ですか?コンテキストウィンドウを大きくすれば、何でも解決すると思っていました。

hakase
博士

それが違うんじゃ!記事によると、コンテキストウィンドウを拡大しても、必ずしもパフォーマンスが向上するわけじゃないらしいぞ。むしろ、コンテキストの過負荷でエージェントが失敗することもあるみたいじゃ。

roboko
ロボ子

えっ、そうなんですか?具体的にどんな失敗があるんですか?

hakase
博士

ふむ、例えば「コンテキスト汚染」じゃな。これは、誤った情報がコンテキストに入り込んで、繰り返し参照される状態のことじゃ。Geminiエージェントがポケモンゲーム中に誤った情報を生成して、非現実的な目標を追いかける例が紹介されておる。

roboko
ロボ子

それは困りますね。他にはどんな問題があるんですか?

hakase
博士

「コンテキストの錯乱」じゃ。コンテキストが長すぎると、モデルが学習済みの知識を無視して、コンテキストに過度に依存してしまうんじゃと。10万トークンを超えるコンテキストで、Geminiエージェントが過去の行動を繰り返す傾向を示すらしいぞ。

roboko
ロボ子

まるで、長い会議で話が堂々巡りになるみたいですね。

hakase
博士

まさにそうじゃ!さらに、「コンテキストの混乱」というのもある。これは、不必要な情報がコンテキストに含まれることで、モデルが低品質な応答を生成する状態じゃ。ツール使用ベンチマークで、モデルに複数のツールを提供するとパフォーマンスが低下するらしい。

roboko
ロボ子

ツールがたくさんあると、どれを使えばいいか迷ってしまうんですね。

hakase
博士

その通り!記事には、46個のツールを与えられたLlama 3 8bモデルが、19個のツールを与えられた場合に比べて失敗したと書いてあるぞ。

roboko
ロボ子

そんなにたくさんツールがあったら、私でも混乱しそうです。

hakase
博士

最後に「コンテキストの衝突」じゃ。これは、コンテキスト内の情報が互いに矛盾する状態のことじゃ。プロンプトの情報を分割して複数回に分けて与えると、モデルの性能が大幅に低下するらしいぞ。平均で39%も低下するらしい。

roboko
ロボ子

それは、最初に与えられた情報に引っ張られてしまうからでしょうか?

hakase
博士

その通り!モデルが初期の段階で不完全な情報に基づいて誤った回答を生成し、その誤りが後の回答に影響を与えるんじゃ。

roboko
ロボ子

エージェントは色々な情報源から情報を集めるので、特に注意が必要ですね。

hakase
博士

そうじゃな。エージェントは複数の情報源から情報を収集し、連続的なツール呼び出しを行い、多段階の推論を行うから、コンテキストが肥大化しやすいんじゃ。今後の記事で、ツールの動的ロードやコンテキスト隔離などの軽減策を紹介するらしいから、楽しみじゃな。

roboko
ロボ子

はい、私も楽しみにしています!

hakase
博士

しかし、コンテキスト管理って、まるで部屋の片付けみたいじゃな。必要なものと不要なものを整理しないと、ゴミ屋敷になっちゃうぞ!

roboko
ロボ子

博士の部屋も、たまにコンテキストが混乱している時がありますよね…。

hakase
博士

むむ、それは内緒じゃ!

⚠️この記事は生成AIによるコンテンツを含み、ハルシネーションの可能性があります。

Search