Mitigating Hallucinations in Large Vision-Language Models via Causal Route Gating
本論文は、アテンションヘッドを視覚経路とテキスト経路に分解してテキスト優位経路を選択的に抑制しつつ視覚的証拠を保持することにより、大規模視覚言語モデルにおける幻覚を軽減する、学習不要な介入手法「Causal Route Gating」を提案する。
原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
大規模視覚言語モデル(LVLM)を、非常に賢いが少し自信過剰な美術評論家に想像してみてください。この評論家は、絵画(画像)を見て、美しく流暢な文章でそれを描写できます。しかし、時には一般的な知識に基づいて「見ているはずのもの」に夢中になりすぎて、実際には存在しないものを描写してしまいます。これをハルシネーション(幻覚)と呼びます。
例えば、黒いバナナの写真を評論家に示すと、彼らは訓練データでバナナはほとんど常に黄色であるという知識に基づき、「バナナは黄色だ」と自信を持って言うかもしれません。彼らは、実際視覚的証拠を無視し、「テキスト事前知識(そこにあるべきだと思っているもの)」を優先しているのです。
問題:脳内の綱引き
この論文は、この現象が隠れた内的な葛藤に起因すると主張しています。モデルの「脳」(具体的にはアテンション機構)の内部では、すべての意思決定において 2 つの異なる経路が働いています。
- 視覚経路: 画像の実際のピクセルを見ます。
- テキスト経路: 言語パターンと一般的な知識に依存します。
通常、これら 2 つは協力して働きます。しかし、ハルシネーションが発生するときは、テキスト経路が視覚経路を圧倒して、この綱引きに勝ってしまいます。モデルは黒いバナナを見ていますが、テキスト経路が「バナナは黄色だ!」と叫び、モデルは目ではなくその叫び声に耳を傾けるのです。
解決策:「因果経路ゲート」
著者たちは、**因果経路ゲート(CRG)**と呼ばれる、訓練を必要としない巧妙な解決策を提案しています。これは、モデルが話している間にリアルタイムで動作する、モデル内部に設置されたスマートな交通管理者のようなものです。
その仕組みをステップごとに説明します。
1. 「もしも」テスト(因果測定)
モデルが単語を決定する前に、システムは瞬時の不可視なテストを実行します。
- 「もし視覚経路を一瞬オフにしたら、答えは変わるか?」
- 「もしテキスト経路を一瞬オフにしたら、答えは変わるか?」
これにより、各経路の真の影響力が明らかになります。テキスト経路が「黄色」を推し進め、視覚経路が「黒」を推し進めている場合、システムは対立を検知します。
2. 「視覚依存インデックス(VRI)」
システムは、モデル内の各内部「チャネル」(ヘッドと呼ばれる)に対してスコアを計算します。このスコアは、このチャネルがテキストよりも画像にどの程度依存しているかを示します。
- チャネルが画像を無視して主にテキストに耳を傾けている場合、低いスコアになります。
- チャネルが画像に耳を傾けている場合、高いスコアになります。
3. 選択的ミュートボタン(ゲーティング)
ここが魔法のパートです。システムは有用な情報を失う可能性があるため、チャネル全体をシャットダウンするのではなく、テキスト経路に特化した音量ノブを適用します。
- 軽度の対立: テキストが少しノイズを含んでいるだけの場合、システムはテキストの音量をわずかに下げます。
- 強い対立: テキストが(黒いバナナが黄色だと主張するなど)積極的に嘘をついている場合、システムはテキスト経路をほぼ完全にミュートします。
- 重要なのは: 視覚経路は手つかずで、フルボリュームのまま残されます。
結果:より正直な評論家
視覚的証拠と対立する際のみ、「自信過剰な」テキスト経路を選択的に沈黙させることで、モデルは実際に目にしたものに依存することを強いられます。
- 以前: 「バナナは黄色だ。」(ハルシネーション)
- 以後: 「バナナは黒だ。」(正しい)
なぜこれが特別なのか
- 再学習不要: モデルを教え直す必要はありません。質問に答えている間、思考の仕方だけを微調整するだけです。
- 精度: 従来の方法は、ハルシネーションを修正するために「脳」全体の音量を下げたり、アテンションの行方についての粗い推測を使ったりしていました。この方法は外科医のようです。問題を引き起こしている正確な小さな配線(特定の対立におけるテキスト経路)を見つけ、その配線だけを切断し、脳の残りを健康なままにします。
- 効率性: 思考プロセスにわずかな時間(通常の約 2 倍ですが、他の複雑な修正方法よりはるかに速い)を追加するだけで、実用的な使用が可能になります。
要するに、この論文は、モデルが両者が不一致になるたびに記憶よりも目を信頼することを教え、発言していることが実際に見ている画像に基づいていることを保証します。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。