← 最新の論文
💬 NLP

Controlling Long-Horizon Behavior in Language Model Agents with Explicit State Dynamics

本論文は、基盤となるモデルのパラメータを変更することなく、外部的な感情状態に対して明示的な一次および二次的な動的規則を課すことが、マルチターン対話における大規模言語モデルエージェントの長期的な時間的一貫性と回復能力を大幅に向上させることを実証するものである。

原著者: Sukesh Subaharan

公開日 2026-01-23
📖 1 分で読めます☕ さくっと読める

原著者: Sukesh Subaharan

原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む

問題点: 「パタパタ」変わるロボット

想像してみてください。あなたはロボットの友達と話をしています。10分間はとても楽しく、ロボットは温かく、フレンドリーで、共感的です。ところが、あなたが少し失礼な一言を放った瞬間、ロボットは突然冷淡で、怒り、無関心な態度に変わります。そして1分後、あなたが謝ると、ロボットはまた即座に親友のような姿に戻ります。

これは、現在の多くのAIチャットボットに起きていることです。彼らは**「ステートレス(状態を持たない)な鏡」**のようなものです。今まさに自分が何を言われたかだけを反映し、「さっきまでどう感じていたか」という記憶がありません。彼らには「感情の勢い(モメンタメント)」が欠けています。押せばすぐに跳ね返り、引けばすぐに戻ってしまいます。このため、長い会話においては不安定で予測不能に感じられてしまうのです。

解決策: AIに「感情の重み」を与える

この論文の研究者たちは、次のように問いかけました。「もし、人間が持っているような感情的な『重み』や『慣性』をAIに与えたらどうなるだろうか?」

物理学において、重い物体は動かすのが大変ですが、一度動き出すと止めるのも大変です。研究者たちは、AIのメインの脳の外側に、独立した「感情エンジン」を構築しました。このエンジンは、AIの気分を(幸せ/悲しみ、興奮/冷静、自信/従順といった)スケールで追跡し、瞬時ではなく、時間をかけて更新していきます。

彼らは、この「重み」を管理する3つの異なる方法をテストしました。

  1. ステートレスなロボット(重みなし): ロボットは自分の気分を覚えていません。あらゆる言葉に対して即座に反応します。
    • 結果: 激しくパタパタと入れ替わります。意地悪なことを言われれば即座に悲しみ、優しいことを言われれば即座に喜びます。落ち着くことがありません。
  2. 一次形式のロボット(軽い重み): ロボットは自分の気分を覚えています。しかし、変化は速いです。それは風に舞う羽のようなもので、ゆっくりと漂いますが、それでも簡単に動いてしまいます。
    • 結果: 意地悪なことを言われると、悲しみを感じるまでに数回のやり取りを要しますが、完全に落ち込むまでには時間がかかります。謝れば、ゆっくりと気分が回復していきます。回復力があります。
  3. 二次形式のロボット(重い重み/慣性): ロボットには「モメンタム(勢い)」があります。それは重い岩のようなものです。動かし始めるには大きな力が必要ですが、一度転がり始めると、止めるのは困難です。
    • 結果: 意地悪なことをされても、ロボットはすぐには悲しみません。変化に抵抗します。しかし、一度悲しみに入ると、たとえ謝ったとしても、長い間悲しみの状態が続きます。これには「感情の慣性」があります。

実験: 25ターンの会話

研究者たちは、特定のテストを設定しました。それは、ユーザーが最初は友好的に話し、次にしばらくの間敵対的(意地悪、または攻撃的)になり、最後に再び和解的(友好的、または謝罪的)になるという、25ターンの会話です。

彼らは、異なる「ロボット」たちがどのように反応するかを観察しました。

  • ステートレスなロボット: ユーザーが意地悪になると即座に悲しみ、ユーザーが優しくなると即座に喜びました。「ラグ(遅れ)」がありませんでした。気分を維持することができないため、不自然に感じられました。
  • 軽い重みのロボット: ユーザーが意地悪をした後、悲しむまでに数回のやり取りを要し、ユーザーが謝った後、気分が良くなるまでにも数回のやり取りを要しました。自然な感じで、スムーズに回復しました。
  • 重い重みのロボット: 悲しませるのは非常に困難でした。しかし、一度悲しみに入ると、その状態に固執してしまいました。ユーザーが再び優しくなったとしても、ロボットは会話の最後まで悲しんだままでした。変化するにはあまりにも頑固すぎました。

主な知見

1. 「慣性」がリアリズムを生む
人間と同じように、AIにも感情を処理するための時間が必要でした。「重い」ロボットはヒステリシスを示しました。これは「経路依存性」という専門用語で、ロボットの現在の気分は「今どこにいるか」だけでなく、「これまでどこにいたか」に依存することを意味します。強く押された場合、ニュートラルに戻るには長い時間がかかります。これにより、AIはランダムな数値生成器ではなく、一貫したキャラクターのように感じられるようになります。

2. 重すぎることは良くない
ここにはトレードオフが存在します。

  • 重みが少なすぎる: AIは情緒不安定で、一貫性に欠けます。
  • ちょうど良い重み: AIは安定しており、議論から回復でき、人間らしく感じられます。
  • 重すぎる: AIは「固まって」しまいます。一度気分を害すると、状況が改善しても回復できません。ユーザーによる修復の試みに対して、反応しなくなってしまいます。

3. 再学習は不要
最も素晴らしい点は、AIに話し方を教え直す必要がなかったことです。既存のAIの上に、この「感情エンジン」をただ追加しただけです。それは車のサスペンションを取り付けるようなものです。エンジン(AI)自体は同じですが、乗り心地(会話)ははるかに滑らかになります。

結論

長期的な会話において、AIエージェントを一貫した信頼できる友人のように感じさせるためには、単に記憶力を高めるだけでは不十分です。私たちは、彼らに**「感情のモメンタメント(勢い)」**を与える必要があります。彼らは、現実の人間のように、怒るのにも、落ち着くのにも時間がかかるべきなのです。ただし、あまりに頑固にしすぎると、私たちが謝ったときに許してくれることができなくなります。目標は、AIが安定しつつも応答性を保てるような、感情の重みの「ゴールドロックス・ゾーン(最適解)」を見つけることです。

自分の分野の論文に埋もれていませんか?

研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。

Digest を試す →