← 最新の論文
🤖 machine learning

CORVUS: Context Optimization and Reduction Via Underlying Synchronization for LLM Coding Agents

CORVUSは、現在のファイル内容を同期されたレジストリとして保持することで、ファイルの読み取りアクションとその観測を分離し、それによって古いスナップショットや冗長な再読み取りを排除することで、性能を維持しながらトークン使用量と推論サイクルを大幅に削減する、LLMコーディングエージェントのための新しい軌跡アーキテクチャを導入します。

原著者: Mingwei Zheng, David OBrien, Siwei Cui, Pardis Pashakhanloo, Rajdeep Mukherjee, Myeongsoo Kim, Sachit Kuhar

公開日 2026-07-28
📖 1 分で読めます☕ さくっと読める

原著者: Mingwei Zheng, David OBrien, Siwei Cui, Pardis Pashakhanloo, Rajdeep Mukherjee, Myeongsoo Kim, Sachit Kuhar

原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む

想像してみてください。あなたの言葉に合わせてコードを書き、バグを修正し、対話だけでソフトウェア全体を構築できる、超スマートなロボットアシスタントがいる世界を。これはサイエンス・フィクションではありません。「LLMコーディングエージェント」の現実です。これらは、問題を考え、ファイルを確認し、変更を加え、自らの作業をチェックするという、ジュニアデベロッパーのような動きをする人工知能モデルです。しかし、ここには落とし穴があります。これらのロボットには、非常に深刻な短期記憶の問題があるのです。自分が何をしたかを覚えておくために、彼らはあらゆる思考、行動、結果を「日記」として記録し続けます。仕事が複雑になればなるなるほど、この日記は膨大になります。やがて日記があまりに巨大になりすぎると、ロボットは混乱し、最も重要な詳細を忘れ、わずか5分前に何をしたかを思い出すためだけに500ページの書物を読まなければならない状況になり、愚かなミスを犯し始めます。このように、情報が多すぎることがAIを「バカ」にしてしまう現象を「コンテキスト・ロット(文脈の腐敗)」と呼びます。

ここで、この記憶の混乱を解決するために設計された賢明な新システム、CORVUSが登場します。CORVUSは、ロボットの日記が制御不能に膨れ上がり、古くて使い物にならないメモで溢れるのを放置しません。CORVUSは、コードは常に変化するものであることを理解しています。もしロボットがファイルを読み、次にそれを編集し、再び読み込んだとしたら、日記にある古いメモはただのゴミです。CORVUSは、ロボットがその都度ファイルの内容を書き込むのを阻止します。その代わりに、ロボットが必要とするファイルの「同期リスト」を保持します。ロボットが新しい決定を下す前に、CORVUSは静かに実際のコンピュータファイルを確認し、最新のバージョンを取得して、それをロボットに手渡します。こうすることで、ロボットは重複した古いページで膨れ上がった日記を持つことなく、常に新鮮でクリーンな情報を手に入れることができます。その結果、ロボットはより速く、より低コストで動作し、ミスも少なくなり、記憶を軽量かつ集中した状態に保つことができるのです。

問題点: 「スタール・スナップショット(鮮度の落ちたスナップショット)」の罠

CORVUSがいかに画期的であるかを理解するために、まずこれらのコーディングエージェントが通常どのように機能しているかを見る必要があります。想像してみてください。あなたは蛇口の漏れを修理しようとしていますが、目隠しをした状態で作業しており、以前に撮った一連の写真を通してしか部屋の様子が見えない状況です。

従来の方法では、エージェント(私たちのロボット)がファイルを見るたびに、そのファイルの「スナップショット」を撮り、それを履歴ログに貼り付けます。もしその後、ファイルが変更された場合(ロボットが編集したか、あるいは人間の開発者が修正を加えた場合)、ログ内の古いスナップショットはそのまま残ります。それは**「スタール(鮮度が落ちた)」**状態になります。

論文の著者たちは、これが2つの大きな悩みを引き起こすことを発見しました。

  1. 重複読み込み: 古いスナップショットが長い履歴の奥深くに埋もれているため、ロボットはすでにそのファイルを見たことを忘れてしまうことがよくあります。そして、再びファイルを読み込み、別のスナップショットを撮って、それを貼り付けます。これは、場所を見失ったために本の同じページを5回も読み返しているようなものです。テストの結果、ロボットがすでに見たファイルを再読していた割合は**26%**に達しました。
  2. スタール・コンテキスト・エラー: さらに悪いことに、ロボットは古いスナップショットに基づいてファイルを編集しようとすることがあります。例えば、ロボットが「10行目:ライトを点ける」というコードを見ているとします。しかし現実の世界では、その行は5分前に削除されていました。ロボットは「10行目」を編集しようとして失敗し、混乱し、何が間違っていたのかを理解するために余計な時間とエネルギーを費やすことになります。

従来の方法による修正は「リアクティブ(反応的)」でした。それは、バックパックが重すぎて持ち上げられなくなるまで石を詰め込み続け、それからようやく石を捨てようとするようなものです。論文は、これでは遅すぎると主張しています。真の解決策は、そもそもバックパックに石を入れないことです。

解決策: 「リビング・シンク(生きた同期)」

著者らは CORVUS(Context Optimization and Reduction Via Underlying Synchronization)を提案しています。CORVUSを日記ではなく、**「ライブフィード」**と考えてください。

ファイルのコンテンツを履歴ログに貼り付ける代わりに、CORVUSは sync_file と呼ばれる特別なツールを使用します。ロボットが「speech_recognition.py を見る必要がある」と言ったとき、CORVUSはログにテキストをコピーするのではなく、「同期:speech_recognition.py」という非常に軽量なメモを置きます。

舞台裏では、CORVUSは Synced File Set(同期ファイルセット) を維持しています。これは、ロボットが現在作業しているファイルの特別なリストです。ロボットが新しい決定を下す直前(すべての推論サイクルごと)に、CORVUSは素早い「コンテキスト・シンク(文脈同期)」を実行します。CORVUSは実際のコンピュータへ行き、そのリストにあるすべてのファイルの現在、最新のバージョンを取得し、それをロボットのプロンプトに注入します。

これにより、すべてが変わります:

  • 重複なし: ロボットは同じファイルの異なるバージョンを見ることはありません。常に唯一の、現在のバージョンだけを見ることになります。
  • スタールデータの排除: もしファイルが変更されても、次にロボットが考えるときには、自動的に新しいバージョンが提供されます。存在しないコードを編集しようとして混乱することはありません。
  • 軽量化: 履歴ログにはロボットの思考と行動のみが含まれるため、ファイルテキストの巨大なブロックを含まず、非常に軽量に保たれます。

実証された成果: より速く、より安く、より賢く

研究者たちは、2つの困難なコーディング課題、SWE-POLYBENCH_VERIFIED(Java、JavaScript、TypeScriptのタスクを含む)と SWE-BENCH PRO(複雑なエンタープライズレベルの問題を特徴とする)を用いてCORVUSをテストしました。彼らは CLAUDE SONNET 4QWEN3-CODER-480B を含む4つの強力なAIモデルでこれらのテストを実施しました。

結果は素晴らしく、コンテキストを新鮮に保つことがAIの効率を大幅に向上させることを示しました。

  • 無駄な読み込みの削減: CORVUSは、重複したファイル読み込みを**22%から86%**削減しました。ロボットはすでに知っているファイルを再読するという時間の無駄を止めました。
  • ステップ数の減少: ロボットが古いデータによって混乱することがなくなったため、タスクをより速く完了できました。推論サイクル(ステップ)の数は15%から37%減少しました。例えば、あるモデルでは、平均45.03ステップから28.22ステップへと減少しました。
  • プロンプトの短縮: 最終的な「プロンプト」(タスクを完了させるためにAIに送られるメッセージ)は、15%から32%短くなりました
  • コスト削減: AIは処理するテキスト量に基づいてコストが発生するため、これらの節約は大きな意味を持ちます。一部のタスクでは、コストが最大50.28%低下しました。例えば、5.27ドルかかっていたタスクが2.62ドルに下がりました。
  • スピード: 全体のプロセスは、総時間において最大40%速く完了しました。

極めて重要な点として、論文は、読むテキストが少なくなってもロボットが「バカ」になったわけではないと述べています。成功率(バグを正しく修正できた割合)は、従来の方法と同等であり、場合によってはわずかに向上さえしました。

大きな展望

著者らは、CORVUSが乱れた履歴をクリーンアップしようとする他の手法と併用できるかどうかも確認しました。その結果、CORVUSとこれらの「リアクティブ(反応的)」なクリーンアップツールは最高の相棒であることが分かりました。CORVUSは問題の発生源(上流)で混乱を防ぎ、他のツールは残ったものを掃除(下流)します。これらを併用することで、さらに多くのトークンと費用を節約できます。

要約すると、CORVUSは、AIコーディングエージェントが真に効率的であるためには、単に過去を覚えるのが上手いだけでなく、現在とつながり続けることが重要であることを示唆しています。ファイルの「読み込み」という行為と「ファイルの内容」を切り離し、代わりにコードベースとのライブ同期を維持することで、より速く、より安く、そして「コンテキスト・ロット(文脈の腐敗)」による混乱に陥りにくいエージェントを構築できるのです。この論文は、CORVUSがAIのあらゆる問題を解決すると主張しているわけではありませんが、静的な日記をライブフィードに置き換えるという単純な構造的変更が、デジタルアシスタントの性能にいかに劇的な違いをもたらすかを示しています。

自分の分野の論文に埋もれていませんか?

研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。

Digest を試す →