Generative Gap Filling
本論文は、大規模言語モデルが残されたテキストからマスクされた未記載の条項を正確に再構成できることを示すことにより、契約書には紛争を解決するには情報が少なすぎるという法的仮定に異議を唱え、裁判所は契約上の空白を埋めるための争い得る証拠として、こうしたモデルによる予測を扱うべきであることを示唆している。
原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
契約書とは、人々が互いに交わした約束を記録した文書である。二当事者が合意書に署名する際、彼らは取引の詳細をあらゆる角度から書き留めようとする。それは、もし何らかの問題が発生した場合でも、裁判官がその書類を見て、何が合意されたのかを正確に把握できるようにするためである。しかし、人生は複雑であり、弁護士がいかに注意深くこれらの文書を起草したとしても、しばしば書き漏らしが生じる。作成者が想像もしなかった特定の出来事が起こったり、極めて重要な詳細が忘れられたりすることがあるのだ。書かれていない事項について紛争が生じたとき、法学ではこれを「ギャップ(空白)」と呼ぶ。長い間、法学者は、契約書の言葉が尽きると、その文書は有用性を失うと考えてきた。もし裁判官が欠落した部分を埋めなければならない場合、テキスト自体には手がかりが一切ないため、裁判官は自身の公平感やビジネスにおいて通常行われていることに頼って、一種の推測を行っているに過ぎない、と考えられてきたのである。
この仮定は、数十年にわたり裁判所による契約紛争の処理方法を形作ってきた。支配的な見解は、テキストが沈黙したとき、裁判官は一般的な規則や個人的な政策に基づいて解決策を考案しなければならないというものである。しかし、この考えは一つの推測に基づいている。すなわち、残されたテキストは、欠落した部分がどのようなものであるかについて、ほとんど情報を提供しないという推測である。もしその推測が間違っているならば、裁判官によるこれらのケースへの考え方そのものを変える必要があるかもしれない。問題は、実際に「書かれている」言葉が、「書かれていない」言葉がどのようなものであったかを、本当に伝えることができるのかどうか、ということである。
二人の法学者が、コンピュータサイエンスの手法を応用して、このアイデアを検証することにした。彼らは、実際に当事者が交渉し合意した特定の条項を隠した、実在の署名済み契約書を用いた。そして、異なるグループの人々やコンピュータに対し、その隠された部分を推測するために、文書の残りの部分を読ませた。研究者たちは、元の契約書を保持しているため、答えを知っていた。この設定により、周囲のテキストを見るだけで、欠落した情報を真に復元できるのかどうかを確認することが可能となった。
結果は驚くべきものだった。法的な訓練を受けていない一般の人々が欠落した条件を推測しようとしたとき、正解率は約5割であった。これは、純粋な偶然で当たる確率の2倍にあたる。法学生や実務家といった法的訓練を受けた人々は、わずかに成績が良く、正解率は6割近くに達した。しかし、最も衝撃的な結果は人工知能からもたらされた。膨大な量のテキストで学習したコンピュータプログラムである大規模言語モデルに同じ課題を与えたところ、彼らは隠された条件を9割近い精度で正しく復元したのである。
研究者たちは、アーティスト、弁護士、製造業者などの様々な種類の契約書を用いてこのテストを行った。ほとんどすべてのケースにおいて、コンピュータモデルは人間を上回る成績を収めた。モデルは、取引の構造、言及されている価格、割り当てられたリスク、および他の条項を分析し、それらの情報を用いて、欠落した部分を高い精度で再構成することができた。これは、契約書が単なる孤立した文章の集まりではないことを示唆している。むしろ、契約の各部分は深く結びついており、たとえ伝送の一部が失われたとしても、メッセージの大部分が伝わるラジオ信号のようなものである。存在するテキストは、欠落しているテキストについての情報を運んでいるのである。
この発見は、契約が不完全なとき、裁判官は自身の好みに頼るほかに何も残されていないという古い信念に異を唱えるものである。この研究は、当事者が合意していなかったとしても、文書自体が当事者の意図を理解するための十分な証拠を含んでいることが多いことを示している。著者らは、これによって、当事者が真に合意しておらず、テキストも手がかりを与えないような「真のギャップ」は、これまで考えられていたよりもはるかに稀であると主張している。多くの場合、答えはすでにそこにある言葉の中に隠されており、ただ見つけられるのを待っているのである。
研究者たちはまた、この発見が法制度をどのように変え得るかについても探究した。彼らは、裁判所が現在辞書や専門家証人を使用しているのと同様に、これらのコンピュータモデルをツールとして利用できる可能性を示唆している。弁護士は、欠落した用語がどのようなものであるかを予測するようモデルに依頼でき、相手方も同様のことができる。そして裁判官は、これらの予測を他のいかなる情報と同様に、証拠として検討することができる。これを公正に行うために、著者らは、契約書の中に「モデル選択条項」を含めることを提案している。これは、もし欠落した用語に関する紛争が生じた場合、特定のコンピュータプログラムを使用して解決を図るべきであると定める単純な一文である。これにより、契約法に新たなレベルの精密さがもたらされ、裁判官の推測を減らし、当事者が実際に意図した通りの取引を実現する助けとなるだろう。
しかし、本研究は、この手法の限界についても指摘している。コンピュータモデルは、契約が標準的なパターンに従っている場合に最も効果を発揮する。取引が非常に独特である場合や、当事者が合意に至らなかったために意図的に空白を残した場合、モデルの精度は低下するものの、依然として人間よりは優れている。また、将来的に契約がすべてコンピュータによって作成されるようになれば、この手法の根幹そのものが変化する可能性があるとも研究者は警告している。なぜなら、当事者の「意図」がもはや人間の決定ではなくなるからである。しかし現時点では、膨大な数の人間が作成した契約書が依然として存在していることから、本研究は、テキストそのものが、誰もが気づいていなかったよりもはるかに豊かな真実の源泉であることを示唆している。欠落した断片は、しばしばそこにあり、ただ読み解かれるのを待っているのである。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。