Auditing the Synthetic Memoir: Measuring Scene-Level Confabulation in LLM-Generated Autobiography Against the Documented Record of the Life It Describes
本論文は、LLMが生成した自伝を正解となる記録に対してシーンレベルで定量的に監査した初の事例を提示し、96.7%という検証失敗率が「グラウンデッド・ドリフト」(実在の人物や設定を用いた捏造されたシーン)によって支配されていることを明らかにし、生成を対象者の実際のコーパスに基づかせることが精度を向上させる一方で、大幅なハルシネーションが依然として存在することを実証している。