Adaptive Pluralistic Alignment: A pipeline for dynamic artificial democracy
本論文は、コンパクトなパーソナライズド報酬モデルを学習し、社会選択理論に基づく投票を採用することで、コストのかかる再学習を必要とせずに価値の固定化(バリュー・ロックイン)を回避しつつ、進化する社会価値を追跡するためにAIシステムを更新する、モジュール式で効率的なパイプラインである適応的多元的整列(Adaptive Pluralistic Alignment: APA)を導入するものである。