On Pareto Optimality for Parametric Choice Bandits
تتقصى هذه الورقة المقايضة بين تعظيم الإيرادات التراكمية وتقليل خطأ استدلال الإيرادات البعدي في تحسين تشكيلة المنتجات المعلمي، حيث تضع استراتيجية استكشاف مثلى من نوع باريتو توازن بين هذين الهدفين المتنافسين.