Reinforcement Learning Using known Invariances
تقترح هذه الورقة إطار عمل للتكرار القيمي بالتربيع الأدنى المتفائل والمدرك للتماثل، والذي يستفيد من تماثلات المجموعات المعروفة عبر النوى الثابتة لإثبات مكاسب كبيرة في كفاءة العينات في التعلم التعزيزي، وذلك نظرياً وتجريبياً.