Extensions of Robbins-Siegmund Theorem with Applications in Reinforcement Learning
توسع هذه الورقة نظرية "روبنز-سيجموند" للتعامل مع شبه المارتينجالات ذات الحدود من الدرجة صفر القابلة للجمع التربيعي (بدلاً من القابلة للجمع) بموجب فرضية طفيفة جديدة، مما يؤدي إلى إرساء معدلات تقارب وحدود تركيز جديدة تحقق أول ضمانات للتقارب شبه المؤكد لتعلم مع التقريب الدالي الخطي.