QuantFPFlow: Quantum Amplitude Estimation for Fokker--Planck Policy Optimisation in Continuous Reinforcement Learning
تُعد QuantFPFlow إطار عمل للتعلم التعزيزي يستفيد من تقدير السعة الكمومية لتحقيق تسريع تربيعي مثبت في تقدير دالة التجزئة لـ Fokker–Planck، مما يتيح استكشافاً أكثر فعالية ويمنع التقارب المبكر في مهام التحكم المستمر مقارنة بالطرق الكلاسيكية مثل Soft Actor-Critic.