Learning to crawl: Benefits and limits of centralized vs distributed control
تقدم هذه الورقة نموذجاً لزاحف متصل بنوابض باستخدام تعلم كيو الجدولي (tabular Q-learning) لتوضيح أنه في حين يوفر التحكم المركزي سرعة ومتانة فائقتين من خلال الاستفادة من الارتباطات طويلة المدى، فإن البنى الهرمية المتوسطة توفر مقايضة مثالية بين الأداء والتكلفة الحسابية مقارنة بالنهجين الموزع الصرف أو المركزي الكامل.