: Unified Chain of Perception-Prediction-Planning Thought via Reinforcement Fine-Tuning
تقدم هذه الورقة البحثية **AutoDrive-P³**، وهو إطار عمل مبتكر يوحد الإدراك والتنبؤ والتخطيط في عملية سلسلة واحدة من تسلسل الأفكوابالاعتماد على مجموعة بيانات متخصصة وتعلم تعزيزي هرمي، محققاً أداءً هو الأفضل في فئته في مجال القيادة الذاتية من خلال ضمان اتخاذ قرارات تآزرية والموازنة بين كفاءة الاستنتاج وأنماط التفكير المزدوجة.