GCImOpt: Learning efficient goal-conditioned policies by imitating optimal trajectories
يُعد GCImOpt إطار عمل فعال حاسوبياً يتعلم سياسات مشروطة بالهدف، صغيرة، وعالية السرعة، وشبه مثالية، من خلال تدريب الشبكات العصبية على مجموعات بيانات عالية الجودة يتم إنشاؤها عبر تحسين المسار وتعزيز البيانات.