Value Functions for Temporal Logic: Optimal Policies and Safety Filters
تتناول هذه الورقة البحثية محدودية التعظيم الجشع لدالة Q في مهام المنطق الزمني ذات الأفق اللانهائي غير المخصوم عبر بناء سياسات غير ماركوفية تعتمد على تاريخ الحالة لضمان المثالية للمواصفات المتداخلة، وتوضيح كيف يمكن لدوال Q أن تعمل كمرشحات سلامة لمتطلبات المنطق الزمني المعقدة.