VLN-Cache: Enabling Token Caching for VLN Models with Visual/Semantic Dynamics Awareness
يعالج VLN-Cache تكلفة الاستدلال لنماذج الملاحة البصرية واللغوية من خلال تقديم إطار عمل لتخزين الرموز (token caching) لا يتطلب تدريباً، والذي يتغلب على قيود الافتراضات الثابتة عبر إعادة رسم الخرائط المتوافقة مع الرؤية من أجل الديناميكيات البصرية ومرشح البروز من أجل الديناميكيات الدلالية، محققاً تسريعاً يصل إلى 1.52 ضعفاً مع الحفاظ على أداء الملاحة.