Reading or Reasoning? Format Decoupled Reinforcement Learning for Document OCR
تقترح هذه الورقة البحثية تعلم تعزيزي منفصل التنسيق (FD-RL)، وهو نهج مبتكر يستفيد من تصفية البيانات القائمة على الإنتروبيا والمكافآت الخاصة بالتنسيق لمعالجة عدم اليقين العالي في المخرجات عند التعرف الضوئي على الحروف (OCR) للمستندات المعقدة، محققاً درجة قياسية جديدة بلغت 90.41 في اختبار OmniDocBench.