PaddleOCR-VL-1.5: Towards a Multi-Task 0.9B VLM for Robust In-the-Wild Document Parsing
يُعد PaddleOCR-VL-1.5 نموذجاً لغوياً بصرياً مطوراً فائق الصغر بحجم 0.9 مليار معلمة، يحقق أداءً هو الأفضل في مجاله في مهام تحليل المستندات، بما في ذلك المتانة ضد التشوهات الفيزيائية الواقعية والقدرات الجديدة مثل التعرف على الأختام وتحديد مواقع النصوص.