FullFlow: Upgrading Text-to-Image Flow Matching Models for Bidirectional Vision--Language Generation
تُعد FullFlow طريقةً فعالةً من حيث الكفاءة في المعلمات، حيث تعمل على ترقية نماذج توليد الصور من النصوص القائمة على التدفق المستقيمي (rectified-flow) والمُدربة مسبقاً إلى مولدات ثنائية الاتجاه للرؤية واللغة عبر تدريب محولات خفيفة الوزن فقط، محققةً أداءً رائدًا في كل من توليد الصور والنصوص مع تقليل التكاليف الحسابية بشكل كبير مقارنةً بالأساليب الحالية.