MRT: Masked Region Transformer for Layered Image Generation and Editing at Scale
تقدم هذه الورقة نموذج MRT، وهو نموذج انتشار مناطق مقنع (masked region diffusion model) بـ 20 مليار معلمة تم تدريبه على 10 ملايين عينة ليوحد مهام تحويل النص إلى طبقات، والصورة إلى طبقات، والطبقات إلى طبقات، لتحقيق توليد وتحرير صور شفافة متعددة الطبقات في الوقت الفعلي وبأفضل حالة ممكنة، بجودة وكفاءة متفوقتين مقارنة بالأنظمة التجارية والمتزامنة الحالية.