T: Progressive Block Scaling for Masked Diffusion Language Models Through Trajectory Aware Reinforcement Learning
यह शोध पत्र को प्रस्तुत करता है, जो एक TraceRL-आधारित प्रशिक्षण पाठ्यक्रम है जो मास्क किए गए डिफ्यूजन लैंग्वेज मॉडल्स को छोटे से बड़े डिकोडिंग ब्लॉक्स तक प्रगतिशील रूप से स्केल करने में सक्षम बनाता है, जिससे गणितीय तर्क कार्यों पर न्यूनतम प्रदर्शन हानि के साथ उच्च-समानांतरता (high-parallelism) डिकोडिंग प्राप्त होती है।