Parallel Test-Time Scaling for Latent Reasoning Models
यह शोधपत्र अनिश्चितता-प्रेरित स्टोकेस्टिक सैंपलिंग रणनीतियों (मोंटे कार्लो ड्रॉपआउट और एडिटिव गॉसियन नॉइज़) और निरंतर वेक्टर स्पेस में प्रभावी ट्राजेक्टरी एग्रीगेशन को सुगम बनाने के लिए एक स्टेप-वाइज कॉन्ट्रास्टिव लेटेंट रिवॉर्ड मॉडल को पेश करके लेटेंट रीजनिंग मॉडल्स के लिए पैरेलल टेस्ट-टाइम स्केलिंग को सक्षम बनाता है।