JEDI: Joint Embedding Diffusion World Model for Online Model-Based Reinforcement Learning
JEDI पहला ऑनलाइन एंड-टू-एंड लेटेंट डिफ्यूजन वर्ल्ड मॉडल पेश करता है जो पिक्सेल-आधारित और अलग से प्रशिक्षित लेटेंट दृष्टिकोणों दोनों की तुलना में मॉडल-आधारित सुदृढीकरण सीखने (reinforcement learning) में बेहतर दक्षता और प्रतिस्पर्धी प्रदर्शन प्राप्त करने के लिए JEPA-शैली के प्रेडिक्टिव रिप्रेजेंटेशन लर्निंग को डिफ्यूजन उद्देश्यों के साथ एकीकृत करता है।