Flame3D: Zero-shot Compositional Reasoning of 3D Scenes with Agentic Language Models
Flame3D एक प्रशिक्षण-मुक्त (training-free) फ्रेमवर्क है जो दृश्यों को संपादन योग्य दृश्य-पाठ्य स्मृतियों (visual-textual memories) के रूप में प्रदर्शित करके और ऑफ-द-शेल्फ MLLMs को ओपन-एंडेड इन्फरेंस के लिए कस्टम स्थानिक उपकरणों (spatial tools) को गतिशील रूप से संश्लेषित करने हेतु सशक्त बनाकर ज़ीरो-शॉट कंपोजिशनल 3D सीन रीजनिंग को सक्षम बनाता है।