TopoBench: Benchmarking LLMs on Hard Topological Reasoning
यह शोधपत्र टोपोबेंच (TopoBench) को प्रस्तुत करता है, जो टोपोलॉजिकल ग्रिड पहेलियों पर बड़े भाषा मॉडलों का मूल्यांकन करने के लिए एक बेंचमार्क है, जो यह प्रकट करता है कि उनका खराब प्रदर्शन मुख्य रूप से अंतर्निहित तर्क सीमाओं के बजाय स्थानिक बाधाओं को निकालने और बनाए रखने में कठिनाइयों के कारण है।