Can Large Language Models Adequately Perform Symbolic Reasoning Over Time Series?
यह शोध पत्र SymbolBench प्रस्तुत करता है, जो वास्तविक दुनिया के टाइम सीरीज़ डेटा पर प्रतीकात्मक तर्क (symbolic reasoning) करने की लार्ज लैंग्वेज मॉडल्स (LLMs) की क्षमता का मूल्यांकन करने के लिए एक व्यापक बेंचमार्क है, और एक एकीकृत ढांचे का प्रस्ताव करता है जो स्वचालित वैज्ञानिक खोज को बढ़ाने के लिए LLMs को जेनेटिक प्रोग्रामिंग के साथ एकीकृत करता है।