Mechanistic Indicators of Understanding in Large Language Models
यह शोध पत्र यांत्रिक व्याख्यात्मकता (mechanistic interpretability) के निष्कर्षों को दार्शनिक सिद्धांत के साथ एकीकृत करने वाले एक स्तरीय ढांचे का प्रस्ताव करता है ताकि यह तर्क दिया जा सके कि बड़े भाषा मॉडल (large language models) समझ के विशिष्ट, पदानुक्रमित रूपों को प्रदर्शित करते हैं—जो वैचारिक विशेषता निर्माण से लेकर सिद्धांत-आधारित सर्किट खोज तक विस्तृत हैं—जिससे द्विआधारी बहसों से आगे बढ़कर एआई संज्ञान (AI cognition) की एक तुलनात्मक, यांत्रिक रूप से आधारित ज्ञानमीमांसा स्थापित की जा सके।