Large Language Model-Driven Small-Capitalization Trading: Integrating Financial News Sentiment, Macroeconomic Indicators, and Technical Signals
यह शोध पत्र प्रदर्शित करता है कि एक अनिश्चितता-जागरूक पोर्टफोलियो निर्माण रणनीति, जो मैक्रोइकोनॉमिक और तकनीकी संकेतों के साथ लार्ज लैंग्वेज मॉडल-व्युत्पन्न सेंटीमेंट को एकीकृत करती है और जोखिम को स्पष्ट रूप से एलियटोरिक (aleatoric) और एपिस्टेमिक (epistemic) घटकों में विभाजित करती है, शुद्ध-अल्फा और शुद्ध-बीटा स्टॉक-चयन व्यवस्थाओं के लिए उनके एक साथ पुष्टिकरण की आवश्यकता के बजाय उन्हें अलग करके श्रेष्ठ प्रदर्शन प्राप्त करती है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
डिजिटल क्रिस्टल बॉल और शेयर बाजार
कल्पना कीजिए कि शेयर बाजार एक विशाल, अराजक महासागर है। दशकों से, निवेशक दो मुख्य उपकरणों का उपयोग करके लहरों की भविष्यवाणी करने की कोशिश कर रहे हैं: पानी की सतह को देखना (तकनीकी संकेत जैसे प्राइस चार्ट) और मौसम की रिपोर्ट पढ़ना (मैक्रोइकॉनॉमिक संकेतक जैसे ब्याज दरें या तेल की कीमतें)। लेकिन इसमें एक तीसरा, शोर वाला तत्व भी है: समाचारों का अंतहीन प्रवाह। अतीत में, कंप्यूटर इस समाचार को सरल "लेक्सिकॉन्स" (lexicons) का उपयोग करके पढ़ने की कोशिश करते थे, जो केवल अच्छे शब्दों (जैसे "लाभ" या "profit") और बुरे शब्दों (जैसे "हानि" या "loss") की सूचियाँ होती थीं। यह एक जटिल फिल्म को केवल यह गिनकर समझने की कोशिश करने जैसा है कि "खुश" या "दुखी" शब्द कितनी बार आए हैं; आप कहानी, व्यंग्य और संदर्भ को खो देते हैं।
यहाँ प्रवेश होता है लार्ज लैंग्वेज मॉडल्स (LLMs) का। इन इन्हें सुपर-स्मार्ट डिजिटल पाठक के रूप में सोचें जो वास्तव में सुर्खियों के पीछे की कहानी को समझ सकते हैं, और उस सूक्ष्मता (nuance) और संदर्भ को पकड़ सकते हैं जिसे साधारण शब्द-गिनती चूक देती है। शोधकर्ता जो बड़ा सवाल पूछ रहे हैं वह यह है: यदि हम इन सुपर-रीडर्स को छोटी, जोखिम भरी कंपनियों (जिन्हें "स्मॉल-कैप" स्टॉक कहा जाता है) के भविष्य की भविष्यवाणी करने का काम दें, तो क्या वे हमें एक बेहतर निवेश पोर्टफोलियो बनाने में मदद कर सकते हैं? उत्तर केवल इस बारे में नहीं है कि समाचार क्या कहता है, बल्कि इस बारे में है कि हम यह तय करने के लिए उस जानकारी का उपयोग कैसे करते हैं कि कौन से स्टॉक खरीदने हैं और कितना जोखिम लेना है।
कहानी: एक रोबोट को माहौल समझना सिखाना
यह शोध पत्र इस बारे में है कि कैसे शोधकर्ताओं की एक टीम ने ठीक इसी विचार का परीक्षण करने के लिए एक परिष्कृत ट्रेडिंग सिस्टम बनाया। वे यह देखना चाहते थे कि क्या वे एक AI का उपयोग वित्तीय समाचारों को पढ़ने, इसे बड़े आर्थिक डेटा के साथ जोड़ने और फिर उस जानकारी का उपयोग छोटी कंपनियों के व्यापार में पैसा बनाने के लिए कर सकते हैं। लेकिन वे केवल भविष्य का अनुमान नहीं लगाना चाहते थे; वे चाहते थे कि AI तब स्वीकार करे जब वह अनिश्चित हो।
यहाँ बताया गया है कि उनका सिस्टम चरण-दर-चरण कैसे काम करता है:
1. न्यूज़ फ़िल्टर: शोर को समूहीकृत करना
एक कंपनी के बारे में एक ब्रेकिंग न्यूज़ स्टोरी की कल्पना करें। दर्जनों समाचार आउटलेट इसके बारे में लिख सकते हैं, कभी-कभी एक ही तथ्यों को बार-बार दोहराते हुए। यदि आप हर एक लेख को गिनते हैं, तो वह एक कहानी वास्तव में जितनी महत्वपूर्ण है, उससे दस गुना अधिक महत्वपूर्ण लग सकती है। शोधकर्ताओं ने इस समस्या को "क्लस्टरिंग" (clustering) नामक एक ट्रिक का उपयोग करके ठीक किया। उन्होंने AI द्वारा समाचार पढ़ने से पहले ही समान लेखों को एक "कहकर" (story) में समूहित कर दिया। इस तरह, AI घटना की महत्ता पर ध्यान केंद्रित करता है, न कि इस पर कि कितने रिपोर्टरों ने उसे कवर किया।
2. संकेतों के दो प्रकार: "प्योर" खिलाड़ी
शोधकर्ताओं ने महसूस किया कि स्टॉक दो बहुत अलग कारणों से चलते हैं, और उन्होंने उन्हें एक खेल के अलग-अलग खिलाड़ियों के रूप में माना:
- प्योर अल्फा (कंपनी का अपना ड्रामा): यह तब होता है जब कोई विशिष्ट कंपनी कुछ अजीब करती है—जैसे CEO का इस्तीफा देना या नया उत्पाद लॉन्च करना—जो सामान्य अर्थव्यवस्था से स्पष्ट नहीं है। यह एक नाटक के एक विशिष्ट अभिनेता के अचानक मंच पर अपनी मर्जी से दृश्य रचने जैसा है।
- प로 बीटा (महासागर की लहर): यह तब होता है जब कोई बड़ा आर्थिक संकेतक (जैसे ब्याज दरें या तेल की कीमतें) बदलता है, और एक स्टॉक इसलिए हिलता है क्योंकि वह उस बदलाव के प्रति संवेदनशील है, इससे पहले कि स्टॉक खुद कुछ अजीब करे। यह एक सर्फर के समुद्र की लहर आने से पहले ही लहर की सवारी करने जैसा है।
टीम ने तीन रणनीतियों का परीक्षण किया: केवल "प्योर अल्फा" ड्रामा पर दांव लगाना, केवल "प्योर बीटा" लहरों पर दांव लगाना, और केवल तब दांव लगाना जब ये दोनों एक ही समय में घटित हों (यानी "बीटा इंटरसेक्शन")।
3. अनिश्चितता के प्रति जागरूक मस्तिष्क
अधिकांश ट्रेडिंग सिस्टम जोखिम को एक निश्चित संख्या के रूप में देखते हैं, जैसे कि गति सीमा का साइन। हालाँकि, इस टीम का AI जोखिम की गणना गतिशील रूप से करता है। यह जोखिम को दो भागों में विभाजित करता है:
- एलेटोरिक अनसर्टेन्टी (Aleatoric Uncertainty): बाजार की अपनी यादृच्छिकता (randomness) (मौसम स्वाभाविक रूप से अप्रत्याशित होता है)।
- एपिस्टेमिक अनसर्टेन्टी (Epistemic Uncertainty): AI का अपना आत्मविश्वास की कमी (AI कह रहा है, "मैं अभी भी इस कहानी को पूरी तरह नहीं समझ पाया हूँ")।
इस "अनिश्चितता स्कोर" को सीधे उस गणित में फीड करके जो यह तय करता है कि प्रत्येक स्टॉक में कितना पैसा लगाया जाए, सिस्टम भ्रमित होने पर अधिक सतर्क और आश्वस्त होने पर अधिक आक्रामक हो जाता है।
उन्होंने क्या पाया: आश्चर्यजनक परिणाम
शोधकर्ताओं ने एक विशिष्ट अवधि 2025 के दौरान एक बड़ी सूची (रसेल 2000) वाली छोटी कंपनियों पर अपने सिस्टम को चलाया। उन्होंने विभिन्न होल्डिंग पीरियड (स्टॉक को कितनी देर तक रखना है) और विभिन्न ट्रांजैक्शन कॉस्ट (व्यापार के लिए दी जाने वाली फीस) का परीक्षण किया।
बड़ा आश्चर्य: सहमति का इंतजार न करें
सबसे महत्वपूर्ण निष्कर्ष यह था कि संकेतों को अलग करना, उनके बीच सहमति का इंतजार करने से कहीं बेहतर काम करता है।
- "दोनों" वाली रणनीति विफल रही: "प्योर अल्फा" ड्रामा और "प्योर बीटा" लहर दोनों के एक साथ होने का इंतजार करने से आमतौर पर सबसे खराब प्रदर्शन हुआ। यह एक आदर्श तूफान और एक आदर्श अभिनेता दोनों के एक साथ आने का इंतजार करने जैसा था; आपने बहुत सारे अच्छे अवसर खो दिए।
- "अलग" रणनीतियाँ जीत गईं: सिस्टम ने सबसे अधिक पैसा तब बनाया जब उसने दोनों संकेतों को अलग-अलग रणनीतियों के रूप में माना।
- अल्पकालिक (1 दिन): "प्योर बीटा" रणनीति (आर्थिक लहर की सवारी करना) तब अच्छा काम करती है जब लेनदेन की लागत कम होती है, लेकिन लागत बढ़ने (100 बेसिस पॉइंट्स) पर इसका लाभ समाप्त हो जाता है।
- मध्यम अवधि (20-40 दिन): "प्योर बीटा" रणनीति यहाँ भी चमक उठी। ऐसा लगता है कि बड़े आर्थिक परिवर्तनों को छोटी कंपनियों पर पूरी तरह से असर डालने में थोड़ा समय लगता है, और AI इस धीमी गति को पकड़ सकता है।
- दीर्घकालिक (5, 10, और 60 दिन): "प्योर अल्फा" रणनीति (कंपनी का अपना ड्रामा) स्पष्ट विजेता रही। यह सुझाव देता है कि जब किसी विशिष्ट कंपनी के पास अनूठी खबर होती है, तो बाजार को इसे पूरी तरह से समझने और इसकी कीमत तय करने में समय लगता है।
सबसे अच्छा संयोजन
उन्होंने जो एकल सबसे सफल सेटअप पाया वह एक "रूढ़िवादी" (conservative) सेटअप था:
- रणनीति: प्योर बीटा (आर्थिक लहर की सवारी)।
- AI मॉडल: GPT-4o mini (AI का एक विशिष्ट संस्करण)।
- होल्डिंग पीरियड: 40 दिन।
- जोखिम प्रबंधन: "स्टूडेंट-टी टारगेट" (एक गणितीय विधि जो बाजार के भारी क्रैश को बेहतर ढंग से संभालती है) और "रिस्क पैरिटी" (केवल पैसे को संतुलित करने के बजाय जोखिम को संतुलित करना) का उपयोग करना।
- परिणाम: इस सेटअप ने 100 बेसिस पॉइंट्स की उच्च ट्रांजैक्शन कॉस्ट के साथ भी 2.33 का शार्प रेश्यो (Sharpe ratio) प्राप्त किया।
इसका क्या अर्थ है
यह शोध पत्र सुझाव देता है कि ट्रेडिंग के लिए AI का उपयोग करने का रहस्य केवल एक स्मार्ट पाठक होना नहीं है; बल्कि यह है कि आप खेल को कैसे व्यवस्थित करते हैं। "कंपनी-विशिष्ट" समाचार को "अर्थव्यवस्था-व्यापी" समाचार से अलग करके, और AI के अपने अनिश्चितता स्कोर को यह निर्देशित करने देकर कि वह कितना जोखिम ले, निवेशक पारंपरिक तरीकों से बेहतर कर सकते हैं।
हालाँकि, लेखक यह ध्यान दिलाते हैं कि यह एक वर्ष के डेटा पर आधारित एक सिमुलेशन है। वे सुझाव देते हैं कि ये परिणाम आशाजनक प्रमाण हैं, भविष्य की गारंटी नहीं। वे यह भी बताते हैं कि उनका AI, हालांकि स्मार्ट है, फिर भी एक "नॉलेज कटऑफ" (knowledge cutoff) रखता है (उसे उन चीजों का पता नहीं है जो उसके प्रशिक्षण के समाप्त होने के बाद हुईं), और लंबे समाचार लेखों का सारांश बनाने में कुछ सूक्ष्म विवरण छूट सकते हैं। लेकिन मूल विचार कायम है: छोटी कंपनियों की शोर भरी दुनिया में, यह जानना कि कब अर्थव्यवस्था को सुनना है और कब कंपनी को सुनना है—और यह जानना कि कब सावधान रहना है—समाचार के बारे में जानने जितना ही महत्वपूर्ण है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।