← नवीनतम पेपर
🤖 AI

OpenFinGym: A Verifiable Multi-Task Gym Environment for Evaluating Quant Agents

यह शोध पत्र OpenFinGym को प्रस्तुत करता है, जो एक एकीकृत और सत्यापन योग्य मल्टी-टास्क जिम वातावरण है जो मौजूदा बेंचमार्क में विखंडन और वित्तीय प्रासंगिकता की कमी को दूर करने के लिए पूर्वानुमान और रणनीति निर्माण से लेकर वास्तविक समय के व्यापार और धोखाधड़ी का पता लगाने तक विविध क्वांटिटेटिव फाइनेंस वर्कफ़्लो को स्वचालित कार्य पीढ़ी और मजबूत सत्यापन तंत्र के साथ एकीकृत करता है ताकि लार्ज लैंग्वेज मॉडल एजेंटों का बेहतर मूल्यांकन किया जा सके।

मूल लेखक: Kaicheng Zhang, Wen Ge, Lei Jiang, Weixin Yang, Jordan Langham-Lopez, Jialin Yu, Lukasz Szpruch, Hao Ni

प्रकाशित 2026-06-26
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Kaicheng Zhang, Wen Ge, Lei Jiang, Weixin Yang, Jordan Langham-Lopez, Jialin Yu, Lukasz Szpruch, Hao Ni

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक रोबोट को पेशेवर स्टॉक ट्रेडर बनना सिखाने की कोशिश कर रहे हैं। अतीत में, शोधकर्ता इस रोबोट का परीक्षण केवल एक समय में एक विशिष्ट कौशल पर करते थे, जैसे कि "क्या तुम कल की कीमत का अनुमान लगा सकते हो?" या "क्या तुम एक फर्जी लेनदेन को पहचान सकते हो?"

समस्या यह है कि वास्तविक जीवन की वित्त व्यवस्था अव्यवस्थित और आपस में जुड़ी हुई है। एक अच्छा ट्रेडर केवल कीमतों का अनुमान नहीं लगाता; वह कीमतों का अनुमान लगाता है, एक रणनीति बनाता है, जोखिमों का प्रबंधन करता है, और लाइव समाचारों पर एक साथ प्रतिक्रिया देता है। यदि आप केवल कीमतों का अनुमान लगाने पर रोबोट का परीक्षण करते हैं, तो आपको लग सकता है कि वह एक जीनियस है, भले ही वह वास्तव में व्यापार करने की कोशिश करते ही अपना सारा पैसा खो दे।

OpenFinGym एक नया, "ऑल-इन-वन" (सब कुछ एक साथ वाला) "ट्रेनिंग जिम" है जिसे इसे ठीक करने के लिए डिज़ाइन किया गया है। यह एक डिजिटल खेल का मैदान है जहाँ AI एजेंट (रोबोट) वित्तीय कार्य के पूरे चक्र का अभ्यास कर सकते हैं, न कि केवल अलग-थलग पड़े छोटे कौशलों का।

यह कैसे काम करता है, यहाँ सरल अवधारणाओं में दिया गया है:

1. चार मुख्य अभ्यास (The Four Main Drills)

केवल एक परीक्षण के बजाय, OpenFinGym चार अलग-अलग प्रकार के "अभ्यास" प्रदान करता है जो वास्तविक वित्तीय कार्य की नकल करते हैं:

  • पूर्वानुमान (The Crystal Ball - भविष्य बताने वाला): एजेंट इतिहास के आधार पर भविष्य की कीमतों, अस्थिरता या बाजार के रुझानों की भविष्यवाणी करने की कोशिश करता है।
  • ट्रेडिंग (The Action - कार्रवाई): एजेंट वास्तव में संपत्तियों को खरीदता और बेचता है। यह ऐतिहासिक डेटा (जैसे किसी वीडियो गेम का रीप्ले) या लाइव, वास्तविक समय के डेटा (जैसे लाइव स्पोर्ट्स मैच) पर काम कर सकता है।
  • मार्केट जनरेशन (The Simulator - सिम्युलेटर): एजेंट ऐसा नकली बाजार डेटा बनाने की कोशिश करता है जो इतना वास्तविक दिखे कि असली और नकली में अंतर करना असंभव हो जाए। यह रणनीतियों के परीक्षण (stress-test) में मदद करता है।
  • फ्रॉड डिटेक्शन (The Security Guard - सुरक्षा गार्ड): एजेंट संदिग्ध या अवैध गतिविधियों का पता लगाने के लिए लेनदेन के जटिल जाल को देखता है।

2. "ग्लास बॉक्स" नियम (The "Glass Box" Rule - कोई नकल नहीं)

कई AI परीक्षणों में, रोबोट गलती से पढ़ाई करते समय उत्तर कुंजी (answer key) को "झाँक" सकता है। OpenFinGym एक सख्त कंटेनर सिस्टम के साथ इसे रोकता है।

  • कल्पना कीजिए कि AI एजेंट एक सीलबंद कमरे में परीक्षा देने वाला छात्र है। उनके पास उनकी सभी पाठ्यपुस्तकें (प्रशिक्षण डेटा) और परीक्षा के प्रश्न (टेस्ट इनपुट) हैं।
  • हालाँकि, उत्तर कुंजी (वास्तविक भविष्य की कीमतें या वास्तविक फ्रॉड लेबल) एक अलग, सुरक्षित तिजोरी में बंद है जिसे केवल प्रॉक्टर (सत्यापनकर्ता/Verifier) ही देख सकता है।
  • छात्र अपने उत्तर जमा करता है, और प्रॉक्टर कुंजी के साथ उनकी जाँच करता है। यह सुनिश्चित करता है कि AI उत्तरों को रटकर नकल न कर सके।

3. "रेसिपी बुक" मशीन (The "Recipe Book" Machine)

इस जिम को बनाने का सबसे शानदार तरीका क्या है? इंसानों द्वारा मैन्युअल रूप से 78 अलग-अलग परीक्षण लिखने के बजाय, उन्होंने एक स्वचालित पाइपलाइन (Automated Pipeline) बनाई है।

  • कल्पना कीजिए कि एक मशीन जो अकादमिक वित्त शोध पत्रों (व्यापार करने या भविष्यवाणी करने के "नुस्खे") को पढ़ती है, उनसे डेटा और नियम निकालती है, और स्वचालित रूप से उनसे एक खेलने योग्य गेम लेवल बनाती है।
  • इसका मतलब है कि जिम लगातार बढ़ता रहता है और बिना हर नए कार्य को कोड किए नवीनतम वैज्ञानिक अनुसंधान के साथ अपडेट रहता है।

4. परिणाम: विशेषज्ञ एथलीट, सुपरहीरो नहीं (The Results: Specialized Athletes, Not Superheroes)

लेखकों ने इस जिम में दुनिया के कई सबसे उन्नत AI मॉडलों का परीक्षण किया। उन्होंने पाया कि कोई एक "सर्वश्रेष्ठ" रोबोट नहीं है।

  • एक AI कीमतों की भविष्यवाणी करने में बहुत अच्छा था लेकिन धोखाधड़ी पकड़ने में बुरा था।
  • दूसरा ट्रेडिंग में अद्भुत था लेकिन नकली डेटा बनाने में संघर्ष करता था।
  • यह एक स्पोर्ट्स टीम की तरह है: आप एक ऐसा एकल खिलाड़ी नहीं चाहते जो सब कुछ करने की कोशिश करे; आप ऐसे विशेषज्ञ चाहते हैं जो अपने विशिष्ट पदों पर उत्कृष्ट हों। OpenFinGym हमें इन विशेषज्ञों को पहचानने में मदद करता है।

5. रोबोटों को प्रशिक्षित करना (Training the Robots)

यह पेपर यह भी दिखाता है कि यह जिम केवल परीक्षण करने के लिए ही नहीं, बल्कि AI को प्रशिक्षित करने के लिए भी बेहतरीन है।

  • उन्होंने एक बुनियादी AI मॉडल लिया जो एक काम करने योग्य ट्रेडिंग स्क्रिप्ट भी नहीं लिख सका (वह 100% बार विफल रहा)।
  • उन्होंने इसे सिखाने के लिए जिम का उपयोग किया (एक प्रक्रिया जिसे "सुपरवाइज्ड फाइन-ट्यूनिंग" और "रीइन्फोर्समेंट लर्निंग" कहा जाता है)।
  • परिणाम: AI सभी कार्यों में विफल होने से लेकर 100% सफलता प्राप्त करने तक पहुँच गया, और उसकी ट्रेडिंग रणनीतियाँ काफी अधिक लाभदायक हो गईं।

सारांश (Summary)

OpenFinGym वित्तीय AI के लिए एक एकीकृत, नकल-मुक्त प्रशिक्षण मैदान है। यह रोबोटों का परीक्षण एकल, अलग-थलग कार्यों पर करने के बजाय, उन्हें वित्तीय दुनिया के एक यथार्थवादी, बहु-चरणीय सिमुलेशन के माध्यम से परखता है। यह सुनिश्चित करता है कि जब हम कहते हैं कि एक AI "वित्त में अच्छा है," तो हमारा मतलब यह है कि वह बाजारों की जटिल, परस्पर जुड़ी वास्तविकता को वास्तव में संभाल सकता है, न कि केवल एक साधारण गणितीय पहेली को हल कर सकता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →