← नवीनतम पेपर
💬 NLP

SAGE Celer 2.6 Technical Card

SAGE Celer 2.6 सामान्य-उद्देश्य वाले भाषा मॉडलों (5B, 10B, और 27B पैरामीटर्स) का एक नया परिवार है जिसमें नेटिव मल्टीमॉडल क्षमताएं, मतिभ्रम (hallucinations) को कम करने के लिए एक इनवर्स रीजनिंग पाइपलाइन, और अंग्रेजी प्रदर्शन को बनाए रखते हुए हिंदी और नेपाली जैसी दक्षिण एशियाई भाषाओं के लिए विशेष अनुकूलन शामिल है।

मूल लेखक: SAGEA Research Team, Basab Jha, Firoj Paudel, Ujjwal Puri, Adrian Liu, Ethan Henkel, Zhang Yuting, Mateusz Kowalczyk, Mei Huang, Choi Donghyuk, Wang Junhao

प्रकाशित 2026-04-17
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: SAGEA Research Team, Basab Jha, Firoj Paudel, Ujjwal Puri, Adrian Liu, Ethan Henkel, Zhang Yuting, Mateusz Kowalczyk, Mei Huang, Choi Donghyuk, Wang Junhao

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आपको अभी-अभी SAGE Celer 2.6 नामक प्रतिभाशाली, बहु-प्रतिभाशाली सहायकों की एक नई टीम से परिचित कराया गया है। वे तीन आकारों में आते हैं: एक फुर्तीला जेब के आकार का मददगार (5B), एक भरोसेमंद ऑफिस मैनेजर (10B), और एक वरिष्ठ विशेषज्ञ सलाहकार (27B)।

यह शोध पत्र (paper) मूल रूप से उनका "रिज्यूमे" और "प्रशिक्षण नियमावली" है, जो बताता है कि उन्हें कैसे बनाया गया, क्या चीज़ उन्हें खास बनाती है, और वे कहाँ लड़खड़ा सकते हैं। यहाँ इसका सरल भाषा में विवरण दिया गया है:

1. मूल दर्शन: मात्रा से अधिक गुणवत्ता (Quality Over Quantity)

अधिकांश AI कंपनियाँ केवल अधिक न्यूरॉन्स (पैरामीटर्स) जोड़कर बड़े दिमाग बनाने की कोशिश करती हैं। SAGEA ने एक अलग दृष्टिकोण अपनाया। उन्होंने कहा, "एक विशाल, धीमे दिमाग को बनाने के बजाय, आइए एक छोटा, सुपर-कुशल दिमाग बनाएं जो अधिक सावधानी से सोचे।"

इसे एक रेस कार बनाम भारी ट्रक की तरह समझें। ट्रक (विशाल मॉडल) में अधिक कच्ची शक्ति होती है, लेकिन Celer 2.6 को गति और सटीकता के लिए ट्यून किया गया है। भले ही 27B संस्करण कुछ 70B दिग्गजों से छोटा है, फिर भी यह तर्क पहेलियों और गणित में उन्हें हरा देता है क्योंकि इसे "बोलने से पहले सोचने" के लिए प्रशिक्षित किया गया था।

2. गुप्त मंत्र: "इनवर्स रीजनिंग" (The Internal Editor)

यहाँ सबसे बड़ा नवाचार "इनवर्स रीजनिंग" (Inverse Reasoning - IR) है।

  • सामान्य AI: यह एक ऐसे छात्र की तरह है जो परीक्षा देते समय वही उत्तर लिख देता है जो उसके दिमाग में सबसे पहले आता है। यदि वह चरण 1 में गलती करता है, तो वह आगे बढ़ता रहता है और पूरा उत्तर गलत हो जाता है।
  • Celer 2.6: यह उस छात्र की तरह है जो रुकता है, अपने काम की जाँच करता है, और कहता है, "रुको, अगर मैं यह करता हूँ, तो क्या यह समझ में आता है?"
    • मॉडल के पास एक अंतर्निहित "आंतरिक संपादक" (Internal Editor) है जो विभिन्न रास्तों का अनुकरण करता है। यदि उसे कोई तार्किक डेड-एंड (बंद रास्ता) दिखता है, तो वह अंतिम उत्तर देने से पहले पीछे हट जाता है और एक अलग रास्ता आज़माता है।
    • उपमा: कल्पना करें कि आप एक भूलभुलैया (maze) में रास्ता खोज रहे हैं। एक सामान्य AI सीधे दीवार से टकरा जाता है। Celer 2.6 रुकता है, मानचित्र देखता है, महसूस करता है कि वहाँ दीवार है, और बिना दीवार से टकराए एक नया रास्ता ढूंढ लेता है।

3. आपकी भाषा बोलना: "देवनागरी" अपग्रेड

AI के साथ एक बड़ी समस्या यह है कि इसे हिंदी और नेपाली जैसी भाषाओं (जो देवनागरी लिपि का उपयोग करती हैं) के साथ संघर्ष करना पड़ता है। मानक AI इन भाषाओं को एक विदेशी कोड की तरह मानता है, जिससे शब्द छोटे, अक्षम टुकड़ों में टूट जाते हैं। इससे वे धीमे और चलाने में महंगे हो जाते हैं।

  • Celer 2.6 का समाधान: उन्होंने विशेष रूप से इन लिपियों के लिए एक कस्टम "अनुवादक" बनाया है।
  • उपमा: कल्पना करें कि आप एक ऐसी किताब पढ़ रहे हैं जहाँ हर अक्षर एक अलग पन्ना है। पुराने AI हिंदी को इसी तरह पढ़ते थे। Celer 2.6 इसे एक सामान्य पुस्तक की तरह पढ़ता है, जहाँ पूरे शब्द एक पन्ने पर होते हैं। यह इसे इन भाषाओं को बोलने में 3 गुना तेज़ और बहुत स्मार्ट बनाता है, बिना अपनी अंग्रेजी बोलने की क्षमता खोए।

4. दुनिया को देखना: आँखें और मस्तिष्क एक ही रूप में

अधिकांश AI मॉडल जो छवियों (images) को "देख" सकते हैं, वे एक ऐसे व्यक्ति की तरह होते हैं जिसके सिर पर कैमरा बंधा हुआ है, लेकिन कैमरा उनके मस्तिष्क से एक लंबे, डगमगाते केबल द्वारा जुड़ा हुआ है। मस्तिष्क तक पहुँचने से पहले छवि धुंधली या विकृत हो जाती है।

  • Celer 2.6 का समाधान: उन्होंने "आँखों" (दृष्टि/vision) को सीधे "मस्तिष्क" (भाषा मॉडल) के भीतर बनाया है।
  • उपमा: केबल वाले कैमरे के बजाय, Celer 2.6 की आँखें उसके चेहरे का हिस्सा हैं। यह एक आरेख (diagram), हस्तलिखित नोट, या चार्ट को देखता है और इसे तुरंत समझ लेता है, ठीक वैसे ही जैसे एक इंसान करता है। यह फ्लोचार्ट में हस्तलिखित गणितीय समस्याओं को भी पढ़ सकता है और उन्हें हल कर सकता है।

5. प्रदर्शन (रिपोर्ट कार्ड)

यह शोध पत्र दिखाता है कि ये मॉडल अपने वजन के मुकाबले कहीं अधिक बेहतर प्रदर्शन कर रहे हैं:

  • 27B मॉडल: यह गणित और तर्क के परीक्षणों में बहुत बड़े मॉडलों (जैसे Llama 3.3 70B) को पछाड़ देता है। यह एक शतरंज के उस विलक्षण प्रतिभा की तरह है जो कम मोहरों के बावजूद ग्रैंडमास्टर को हरा देता है।
  • 5B और 10B मॉडल: ये इतने कुशल हैं कि इन्हें लैपटॉप या यहाँ तक कि फोन पर भी चलाया जा सकता है, फिर भी ये कोडिंग और तर्क में बहुत बड़े प्रतिस्पर्धियों से बेहतर प्रदर्शन करते हैं।

6. जहाँ वे लड़खड़ा सकते हैं (सीमाएँ)

यहाँ तक कि जीनियस के भी बुरे दिन होते हैं। यह शोध पत्र इस बारे में ईमानदार है कि Celer 2.6 कहाँ विफल हो सकता है:

  • "नकली तथ्य" का जाल: यदि आप किसी बहुत ही अज्ञात या काल्पनिक तथ्य के बारे में पूछते हैं, तो मॉडल आत्मविश्वास के साथ झूठ बोल सकता है क्योंकि यह तर्क करने में इतना अच्छा है कि यह झूठ को तार्किक दिखाने की पूरी कोशिश करता है।
  • ज़रूरत से ज़्यादा सोचना: कभी-कभी, "Strawberry" शब्द में कितने 'R' हैं जैसे सरल प्रश्न के लिए, यह अत्यधिक विश्लेषण कर सकता है और उत्तर देने में बहुत समय ले सकता है क्योंकि इसका "आंतरिक संपादक" ओवरटाइम काम कर रहा होता है।
  • 3D विज़न: यह 2D चित्रों (जैसे चार्ट) के लिए बेहतरीन है, लेकिन यदि आप इसे कागज पर बना एक जटिल 3D गाँठ (knot) दिखाएंगे, तो यह अंतरिक्ष में टुकड़ों के मुड़ने के तरीके को लेकर भ्रमित हो सकता है।

7. इनका उपयोग कौन कर सकता है?

  • 5B (पॉकेट): उन छात्रों, लेखकों और डेवलपर्स के लिए बेहतरीन जिन्हें बिना सुपरकंप्यूटर की आवश्यकता के अपने लैपटॉप पर एक स्मार्ट सहायक चाहिए।
  • 10B (ऑफिस): उन व्यवसायों के लिए आदर्श जिन्हें दस्तावेज़ों को प्रोसेस करने, भाषाओं का अनुवाद करने या डेटा का विश्लेषण करने की आवश्यकता है।
  • 27B (एक्सपर्ट): जटिल अनुसंधान, कानूनी दस्तावेज़ों की समीक्षा और गहन कोडिंग कार्यों के लिए सबसे अच्छा, लेकिन इसके लिए सख्त मानवीय पर्यवेक्षण की आवश्यकता होती है (आपको अकेले चिकित्सा या वित्तीय निर्णय लेने के लिए इस पर भरोसा नहीं करना चाहिए)।

निष्कर्ष

SAGE Celer 2.6 एक बड़ी उपलब्धि है क्योंकि यह साबित करता है कि स्मार्ट होने के लिए आपको एक विशाल, ऊर्जा-खपत करने वाले दिमाग की आवश्यकता नहीं है। मॉडल को अपने विचारों को सत्यापित करने, स्थानीय भाषाओं को स्वाभाविक रूप से बोलने और छवियों को स्पष्ट रूप से देखने की शिक्षा देकर, उन्होंने AI का एक ऐसा परिवार बनाया है जो तेज़, कुशल और आश्चर्यजनक रूप से मानव जैसा तर्क करने वाला है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →