← नवीनतम पेपर
💻 computer science

FastFlow: Accelerating The Generative Flow Matching Models with Bandit Inference

FastFlow एक प्लग-एंड-प्ले, एडेप्टिव इन्फरेंस फ्रेमवर्क है जो फ्लो-मैचिंग मॉडल्स को मल्टी-आर्म्ड बैंडिट अप्रोच का उपयोग करके और फाइनाइट-डिफरेंस वेलोसिटी एक्सट्रपलेशनेशन के माध्यम से बुद्धिमानी से डिनोइजिंग स्टेप्स को स्किप करके त्वरित करता है, जिससे बिना रिट्रेनिंग या गुणवत्ता से समझौता किए महत्वपूर्ण गति प्राप्त होती है।

मूल लेखक: Divya Jyoti Bajpai, Dhruv Bhardwaj, Soumya Roy, Tejas Duseja, Harsh Agarwal, Aashay Sandansing, Manjesh Kumar Hanawal

प्रकाशित 2026-02-12
📖 4 मिनट में पढ़ें☕ कॉफ़ी ब्रेक में पढ़ें

मूल लेखक: Divya Jyoti Bajpai, Dhruv Bhardwaj, Soumya Roy, Tejas Duseja, Harsh Agarwal, Aashay Sandansing, Manjesh Kumar Hanawal

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक पेशेवर चित्रकार हैं जिसे एक विशाल, विस्तृत परिदृश्य (लैंडस्केप) पेंट करने का काम सौंपा गया है। इसे एकदम सटीक बनाने के लिए, आप आमतौर पर एक सख्त, चरण-दर-चरण प्रक्रिया का पालन करते हैं: पहले आप रूपरेखा (आउटलाइन) खींचते हैं, फिर आधार रंग जोड़ते हैं, फिर छाया (शैडो) की परतें चढ़ाते हैं, फिर सूक्ष्म हाइलाइट्स जोड़ते हैं, और अंत में बारीकियों को अंतिम रूप देते हैं। इस प्रक्रिया में 50 सटीक चरण लगते हैं।

अधिकांश लोग सोचते हैं कि तेजी से काम करने के लिए, आपको या तो चरणों को पूरी तरह से छोड़ देना होगा (जिससे पेंटिंग बिखरी हुई दिखती है) या एक दूसरे चित्रकार को मदद के लिए रखना होगा (जो महंगा है और जिसके लिए अतिरिक्त प्रशिक्षण की आवश्यकता होती है)।

FastFlow के पीछे के शोधकर्ताओं ने एक तीसरा तरीका खोज निकाला है: द स्मार्ट असिस्टेंट मेथड (स्मार्ट सहायक विधि)।

समस्या: "एक ही आकार सबके लिए" (One-Size-Fits-All) का जाल

वर्तमान AI मॉडल (जैसे कि वे जो चित्र या वीडियो बनाते हैं) उन चित्रकारों की तरह हैं जो एक कठोर नियमावली का पालन करते हैं। भले ही पेंटिंग का एक हिस्सा केवल एक सादा नीला आकाश हो—जिसे बहुत अधिक काम की आवश्यकता नहीं है—AI उस नीले आकाश को भी उतना ही समय और ऊर्जा खर्च करता है जितना कि वह एक जटिल मानव चेहरे पर करता है। यह AI को धीमा और गणनात्मक रूप से "महंगा" बनाता है।

समाधान: FastFlow

FastFlow उस चित्रकार को एक "स्मार्ट असिस्टेंट" (एक गणितीय उपकरण जिसे मल्टी-आर्म्ड बैंडिट कहा जाता है) देने जैसा है जो वास्तविक समय में काम पर नज़र रखता है।

यह तीन सरल अवधारणाओं का उपयोग करके काम करता है:

1. "अनुमानित छलांग" (The Predictive Leap - टेलर सीरीज़)

हर एक ब्रशस्ट्रोक के बाद कैनवास को देखने के लिए रुकने के बजाय, AI उस दिशा को देखता है जिसमें वह पहले से ही बढ़ रहा है। यदि वह एक सीधी रेखा खींच रहा है, तो AI कहता है, "मुझे पता है कि यह रेखा कहाँ जा रही है। मुझे हर मिलीमीटर पर रुककर जाँच करने की ज़रूरत नहीं है; मैं बस पाँच इंच आगे की छलांग लगाऊँगा और देखूँगा कि क्या मैं अभी भी सही रास्ते पर हूँ।" यह "छलांग" भारी गणना किए बिना अगले कुछ चरणों का अनुमान लगाने का एक गणितीय तरीका है।

2. "स्मार्ट असिस्टेंट" (The Multi-Armed Bandit)

यही FastFlow का मस्तिष्क है। कल्पना कीजिए कि चित्रकार के पास पासे (dice) का एक सेट है। एक पासा उन्हें 2 चरण छोड़ने देता है, दूसरा 5 चरण, और तीसरा 10 चरण।

  • यदि चित्रकार 10 चरण छोड़ता है और पेंटिंग शानदार दिखती है, तो असिस्टेंट कहता है, "बहुत बढ़िया! चलिए अक्सर 10 चरण छोड़ना जारी रखते हैं।" (यह एक्सप्लोइटेशन/उपयोग है)।
  • यदि चित्रकार 10 चरण छोड़ता है और गलती से घर की जगह पेड़ बना देता है, तो असिस्टेंट कहता है, "ओह! यह बहुत ज़्यादा था। अगली बार सुरक्षित रहने के लिए केवल 2 चरण छोड़ना बेहतर होगा।" (यह गलती से सीखना है)।
    असिस्टेंट लगातार गति (चरण छोड़ना) बनाम सटीकता (गलतियाँ न करना) के बीच संतुलन बनाए रखता है।

3. "अनुकूलनशील लय" (The Adaptive Rhythm)

अन्य तरीकों के विपरीत जो सब कुछ एक ही गति से तेज़ करने की कोशिश करते हैं, FastFlow अनुकूलनशील (adaptive) है।

  • जब कार्य आसान हो (जैसे कि साफ नीला आकाश), तो AI "टर्बो मोड" में चला जाता है और कई चरण छोड़ देता है।
  • जब कार्य कठिन हो (जैसे कि एक जटिल चेहरा या चलता हुआ वीडियो), तो AI महसूस करता है कि रास्ता घुमावदार और अप्रत्याशित है, इसलिए वह धीमा हो जाता है और पूरी, सावधानीपूर्वक गणना करता है।

परिणाम: तेज़, न कि बदतर

इस "स्मार्ट असिस्टेंट" का उपयोग करके यह तय करने के लिए कि कब छलांग लगानी है और कब रेंगना है, शोधकर्ता 2.6 गुना की गति वृद्धि (speedup) प्राप्त करने में सफल रहे।

साधारण शब्दों में: AI पहले की तुलना में दोगुनी से अधिक तेज़ी से उच्च गुणवत्ता वाली छवियां और वीडियो बना सकता है, बिना उन बारीक विवरणों को खोए जो उन्हें वास्तविक दिखाते हैं। यह एक ऐसे चित्रकार की तरह है जो ठीक से सीख जाता है कि उसे कब तेज़ी से काम करने की अनुमति है और कब उसे मास्टरपीस को सही करने के लिए धीमा होने की आवश्यकता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →