Metriq: A Collaborative Platform for Benchmarking Quantum Computers
यह शोध पत्र मेट्रिक (Metriq) को प्रस्तुत करता है, जो एक ओपन-सोर्स सहयोगात्मक प्लेटफॉर्म है जो विविध प्रकार के मैट्रिक्स और एक संयुक्त मेट्रिक स्कोर (Metriq Score) के माध्यम से क्वांटम कंप्यूटरों के पुनरुत्पादनीय (reproducible), क्रॉस-प्लेटफॉर्म प्रदर्शन मूल्यांकन को सक्षम करने के लिए बेंचमार्क परिभाषा, निष्पादन और डेटा संग्रह को एकीकृत करता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि क्वांटम कंप्यूटिंग की दुनिया एक हलचल भरी, अराजक नगरी है जहाँ हर निर्माता (जैसे IBM, Quantinuum, Rigetti, आदि) अपना अनूठा गगनचुंबी भवन बना रहा है। कुछ कांच के बने हैं, कुछ स्टील के, तो कुछ लकड़ी के। वे सभी दावा करते हैं कि वे "सबसे ऊंचे" या "सबसे तेज़" हैं, लेकिन वे ऊंचाई को अलग-अलग पैमानों से मापते हैं, समय की अलग-अलग इकाइयों का उपयोग करते हैं, और किसी को भी अपने ब्लूप्रिंट (खाके) की जांच करने की अनुमति नहीं देते हैं।
यही वह समस्या है जिसे पेपर "Metriq" संबोधित करता है। यह एक नया, ओपन-सोर्स प्लेटफॉर्म पेश करता है जिसे क्वांटम कंप्यूटरों के लिए सार्वभौमिक "कंज्यूमर रिपोर्ट्स" के रूप में डिज़ाइन किया गया है।
यहाँ बताया गया है कि Metriq कैसे काम करता है, सरल उपमाओं का उपयोग करते हुए:
1. समस्या: टॉवर ऑफ बेबेल (भाषाओं का भ्रम)
अभी, यदि आप जानना चाहते हैं कि कौन सा क्वांटम कंप्यूटर सबसे अच्छा है, तो यह कारों की तुलना करने जैसा है जहाँ एक निर्माता गति को "मील प्रति घंटा" में मापता है, दूसरा "वे कितने बादलों के बीच से उड़ सकते हैं" में, और तीसरा बस कहता है, "हम पर भरोसा करें, हम तेज़ हैं।"
- समस्या: उनके बीच तुलना करने का कोई मानक तरीका नहीं है। डेटा बिखरा हुआ, असंगत और अक्सर पे-वॉल (पैसे देकर ही दिखने वाली जानकारी) या विशिष्ट कंपनी के टूल्स के पीछे छिपा होता है।
- परिणाम: यह स्पष्ट तस्वीर पाना असंभव है कि वास्तव में दौड़ में कौन जीत रहा है।
2. समाधान: Metriq (सार्वभौमिक अनुवादक)
Metriq एक स्वतंत्र समूह (Unitary Foundation) द्वारा बनाया गया एक सहयोगात्मक प्लेटफॉर्म है जो एक निष्पक्ष रेफरी के रूप में कार्य करता है। यह किसी एक कंपनी का नहीं है। इसके तीन मुख्य भाग हैं जो एक सुव्यवस्थित मशीन की तरह मिलकर काम करते हैं:
- द रनर (
metriq-gym): इसे एक यूनिवर्सल रिमोट कंट्रोल के रूप में सोचें। हर टीवी ब्रांड के लिए अलग रिमोट की आवश्यकता होने के बजाय, Metriq के पास एक ऐसा रिमोट है जो किसी भी क्वांटम कंप्यूटर से बात कर सकता है, चाहे वह IBM, Google या किसी विश्वविद्यालय की लैब से बना हो। यह हर मशीन को परीक्षणों का एक ही सेट भेजता है। - द डेटासेट (
metriq-data): यह परिणामों का सार्वजनिक पुस्तकालय है। हर बार जब कोई टेस्ट चलाया जाता है, तो परिणाम एक मानकीकृत प्रारूप में सहेजे जाते हैं। निजी स्प्रेडशीट में डेटा छिपाने का दौर खत्म। हर कोई कच्चे आंकड़े देख सकता है। - द वेबसाइट (
metriq-web): यह इंटरैक्टिव डैशबोर्ड है। यह उस सभी कच्चे डेटा को लेता है और उसे आसानी से पढ़े जाने वाले चार्ट, ग्राफ और लीडरबोर्ड में बदल देता है। आप "सबसे तेज़", "सबसे सटीक", या "मशीन लर्निंग के लिए सर्वश्रेष्ठ" के आधार पर फ़िल्टर कर सकते हैं।
3. परीक्षण: "ड्राइवर लाइसेंस" परीक्षा
Metriq केवल एक परीक्षण नहीं करता; यह यह देखने के लिए परीक्षणों की एक पूरी श्रृंखला चलाता है कि "कारें" विभिन्न रास्तों पर कैसा प्रदर्शन करती हैं। उनके पास दो प्रकार के परीक्षण हैं:
A. "इंजन रूम" परीक्षण (सिस्टम-लेवल)
ये मशीन के बुनियादी स्वास्थ्य की जांच करते हैं, जैसे तेल के दबाव या टायर के घिसाव की जांच करना।
- BSEQ (बेल स्टेट इफेक्टिव क्यूबिट्स): कल्पना कीजिए कि आप एक भीड़ भरे कमरे में अपने साथी का हाथ पकड़ने की कोशिश कर रहे हैं। क्या आप बिना हाथ छोड़े जुड़े रह सकते हैं? यह परीक्षण जांचता है कि क्या कंप्यूटर पूरे चिप पर क्यूबिट्स को "एंटैंगल्ड" (जुड़ा हुआ) रख सकता है।
- EPLG (एरर पर लेयर्ड गेट): यह एक पतली रस्सी पर चलते समय आपके कितनी बार लड़खड़ाने की गिनती करने जैसा है। यह मापता है कि बुनियादी चालों का एक क्रम करने के दौरान कितने एरर (त्रुटियां) होते हैं।
- CLOPS (सर्किट लेयर ऑपरेशंस पर सेकंड): यह स्पीडोमीटर है। यह मापता है कि कंप्यूटर वास्तव में निर्देशों को कितनी तेज़ी से निष्पादित कर सकता है, जिसमें प्रोग्राम लोड करने और कतार में प्रतीक्षा करने का समय भी शामिल है।
B. "रोड ट्रिप" परीक्षण (एप्लीकेशन-लेवल)
ये परीक्षण देखते हैं कि क्या कंप्यूटर वास्तव में कुछ उपयोगी कर सकता है, न कि केवल गोल-गोल घूम सकता है।
- QML कर्नेल: क्या कंप्यूटर डेटा के पैटर्न को पहचान सकता है? (जैसे कि AI का एक बहुत ही बुनियादी संस्करण)।
- WIT (वॉर्महोल टेलीपोर्टेशन): एक फैंसी भौतिकी परीक्षण। यह एक "वॉर्महोल" (अंतरिक्ष के माध्यम से एक शॉर्टकट) का अनुकरण करने की कोशिश करता है ताकि यह देखा जा सके कि क्या कंप्यूटर सूचना को इधर-उधर ले जाते समय उसे सुरक्षित रख सकता है।
- LR-QAOA: एक पहेली सुलझाने वाला परीक्षण। क्या कंप्यूटर एक जटिल अनुकूलन समस्या (जैसे डिलीवरी ट्रक के लिए सबसे छोटा रास्ता ढूंढना) का सर्वोत्तम समाधान पा सकता है?
4. स्कोर: "मेट्रिक स्कोर"
आप इन सभी अलग-अलग परीक्षणों को एक संख्या में कैसे बदल सकते हैं?
कल्पना कीजिए कि आप एक रेस्टोरेंट को रेटिंग दे रहे हैं। आपके पास स्कोर हैं:
- भोजन की गुणवत्ता (0-10)
- सेवा की गति (0-10)
- माहौल (0-10)
Metriq इन सभी अलग-अलग परीक्षण परिणामों को लेता है और उन्हें एक एकल Metriq स्कोर में जोड़ देता है।
- ट्विस्ट: वे कठिनाई के आधार पर परीक्षणों को भार (weight) देते हैं। 100 क्यूबिट्स के साथ एक परीक्षण पास करना 5 क्यूबिट्स के साथ एक परीक्षण पास करने की तुलना में बहुत अधिक महत्वपूर्ण है, ठीक वैसे ही जैसे फॉर्मूला 1 कार चलाना एक गो-कार्ट चलाने से कठिन होता है।
- बेसलाइन: वे एक कंप्यूटर (वर्तमान में एक IBM मशीन जिसे "Torino" कहा जाता है) को "मानक" के रूप में चुनते हैं और उसे 100 का स्कोर देते हैं। यदि कोई अन्य मशीन 120 स्कोर करती है, तो वह मानक से 20% बेहतर है। यदि वह 50 स्कोर करती है, तो वह मानक से आधी जितनी अच्छी है।
5. यह क्यों मायने रखता है
- पारदर्शिता: अब "ब्लैक बॉक्स" परिणाम नहीं। यदि कोई कंपनी दावा करती है कि उनका कंप्यूटर सबसे अच्छा है, तो Metriq आपको सत्यापित करने के लिए कच्चे डेटा को देखने की अनुमति देता है।
- सामुदायिक शक्ति: कोई भी नया परीक्षण सुझा सकता है या अपने स्वयं के लैब उपकरणों पर परीक्षण चला सकता है। यह एक जीवित, सांस लेता हुआ प्रोजेक्ट है जो तकनीक के साथ बढ़ता है।
- भविष्य के लिए तैयारी: जैसे-जैसे क्वांटम कंप्यूटर बड़े और बेहतर होते जाते हैं, Metriq अपने परीक्षणों को अपडेट करता है। इसे वर्षों की प्रगति को ट्रैक करने के लिए डिज़ाइन किया गया है, न कि केवल आज की एक झलक दिखाने के लिए।
निष्कर्ष
Metriq पहली बार क्वांटम जगत के लिए एक निष्पक्ष, खुला और मानकीकृत तरीका है यह कहने का कि, "ठीक है, आइए देखते हैं कि वास्तव में कौन अपने दावों में सबसे अच्छा है।"
यह अलग-अलग नियमों वाली एक अराजक दौड़ को एक स्पष्ट, पारदर्शी प्रतियोगिता में बदल देता है जहाँ सर्वश्रेष्ठ तकनीक अंततः चमक सकती है। और सबसे अच्छी बात यह है कि यह सभी के उपयोग, जांच और सुधार के लिए मुफ्त है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।