← नवीनतम पेपर
📄 medicine

Evaluating the Usefulness, Quality, Reliability, and Readability of Large Language Model Responses About Pediatric Laser Dentistry: A Parent-Oriented Study

यह अध्ययन माता-पिता पर केंद्रित बाल चिकित्सा लेजर दंत चिकित्सा संबंधी प्रश्नों पर चार सशुल्क लार्ज लैंग्वेज मॉडल्स का मूल्यांकन करता है, जिसमें यह पाया गया कि हालांकि ChatGPT ने उच्चतम सामग्री गुणवत्ता और विश्वसनीयता प्रदर्शित की, सभी मॉडल्स ने अनुशंसित पठनीयता स्तरों को पार कर दिया और उन्हें पेशेवर दंत परामर्श के विकल्प के बजाय केवल शैक्षिक पूरक के रूप में ही उपयोग किया जाना चाहिए।

मूल लेखक: Berkehan Aykanat, Emine Şuranur Ayaz

प्रकाशित 2026-06-25
📖 4 मिनट में पढ़ें☕ कॉफ़ी ब्रेक में पढ़ें

मूल लेखक: Berkehan Aykanat, Emine Şuranur Ayaz

मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक माता-पिता हैं जो यह समझने की कोशिश कर रहे हैं कि क्या एक नया, हाई-टेक "लेजर" टूल आपके बच्चे के दांतों के लिए सुरक्षित और अच्छा है। अपने डेंटिस्ट को कॉल करने के बजाय, आप सलाह के लिए चार सुपर-स्मार्ट, डिजिटल "रोबोट्स" (AI चैटबॉट्स) के एक समूह से पूछते हैं। यह अध्ययन एक 'टेस्ट टेस्ट' की तरह है जहाँ दो विशेषज्ञ डेंटिस्टों ने जज के रूप में यह देखने के लिए काम किया कि किस रोबोट ने सबसे अच्छा, सबसे ईमानदार और सबसे आसानी से समझ में आने वाला उत्तर दिया।

यहाँ बताया गया है कि क्या हुआ, सरल उपमाओं (analogies) का उपयोग करते हुए:

प्रतियोगी

शोधकर्ताओं ने चार उन्नत AI मॉडलों (सोचिए कि वे चार अलग-अलग शेफ हैं) के बीच एक दौड़ आयोजित की:

  1. ChatGPT-5.5 Thinking
  2. Google Gemini 3.1 Pro
  3. Claude Opus 4.7
  4. DeepSeek-V4

उन्होंने इन रोबोटों से लेजर डेंटिस्ट्री के बारे में 20 विशिष्ट प्रश्न पूछे (जैसे, "क्या इसमें दर्द होता है?" "क्या यह बच्चों के दूध के दांतों के लिए सुरक्षित है?")। उन्होंने यह देखने के लिए कि क्या रोबोट समय के साथ अलग-अलग उत्तर देते हैं, एक सप्ताह तक हर दिन वही प्रश्न पूछे।

जज

दो वास्तविक बाल दंत चिकित्सक (बच्चों के दांतों के विशेषज्ञ) ने रोबोट द्वारा दिए गए सभी 560 उत्तरों को पढ़ा। उन्हें यह नहीं पता था कि कौन सा उत्तर किस रोबोट ने लिखा था (वे स्रोत से "अंधे" थे)। उन्होंने उत्तरों को तीन मुख्य चीजों पर स्कोर दिया:

  • उपयोगिता (Usefulness): क्या उत्तर वास्तव में मददगार था?
  • गुणवत्ता (Quality): क्या जानकारी सटीक और पूर्ण थी?
  • पठनीयता (Readability): क्या इसे सरल अंग्रेजी में लिखा गया था, या यह एक भ्रमित करने वाली विज्ञान की पाठ्यपुस्तक जैसा लग रहा था?

परिणाम: कौन जीता?

🏆 स्टार परफॉर्मर: ChatGPT
ChatGPT स्पष्ट विजेता था। इसके उत्तर एक बुद्धिमान, अनुभवी शिक्षक की तरह थे। इसने सबसे सटीक, पूर्ण और सहायक जानकारी दी। इसने केवल बहुत सारी बातें नहीं कीं; इसने ठीक वही कहा जो एक माता-पिता को एक अच्छा निर्णय लेने में मदद करने के लिए आवश्यक था। इसने गुणवत्ता और उपयोगिता पर उच्चतम स्कोर प्राप्त किया।

🥈 मध्यम स्तर: Claude और Google Gemini
ये दोनों ठोस, विश्वसनीय छात्रों की तरह थे। उन्होंने अच्छा काम किया, लेकिन वे ChatGPT जितने पूर्ण नहीं थे। उनके उत्तर मददगार और ज्यादातर सटीक थे, लेकिन वे कभी-कभी कुछ छोटे विवरणों को छोड़ देते थे या उतने स्पष्ट नहीं थे जितने कि विजेता थे। वे प्रदर्शन में एक-दूसरे के बहुत समान थे।

📉 "शब्दों का जाल" बुनने वाला कमजोर प्रदर्शन: DeepSeek
DeepSeek सबसे दिलचस्प मामला था। कल्पना कीजिए कि एक छात्र एक साधारण प्रश्न का उत्तर देने के लिए 10 पन्नों का निबंध लिखता है

  • अच्छा: DeepSeek ने सबसे लंबे उत्तर लिखे और सबसे सरल शब्दों का उपयोग किया। इसे पढ़ना सबसे आसान था (जैसे एक मित्रवत कहानी की किताब)।
  • बुरा: भले ही यह पढ़ने में आसान और बहुत लंबा था, विशेषज्ञ डेंटिस्टों ने इसे सटीकता और विश्वसनीयता के लिए सबसे कम स्कोर दिया। यह एक बहुत लंबी, मित्रवत कहानी की तरह था जो तथ्यों को गलत बताता था या महत्वपूर्ण चेतावनियों को छोड़ देता था। यह "दिखावटी" था लेकिन "ठोस" नहीं था।

"दिन-प्रतिदिन" की जाँच

शोधकर्ताओं ने सात दिनों तक लगातार रोबोटों से वही प्रश्न पूछे।

  • निष्कर्ष: रोबोट आश्चर्यजनक रूप से सुसंगत थे। उन्होंने सोमवार से रविवार तक अपने व्यक्तित्व या अपने उत्तरों में बहुत अधिक बदलाव नहीं किया। वे स्थिर थे, जैसे एक घड़ी जो हमेशा एक ही गति से टिक-टिक करती है।

बड़ा निष्कर्ष

अध्ययन ने पाया कि हालांकि ये AI रोबोट बेहतर हो रहे हैं, लेकिन वे अभी तक पूर्ण शिक्षक नहीं हैं।

  • ChatGPT इस विशिष्ट विषय के लिए सटीक, उच्च-गुणवत्ता वाली सलाह देने में सबसे अच्छा था।
  • DeepSeek ने सिद्ध किया कि सिर्फ इसलिए कि कोई उत्तर लंबा और पढ़ने में आसान है, इसका मतलब यह नहीं है कि वह सत्य और सुरक्षित है।
  • उन सभी ने ऐसे उत्तर लिखे जो औसत माता-पिता के पढ़ने के लिए अभी भी थोड़े जटिल थे (एक साधारण पर्चे के बजाय एक कॉलेज की पाठ्यपुस्तक की तरह)।

अंतिम निर्णय:
यह पेपर निष्कर्ष निकालता है कि ये AI उपकरण माता-पिता के लिए लेजर डेंटिस्ट्री के बारे में जानने के लिए एक सहायक शुरुआती बिंदु हो सकते हैं, लेकिन उन्हें कभी भी एक वास्तविक डेंटिस्ट के साथ बातचीत का स्थान नहीं लेना चाहिए। जैसे आप खिड़की से बाहर देखे बिना कार चलाने के लिए GPS पर भरोसा नहीं करेंगे, वैसे ही आपको अपने बच्चे के चिकित्सा संबंधी निर्णय लेने के लिए किसी चैटबॉट को पेशेवर की जांच के बिना निर्णय लेने के लिए नहीं छोड़ना चाहिए।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →