← नवीनतम पेपर
🤖 AI

VERA-MH Concept Paper

यह शोध पत्र VERA-MH को प्रस्तुत करता है, जो एक स्वचालित ढांचा है जो विशेष रूप से आत्महत्या के जोखिम के संबंध में, एक क्लिनिशियन द्वारा विकसित रूब्रिक के माध्यम से, मानसिक स्वास्थ्य चैटबॉट्स के सुरक्षा और नैतिक प्रदर्शन का मूल्यांकन करने के लिए सिम्युलेटेड (simulated) उपयोगकर्ता और जज AI एजेंटों का उपयोग करता है।

मूल लेखक: Luca Belli, Kate H. Bentley, Will Alexander, Emily Ward, Matt Hawrilenko, Kelly Johnston, Mill Brown, Adam M. Chekroud

प्रकाशित 2026-05-14
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Luca Belli, Kate H. Bentley, Will Alexander, Emily Ward, Matt Hawrilenko, Kelly Johnston, Mill Brown, Adam M. Chekroud

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप मानसिक स्वास्थ्य से जूझ रहे लोगों के लिए एक नए प्रकार का डिजिटल सहायक बना रहे हैं। आप चाहते हैं कि यह दयालु, सहायक और सुरक्षित हो। लेकिन आप यह कैसे परीक्षण करेंगे कि यह वास्तव में सुरक्षित है या नहीं, इससे पहले कि इसे वास्तविक लोगों से बात करने दिया जाए? आप इसे केवल यह नहीं पूछ सकते कि "क्या आप सुरक्षित हैं?" क्योंकि यह हमेशा "हाँ" ही कहेगा।

यह शोध पत्र VERA-MH पेश करता है, जो एक नया "सुरक्षा निरीक्षक" (safety inspector) है जिसे विशेष रूप से उन AI चैटबॉट्स का परीक्षण करने के लिए डिज़ाइन किया गया है जो मानसिक स्वास्थ्य से जुड़े मामलों को संभालते हैं, जिसमें विशेष रूप से आत्महत्या के जोखिम पर ध्यान केंद्रित किया गया है। VERA-MH को एक साधारण चेकलिस्ट के रूप में नहीं, बल्कि एक हाई-टेक सिमुलेशन लैब के रूप में सोचें।

यह सिस्टम कैसे काम करता है, इसे सरल भागों में यहाँ दिया गया है:

1. नाटक के तीन पात्र (The Three Actors in the Play)

चैटबॉट का परीक्षण करने के लिए, VERA-MH एक मंच तैयार करता है जहाँ तीन पात्र होते हैं:

  • चैटबॉट (मुख्य कलाकार - The Star): यह वह AI है जिसका आप परीक्षण कर रहे हैं। यह मदद करने की कोशिश कर रहा है।
  • यूज़र-एजेंट (मेथड एक्टर - The Method Actor): यह एक दूसरा AI है जिसे संकट में फंसे एक वास्तविक व्यक्ति की तरह अभिनय करने के लिए प्रोग्राम किया गया है। एक इंसान के टाइप करने के बजाय, यह "अभिनेता" भूमिका निभाता है। कुछ लोग अपने दर्द के बारे में बहुत स्पष्ट होते हैं, कुछ अस्पष्ट होते हैं, और कुछ तत्काल खतरे में होते हैं। क्लिनिशियनों (वास्तविक डॉक्टरों) ने इन अभिनेताओं के लिए स्क्रिप्ट लिखी है ताकि वे वास्तविक लग सकें।
  • जज-एजेंट (आलोचक - The Critic): यह एक तीसरा AI है। यह चैटबॉट और यूज़र-एजेंट के बीच होने वाली बातचीत को देखता है। यह केवल "अच्छा काम किया" या "बुरा काम किया" नहीं कहता। यह प्रदर्शन को ग्रेड देने के लिए मानसिक स्वास्थ्य विशेषज्ञों द्वारा बनाए गए एक विशेष स्कोरकार्ड (जिसे रूब्रिक कहा जाता है) का उपयोग करता है।

2. स्कोरकार्ड (The Rubric)

"जज" केवल दयालुता नहीं देखता। यह विशिष्ट सुरक्षा कौशल देखता है, ठीक वैसे ही जैसे ड्राइविंग टेस्ट यह जाँचता है कि क्या आपने ब्रेक लगाया, संकेत दिया और लेन बदली। स्कोरकार्ड पाँच चीजों की जाँच करता है:

  1. क्या उन्होंने खतरे को पहचाना? (क्या चैटबॉट ने चेतावनी के संकेतों को सुना?)
  2. क्या उन्होंने कठिन सवाल पूछे? (क्या उन्होंने विनम्रता से पूछा, "क्या आप खुद को नुकसान पहुँचाने के बारे में सोच रहे हैं?")
  3. क्या उन्होंने सही अगले कदम उठाए? (क्या उन्होंने कोई हेल्पलाइन, जैसे संकट हॉटलाइन, प्रदान की या किसी इंसान से बात करने का सुझाव दिया?)
  4. क्या उन्होंने भावनाओं को मान्य किया? (क्या उन्होंने कहा, "मैं आपकी बात समझ रहा हूँ, और आपका दर्द वास्तविक है," बजाय इसके कि केवल सलाह दें?)
  5. क्या वे सुरक्षित रहे? (क्या उन्होंने ऐसी कोई बात कहने से परहेज किया जिससे स्थिति और खराब हो सकती थी?)

3. "तनाव परीक्षण" (The "Stress Test")

चैटबॉट से केवल एक प्रश्न पूछकर उसका उत्तर देखने के बजाय, VERA-MH पूरी बातचीत चलाता है। यह एक 'फायर ड्रिल' (आग लगने की स्थिति का अभ्यास) की तरह है। यूज़र-एजेंट कह सकता है, "मैं जीने से थक गया हूँ," और चैटबॉट को जवाब देना होगा। फिर यूज़र-एजेंट कह सकता है, "मेरा कोई प्लान नहीं है," और चैटबॉट को बातचीत को सुरक्षित रखना होगा।

सिस्टम कई बार अलग-अलग "अभिनेताओं" के साथ इन सिमुलेशन को चलाता है ताकि यह देखा जा सके कि चैटबॉट विभिन्न प्रकार के लोगों और जोखिम के विभिन्न स्तरों को कैसे संभालता है।

4. अब तक के परिणाम (The "Preliminary Report")

लेखकों ने इस प्रणाली का उपयोग करके तीन प्रसिद्ध AI मॉडल (GPT-5, Claude Opus, और Claude Sonnet) का परीक्षण किया।

  • अच्छी खबर: तीनों मॉडल आम तौर पर सहानुभूति दिखाने और भावनाओं को मान्य करने में अच्छे थे। उन्होंने शायद ही कभी ऐसी बातें कहीं जो "सक्रिय रूप से हानिकारक" हों।
  • बुरी खबर: मॉडल्स ने कभी-कभी सीधे सवाल पूछने के अवसरों को छोड़ दिया या जब उन्हें मानवीय सहायता तक बातचीत को ले जाना चाहिए था, तो वे ऐसा नहीं कर पाए।
  • "उदार जज" की समस्या (The "Lenient Judge" Problem): जब लेखकों ने AI "जज" की तुलना वास्तविक मानव डॉक्टरों से की, तो उन्होंने पाया कि AI जज चैटबॉट्स के प्रति बहुत उदार था। इसने मानव डॉक्टरों की तुलना में उन्हें "सर्वश्रेष्ठ अभ्यास" (Best Practice) के ग्रेड अधिक दिए। मानव डॉक्टर अधिक सख्त थे।

5. आगे क्या? (What's Next?)

लेखक स्वीकार करते हैं कि यह प्रणाली अभी भी विकास के चरण में है। वे वर्तमान में:

  • जज को कैलिब्रेट कर रहे हैं: AI जज को अधिक सख्त और वास्तविक मानव डॉक्टर की तरह बनने के लिए प्रशिक्षित कर रहे हैं।
  • अभिनेताओं में सुधार कर रहे हैं: "यूज़र-एजेंट्स" को और भी अधिक वास्तविक इंसान जैसा बनाने के लिए, जिनमें वे लोग भी शामिल हैं जो मदद मांगने में शर्म महसूस करते हैं या संकोच करते हैं।
  • कलाकारों का विस्तार कर रहे हैं: उनके पास वर्तमान में 10 अलग-अलग "अभिनेता" स्क्रिप्ट हैं, लेकिन वे जानते हैं कि सभी प्रकार के लोगों को कवर करने के लिए उन्हें और अधिक की आवश्यकता है। (उन्होंने चीजों को सरल रखने के लिए बच्चों को अभी जानबूझकर बाहर रखा है)।

निचोड़ (The Bottom Line)

यह शोध पत्र तर्क देता है कि हम केवल इसलिए AI पर भरोसा नहीं कर सकते क्योंकि यह "अच्छा सुनाई देता है।" हमें इन उपकरणों को तनाव-मुक्त (stress-test) करने के लिए एक कठोर, स्वचालित तरीका चाहिए ताकि यह सुनिश्चित हो सके कि वे अनजाने में किसी संवेदनशील व्यक्ति को नुकसान न पहुँचाएँ। VERA-MH उनका एक सुरक्षा जाल बनाने का प्रयास है, जिसमें AI का उपयोग AI को परखने के लिए किया जा रहा है, जिसका मार्गदर्शन मानव डॉक्टरों के ज्ञान द्वारा किया जा रहा है।

महत्वपूर्ण नोट: शोध पत्र स्पष्ट रूप से बताता है कि यह एक अवधारणा और सत्यापन उपकरण (concept and validation tool) है। यह स्वयं एक थेरेपी ऐप नहीं है, और अब तक के परिणाम प्रारंभिक हैं। इसका लक्ष्य डेवलपर्स को सुरक्षित उपकरण बनाने में मदद करना है, न कि मानव थेरेपिस्टों की जगह लेना।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →