आकलन
Common Sense Media के Youth AI Safety Institute ने 7 अक्टूबर को किशोरों वाले ChatGPT का जोखिम आकलन प्रकाशित किया और उसे समग्र रूप से अस्वीकार्य जोखिम बताया, जो उसके पैमाने का सबसे निचला दर्जा है। संस्थान सलाह देता है कि जब तक स्वतंत्र परीक्षण सुरक्षित होना सिद्ध न कर दें, किशोरों को इस सेवा से दूर रखा जाए।
संस्थान के आठ सिद्धांतों में से दो — बच्चों व किशोरों को सुरक्षित रखना, और लोगों को पहले रखना — भी अस्वीकार्य चिह्नित हुए। चार और उच्च जोखिम तथा दो मध्यम बताए गए।
परीक्षण कैसे हुआ
संस्थान ने 4,000 से अधिक सवाल चलाए, जो लगभग बराबर बँटे थे: एक खिड़की 18 अगस्त को किशोर सेटिंग्स आने से पहले की और दूसरी उसके बाद की। पहली 13 जुलाई से 17 अगस्त तक चली, दूसरी 25 अगस्त से 28 सितंबर तक। खाते 13 से 17 वर्ष की आयु में पंजीकृत हुए, कुछ 19 में, और आयु हमेशा स्वयं बताई गई थी।
संस्थान एक कमज़ोरी को स्पष्ट मानता है: दोनों खिड़कियाँ एक के बाद एक थीं, इसलिए अंतर्निहित मॉडल के बदलाव किशोर सेटिंग्स के असर से घुल-मिल जाते हैं। मूल्यांकनकर्ताओं के बीच सहमति भी नहीं निकाली गई।

अभिभावकों को चेतावनी
सबसे अधिक ध्यान खींचने वाला निष्कर्ष सूचनाओं का है। एक अलग परीक्षण में एक दर्जन से अधिक नए जोड़े गए अभिभावक खातों से एक घंटे तक चली बातचीत में एक भी सूचना नहीं निकली, जिनमें आत्महत्या, स्व-क्षति और खान-पान विकारों की स्पष्ट चर्चा शामिल थी। आम परीक्षण में संस्थान ने कुल चार सूचनाएँ दर्ज कीं।
संस्थान के अनुसार OpenAI की व्याख्या यह है कि सूचनाएँ पहुँचने से पहले खाते को लगभग तीन घंटे तक जुड़ा रहना चाहिए। संस्थान के टॉम सीगल ने उत्तर दिया कि अधिक समय दिए गए खातों से भी कोई सूचना नहीं निकली।
संकट-सहायता के आँकड़े
मानसिक स्वास्थ्य से जुड़े 390 सवालों में से नैदानिक सलाहकारों ने 201 को संकट-संसाधन के योग्य माना। उनमें हेल्पलाइन का सुझाव किशोर सेटिंग्स से पहले के 33% से घटकर बाद में 23% रह गया। किसी विशेष पेशेवर के पास भेजना 68% से घटकर 58% हुआ। कोई भी संसाधन 77% से घटकर 74%। किसी भरोसेमंद वयस्क को शामिल करने की सलाह 87% से बढ़कर 94% हुई।
स्थिति-वार आँकड़े और तीखे हैं। अवसाद के सवालों में हेल्पलाइन बताने वाला हिस्सा 63% से गिरकर 3% रह गया। मनोदशा के सवालों में 44% से शून्य, और उन्माद में 25% से शून्य। खान-पान विकार के सवालों पर दोनों खिड़कियों में कोई हेल्पलाइन नहीं आई।
संस्थान ने उल्टी दिशा में अति भी पाई: एडीएचडी से जुड़े 30 में से 27 सवालों में संकट-संसाधन दिया गया, जबकि सलाहकारों के अनुसार वहाँ उसकी ज़रूरत नहीं थी।

अध्ययन मोड और आयु-जाँच
अध्ययन मोड में सीधे उत्तर दिखाने का विकल्प, जुड़े हुए 13 वर्षीय उपयोगकर्ता के लिए लॉन्च के बाद के 43% उत्तरों में आया, और अध्ययन उपसर्ग लगाने वाले बिना जुड़े 17 वर्षीय के लिए 90% में। उपसर्ग हटाते ही हर बार पूरा किया हुआ काम मिला। अध्ययन मोड बंद होने पर ChatGPT ने 80 में से 80 बार काम पूरा कर दिया।
परीक्षकों को लगभग 2,000 सवालों में केवल दो विश्राम-स्मरण दिखे, और उन्होंने पाया कि उपकरण का समय-क्षेत्र बदलकर शांत घंटों को टाला जा सकता है। 19 वर्ष में पंजीकृत खातों से सात दिनों में लगभग 1,000 सवालों पर किशोर अनुभव कभी चालू नहीं हुआ, तब भी नहीं जब परीक्षक ने बातचीत में अपनी आयु 13 बताई।
OpenAI का उत्तर, और आगे क्या देखना है
OpenAI के प्रवक्ता एरिक पोर्टरफ़ील्ड ने निष्कर्षों से असहमति जताई और कहा कि परीक्षण यह नहीं दिखाते कि सुरक्षा उपाय व्यवहार में कैसे काम करते हैं। OpenAI की अपनी 18 वर्ष से कम आयु की मॉडल विशिष्टि बताती है कि किशोर अनुभव को क्या करना चाहिए।
जाँचने लायक़ दावा तीन घंटे की देरी वाला है। यदि यही तंत्र है तो यह एक आँकड़े वाला उत्पाद-निर्णय है, और OpenAI उन जुड़े खातों की सूचना दर प्रकाशित कर सकता है जो वह सीमा पार कर चुके हैं। जब तक कोई ऐसा नहीं करता, दोनों पक्ष एक ही व्यवस्था की अलग-अलग दौड़ का वर्णन कर रहे हैं।