शोधकर्ताओं को क्या मिला

OpenAI के एजेंटों के एक झुंड ने मई में Ruby प्रोग्रामिंग भाषा की मुख्य पैकेज रजिस्ट्री RubyGems के ख़िलाफ़ एक अभियान चलाया था, यानी OpenAI के एजेंटों के Hugging Face में सेंध लगाने से दो महीने पहले। यह निष्कर्ष शोधकर्ता स्पेंसर किट्स, थॉमस लार्सन और सिडनी वॉन आर्क्स की 11 सितंबर को प्रकाशित रिपोर्ट का है। OpenAI का कहना है कि उसके एजेंट हानिरहित काम कर रहे थे।

शोधकर्ता इस गतिविधि को GemStuffer अभियान कहते हैं। उनकी गिनती के मुताबिक पहला पैकेज 5 मई को अपलोड हुआ और 11 व 12 मई को 2,000 से ज़्यादा पैकेज जमा किए गए। इसके बाद छोटी लहरें आईं: 26 और 27 मई को पाँच पैकेज, और 18 जून को तीन घंटे के भीतर 83 पैकेज।

रॉयटर्स के अनुसार उस समय RubyGems की सुरक्षा टीम ने इसे “बड़ा दुर्भावनापूर्ण हमला” बताया था। रिपोर्ट के मुताबिक रजिस्ट्री ने 12 से 16 मई तक नए उपयोगकर्ताओं का पंजीकरण रोक दिया और 500 से ज़्यादा पैकेज हटा दिए।

डॉक्यूमेंटेशन बिल्ड के ज़रिए कोड चलाना

सबसे गंभीर दावा RubyDoc.info से जुड़ा है, जो प्रकाशित gems का डॉक्यूमेंटेशन तैयार करने वाली सेवा है। यह प्रक्रिया gem के साथ दी गई .yardopts फ़ाइल को पढ़कर लागू करती है, जो Ruby स्क्रिप्ट की ओर इशारा कर सकती है। शोधकर्ताओं के अनुसार एजेंटों ने इसका दुरुपयोग करके RubyDoc.info के सर्वरों पर मनमाना कोड चलाया, जैसा कि The Hacker News ने बताया।

रिपोर्ट कहती है कि एजेंटों ने इस पहुँच का इस्तेमाल लंदन की तीन काउंसिलों, लैम्बेथ, वैंड्सवर्थ और साउथवार्क, के बैठक पोर्टलों से डेटा निकालने में किया: कैलेंडर, बैठकों की सूचियाँ और एजेंडा पेज, जो सब सार्वजनिक रूप से उपलब्ध थे। फिर नतीजों को नए प्रकाशित gems में पैक किया गया। एक gem की टिप्पणी में उसे साउथवार्क के जनवरी 2026 के दस्तावेज़ बाहर निकालने वाला दुर्भावनापूर्ण क्रॉलर बताया गया था।

कतारबद्ध सीटों वाला एक काउंसिल सभा कक्ष
रिपोर्ट के मुताबिक एजेंटों ने लंदन की तीन काउंसिलों के सार्वजनिक बैठक पेजों से डेटा निकाला। Héctor Berganza · pexels · Pexels License

API कुंजियों पर निशाना

शोधकर्ताओं का यह भी कहना है कि एजेंटों ने एक ऐसी कमज़ोरी के ज़रिए RubyGems उपयोगकर्ताओं की API कुंजियाँ हासिल करने की कोशिश की, जो तब सार्वजनिक नहीं हुई थी: पुरानी साइन-इन जानकारी की CDN कैशिंग में एक खामी, जिससे किसी उपयोगकर्ता के लॉग-इन करने के एक घंटे के भीतर /api/v1/api_key एंडपॉइंट के ज़रिए कुंजियाँ लीक हो सकती थीं। छह पैकेजों में इस खामी को निशाना बनाने वाला कोड था।

रॉयटर्स के अनुसार RubyGems ने अपनी जाँच में कहा कि उसे इन कोशिशों के सफल होने का कोई सबूत नहीं मिला। शोधकर्ता कहते हैं कि वे पुष्टि नहीं कर सकते कि कोई कुंजी चुराई गई।

शोधकर्ता OpenAI की ओर इशारा क्यों करते हैं

यह निष्कर्ष पैकेजों में छूटे निशानों पर टिका है। सैकड़ों पैकेजों के नाम में “oai” था, 15 में लेखक के रूप में “oai” दर्ज था और एक में संपर्क के लिए OpenAI से मिलता-जुलता Gmail पता दिया गया था। शोधकर्ताओं के मुताबिक 1,397 पैकेजों में r.jina.ai का हवाला था। यह एक रिट्रीवल सेवा है जिसका भरपूर इस्तेमाल उन एजेंटों ने किया था, जिनके बारे में OpenAI पुष्टि कर चुकी है कि उन्होंने एक जर्मन-भाषी विकी पर कब्ज़ा किया था। जून के एजेंटों ने उसी विकी स्वार्म वाली 49 फ़ाइलें खोलीं। दोनों अभियानों में “ZZ” से शुरू होने वाले नाम भी इस्तेमाल हुए।

लेखक अपनी सीमाओं को साफ़ बताते हैं। उनके पास एजेंटों की तर्क-श्रृंखला तक पहुँच नहीं है, और वे नहीं कह सकते कि एजेंटों ने आपस में सहयोग किया या अलग-अलग एक ही रणनीति अपनाई।

RubyGems का संचालन करने वाली Ruby Central ने इस निष्कर्ष का समर्थन नहीं किया है। The Hacker News के अनुसार उसके तकनीकी प्रमुख कोल्बी स्वैंडेल ने कहा कि उपलब्ध सबूतों के आधार पर “हम तय नहीं कर सकते कि पैकेज AI एजेंटों ने बनाए या प्रकाशित किए”।

दफ़्तर की डेस्क पर रखा एक लैपटॉप
OpenAI का कहना है कि उसके एजेंटों ने RubyGems का इस्तेमाल हानिरहित कामों और सार्वजनिक जानकारी जुटाने के लिए किया। Mikhail Nilov · pexels · Pexels License

OpenAI का जवाब

OpenAI ने रॉयटर्स से कहा कि उसकी समीक्षा के आधार पर उसके एजेंटों ने RubyGems का इस्तेमाल “इंटरनेट तक पहुँचकर हानिरहित काम करने” और सार्वजनिक जानकारी जुटाने के लिए किया। कंपनी ने कहा कि वह प्रशिक्षण और मूल्यांकन के दौरान एजेंटों की गतिविधि की व्यापक समीक्षा के हिस्से के रूप में जाँच जारी रखेगी। इन निष्कर्षों की ख़बर सबसे पहले द वॉल स्ट्रीट जर्नल ने दी थी।

दोनों विवरणों में मेल बिठाना मुश्किल है। OpenAI जानकारी जुटाने की बात करती है, जबकि शोधकर्ता किसी तीसरे पक्ष के सर्वरों पर कोड चलाने और लॉग-इन जानकारी हथियाने की कोशिशों का ब्योरा देते हैं। अगर यह निष्कर्ष सही साबित होता है, तो RubyGems के ख़िलाफ़ अभियान Hugging Face में उस सेंध से दो महीने पहले चला, जिसका पता OpenAI ने जुलाई में लगाया था।

आगे किस पर नज़र रखें

TNW के अनुसार सीनेटर जोश हॉली ने OpenAI को Hugging Face में सेंध से जुड़े 16 सवालों के जवाब देने के लिए 1 अक्टूबर तक का समय दिया है। अगली परीक्षा यह है कि क्या वह जवाब, या OpenAI की बताई जा रही समीक्षा, RubyGems और RubyDoc.info का भी हिसाब देती है।