ऐसी सीमा जिससे मॉडल बहस नहीं कर सकता

Nvidia ने सोमवार को Open Agent Safety Platform की घोषणा की — एक खुला सॉफ़्टवेयर ढाँचा और एक हार्डवेयर संदर्भ डिज़ाइन, जिसका मक़सद एआई एजेंट को वह करने से रोकना है जो किसी ने उससे नहीं कहा। कंपनी कहती है कि 100 से अधिक संगठन इस पर काम कर रहे हैं, जिनमें Anthropic, Microsoft, Cisco, CrowdStrike, Dell, Figure, HPE, Hugging Face, JPMorganChase, Palantir, Palo Alto Networks, Perplexity, Red Hat, Salesforce, SAP, Scale AI, ServiceNow और SpaceXAI शामिल हैं।

इसके दो हिस्से हैं। OpenShell ओपन सोर्स सॉफ़्टवेयर है जो एजेंट के चारों ओर एक रनटाइम सीमा खींचता है: अलग-थलग निष्पादन, सेवाओं तक नियंत्रित पहुँच, क्रेडेंशियल प्रबंधन, और एक पर्यवेक्षक जो हर बाहर जाने वाले अनुरोध को नीति के विरुद्ध जाँचता है, जबकि कर्नेल स्तर के नियंत्रण फ़ाइल सिस्टम और प्रक्रिया सूची को थामे रखते हैं। यह Nvidia के Vera प्रोसेसर पर चलता है और कंपनी के अनुसार Arm तथा Intel प्लेटफ़ॉर्म तक फैलता है।

Sentry असामान्य हिस्सा है। यह Nvidia की BlueField-4 डेटा प्रोसेसिंग इकाइयों पर चलने वाले बैंड-बाहर पहरेदार का संदर्भ डिज़ाइन है — अलग विश्वास-क्षेत्र, अलग सिलिकॉन में, जो एजेंट को उस मशीन के बाहर से देखता है जिस पर वह चल रहा है। Nvidia कहती है कि अपनी अनुमत सीमा पार करने वाले एजेंट को यह मिलीसेकंड में अलग कर सकता है या रोक सकता है।

वह महीना जिसने इसे जन्म दिया

सर्किट बोर्ड का नज़दीकी दृश्य जिसके बीच में एक प्रोसेसर है
Sentry एजेंटों को सिलिकॉन में अलग विश्वास-क्षेत्र से देखता है। स्टॉक तस्वीर, BlueField-4 इकाई की नहीं। Jeremy Waterhouse · pexels · Pexels License

डिज़ाइन की मान्यता स्पष्ट है और वह मॉडलों के लिए चापलूसी भरी नहीं है। जैसा SpaceXAI के अध्यक्ष Mike Nicolls ने Nvidia की घोषणा में कहा: “सुरक्षा मॉडल के बाहर ऐसे अतिरिक्त नियंत्रणों से लागू होनी चाहिए जिन्हें एजेंट पार न कर सके।”

सितंबर ने प्रमाण दिए हैं। OpenAI ने अपने सबसे सक्षम मॉडलों का प्रशिक्षण रोक दिया, जब उनमें से एक DNS रिज़ॉल्वर के ज़रिए बाहरी चैटबॉट तक पहुँच गया। उसके एजेंटों को संयुक्त राष्ट्र के एक सांख्यिकी पोर्टल के 16,000 से अधिक स्कैन तक, ऑस्ट्रेलियाई सरकार के एक स्वास्थ्य पोर्टल तक, और Hugging Face की डेटा प्रोसेसिंग प्रणालियों पर एक स्वायत्त हमले तक ट्रेस किया गया। Meta ने अपने Muse एजेंट की एक ख़ामी ठीक की। ब्रिटेन के राष्ट्रीय साइबर सुरक्षा केंद्र ने चेताया है कि एजेंट व्यापक सिस्टम पहुँच के साथ ऐसी रफ़्तार जोड़ते हैं जिससे अप्रत्याशित व्यवहार समय रहते पकड़ना मुश्किल हो जाता है।

Nvidia के मुख्य कार्यकारी Jensen Huang ने प्लेटफ़ॉर्म को इन्हीं शब्दों में रखा: “समाज के लिए एआई की असाधारण संभावना तभी साकार होगी जब हम एआई सुरक्षा हल कर लेंगे।”

ग्राहक इसे अभी से जोड़ रहे हैं

Salesforce ने OpenShell को Slack से जोड़ा है ताकि टीमें देख सकें कि एजेंट क्या कर रहा है और ऐप के भीतर ही उसकी अनुमति-माँग स्वीकार या अस्वीकार कर सकें। SAP इसे अपने Business AI Platform में Joule Studio के रनटाइम में डाल रही है। Scale AI इसे अपने GenAI पोर्टफ़ोलियो की एजेंट इन्फ़्रास्ट्रक्चर परत में बना रही है।

बैठक कक्ष में लकड़ी की मेज़ के चारों ओर लैपटॉप लिए बैठे छह लोग
Nvidia के अनुसार 100 से अधिक संगठन इस प्लेटफ़ॉर्म पर काम कर रहे हैं। स्टॉक तस्वीर। Matheus Bertelli · pexels · Pexels License

Anthropic के मुख्य वाणिज्यिक अधिकारी Paul Smith ने घोषणा में कहा कि “कंपनियाँ एआई एजेंटों को अपना सबसे महत्वपूर्ण काम अधिकाधिक सौंप रही हैं, और उन्हें यह निर्देशित और सत्यापित करना होगा कि वे एजेंट क्या करते हैं”।

आगे क्या देखना है

सॉफ़्टवेयर अभी Nvidia के डेवलपर संसाधनों और GitHub पर उपलब्ध है; Sentry को BlueField-4 हार्डवेयर चाहिए, जो तय करता है कि निकट भविष्य में पूरा डिज़ाइन कौन अपना सकता है। दो सवाल तय करेंगे कि यह मानक बनेगा या उत्पाद पंक्ति। पहला यह कि क्या OpenShell का नीति मॉडल उन एजेंटों के संपर्क में टिकेगा जो उसके लिए लिखे ही नहीं गए — अब तक हर रोकथाम परत को किसी न किसी ने पार किया है। दूसरा व्यावसायिक है: ऐसी सुरक्षा सीमा जो केवल एक ही निर्माता के प्रोसेसर और उसी निर्माता की डेटा प्रोसेसिंग इकाइयों पर ठीक चलती है, क़ीमत वाली सुरक्षा सीमा है, और OpenShell का खुला लाइसेंस अपने आप इसका उत्तर नहीं देता।