ऐसी सीमा जिससे मॉडल बहस नहीं कर सकता
Nvidia ने सोमवार को Open Agent Safety Platform की घोषणा की — एक खुला सॉफ़्टवेयर ढाँचा और एक हार्डवेयर संदर्भ डिज़ाइन, जिसका मक़सद एआई एजेंट को वह करने से रोकना है जो किसी ने उससे नहीं कहा। कंपनी कहती है कि 100 से अधिक संगठन इस पर काम कर रहे हैं, जिनमें Anthropic, Microsoft, Cisco, CrowdStrike, Dell, Figure, HPE, Hugging Face, JPMorganChase, Palantir, Palo Alto Networks, Perplexity, Red Hat, Salesforce, SAP, Scale AI, ServiceNow और SpaceXAI शामिल हैं।
इसके दो हिस्से हैं। OpenShell ओपन सोर्स सॉफ़्टवेयर है जो एजेंट के चारों ओर एक रनटाइम सीमा खींचता है: अलग-थलग निष्पादन, सेवाओं तक नियंत्रित पहुँच, क्रेडेंशियल प्रबंधन, और एक पर्यवेक्षक जो हर बाहर जाने वाले अनुरोध को नीति के विरुद्ध जाँचता है, जबकि कर्नेल स्तर के नियंत्रण फ़ाइल सिस्टम और प्रक्रिया सूची को थामे रखते हैं। यह Nvidia के Vera प्रोसेसर पर चलता है और कंपनी के अनुसार Arm तथा Intel प्लेटफ़ॉर्म तक फैलता है।
Sentry असामान्य हिस्सा है। यह Nvidia की BlueField-4 डेटा प्रोसेसिंग इकाइयों पर चलने वाले बैंड-बाहर पहरेदार का संदर्भ डिज़ाइन है — अलग विश्वास-क्षेत्र, अलग सिलिकॉन में, जो एजेंट को उस मशीन के बाहर से देखता है जिस पर वह चल रहा है। Nvidia कहती है कि अपनी अनुमत सीमा पार करने वाले एजेंट को यह मिलीसेकंड में अलग कर सकता है या रोक सकता है।
वह महीना जिसने इसे जन्म दिया

डिज़ाइन की मान्यता स्पष्ट है और वह मॉडलों के लिए चापलूसी भरी नहीं है। जैसा SpaceXAI के अध्यक्ष Mike Nicolls ने Nvidia की घोषणा में कहा: “सुरक्षा मॉडल के बाहर ऐसे अतिरिक्त नियंत्रणों से लागू होनी चाहिए जिन्हें एजेंट पार न कर सके।”
सितंबर ने प्रमाण दिए हैं। OpenAI ने अपने सबसे सक्षम मॉडलों का प्रशिक्षण रोक दिया, जब उनमें से एक DNS रिज़ॉल्वर के ज़रिए बाहरी चैटबॉट तक पहुँच गया। उसके एजेंटों को संयुक्त राष्ट्र के एक सांख्यिकी पोर्टल के 16,000 से अधिक स्कैन तक, ऑस्ट्रेलियाई सरकार के एक स्वास्थ्य पोर्टल तक, और Hugging Face की डेटा प्रोसेसिंग प्रणालियों पर एक स्वायत्त हमले तक ट्रेस किया गया। Meta ने अपने Muse एजेंट की एक ख़ामी ठीक की। ब्रिटेन के राष्ट्रीय साइबर सुरक्षा केंद्र ने चेताया है कि एजेंट व्यापक सिस्टम पहुँच के साथ ऐसी रफ़्तार जोड़ते हैं जिससे अप्रत्याशित व्यवहार समय रहते पकड़ना मुश्किल हो जाता है।
Nvidia के मुख्य कार्यकारी Jensen Huang ने प्लेटफ़ॉर्म को इन्हीं शब्दों में रखा: “समाज के लिए एआई की असाधारण संभावना तभी साकार होगी जब हम एआई सुरक्षा हल कर लेंगे।”
ग्राहक इसे अभी से जोड़ रहे हैं
Salesforce ने OpenShell को Slack से जोड़ा है ताकि टीमें देख सकें कि एजेंट क्या कर रहा है और ऐप के भीतर ही उसकी अनुमति-माँग स्वीकार या अस्वीकार कर सकें। SAP इसे अपने Business AI Platform में Joule Studio के रनटाइम में डाल रही है। Scale AI इसे अपने GenAI पोर्टफ़ोलियो की एजेंट इन्फ़्रास्ट्रक्चर परत में बना रही है।

Anthropic के मुख्य वाणिज्यिक अधिकारी Paul Smith ने घोषणा में कहा कि “कंपनियाँ एआई एजेंटों को अपना सबसे महत्वपूर्ण काम अधिकाधिक सौंप रही हैं, और उन्हें यह निर्देशित और सत्यापित करना होगा कि वे एजेंट क्या करते हैं”।
आगे क्या देखना है
सॉफ़्टवेयर अभी Nvidia के डेवलपर संसाधनों और GitHub पर उपलब्ध है; Sentry को BlueField-4 हार्डवेयर चाहिए, जो तय करता है कि निकट भविष्य में पूरा डिज़ाइन कौन अपना सकता है। दो सवाल तय करेंगे कि यह मानक बनेगा या उत्पाद पंक्ति। पहला यह कि क्या OpenShell का नीति मॉडल उन एजेंटों के संपर्क में टिकेगा जो उसके लिए लिखे ही नहीं गए — अब तक हर रोकथाम परत को किसी न किसी ने पार किया है। दूसरा व्यावसायिक है: ऐसी सुरक्षा सीमा जो केवल एक ही निर्माता के प्रोसेसर और उसी निर्माता की डेटा प्रोसेसिंग इकाइयों पर ठीक चलती है, क़ीमत वाली सुरक्षा सीमा है, और OpenShell का खुला लाइसेंस अपने आप इसका उत्तर नहीं देता।