डीपसीक ने 30 सितंबर को हुआवेई के Ascend एक्सेलेरेटरों के लिए छह ओपन-सोर्स सॉफ़्टवेयर मॉड्यूल प्रकाशित किए और उनकी घोषणा अपने वीचैट खाते से की। पैकेज में TileLang का एक संस्करण है — कंपनी की उच्च-स्तरीय चिप प्रोग्रामिंग भाषा — जिसे Ascend 950 पर चलाने के लिए ढाला गया है, और डीपसीक स्पष्ट है कि वह इसे एनविडिया के CUDA के सामने रख रही है।

बाकी पाँच वे हिस्से हैं जिनकी किसी प्रशिक्षण प्रणाली को वास्तव में ज़रूरत होती है: मैट्रिक्स गुणन के लिए DeepGEMM, अटेंशन के लिए FlashMLA, तथा TileKernel, DeepSelect और DeepEP। रॉयटर्स ने बताया कि दोनों कंपनियों ने 128 Ascend 950 चिपों से बने एक “सुपरनोड” पर भी साथ काम किया है, जिसे गणना और आपसी संचार दोनों के लिए अनुकूलित किया गया है।

खाई सॉफ़्टवेयर है, चिप नहीं

एनविडिया की टिकाऊ बढ़त कभी यह नहीं रही कि उसके चिप ही अकेले तेज़ हैं। बढ़त यह रही कि CUDA उन्नीस साल पुराना है, हर फ्रेमवर्क उसी को लक्ष्य बनाता है, और संचित कर्नेल, प्रोफ़ाइलर और जुगाड़ किसी एक हार्डवेयर पीढ़ी से अधिक मूल्यवान हैं। चीनी एक्सेलेरेटर वर्षों से मौजूद हैं; वे प्रयोगशाला में इसलिए रह गए क्योंकि उन पर कोई गंभीर प्रशिक्षण ले जाने में चिपों से होने वाली बचत से ज़्यादा इंजीनियर-महीने लगते थे।

डेटा हॉल में केबलों सहित सर्वरों की कतारें
दोनों कंपनियों ने 128 चिप वाला सुपरनोड भी बनाया। प्रतीकात्मक तस्वीर। Brett Sayles · pexels · Pexels License

डीपसीक का तर्क ठीक वहीं निशाना लगाता है। वह TileLang को विकल्प की तुलना में “एक सरल प्रोग्रामिंग मॉडल” बताती है, और बड़ी महत्वाकांक्षा को “ऐसी उच्च-स्तरीय भाषा स्थापित करने” के रूप में रखती है “जो सार्वभौमिक हो, प्रोग्राम करने में आसान हो, और फिर भी हार्डवेयर की पूरी प्रदर्शन क्षमता तक पहुँच सके” — उसके शब्दों में, “स्वतंत्र, स्व-नियंत्रित जीपीयू सॉफ़्टवेयर पारिस्थितिकी तंत्र की नई पीढ़ी” की ओर बुनियादी कदम।

यह वाक्य जितना तकनीकी है उतना ही राजनीतिक, और इसे दोनों तरह पढ़ा जाना चाहिए। यह उपयोग-सुगमता का ऐसा दावा भी है जिसे अब तक किसी स्वतंत्र पक्ष ने परखा नहीं है।

स्वच्छ कक्ष में संभाली जा रही सिलिकॉन वेफ़र
रिलीज़ के साथ कोई स्वतंत्र प्रदर्शन आँकड़ा नहीं आया। प्रतीकात्मक तस्वीर। Jess Loiterton · pexels · Pexels License

यह काम डीपसीक ही क्यों कर रही है

डीपसीक निर्यात नियंत्रणों के बीच फ्रंटियर पैमाने पर प्रशिक्षण करती है, यानी सीमित हार्डवेयर को काम में लाने की कीमत वह पहले ही चुका चुकी है और उसके पास उसके लिए लिखे कर्नेल हैं। उन्हें खोलना एक निजी जुगाड़ को साझा बुनियादी ढाँचे में बदल देता है और हर उस चीनी प्रयोगशाला के लिए बदलाव की लागत घटाता है जो किसी और के पहले कदम का इंतज़ार कर रही थी। हुआवेई को वह मिलता है जिसकी उसे Ascend शृंखला शुरू होने से ज़रूरत थी: ऐसा सॉफ़्टवेयर जो चिप बेचने वालों ने नहीं, बल्कि बड़े मॉडल प्रशिक्षित करने वालों ने लिखा है।

इसमें से किसी का स्वतंत्र मापन नहीं हुआ है, और रिलीज़ के साथ कोई थ्रूपुट आँकड़ा नहीं आया।

आगे क्या देखना है

क्या डीपसीक के बाहर की कोई प्रयोगशाला इन लाइब्रेरियों से Ascend पर कोई प्रशिक्षण प्रकाशित करती है, और क्या सुपरनोड की 128-चिप संरचना किसी चीनी क्लाउड की सार्वजनिक कीमत सूची में दिखती है। किसी ऐसे पक्ष द्वारा अपनाया जाना जिसे दोनों कंपनियों की चापलूसी का कोई कारण न हो, यही एकमात्र माप है जो इसे तय करेगा।