एक ही रिलीज़ में छह मॉडल
अबू धाबी स्थित प्रयोगशाला इंस्टिट्यूट ऑफ फाउंडेशन मॉडल्स, जिसकी स्थापना एमबीज़ेडयूएआई ने मई 2025 में की थी, ने 3 सितंबर को K2 Horizon जारी किया: 0.9 अरब, 3.7 अरब, 7 अरब और 32 अरब पैरामीटर वाले चार सघन मॉडल, तथा विशेषज्ञ मिश्रण वाले दो विरल मॉडल — 36 अरब पैरामीटर वाला जिसमें लगभग 4 अरब सक्रिय हैं, और 375 अरब वाला जिसमें लगभग 23 अरब सक्रिय हैं।
आईएफएम हर आकार को एक अलग काम सौंपता है, न कि उन्हें एक ही मॉडल के छोटे रूप मानता है। सबसे छोटा एज हार्डवेयर के लिए है, मध्यम आकार डिवाइस पर चलने वाले एजेंटों और स्थानीय होस्टिंग के लिए, और 375 अरब वाला बड़े तर्क तथा एजेंट कार्यभार के लिए। मॉडल कार्ड के अनुसार इन मॉडलों की संदर्भ खिड़की 5,24,288 टोकन है, और आईएफएम का कहना है कि हर मॉडल को लगभग 20 खरब टोकन पर पूर्व-प्रशिक्षित किया गया।
वेट और कोड अपाचे 2.0 के तहत हैं। डेटासेट अपने-अपने लाइसेंस बनाए रखते हैं, जिनमें ओडीसी-बीवाई भी शामिल है जहाँ पुनर्वितरण की अनुमति है।
वह दावा जो इसे अलग बनाता है
कई प्रयोगशालाएँ वेट प्रकाशित करती हैं। आईएफएम का तर्क है कि अकेले वेट खुला स्रोत नहीं हैं।
“खुला स्रोत खुले वेट से कहीं अधिक है,” आईएफएम के संस्थापक एरिक शिंग ने कहा। “विज्ञान तब काम करता है जब दूसरे डेटा देख सकें, विधि का अनुसरण कर सकें, परिणाम दोहरा सकें और उसमें सुधार कर सकें।”

रिलीज़ में प्रशिक्षण कोड, कॉन्फ़िगरेशन, मध्यवर्ती चेकपॉइंट, विस्तृत लॉग, मूल्यांकन परिणाम और स्वयं प्रशिक्षण डेटा शामिल होने चाहिए — और जहाँ किसी डेटासेट का पुनर्वितरण संभव नहीं, वहाँ उसे बनाने की विधि दी जाएगी। आईएफएम की सिलिकॉन वैली प्रयोगशाला के निदेशक हेक्टर लियू ने इसका पैमाना यूँ बताया: “एक अकेला मॉडल जारी करने के बजाय हम पूरा बेड़ा जारी कर रहे हैं।”
यह उन खुले-वेट रिलीज़ों से स्पष्ट रूप से मजबूत प्रतिबद्धता है जिनका क्षेत्र आदी हो चुका है, और यही वह हिस्सा है जिसे दोहराने के बजाय जाँचना चाहिए।
पहले दिन असल में क्या मिला
खुलापन चरणों में आ रहा है। मॉडल कार्डों की समीक्षा के बाद सेलकॉग बताता है कि 3.7 अरब और 7 अरब वाले मॉडल पूरे पैकेज के साथ आए — वेट, डेटा और विधियाँ, कोड और मध्यवर्ती चेकपॉइंट — जबकि प्रमुख 375 अरब और विरल 36 अरब मॉडल केवल वेट के साथ जारी हुए, और उनके कार्डों में लिखा है कि चेकपॉइंट, डेटा और प्रशिक्षण कोड बाद में जारी किए जाएँगे। 32 अरब वाला पहले चरण का चेकपॉइंट बताया गया है, अंतिम संस्करण अभी आना है।
यानी जिन मॉडलों को अधिकांश शोधकर्ता दोहराना चाहेंगे, फिलहाल उन्हीं के पीछे सबसे कम सामग्री प्रकाशित है। यह टूटा हुआ वादा नहीं, अधूरा वादा है, और यह अंतर तभी मायने रखता है जब बाकी हिस्सा आ जाए।

प्रदर्शन और उपलब्धता
आईएफएम का कहना है कि तीन सबसे छोटे मॉडल अपने आकार वर्ग में सर्वश्रेष्ठ प्रदर्शन स्थापित करते हैं। ये आँकड़े प्रयोगशाला के अपने हैं; स्वतंत्र मूल्यांकन अभी नहीं हुआ है, और किसी भी विक्रेता के आँकड़े को अंतिम परिणाम नहीं माना जाना चाहिए।
वेट हगिंग फेस पर हैं — वही मंच जिसे उसी सप्ताह एनवीडिया ने 12.93 अरब डॉलर में खरीदने पर सहमति दी — और ये vLLM, SGLang तथा Ollama पर चलते हैं। एपीआई पहुँच कंपास, सेरेब्रास, एडब्ल्यूएस और नेबियस के माध्यम से उपलब्ध है।
आगे क्या देखना है
दो बातें तय करेंगी कि K2 Horizon वही है जो वह कहता है। पहली, 375 अरब और 36 अरब वाले मॉडलों का प्रशिक्षण डेटा और कोड प्रकाशित होता है या नहीं, और कब। दूसरी, स्वतंत्र मूल्यांकन आकार-वर्ग के दावों को दोहरा पाते हैं या नहीं। जब तक दोनों नहीं होते, यह खुली वैज्ञानिकता के वादे के साथ जुड़ा एक बहुत बड़ा खुला-वेट रिलीज़ है।