ستة نماذج في إطلاق واحد
أطلق معهد النماذج التأسيسية، المختبر الذي أسّسته جامعة محمد بن زايد للذكاء الاصطناعي في أبوظبي في مايو 2025، حزمة K2 Horizon في الثالث من سبتمبر: ستة نماذج بأحجام 0.9 و3.7 و7 و32 مليار معامل بتصميم كثيف، إضافة إلى نموذجين متفرّقين من نوع مزيج الخبراء، أحدهما بـ36 مليار معامل ونحو 4 مليارات نشطة، والآخر بـ375 مليار معامل ونحو 23 مليار نشطة.
ويمنح المعهد كل حجم مهمّة خاصة به بدل معاملتها كنموذج واحد مصغّر. فالأصغر موجّه لعتاد الأطراف، والأحجام المتوسطة لوكلاء يعملون على الجهاز وللاستضافة المحلية، ونموذج 375 مليار لأعباء الاستدلال والوكلاء الأكبر. وبحسب بطاقات النماذج، تبلغ نافذة السياق 524,288 وحدة رمزية، ويقول المعهد إنّ كل نموذج دُرِّب مسبقاً على نحو 20 تريليون وحدة رمزية.
الأوزان والشيفرة برخصة أباتشي 2.0. أمّا مجموعات البيانات فتحتفظ برخصها الخاصة، ومنها ODC-BY حيثما تسمح إعادة التوزيع.
الادّعاء الذي يصنع الفارق
مختبرات كثيرة تنشر الأوزان. وحجّة المعهد أنّ الأوزان وحدها ليست مصدراً مفتوحاً.
“المصدر المفتوح أكثر بكثير من أوزان مفتوحة”، قال إريك شينغ، مؤسّس المعهد. “العلم ينجح حين يستطيع الآخرون رؤية البيانات، واتّباع المنهج، وإعادة إنتاج النتيجة، والبناء عليها.”

ويفترض أن يشمل الإطلاق شيفرة التدريب والإعدادات ونقاط التحقّق الوسيطة والسجلّات التفصيلية ونتائج التقييم وبيانات التدريب نفسها — مع وصفات بناء بديلة حين يتعذّر إعادة توزيع مجموعة بيانات. وقد لخّص هيكتور ليو، مدير مختبر المعهد في وادي السيليكون، حجم العملية بقوله: “بدل إطلاق نموذج واحد، نطلق أسطولاً كاملاً.”
هذا التزام أقوى بوضوح من إصدارات الأوزان المفتوحة التي اعتاد عليها القطاع، وهو الجزء الذي يستحقّ التحقّق منه بدل ترديده.
ما الذي سُلِّم فعلياً في اليوم الأول
الانفتاح يأتي على مراحل. فبعد مراجعة بطاقات النماذج، تفيد CellCog بأنّ نموذجَي 3.7 و7 مليارات وصلا بالحزمة الكاملة — أوزان وبيانات ووصفات وشيفرة ونقاط تحقّق وسيطة — بينما صدر النموذج الرئيسي بـ375 مليار والنموذج المتفرّق بـ36 مليار بالأوزان فقط، وتشير بطاقتاهما إلى أنّ نقاط التحقّق والبيانات وشيفرة التدريب ستُنشر لاحقاً. أمّا نموذج 32 مليار فمصنّف كنقطة تحقّق من المرحلة الأولى بانتظار نسخة نهائية.
وهكذا فإنّ النماذج التي يرغب معظم الباحثين في إعادة إنتاجها هي، حتى الآن، الأقلّ نشراً لما وراءها. ليس هذا وعداً مخلوفاً بل وعداً لم يُستكمل بعد، والفارق لا يهمّ إلّا إذا وصل الباقي.

الأداء وأين يمكن الحصول عليه
يقول المعهد إنّ النماذج الثلاثة الأصغر تحقّق أفضل أداء في فئات حجمها. وهذه أرقام المختبر نفسه؛ فالتقييم المستقلّ لم يلحق بها بعد، ولا ينبغي قراءة أيّ قياس صادر عن المطوّر باعتباره نتيجة نهائية.
الأوزان متاحة على هجينغ فيس — المنصة التي وافقت إنفيديا على شرائها بـ12.93 مليار دولار في الأسبوع نفسه — وتعمل عبر vLLM وSGLang وOllama. أمّا الوصول عبر الواجهات البرمجية فيتاح من خلال Compass وCerebras وAWS وNebius.
ما الذي يستحقّ المتابعة
أمران يحسمان ما إذا كانت K2 Horizon على ما تدّعيه. الأول: هل تُنشر بيانات وشيفرة تدريب نموذجَي 375 و36 مليار، وبأيّ جدول زمني. والثاني: هل تعيد التقييمات المستقلّة إنتاج الادّعاءات في كل فئة حجم. وإلى أن يتحقّق الأمران، يبقى هذا إصداراً ضخماً لأوزان مفتوحة مرفقاً بوعد بعلم مفتوح.