نموذج بتريليون معامل برخصة MIT
طرحت شاومي سلسلة MiMo-V2.6 يوم الاثنين ووضعت الأوزان على Hugging Face برخصة MIT. النموذج الرئيسي، MiMo-V2.6-Pro، هو مزيج خبراء متناثر يضم 1.02 تريليون معامل إجمالًا و42 مليار معامل نشط لكل رمز. أما MiMo-V2.6-Flash الأرخص فيضم 309 مليارات إجمالًا و15 مليارًا نشطة. كلاهما يقبل النص والصورة والصوت والفيديو، ولكليهما نافذة سياق تبلغ مليون رمز.
وقد منحت Artificial Analysis، التي تجري تقييماتها بنفسها بدل إعادة نشر جداول الشركات، نموذج MiMo-V2.6-Pro 46 نقطة على مؤشر الذكاء الخاص بها، ووضعته أول 114 نموذجًا مفتوح الأوزان تتابعها. ووسيط ذلك المؤشر يقف عند 18.
السعر هو الحجة
على واجهة شاومي البرمجية يكلّف نموذج Pro مبلغ 0.43 دولار لكل مليون رمز مُدخل و0.87 دولار لكل مليون رمز مُخرج، مع خصم 99 بالمئة على المُدخلات المخزّنة مؤقتًا. ويكلّف Flash مبلغ 0.14 و0.28 دولار. وتقدّر Artificial Analysis تكلفة تمرير مؤشرها كاملًا عبر Pro بنحو 0.13 دولار للمهمة، وهو ما يضع النموذج على حدّ المفاضلة بين الذكاء والتكلفة.

هذا نحو خُمس ما يتقاضاه أقرب نظير غربي. فنموذج Grok 4.7 من SpaceXAI، الذي منحته Artificial Analysis النقاط الـ46 نفسها يوم الاثنين ذاته، يُسعّر بدولارين لكل مليون رمز مُدخل وستة دولارات لكل مليون رمز مُخرج.
ويسجّل المؤشر المستقل أيضًا المقايضات العملية. إذ يولّد Pro مئة وخمسة وعشرين رمزًا في الثانية، وهو الثاني عشر سرعةً بين النماذج المفتوحة المتابَعة، ويستغرق 2.19 ثانية حتى أول رمز. وهو مُسهب: احتاج المقيّم إلى 140 مليون رمز لتشغيل المؤشر كاملًا.
تدريب على مرأى من الجميع
قدّمت شاومي الإصدار على أنه بُني علنًا. فمنذ الخامس عشر من سبتمبر تبثّ لوحة مباشرة عمليات التعلّم المعزّز للنموذجين: الخطوات، ومنحنيات المكافأة، وإنتاجية الرموز، ونتائج الاختبارات، وعدّادًا جاريًا للتكلفة.

ووفق حسابات شاومي نفسها أنجز النموذجان ثلاثين خطوة تعلّم معزّز لكل منهما عبر نحو 750 ألف مسار، بتكلفة تقارب 2.62 مليون دولار لـPro ونحو 850 ألف دولار لـFlash. وتقول الشركة إنها استخدمت أسلوبين لمنع النموذجين من التحايل على مكافأتهما: أحدهما يبني معيار تقييم لكل مهمة بمقارنة عدة محاولات لها، والآخر ينقل ثقل التدريب نحو الحلول الناجحة الأفضل داخل المجموعة الواحدة. وهذه أوصاف الشركة لمنهجها هي، ولم يكرّرها أي طرف خارجي.
ما هو مفتوح وما ليس كذلك
تغطي رخصة MIT الأوزان، وتنشر شاومي كذلك التقرير التقني وبيئات تدريب التعلّم المعزّز وشيفرته. وهذا انفتاح أوسع مما فعلته علي بابا الأسبوع الماضي، حين صدر Qwen-Image-2.1 بأوزان مفتوحة ورخصة مقصورة على البحث.
أما النسخة الثالثة، MiMo-V2.6-Pro-UltraSpeed، فهي خدمة مستضافة لا ملف للتنزيل: تبيعها شاومي بسعر أعلى مقابل إخراج أسرع بعشرين ضعفًا.
ما ينبغي متابعته
السؤال الأول هو ما إذا كان الترتيب سيصمد أمام مقيّمين غير Artificial Analysis. والثاني هو الانتشار: رخصة MIT على نموذج بتريليون معامل لا تفيد إلا من يملك عتادًا لتشغيل 42 مليار معامل نشط، ومعظم الطلب سينتهي إلى الواجهة البرمجية المستضافة وإلى المُوجّهات لا إلى وحدات معالجة رسومية مملوكة.