ميسترال تفتح النسخة الأولية وتقدّم القدرة التي يحجبها المنافسون
أطلقت ميسترال إيه آي نسخة أولية عامة من Mistral Large 4 في السادس من أكتوبر، وهو نموذج تسميه ML4 وبصورة أقل رسمية “le Chonk”. إنه نموذج مزيج خبراء متعدد الوسائط في أصله، بتريليون معامل إجمالًا و49 مليار معامل نشط لكل رمز، وتقول ميسترال إنه الأكبر والأقدر بين ما بنته حتى الآن. الأوزان لم تصدر بعد: قالت الشركة إنها ستنشرها في نهاية أكتوبر، بعد انتهاء أعمال الفريق الأحمر.
حتى ذلك الحين، الوصول منقسم إلى قسمين. واجهة النسخة الأولية مفتوحة على Mistral Studio بسعر 1.36 دولار لكل مليون رمز مُدخل و4.18 دولار لكل مليون رمز مُخرج. أما المجموعة الثانية — “قادة الأمن السيبراني والشركاء المعتمدون والسلطات الحكومية”، بتعبير ميسترال — فتحصل على النموذج نفسه مع إشراف مخفّف وقدرات سيبرانية موسّعة.

الحجة هي نموذج لن يرفض
الادعاء المركزي لميسترال يتعلق بأعمال الأمن، والشركة صريحة بشكل غير معتاد في تحديد من تقارن نفسها به. على مؤشر Artificial Analysis Cyber Index، وهو تقييم مستقل لقدرة النماذج على إيجاد العيوب في برمجيات حقيقية وإصلاحها، قالت ميسترال إن ML4 يأتي بين أفضل خمسة نماذج عالميًا. وفي اختبار المؤشر الذي يطلب من النموذج إعادة إنتاج ثغرة حقيقية في برمجية مفتوحة المصدر ثم ترقيعها، أعلنت ميسترال 82%، وهو ما تقول إنه أعلى نتيجة لأي نموذج.
والسبب، بحسب روايتها، ليس القدرة وحدها. كتبت الشركة أن كلود أوبس 5.5 وجي بي تي-6 أسترا “يحصلان على ما يقارب الصفر في الاختبار نفسه لأنهما يرفضان تنفيذ المهمة”. وحجتها أن الدفاع يبدأ بإثبات أن الخلل حقيقي، وأن رفض المزوّد في منتصف حادثة هو في ذاته خطر أمني. وعلى Cybench، وهي مجموعة من 40 تمرينًا مأخوذة من مسابقات أمنية، أعلنت ميسترال 93% — وهو رقم من اختباراتها الخاصة لا من تشغيل مستقل.
يأتي هذا الطرح أيامًا بعد أن منحت غوغل أول نموذج جيميني 4 للمدافعين السيبرانيين مع تخفيف الضوابط السيبرانية، وهو يشير إلى السؤال نفسه الذي لم يُحسم: لمن يُسلَّم نموذج ينفّذ أعمال أمن هجومية عند الطلب.
بقية الأرقام هي في معظمها أرقام ميسترال
في البرمجة، أعلنت ميسترال 61.7% على DeepSWE v1.1، و28.3% على Terminal-Bench 4، و59.4% على SWE-Atlas-QnA، إضافة إلى مؤشر Coding Agent Index مجمّع بنسبة 49.8% تضعه أمام DeepSeek V4 Pro وQwen3.8 Max. وعلى AutomationBench — 657 سياق عمل مؤسسيًا في أدوات مثل جيميل وغوغل شيتس وسلاك وسيلزفورس — أعلنت 59.9%.
وفي تقييم بشري أعمى أُجري مع Surge AI، جاء ML4 ثانيًا بين خمسة نماذج في جودة الكود بنتيجة 3.74 من 5، متقدمًا على Kimi K3 من مونشوت إيه آي بـ3.59 وعلى GLM-5.3 بـ3.60، ومتأخرًا عن كلود أوبس 5 بـ4.22. وفي التأسيس البصري، قالت ميسترال إن ML4 يحصل على 42% في Dense 200 مقابل 41% لجي بي تي-6 أسترا، وهو الموضع الوحيد الذي تدّعي فيه تجاوز نموذج مغلق في المقدمة.
خلاصة ميسترال نفسها محدودة بعناية: ML4 “منافس لأقوى نماذج المصدر المفتوح عالميًا” في حين أنه “يتفوق بشكل كبير على أي نموذج مفتوح الأوزان طُوِّر في الولايات المتحدة أو أوروبا”. وهذا ادعاء عن ميدان إقليمي لا عن الميدان العالمي، والنماذج الصينية مفتوحة الأوزان تبقى المعيار.

دُرِّب في أوروبا، على 3800 شريحة
قالت ميسترال إن ML4 دُرِّب من الصفر على 3800 وحدة معالجة رسومات من طراز إنفيديا غريس بلاكويل في مراكز بياناتها الأوروبية الخاصة، وإن النسخة الأولية العامة تُقدَّم على البنية نفسها. وأضافت أن حصة كبيرة من بيانات التدريب كانت متعددة اللغات، وتغطي أكثر من 160 لغة بينها كل لغة رسمية في الاتحاد الأوروبي، وأن نشرًا أوروبيًا سيُدار من طرف إلى طرف تحت القانون الأوروبي وباستقلال عن مزوّدي خدمات رقمية آخرين.
وما ينقص هو كل ما يتيح لجهة خارجية التحقق من هذه الادعاءات: الأوزان، والمعمارية، ومنهجية ما بعد التدريب، وشروط الترخيص. قالت ميسترال إن ذلك كله سيصدر مع الإطلاق في نهاية الشهر. وحتى ذلك الحين، كل رقم أعلاه هو رقم من المزوّد، باستثناء واحد هو موقعه في مؤشر Artificial Analysis.