المختبر الألماني يختار يوم الوحدة لإطلاق أول نموذج مفتوح كبير له
أطلقت شركة أليف ألفا نموذج كوليبري في الثالث من أكتوبر، يوم الوحدة الألمانية، ونشرت أوزانه الكاملة على منصة هاغينغ فيس بموجب رخصة أباتشي 2.0. وهو أول إصدار مفتوح الأوزان بهذا الحجم للشركة التي تتخذ من هايدلبرغ مقرا لها. أما النموذج السابق، كوليبري أوريجين، فقد أكمل تدريبه الأولي في 11 يونيو ولم ينشر قط.
كوليبري محول من نوع مزيج الخبراء يضم 78.1 مليار معامل في المجموع، منها 3.46 مليار نشطة لكل رمز: 384 خبيرا يعمل ستة منها في الوقت ذاته. وقالت أليف ألفا إنها دربت النموذج على 20 تريليون رمز، منقاة من أكثر من 200 تريليون رمز من البيانات الخامة، وإن 21.3% من خليط التدريب الأولي كان بالألمانية. ويمثل النص المترجم 6% من المجموع، وهي نسبة قالت الشركة إنها أبقتها منخفضة لأن النص المترجم يحمل معه البصمة الثقافية للغته الأصلية.
تصل نافذة السياق إلى مليون رمز، وإن كان أطول تسلسل دُرب النموذج عليه فعليا هو 262144 رمزا. وحد المعرفة لديه هو 18 يونيو 2026 بالنسبة للإنجليزية والألمانية على حد سواء.

الاختصاص القضائي، لا الصدارة
لا تدعي أليف ألفا أنها لحقت بمختبرات الصدارة. ما تدعيه هو الاختصاص القضائي. فقد قالت الشركة إن كوليبري بنته فرقها الخاصة في ألمانيا ودُرب على بنية تحتية في ألمانيا وفنلندا، في ظل القانون الأوروبي والألماني ودون سيطرة أجنبية، وإنها صممت النموذج من البداية بما يتوافق مع قانون الذكاء الاصطناعي الأوروبي ومدونة قواعد الممارسة للذكاء الاصطناعي العام واللائحة العامة لحماية البيانات.
والعرض موجه إلى الإدارة العامة والصناعة وقطاع الطيران: مشترون لا يستطيعون إرسال مستنداتهم الداخلية إلى خدمة استدلال تابعة لجهة خارجية. وتشغيل 3.46 مليار معامل لكل رمز صغير بما يكفي لتشغيله داخل منشآت العميل نفسه، وهذا هو الغرض من هذه البنية.
ودُرب النموذج كذلك على الامتناع عن الإجابة. فقد استخدمت أليف ألفا بيانات امتناع وبروتوكولا تسميه ميرلين-آرثر، بحيث يقول كوليبري إنه لا يعرف حين لا تكون الإجابة موجودة في السياق المقدم له، وهو سلوك تقول الشركة إن العملاء يطلبونه وإنها تتابعه كمقياس خلال التدريب.
الأرقام، ومن أنتجها
كل النتائج المنشورة لكوليبري هي من أليف ألفا نفسها. وبحسب أرقامها، يبلغ النموذج 96.9 في اختبار AIME 2025، و90.0 في ترجمة ألمانية لاختبار AIME 2026، و84.3 في GPQA Diamond، و85.9 في LiveCodeBench v6. وقارنته الشركة بنموذج Qwen3.6-35B-A3B من علي بابا، وNemotron 3 Super من إنفيديا، وMistral Small 4، وقالت إن كوليبري يضاهي نماذج تبلغ معاملاتها النشطة أربعة أضعاف معاملاته. لكن التقدم غير متساو: في اختبار لوكلاء البنوك تعلن الشركة 38.1 مقابل 10.6 لنموذج Qwen3.6-35B-A3B، أما في BFCL v4 فتعلن 61.4 مقابل 67.2 لنموذج كوين.

ومجموعة المقارنة نفسها محل خلاف. فقد أشار موقع تريندينغ توبيكس إلى أن المنافسين الثلاثة الذين اختارتهم أليف ألفا يعودون جميعا إلى الربيع، وأن كوليبري لم يقس في مواجهة Qwen3.8 أو GLM-5.3 أو Kimi K3. وبحسب قراءة الموقع لمؤشر أرتيفيشال أناليسيس للذكاء، سيحل كوليبري خلف عشرين نموذجا مفتوح الأوزان على الأقل. ورد أليف ألفا هو أن الاختبارات العامة تصف احتياجات عملائها وصفا سيئا. ولم ينشر حتى الآن أي تقييم مستقل لكوليبري.
ثلاثة أشهر من 30 مليارا إلى 78 مليارا
الإصدار حجة أيضا حول السرعة. فقد كان لكوليبري أوريجين 30.6 مليار معامل في المجموع، ونافذة 65 ألف رمز، و7.51 تريليون رمز تدريب. وأكمل كوليبري تدريبه الأولي في 11 سبتمبر، بعد ثلاثة أشهر. وفي تلك الفترة ضاعفت أليف ألفا عدد الخبراء ثلاث مرات، واستبدلت خوارزمية التوجيه، وأحلت محل الانتباه الكامل نافذة متحركة بطول 512 رمزا مع انتباه كامل كل خمس طبقات، ولقنت النموذج أربعة مستويات من جهد الاستدلال.
واستمر التدريب الأولي 21 يوما وشهد 38 انقطاعا غير مخطط له بسبب أعطال في العتاد وانقطاع الاتصالات، أي نحو انقطاع واحد لكل عشرة آلاف ساعة معالجة رسومية، قالت الشركة إن مسار عملها تولاها جميعا دون تدخل بشري.
وما يستحق المتابعة هو ما إذا كانت أي قائمة تصنيف مستقلة ستؤكد أيا من هذا، وما إذا كانت الجهات العامة الألمانية ستشغل النموذج فعليا. فتقييمات أليف ألفا الداخلية القريبة من العملاء هي حتى الآن الدليل الوحيد على أن تخصيصها يعمل.