تؤكد المستودعات إتاحة أوزان الأحجام الستة بترخيص “Apache 2.0″، لكن بعض بطاقات النماذج تقول إن بيانات وشفرة تدريب ستصدر لاحقاً.
تصور تحريري للأحجام الستة في عائلة “K2 Horizon”. رسم أصلي مولّد بالذكاء الاصطناعي لأغراض تحريرية.
- تضم عائلة “K2 Horizon” ستة نماذج تبدأ من 0.9 مليار معامل وتصل إلى 375 ملياراً.
- تظهر مستودعات “Hugging Face” العامة ملفات أوزان لكل الأحجام الستة المعلنة تحت ترخيص “Apache 2.0”.
- لا تثبت المواد المتاحة اكتمال نشر الشفرة والبيانات ونقاط التحقق لكل نموذج حتى وقت الفحص.
- نتائج الأداء المنشورة اختبارات أعلنها المطور، ولا تكفي للحكم على جودة النماذج في اللغة العربية.
عائلة واحدة من الساعة إلى الخادم
أطلقت “جامعة محمد بن زايد للذكاء الاصطناعي”، عبر “معهد النماذج التأسيسية” التابع لها، عائلة “K2 Horizon” التي تضم ستة نماذج أساس تتدرج من 0.9 إلى 375 مليار معامل. ويضع الإطلاق خيارات صغيرة للأجهزة محدودة الموارد إلى جانب نماذج كثيفة ومتفرقة موجهة إلى محطات العمل والخوادم والاستخدام المؤسسي.[1][2]
الأحجام المعلنة هي 0.9 و3.7 و7 و32 مليار معامل، إضافة إلى نموذج متفرق يضم 36 مليار معامل ويشغّل نحو 4 مليارات لكل رمز، ونموذج رئيسي يضم 375 ملياراً ويشغّل نحو 23 ملياراً لكل رمز. وتعرض مجموعة “Hugging Face” الرسمية مستودعاً أساسياً لكل واحد من هذه الأحجام الستة، إلى جانب نسخ مكممة ومجموعات بيانات مساندة.[3][4]
يقول المعهد إن النماذج تشترك في قرارات معمارية ومنهجية تدريب وواجهات وأدوات نشر، مع مفردات أصغر للنموذج ذي 0.9 مليار معامل. هذه الوحدة قد تسهّل انتقال المطور من نموذج صغير إلى آخر أكبر، لكنها لا تعني أن الكلفة أو متطلبات الذاكرة أو النتائج ستكون متماثلة بين البيئات. كما أن وصف أصغر نموذج بأنه مناسب للساعات والهواتف يعبر عن هدف تصميمي أعلنه المطور، ولا يثبت وحده سرعة الاستجابة أو استهلاك الطاقة على جهاز تجاري محدد. ويتطلب ذلك قياسات على عتاد فعلي وإصدارات مكممة وإعدادات تشغيل معلنة.[1]
ماذا تعني الإتاحة المفتوحة هنا؟
تصف الجهة المطورة الإطلاق بأنه مفتوح بالكامل، وتقول إن النماذج والشفرة تصدر بترخيص “Apache 2.0”. وأكد فحص واجهة “Hugging Face” العامة، وقت إعداد التقرير، أن المستودعات الستة غير خاصة وغير محجوبة، وأن بياناتها الوصفية تحمل الترخيص نفسه وتدرج ملفات أوزان بصيغة “Safetensors”. وينص نص الترخيص الرسمي، مع التقيد بشروطه، على منح صلاحيات إعادة إنتاج العمل وإعداد أعمال مشتقة منه وتوزيعه، لكن مجموعات البيانات تبقى خاضعة لتراخيصها الخاصة.[3][4][17]
مع ذلك، لا تدعم حالة المستودعات حتى وقت الفحص صياغة أن جميع مكونات دورة التدريب اكتملت لكل الأحجام. بطاقة نموذج 0.9 مليار تقول إن بيانات التدريب أو وصفتها والشفرة ستتاح لاحقاً، بينما تقول بطاقتا 3.7 و7 مليارات إنها متاحة. أما مستودع 32 ملياراً فيعرض نسخة المرحلة الأولى وينص على أن نقطة التحقق النهائية ستصدر لاحقاً.[5][6][7][8]
وتقول بطاقتا 36 و375 ملياراً إن نقطة التحقق النهائية منشورة، لكنهما تستخدمان صيغة المستقبل بشأن نقاط التحقق الوسيطة والبيانات وشفرة التدريب.[9][10] وفي المقابل، يوجد مستودعان عامان يصفهما المطور بأنهما لشفرة ما قبل التدريب وما بعده، لكن كلاً منهما لا يحتوي حالياً إلا README.md وLICENSE و.gitignore، بلا شفرة فعلية، كما توجد عدة مجموعات بيانات مرتبطة بالمشروع.[11][12][13][14][15][16] لذلك فالأدق هو الفصل بين وجود مكونات عامة على مستوى العائلة وبين اكتمال الحزمة الموعودة لكل نموذج على حدة.
أرقام الأداء تحتاج اختباراً خارجياً
يقول “معهد النماذج التأسيسية” إن النماذج الثلاثة الأصغر حققت نتائج رائدة ضمن فئات أحجامها في اختبارات الرياضيات والاستدلال والبرمجة واستخدام الأدوات، وإن نموذج 36 ملياراً يوفر كفاءة مرتفعة قياساً إلى عدد المعاملات النشطة. كما يعرض المطور جداول تقارن النموذج الأكبر بنماذج مفتوحة ومغلقة في مهام وكيلية وعلمية وبرمجية.[1][3]
هذه نتائج صادرة عن الجهة المطورة، حتى عندما تنشر تفاصيل البروتوكولات والمقارنات. بعض بطاقات النماذج نفسها تنبه إلى اختلاف بروتوكولات النماذج المرجعية، كما أن جداول 32 ملياراً تظهر أن منافسين سجلوا نتائج أعلى في عدة اختبارات. ولهذا لا يثبت الإعلان تفوقاً عاماً، ولا يمكن اختزال أداء نموذج واحد في رقم أو ترتيب واحد.[8]
كذلك لا تقدم المصادر المستخدمة تقييماً مخصصاً للعربية أو لهجاتها. منشأ المشروع في أبوظبي لا يكفي لاستنتاج جودة لغوية عربية، ولا تظهر الصفحات المفحوصة نتائج معيارية عربية يمكن البناء عليها. يحتاج الحكم إلى اختبارات مستقلة تشمل الفصحى واللهجات، واسترجاع المعرفة المحلية، والسلامة الثقافية، قبل توصية المؤسسات العربية بالتبني.
قيمة بحثية مشروطة بالاكتمال
بالنسبة إلى الجامعات والشركات، تكمن القيمة الفورية في إمكان تنزيل الأوزان وفحص البنية وتشغيل أحجام مختلفة محلياً، بدلاً من حصر التجربة في واجهة مغلقة. وقد تفيد الأحجام الصغيرة في أبحاث الأجهزة الطرفية والخصوصية، بينما تمنح الأحجام الأكبر فرق البنية التحتية مجالاً لاختبار الاستضافة الداخلية وتوجيه المهام بين نماذج متفاوتة الكلفة.
لكن قابلية إعادة إنتاج التدريب تعتمد على أكثر من الأوزان: يلزم تطابق الشفرة والبيانات أو وصفات بنائها والإعدادات والسجلات ونقاط التحقق مع كل نسخة معلنة. والتباين الحالي بين لغة البيان وبطاقات بعض المستودعات يجعل التحقق الزمني مهماً؛ فقد تتغير الحالة مع إضافة الملفات لاحقاً، وعندها ينبغي تحديث الحكم استناداً إلى ما أصبح متاحاً فعلياً.
الخلاصة أن “K2 Horizon” إطلاق واسع بستة أحجام وأوزان ظاهرة وترخيص واضح للنماذج والشفرة، لكنه ليس دليلاً مكتملاً بعد على تحقق كل وعود الانفتاح لكل حجم. أما التفوق التقني والأداء العربي فيبقيان سؤالين تجريبيين، لا نتيجة يحسمها بيان الإطلاق.
المصادر
- “جامعة محمد بن زايد للذكاء الاصطناعي” — بيان الإطلاق
- “ذا ناشيونال” — تغطية مستقلة للإطلاق
- “معهد النماذج التأسيسية” — المدونة التقنية
- “Hugging Face” — مجموعة “K2 Horizon”
- بطاقة نموذج 0.9 مليار
- بطاقة نموذج 3.7 مليارات
- بطاقة نموذج 7 مليارات
- بطاقة نموذج 32 ملياراً
- بطاقة نموذج 36 ملياراً
- بطاقة نموذج 375 ملياراً
- مستودع “xllm” العام — موصوف لشفرة ما قبل التدريب؛ بلا شفرة فعلية حالياً
- مستودع “horizon-post-train” العام — موصوف لشفرة ما بعد التدريب؛ بلا شفرة فعلية حالياً
- مجموعة بيانات “TxT360-v2”
- مجموعة بيانات “Code-Reasoning”
- مجموعة بيانات “Math-Reasoning”
- مجموعة بيانات “SFT-Reasoning”
- “مؤسسة برمجيات أباتشي” — النص الرسمي لترخيص “Apache 2.0”