كشفت شركة علي بابا الصينية، يوم الاثنين، عما وصفته بأنه أكبر نماذجها للذكاء الاصطناعي وأكثرها كفاءة، وهو نموذج Qwen3.8-Max، الذي لا يقل حجمه كثيرًا عن النموذج الذي أطلقته الشهر الماضي منافستها المحلية " مونشوت إيه آي".
وتخوض شركات التكنولوجيا الصينية، التي تمثل قوة كبيرة عالميًا في مجال نماذج الذكاء الاصطناعي ذات الأوزان المفتوحة منافسة شرسة وسريعة الوتيرة لبناء أنظمة أكثر قوة دون جعل تكاليف تشغيلها باهظة.
ويضم Qwen3.8-Max نحو 2.4 تريليون معلمة، وهي الإعدادات الرقمية التي يتعلمها النموذج من البيانات ويستخدمها للتعرف على الأنماط، وتوليد الإجابات، وتنفيذ المهام. ويضم نموذج "Kimi K3" من "مونشوت إيه آي" نحو 2.8 تريليون معلمة، بحسب "رويترز".
ولا يعني ارتفاع عدد المعلمات تلقائيًا أن النموذج أفضل، لكنه أصبح مؤشرًا يحظى بمتابعة واسعة لقياس حجم القدرة الحاسوبية والبيانات التي تقف وراء أنظمة الذكاء الاصطناعي المتقدمة.
وتحرص شركات التكنولوجيا الصينية على نشر عدد المعلمات لمساعدة نماذجها على اكتساب انتشار بين مجتمع المطورين. وتميل هذه النماذج إلى أن تكون ذات أوزان مفتوحة، ما يعني أن الإعدادات الأساسية التي تتيح للمطورين تشغيل النظام أو تعديله متاحة للتنزيل.
وفي المقابل، لا تنشر شركات "أوبن إيه آي" و"أنثروبيك" و"غوغل" الأميركية عدد المعلمات في نماذجها المغلقة المصدر.
وكُشف عن Qwen3.8-Max على منصة "Arena.AI" المعتمدة على مساهمات المستخدمين لمقارنة النماذج، حيث أصبح فورًا أعلى نموذج صيني تصنيفًا في فئة النماذج النصية، لكنه لا يزال متأخرًا عن "كلود فابل 5" وثلاثة إصدارات من "أوبوس"، وجميعها من تطوير "أنثروبيك".
أما في لوحة تصنيف "Arena.AI" الخاصة بنماذج الذكاء الاصطناعي التي تحلل الصور والمواد البصرية الأخرى، فقد جاء نموذج Qwen3.8-Max في المرتبة الثانية عالميًا، خلف أحد إصدارات "كلود فابل 5" فقط.
ويستطيع كل من Qwen3.8-Max وKimi K3 التعامل مع النصوص والصور والفيديو، ومعالجة ما يصل إلى مليون توكن في المرة الواحدة.
والتوكنات هي وحدات بيانات، غالبًا ما تكون أجزاءً من كلمات أو كلمات قصيرة، ويعني العدد الكبير منها أن النموذج يمكنه استيعاب كميات كبيرة من المحتوى دفعة واحدة، مثل ملفات قانونية طويلة، أو قاعدة برمجية كبيرة، أو مئات الصفحات من الوثائق.
وقالت "علي بابا" إن نموذجها يستخدم تصميم "مزيج الخبراء"، الذي يوزع العمل بين أجزاء متخصصة من النظام بدلًا من تشغيل النموذج بالكامل مع كل طلب. ولا يُستخدم في كل مرة سوى 95 مليار معلمة، ما يقلل التكاليف وزمن الاستجابة.
وأضافت الشركة أن النموذج أنجز مشروعًا في هندسة البرمجيات خلال 16 يومًا.
ومن المقرر إطلاق Qwen3.8-Max الأسبوع المقبل عبر منصة "Model Studio" التابعة لـ"علي بابا كلاود".
المصدر:
العربيّة