أصدرت أربعة مختبرات بارزة في مجال الذكاء الاصطناعي (AI) نماذج لغوية رائدة خلال فترة مدتها ثلاثة أسابيع في يوليو 2026، وقد تقلصت الفجوة بشكل حاد بين ما تنجزه هذه الأنظمة دون تدخل بشري وما كان متاحًا في السابق.
شركات الذكاء الاصطناعي العملاقة تطلق 4 نماذج رائدة في غضون 3 أسابيع مع دخول السباق مرحلة التسارع

النقاط الرئيسية
- أطلقت xAI نموذج Grok 4.5 في 8 يوليو بسعر 2/6 دولارات لكل مليون توكن، متفوقةً على أسعار Opus 4.8 بنسبة تزيد عن 60%.
- أصدرت شركة Anthropic نموذج Claude Opus 5 في 24 يوليو باعتباره النموذج الافتراضي الجديد لاشتراكات Claude Max.
- أصدرت Moonshot AI نموذج Kimi K3، وهو أكبر نموذج لها بـ 2.8 تريليون معلمة.
يستهدف كل من Grok 4.5 من xAI، وClaude Opus 5 من Anthropic، وعائلة GPT-5.6 من OpenAI، وKimi K3 من Moonshot AI نفس المشكلة: جعل نظام الذكاء الاصطناعي يقوم بمهمة تستغرق عدة ساعات، بدءًا من البحث ومرورًا بالبرمجة وصولًا إلى إعداد التقارير المنظمة، دون أن يضل طريقه عن الخطة الموضوعة.
Grok 4.5 يتم تدريبه على جلسات مطورين حقيقية
أطلقت xAI نموذج Grok 4.5 في 8 يوليو. يعمل النموذج على قاعدة تضم 1.5 تريليون معلمة، وقد تم تدريبه جزئيًا على بيانات استخدام حقيقية من Cursor، منصة البرمجة التي استحوذت عليها SpaceXAI في وقت سابق من هذا العام. تبلغ التكلفة 2 دولار لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج، مع نافذة سياق تبلغ 500,000 رمز.

وصف إيلون ماسك Grok 4.5 بأنه نموذج من فئة Opus يعمل بشكل أسرع وبتكلفة أقل. وتضعه الجهات المستقلة التي تتابع أداء النماذج في المرتبة الرابعة على مؤشر الذكاء الاصطناعي للتحليل (Artificial Analysis Intelligence Index)، متقدماً على جميع النماذج ذات التوزيع المفتوح، وبسعر يقل بأكثر من 60% عن كل من Claude Opus 4.8 وGPT-5.5. في اختبار Terminal-Bench 2.1، الذي يقيّم مدى كفاءة النموذج في إنجاز مهام الهندسة عبر سطر الأوامر، سجل Grok 4.5 نسبة 83.3%.
التغيير الأكبر يكمن في كفاءة الرموز. تقول xAI إن النموذج يحتاج إلى ما يقارب خمس الرموز الناتجة التي يتطلبها Opus 4.8 لأداء مهام مماثلة، مما يقلل من تكلفة تشغيل جلسات الوكيل الطويلة.
Claude Opus 5 يحافظ على مستواه السعري
أطلقت شركة Anthropic نموذج Claude Opus 5 في 24 يوليو، ووضعته كنموذج يقترب من أداء نموذج Claude Fable 5، وهو الإصدار الأكثر كفاءة للشركة، بنصف سعر Fable البالغ 10 دولارات للمدخلات و50 دولارًا للمخرجات. ويحمل Opus 5 نفسه نفس أسعار الإدخال البالغة 5 دولارات والإخراج البالغة 25 دولارًا مثل سابقه، Opus 4.8.

يأتي النموذج مزودًا بنافذة سياق تبلغ 1 مليون توكن، و128,000 توكن كحد أقصى للمخرجات، وإعدادًا قابلًا للتعديل لجهد الاستدلال يتراوح من «منخفض» إلى وضع «xhigh» الجديد. تقول شركة Anthropic إن Opus 5 يحقق أرقامًا قياسية جديدة في Frontier-Bench وGDPval-AA، وهما تقييمان لأعمال البرمجة والمعرفة، على الرغم من أنه يتخلف عن نموذج Claude Mythos 5 المقيد في مهام الأمن السيبراني. أصبح Opus 5 الآن النموذج الافتراضي في Claude Max والخيار الأقوى في Claude Pro.
OpenAI تقسم GPT-5.6 إلى ثلاث مستويات
قامت OpenAI بإتاحة GPT-5.6 للجمهور العام في 9 يوليو بعد فترة عرض مسبق استمرت أسبوعين واقتصرت على حوالي 20 مؤسسة خضعت للتدقيق من قبل الحكومة الأمريكية، وذلك في أعقاب أمر تنفيذي مرتبط بمراجعة سلامة النماذج الرائدة. تتوفر العائلة في ثلاث مستويات: Sol، النموذج الرائد، بسعر 5 دولارات للإدخال و30 دولارًا للإخراج لكل مليون توكن؛ Terra، وهو نموذج من الفئة المتوسطة بسعر 2.50 دولار و15 دولارًا، والذي تقول OpenAI إنه يضاهي GPT-5.5 بنصف التكلفة؛ و Luna، وهو نموذج سريع ومنخفض التكلفة بسعر 1 دولار و6 دولارات.

تشير OpenAI إلى أن Sol يتصدر مؤشر وكلاء الترميز والتحليل الاصطناعي (Artificial Analysis Coding Agent Index) ويحقق 88.8% في اختبار Terminal-Bench 2.1، وترتفع النسبة إلى 91.9% عندما يقوم النموذج بتشغيل أربعة وكلاء فرعيين بالتوازي في إطار «الوضع الفائق» الجديد. تحمل المستويات الثلاثة جميعها أعلى تصنيف داخلي للمخاطر من OpenAI فيما يتعلق باحتمالية إساءة الاستخدام السيبراني والبيولوجي، مما أدى إلى إجراء مراجعة إضافية خلال العرض المسبق المخصص للجهات الحكومية.
Kimi K3 يدفع نماذج الوزن المفتوح نحو آفاق جديدة
أطلقت Moonshot AI نموذج Kimi K3 في 16 يوليو، وهو نموذج «مزيج الخبراء» (Mixture of Experts) الذي يضم 2.8 تريليون معلمة، مع إجمالي 896 خبيرًا و16 خبيرًا نشطًا لكل مهمة. يحتوي النموذج على نافذة سياق تبلغ مليون رمز ومدخلات متعددة الوسائط أصلية، مع تسعير واجهة برمجة التطبيقات (API) بمعدل 3 دولارات للمدخلات و15 دولارًا للمخرجات لكل مليون رمز. وقد التزمت Moonshot بنشر الأوزان المفتوحة بالكامل بحلول 27 يوليو.

يُعد K3 أكبر نموذج مفتوح الأوزان تم إصداره حتى الآن، حيث يتفوق بحوالي 75% على أكبر نموذج مفتوح سابق كان مستخدمًا على نطاق واسع. وتضع أدوات التتبع المستقلة K3 في المرتبة الرابعة بين الأنظمة الرائدة الحالية، خلف كلود فابل 5 وGPT-5.6 سول، ولكن متقدمًا على كلود أوبوس 4.8.
لماذا يهم الفارق مع النماذج الأقدم
كانت نوافذ السياق التي تقل عن 200,000 توكن تُجبر المطورين في السابق على تقسيم قواعد البيانات البرمجية الكبيرة أو حزم الأبحاث إلى أجزاء. يعمل كل نموذج في هذه المجموعة الآن بسعة 500,000 توكن أو أكثر، حيث تصل سعة ثلاثة من أصل أربعة نماذج إلى مليون توكن، مما يسمح لجلسة واحدة باستيعاب مستودع كامل أو مجموعة من الوثائق المصدرية الأولية.
كما تحسنت موثوقية الوكلاء أيضًا. غالبًا ما كانت الأنظمة من فترتي 2023 و2024 تفقد خطتها بعد عدد قليل من استدعاءات الأدوات. أما النماذج التي تم إصدارها هذا الشهر، فقد صُممت لتحمل عشرات الخطوات المنسقة والاستعادة عندما يعرض استدعاء أداة بيانات خاطئة بدلاً من التوقف التام.
بالنسبة للمطورين، يتمثل التأثير العملي في انخفاض تكلفة كل مهمة مكتملة بدلاً من رفع الحد الأقصى لأي معيار أداء فردي. تشير ضوابط الجهد في Opus 5، والتسعير المتدرج في GPT-5.6، وادعاءات الكفاءة وراء Grok 4.5 إلى الهدف نفسه: السماح للفرق باختيار مقدار الحوسبة التي تستحقها المهمة بدلاً من دفع أسعار النماذج الرائدة مقابل كل طلب.
بالنسبة للمؤسسات وصانعي السياسات، يشير طرح GPT-5.6 الخاضع لرقابة الحكومة إلى أن الرقابة أصبحت الآن جزءًا لا يتجزأ من جداول إصدار النماذج الأكبر حجمًا، ولم تعد تُضاف بعد الإصدار. وكان التعليق المؤقت الذي قامت به شركة Anthropic في يونيو، بتوجيه من الحكومة، للوصول إلى Fable وMythos نسخة سابقة من نفس النمط.
تمت ترجمة هذه المقالة من الإنجليزية باستخدام الذكاء الاصطناعي. النسخة الإنجليزية الأصلية هي المصدر الموثوق؛ وقد تحتوي الترجمات الآلية على أخطاء، لا سيما في المصطلحات القانونية والتنظيمية.

















