2026/08/13
قفزة نوعية في عالم البرمجة: Grok 4.6 يقتحم صدارة النماذج الذكية بأداء استثنائي

أطلقت شركة SpaceXAI نموذجها الجديد Grok 4.6، ليمثل بذلك خطوة محورية في قدرات الوكلاء المستقلين ومهام البرمجة المعقدة. يأتي هذا الإصدار خلفاً لـ Grok 4.5، مع تركيز استراتيجي على تعزيز الثبات في المهام البرمجية متعددة الخطوات التي تتطلب دقة عالية.

أداء تنافسي على مؤشرات الذكاء العالمية

سجل Grok 4.6 قفزة ملحوظة على مؤشر Artificial Analysis، حيث وصل إلى 61 نقطة، ليتساوى بذلك مع نموذج GPT-5.6 Sol Max، متجاوزاً في أدائه نموذج Kimi K3 الصيني، بينما لا يزال التنافس محتدماً مع نماذج مثل Claude Opus 5 وClaude Fable 5 التي تحتفظ بمراكز متقدمة.

  • حقق جروك 4.6 قفزة كبيرة في اختبارات البرمجة والمهام المعقدة متعددة الخطوات.
  • سجل 61 نقطة على مؤشر Artificial Analysis متساويًا مع GPT-5.6 Sol Max.
  • رفع أداءه في DeepSWE وTerminal-Bench مع استمرار تفوق منافسين في بعض الاختبارات.
  • يقدم 4 مستويات للتفكير وسعرًا يبدأ من 2 دولار لكل مليون رمز مدخل.

نتائج الاختبارات: تفوق في بيئات التطوير

كشفت نتائج الاختبارات التقنية عن حجم التحسن الكبير مقارنة بالإصدار السابق، حيث حقق النموذج قفزة نوعية في اختبار GDPval-AA v2 الخاص بالمهام المعرفية المعقدة، ليصل إلى 1753 نقطة مقارنة بـ 1526 نقطة في الجيل السابق. وتتلخص أبرز نتائج الاختبارات في الآتي:

  • كفاءة البرمجة (CursorBench v3.2): حقق 69.9% داخل بيئات التطوير الحقيقية.
  • اختبار DeepSWE v1.1: قفز الأداء إلى 65.9%، بزيادة قدرها 11.9 نقطة.
  • اختبار Terminal-Bench v3.0: وصل الأداء إلى 26%، مقارنة بـ 15.7% في الإصدار السابق.
مقارنة

تطوير الوكلاء البرمجيين ومرونة الاستخدام

يركز التحديث الجديد على الحفاظ على تماسك وكلاء الذكاء الاصطناعي خلال العمليات الطويلة، مما يمنع فقدان السياق أو التكرار. ويوفر النموذج أربعة مستويات من جهد التفكير، بدءاً من المستوى المنخفض وصولاً إلى مستوى xhigh الجديد، مما يمنح المطورين مرونة أكبر في الموازنة بين السرعة والدقة عبر منصات مثل Cursor وOpenRouter وVercel وCloudflare.

هيكلة التكاليف ونوافذ السياق

تحليل

تعتمد التسعيرة الجديدة على نموذج تنافسي يبدأ من 2 دولار لكل مليون رمز مدخل و6 دولار لكل مليون رمز مخرج، مع تطبيق خصومات للرموز المخزنة مؤقتاً. وتحتفظ نافذة السياق بسعتها البالغة 500 ألف رمز، مع الإشارة إلى أن تجاوز حد الـ 200 ألف رمز يؤدي إلى مضاعفة التكاليف لتصل إلى 4 دولار للمدخلات و12 دولار للمخرجات، مما يضع المطورين أمام معادلة دقيقة لضبط التكاليف مقابل الأداء.

تم طباعة هذه الخبر من موقع السلام نيوز www.yen-news.com - رابط الخبر: http://alsalam-news.com/news35091.html