GPT-5.6 أم Grok 4.5؟ ما الذي يقدمه لك فعلياً سعر 2 دولار لكل مليون توكن؟

Reviewers weigh OpenAI's new flagship model against SpaceXAI's budget challenger after both launched a day apart in July. (Image: Shutterstock)
Reviewers weigh OpenAI's new flagship model against SpaceXAI's budget challenger after both launched a day apart in July. (Image: Shutterstock)

Grok 4.5 وGPT-5.6 أُطلقا بفارق يوم واحد، ليقسما آراء المراجعين بين تفوق OpenAI في درجة البرمجة العاملية بنسبة 91.9% وبين تحدي SpaceXAI للتسعير المتقدم عبر كلفة 2 دولار فقط لكل مليون توكن.

أبرز النقاط:

  • GPT-5.6 Sol يتفوق في معظم اختبارات المقارنة المباشرة، بينما يتفوق Grok 4.5 في السعر والسرعة وكفاءة استهلاك التوكنات.
  • مختبرون مستقلون يضعون Grok 4.5 في المركز الرابع في الذكاء، مع معدل هلوسة تضاعف إلى 54%.
  • المراجِعون يفضلون GPT-5.6 في الكتابة وسلاسل البرمجة الطويلة، وGrok 4.5 للمهام الضخمة منخفضة التكلفة.

معايير المقارنة بين Grok 4.5 وGPT-5.6

SpaceXAI طرحت Grok 4.5 في 8 يوليو، وردّت OpenAI في اليوم التالي بإطلاق GPT-5.6، وهي عائلة تضم النسخة الرائدة Sol إلى جانب النسختين الأرخص Terra وLuna. شركة القياس Artificial Analysis وضعت Grok الجديد في المركز الرابع على مؤشر الذكاء لديها بـ54 نقطة، خلف Claude Fable 5 وGPT-5.5 وOpus 4.8.

المواجهة المباشرة تميل لمصلحة OpenAI. بطاقة نتائج أولية تُقدّر GPT-5.6 Sol عند 86 نقطة مقابل 82 لـGrok 4.5، مدفوعة بفارق واضح في المهام العاملية القائمة على الطرفية (91.9% مقابل 83.3%)، في حين جاءت معدلات الأداء في البرمجة شبه متعادلة عند 64.7 مقابل 64.6.

OpenAI تقول إن Sol في وضع أقصى الاستدلال حقق رقماً قياسياً بلغ 80 نقطة على مؤشر Coding Agent المستقل، بينما سجّل Grok 4.5 نتيجة 76 ضمن بيئة Grok Build الخاصة به. لكن المعادلة الاقتصادية تعكس الكفة: Grok يفرض 2 دولار لكل مليون توكن إدخال مقابل 5 دولارات لـSol، وتكاليف إنهاء مهمة برمجية كاملة تبلغ 2.49 دولار مقابل 11.80 دولار لـFable 5.

اطلع أيضاً: رهانات Dodgers تصل إلى 68 مليون دولار مع تحوّل Polymarket وKalshi إلى سباق البلاي أوف في البيسبول

البرمجة والكتابة والمهام اليومية

التقارير العملية تعكس الانقسام ذاته. في اختبار طويل الأجل واحد أظهر أن Sol أتم 63.7% من أكثر من 100 مهمة حقيقية على مستودعات برمجية دون أخطاء تجريبية، مع قدرته على البقاء متماسكاً عبر قوائم تحقق متعددة الخطوات وفوضوية. اختبار برمجة مستقل آخر سجّل 92 نقطة من 100 لـSol مقابل 87 لـGrok 4.5، وهي نتيجة تعادل أفضل النماذج مفتوحة الأوزان.

الكُتّاب يميلون في الاتجاه نفسه؛ مختبرون مبكرون وصفوا Sol بأنه أداة العمل اليومية الأساسية، القادرة الآن على تغطية نحو 80% من أعمال المعرفة الروتينية، مع قدرة أفضل على الالتزام بأدلة الأسلوب مقارنة بالمنافسين.

Grok 4.5 يرد بالسرعة والانضباط. مراجِعون شغّلوا النموذج على أعمال حية أفادوا بأنه يقدّم نواتج نظيفة من المحاولة الأولى، وإخراجاً منظماً بدرجة عالية، واستجابات في أقل من خمس ثوانٍ بسرعات تقارب 80 توكناً في الثانية. لكن الدقة تبقى نقطة الضعف: معدل الهلوسة المقاس قفز من 25% إلى 54% رغم تحسن الدقة الواقعية إلى 52%.

تقييمات الخبراء وأسئلة الثقة

إيلون ماسك قدّم Grok 4.5 على أنه «نموذج من فئة Opus، لكن أسرع وأكثر كفاءة في التوكنات وبكلفة أقل». بعض المحللين جادلوا بأن فجوة السعر أهم من فجوة التقييمات، بما أن Grok يستهلك 1.9 مليون توكن للمهمة مقابل 7.2 مليون لـFable 5.

المشككون يرون أسباباً للحذر. مراجِعون أشاروا إلى أن نتائج الإطلاق كانت مُبلَّغاً عنها من البائع نفسه، وأن النموذج طُرح بلا بطاقة تقنية، وأن Cursor سحبت معياراً داخلياً بعد أن تبيّن أن Grok تدرّب بالخطأ على شيفرتها. GPT-5.6 بدوره يحمل تحفّظاً خاصاً، إذ تعترف بطاقة النظام لدى OpenAI بأن النموذج يتجاوز التعليمات المقيّدة أكثر من سلفه.

المنافسة اختتمت فترة مضطربة في القطاع: SpaceX استحوذت على xAI في فبراير، ثم اشترت Cursor مقابل 60 مليار دولار في يونيو، وأعادت تسمية المختبر إلى SpaceXAI قبل يومين فقط من طرح Grok 4.5. في المقابل، أمضت OpenAI أواخر يونيو مع Sol قيد مراجعة حكومية، بينما Fable 5 من Anthropic، الذي لا يزال متصدر المعايير المنشورة، لم يعد إلى الخدمة إلا في 1 يوليو بعد تعليق دام 19 يوماً.

اقرأ التالي: إيثريوم يتقدم على بيتكوين ويختبر سيناريو الصعود لعام 2026 لدى توم لي

Alexey Bondarev profile photo

Alexey Bondarev

أليكسي بونداريف هو رئيس قسم المحتوى في Yellow.com، وقد قام بتغطية أخبار العملات المشفّرة خلال السنوات العشر الماضية. وهو متخصص في إعداد أبحاث معمّقة ومقالات تعليمية، مع تركيز على التقارير التحليلية، وسياق الصناعة، والقوى الكبرى التي تشكّل عالم العملات المشفّرة، ابتداءً من عصر الذكاء الاصطناعي وتقنيات الأمن وصولاً إلى الابتكار في التكنولوجيا المالية. يؤمن بأن كل ما هو رقمي سيتفوّق قريبًا على كل ما هو تماثلي، ويعمل بجد لجعل ذلك حقيقة.

إخلاء المسؤولية وتحذير المخاطر: المعلومات المقدمة في هذا المقال مخصصة للأغراض التعليمية والإعلامية فقط وتستند إلى رأي المؤلف. وهي لا تشكل مشورة مالية أو استثمارية أو قانونية أو ضريبية. أصول العملات المشفرة شديدة التقلب وتخضع لمخاطر عالية، بما في ذلك خطر فقدان كامل أو جزء كبير من استثمارك. قد لا يكون تداول أو حيازة الأصول المشفرة مناسباً لجميع المستثمرين. الآراء المعبر عنها في هذا المقال هي آراء المؤلف (المؤلفين) فقط ولا تمثل السياسة أو الموقف الرسمي لشركة Yellow أو مؤسسيها أو مديريها التنفيذيين. قم دائماً بإجراء بحثك الشامل بنفسك (D.Y.O.R.) واستشر مختصاً مالياً مرخصاً قبل اتخاذ أي قرار استثماري.
أخبار ذات صلة
مقالات البحث ذات الصلة
مقالات التعلم ذات الصلة
GPT-5.6 أم Grok 4.5؟ ما الذي يقدمه لك فعلياً سعر 2 دولار لكل مليون توكن؟ | Yellow