قم بشحن Grok 4,7 من قبل SpaceXAI، وتضعه التقييمات المستقلة في المركز الرابع بين مختبرات الذكاء الاصطناعي الرائدة.
قامت شركة Artificial Analysis، وهي شركة مستقلة لتقييم النماذج، بإعطاء النموذج درجة 46 في مؤشر الذكاء الخاص بها، أي نقطتين فوق Grok 4,6. وتتفوق عليه كل من كلود فابل 5,1 وGPT-6 Astra وكلود أوبس 5.
دفع Grok 4,7 شركة SpaceXAI إلى المراكز الأربعة الأولى لمختبرات الذكاء الاصطناعي
قال إيلون ماسك قبل الإطلاق أن النموذج سيعمل على قاعدة من 2,1 تريليون معلمة وسيتجاوز جميع النماذج الحالية. أضاف أيضا أن تدريب النموذج شمل بيانات شركة سبيس إكس.
تابعنا على X للحصول على آخر الأخبار فور حدوثها
لكن كيف يعمل Grok 4,7 فعليا؟ على اختبار AA-Briefcase، وهو معيار من شركة Artificial Analysis لمهام العمل الاحترافية الواقعية، حصل Grok 4,7 على 1 657 Elo. يمثل ذلك قفزة بـ111 نقطة فوق Grok 4,6 واقترب بمستواه من كلود أوبس 5.
على GDPval-AA، وصل النموذج إلى 1 695 Elo، مما يضعه 90 نقطة فوق سابقه. تحركت نتائج البرمجة في نفس الاتجاه.
اقرن مع Grok Build، وكيله الخاص للبرمجة، حصل Grok 4,7 على 56 في مؤشر وكيل الترميز. هذا تسع نقاط فوق Grok 4,6.
تجاوز النموذج GPT-5,6 Sol ويأتي بعد كلود فابل 5,1 من Anthropic وGPT-6 Astra وأوبس 5 فقط.
أفاد المنشور بأن حصول Grok 4,7 على 46 في مؤشر الذكاء من Artificial Analysis قد أدخل SpaceXAI إلى قائمة أفضل أربعة مختبرات ذكاء اصطناعي، وأن أداء مؤشر وكيل البرمجة تحسن أيضا متفوقا على GPT-5,6 Sol.
تحرك النموذج بالكاد في أماكن أخرى. زادت نسبته ب4,5 نقاط% على اختبار Terminal-Bench 4.0 و3 نقاط% على اختبار GDP.pdf. تراجعت الدرجات في اختبارات AA-LCR وAutomationBench-AA. في يوليو، تصدر Grok 4.5 اختبار AutomationBench، مما دعم ادعاء ماسك بأنه يضاهي كلود أوبوس.
تحقق المكاسب مع فاتورة رمزية
لم تتغير بطاقة الأسعار. لا يزال Grok 4.7 يكلف $2 لكل مليون رمز إدخال و$6 لكل مليون رمز إخراج. تظل الوصولات المخبئية بخصم $0,50 ، وتستمر نافذة السياق ذات 500 000 رمز من Grok 4.6.
يؤدي النموذج عملاً أكبر بكثير لكل إجابة. قيست تحليلات الذكاء الاصطناعي بحوالي 81 000 رمز إخراج لكل مهمة Index، مقابل 36 000 لGrok 4.6 و27 000 لGPT-6 Astra. لذلك، يؤدي تسعير الرموز الثابت إلى فاتورة أعلى لكل مهمة.
يؤثر هذا الطلب على الرموز على قسم أبلغ سابقاً عن خسارة بقيمة $1,26 مليار. في الوقت نفسه، صرح ماسك في 14 سبتمبر أن Grok 4.8 سينهي التدريب خلال أسبوع.
توقع ماسك أيضاً أن يكون Grok 5 النموذج الذي يصل إلى الذكاء الاصطناعي العام. سيختبر الإصدار القادم ما إذا كان SpaceXAI يمكنه الصعود في التصنيفات دون حرق المزيد من الحوسبة.
اشترك في قناتنا على يوتيوب لمشاهدة القادة والصحفيين يقدمون تحليلاتهم الخبيرة









