العربية

أطلقت Google وMeta نماذج ذكاء اصطناعي منافسة بفارق ساعات فقط. لم يفز أي منهما: من يتصدر؟

  • أطلقت Google وMeta نماذج الذكاء الاصطناعي المتقدمة المنافسة في 2 سبتمبر.
  • يكلف Gemini 3.8 Flash ‎0.75 دولار لكل مليون رمز إدخال.
  • حصل Muse Spark 1.3 xhigh على 61 نقطة في مؤشر الذكاء الاصطناعي للتحليل الاصطناعي.
Promo

أصدرت جوجل وميتا أحدث نماذج الذكاء الاصطناعي المتقدمة الخاصة بهما بفارق ساعات فقط يوم الأربعاء. شحنت جوجل نسخة Gemini 3,8 Flash جنبًا إلى جنب مع إصدار خاص بالأمن السيبراني، بينما أطلقت ميتا Muse Spark 1,3.

تدعو عمليات الإطلاق هذه للمقارنة المباشرة. أظهرت اختبارات مستقلة أجرتها مؤسسة Artificial Analysis تقسيم النتائج. تتفوق ميتا في الأعمال المعرفية العاملة بالوكالة والتفكير العلمي، بينما تحتفظ جوجل بالأفضلية في استرجاع المعلومات الدقيقة وبرمجة النهايات.

ممول
ممول

إصداران متقدمان يصدران في نفس اليوم

أطلقت جوجل Gemini 3,8 Flash كثالث إصدار Flash خلال ستة أسابيع. يكلف النموذج $0,75 لكل 1 مليون رمز إدخال و$3,75 لكل 1 مليون رمز إخراج.

تابعنا على X للحصول على آخر الأخبار فور حدوثها

يمتد هذا السعر التمهيدي حتى 31 ديسمبر 2026. بعد ذلك تتضاعف الأسعار إلى $1,50 و$7,50 لكل 1 مليون رمز.

اقترنت جوجل بالنموذج العام بإصدار Gemini 3,8 Flash Cyber. أصبح النموذج متاحًا لمجموعة من المدافعين الموثوق بهم. حصل على 86,2% في اختبار CyberGym، وهو معيار لاكتشاف الثغرات.

ممول
ممول

حقق الإصدار السيبراني أيضًا 47,2% في اختبار CWE-Bench، وهو معيار لتصحيح الثغرات. صرحت جوجل بأن النموذج أنتج تصحيحات صحيحة لثغرات كروم بمقدار 2,6 مرة أكثر من النماذج التجارية الأكبر حجماً.

تأتي إمكانية الوصول خلف برنامج Fairwind، الذي يقصر استخدام النموذج على الجهات الحكومية ومشغلي البنية التحتية الحيوية. وضعت أوبن إيه آي حدًا مشابهًا قبل يوم حول Astra، وهو أول نموذج تم تقييمه عند عتبة حرجة للأمن السيبراني.

في الوقت نفسه، طرحت ميتا Muse Spark 1,3 من خلال Muse Code وMeta Model API. قاس مهندسو الشركة تقريبًا عدد المكالمات للأدوات أقل بنسبة 20% مقارنة بالإصدار 1,2.

Gemini 3,8 Flash مقابل Muse Spark 1,3: المعايير المستقلة تفصل النتائج

اختبرت Artificial Analysis النماذج، و تظهر النتائج ترتيبها. حصل Muse Spark 1,3 بوضعية الحد الأقصى على 1 754 Elo في GDPval-AA v2. أعاد Gemini 3,8 Flash (مرتفع) نتيجة 1 545.

تقدمت ميتا أيضاً في اختبار وكيل البنك لسيرا ريسيرش بنسبة 52,4% مقابل 44,9% و في اختبار CritPt للاستدلال الفيزيائي. تصدرت فلاش جيميني 3,8 اختبار Terminal-Bench 2,1 بنسبة 87,6% ، و اختبار AA-LCR للسياق الطويل بنسبة 81% ، و اختبار AA-Omniscience للدقة بنسبة 55%.

حققت فلاش جيميني 3,8 أعلى نتيجة GPQA Diamond بين النماذج المختبرة بنسبة 95%. أنهى الاثنان بفارق نقطة واحدة عن بعضهما في اختبار Humanity's Last Exam.

لا يتم توفير أعلى نموذج حاصل على الدرجات من ميتا اليوم. ذكرت الشركة أن أقصى قدرات الاستدلال ستتوفر بعد استكمال اختبارات السلامة الإضافية، مما يبقي نسخة xhigh هي المتاحة حالياً.

سجل هذا الإصدار 61 على مؤشر الذكاء الاصطناعي للتحليل الصناعي، متفوقاً بأربع نقاط على Muse Spark 1,2. ويأتي بعد Claude Fable 5,1 الذي سجل 66 وبعد Claude Opus 5 الذي سجل 63 .

تجدر الإشارة إلى أن المزيد من الإصدارات جاهزة للإطلاق. صرح إيلون ماسك أن Grok 4,7 سيصل قريباً، ما سيضع أربعة إصدارات متقدمة في غضون أسبوعين.

اشترك في قناتنا على يوتيوب لمتابعة قادة وصحفيين يقدمون تحليلات وخبرات متخصصة


لقراءة أحدث تحليلات سوق العملات المشفرة من BeInCrypto، انقر هنا.

تنبيه

جميع المعلومات المنشورة على موقعنا الإلكتروني تم عرضها على أساس حسن النية ولأغراض المعلومات العامة فقط. لذا، فأي إجراء أو تصرف أو قرار يقوم به القارئ وفقاً لهذه المعلومات يتحمل مسؤوليته وتوابعه بشكل فردي حصراً ولا يتحمل الموقع أية مسؤولية قانونية عن هذه القرارات.

ممول
ممول