← كل الأدلةلمحة سريعة
أطلقته xAI في 9 يوليو 2025. دُرّب Grok 4 بتعلّم معزز مكثف على الاستدلال، وكانت نسخته Heavy أول نموذج يتجاوز 50% في اختبار Humanity's Last Exam - وهو اختبار من 2,500 سؤال بمستوى الدكتوراه يغطي الرياضيات والفيزياء والكيمياء واللسانيات والهندسة.
في الخطة الشاملة يكلّف رد Grok 4 ثلاثة أرصدة (3).
نتائج الاختبارات المعيارية
- Humanity's Last Exam (القسم النصي): 50.7% - أول من يتجاوز عتبة الـ 50%.
- ARC-AGI v2 (استدلال تجريدي مستجد): 15.9% - نحو ضعف أقرب نموذج تجاري عند الإصدار.
- اختبار البراهين الرياضية USAMO 2025: 61.9% في نسخة Heavy.
أفضل استخداماته على Magnus
الاستدلال الصعب بشخصية جريئة: أسئلة البحث، وآراء محامي الشيطان، وجولات المناظرة ضد وكيل يعمل بـ Claude. أسلوبه المباشر الجريء قليلًا يجعله مفضلًا لشخصية المتحدّي في شريط الوكلاء.
- يغطي Grok الدردشة والمستندات؛ وتبقى أدوات التكاملات (Gmail وتقويم Google وإجراءات Slack) مع Claude.