← Alle gidsenIn het kort
Gelanceerd op 9 juli 2025 door xAI. Grok 4 is getraind met zware reinforcement learning op redeneren, en zijn Heavy-configuratie was het eerste model dat de 50% doorbrak op Humanity's Last Exam - een benchmark van 2.500 vragen op PhD-niveau over wiskunde, natuurkunde, scheikunde, taalkunde en techniek.
Op het All-inclusive-abonnement kost een Grok 4-antwoord 3 credits.
Benchmarks
- Humanity's Last Exam (tekstsubset): 50,7% - als eerste voorbij de 50%.
- ARC-AGI v2 (nieuw abstract redeneren): 15,9% - grofweg het dubbele van het volgende commerciƫle model bij release.
- USAMO 2025-wiskundebewijsbenchmark: 61,9% in de Heavy-configuratie.
Het best in op Magnus
Zwaar redeneren met attitude: onderzoeksvragen, advocaat-van-de-duivel-standpunten en debatrondes tegen een Claude-agent. Zijn directe, licht oneerbiedige stijl maakt hem favoriet voor een uitdager-persona op de agentbalk.
- Grok dekt chat en documenten; integratietools (Gmail, Agenda, Slack-acties) blijven bij Claude.