← Toate ghidurileLa prima vedere
Lansat pe 9 iulie 2025 de xAI. Grok 4 a fost antrenat cu reinforcement learning intens pe raționament, iar configurația sa Heavy a fost primul model care a depășit 50% la Humanity's Last Exam - un benchmark de 2.500 de întrebări la nivel de doctorat acoperind matematică, fizică, chimie, lingvistică și inginerie.
Pe planul All-inclusive, un răspuns Grok 4 costă 3 credite.
Benchmark-uri
- Humanity's Last Exam (subset text): 50,7% - primul care a depășit pragul de 50%.
- ARC-AGI v2 (raționament abstract nou): 15,9% - aproximativ dublu față de următorul model comercial la lansare.
- USAMO 2025 benchmark demonstrație matematică: 61,9% în configurația Heavy.
Cel mai bun la în Magnus
Raționament dificil cu atitudine: întrebări de cercetare, perspective de avocat al diavolului și runde de dezbatere împotriva unui agent Claude. Stilul său direct, ușor ireverent îl face favorit pentru un personaj contestatar pe bara de agenți.
- Grok acoperă chat și documente; instrumentele de integrare (Gmail, Calendar, acțiuni Slack) rămân cu Claude.