← Kaikki oppaatLyhyesti
xAI:n julkaisema 9. heinäkuuta 2025. Grok 4 koulutettiin vahvalla vahvistusoppimisella päättelyssä, ja sen Heavy-kokoonpano oli ensimmäinen malli, joka ylitti 50% Humanity's Last Exam -testissä - 2 500 kysymyksen, tohtorin tason vertailussa, joka kattaa matematiikan, fysiikan, kemian, kielitieteen ja tekniikan.
All-inclusive-suunnitelmalla Grok 4 -vastaus maksaa 3 krediittiä.
Vertailutulokset
- Humanity's Last Exam (tekstitiedosto): 50,7% - ensimmäinen 50% rajan yli.
- ARC-AGI v2 (uudenlainen abstrakti päättely): 15,9% - karkeasti kaksinkertainen seuraavaan kaupalliseen malliin nähden julkaisuhetkellä.
- USAMO 2025 matematiikkatodistus-vertailu: 61,9% Heavy-kokoonpanossa.
Paras käyttö Magnuksessa
Vaikea päättely asenteella: tutkimuskysymykset, paholaisen asianajaja -näkökulmat ja väittelykierrokset Claude-agenttia vastaan. Sen suora, hieman röyhkeä tyyli tekee siitä suosikin haastajapersoonalle agenttipalkkiin.
- Grok kattaa chatin ja dokumentit; integraatiotyökalut (Gmail, Kalenteri, Slack-toiminnot) pysyvät Claudella.