← Усі гідиКоротко
Запущена 9 липня 2025 року компанією xAI. Grok 4 навчалася з інтенсивним підкріплювальним навчанням у міркуванні, і її конфігурація Heavy стала першою моделлю, яка подолала 50% на Humanity's Last Exam - бенчмарку з 2 500 питань рівня PhD, що охоплює математику, фізику, хімію, лінгвістику та інженерію.
На тарифі «Все включено» відповідь Grok 4 коштує 3 кредити.
Бенчмарки
- Humanity's Last Exam (текстова підмножина): 50.7% - перша за позначкою 50%.
- ARC-AGI v2 (нове абстрактне мислення): 15.9% - приблизно вдвічі більше наступної комерційної моделі на момент релізу.
- USAMO 2025 (бенчмарк математичних доведень): 61.9% у конфігурації Heavy.
Найкраще у Magnus
Складне мислення з характером: дослідницькі питання, аргументи від супротивного та дебати проти агента на Claude. Її прямий, злегка іронічний стиль робить її улюбленицею для ролі опонента на панелі агентів.
- Grok охоплює чат і документи; інструменти інтеграцій (Gmail, Calendar, дії Slack) залишаються у Claude.