xAI

Grok 4

Тип
языковая модель
Контекст
256K токенов
Максимум на выходе
16K
Вышла
9 июля 2025
Строка для API
grok-4-0709

Цены по поставщикам

Поставщик Вход, $ за 1M Выход, $ за 1M В наших данных с
Jiekou.AI $2,7 $13,5 31 июл 2026
Abacus.AI $3 $15 31 июл 2026
xAI $3 $15 31 июл 2026

Показан только базовый тариф и только потокенные цены. Батчевые, льготные и кэшированные ставки, а также цены за изображение или секунду видео в эту таблицу не идут: их нельзя ставить в одну колонку с ценой за миллион токенов.

Дата в последней колонке — день, когда эта цена впервые попала в наш сбор. Цена может быть и старше: до этого дня мы её просто не записывали. Меняться она с тех пор не меняла — иначе на её месте стояла бы новая строка с новой датой.

Результаты замеров

Набор задач Результат Условия прогона Кто измерил
Arena Score на французском языке 1 425,25 1 399–1 452
Arena Score, математика 1 424,24 1 412–1 437
Arena Score на английском языке 1 418,4 1 413–1 423
Arena Score, экспертные вопросы 1 417,67 1 404–1 431
Arena Score, многоходовый диалог 1 415,59 1 408–1 423
Arena Score на испанском языке 1 413,5 1 394–1 433
Arena Score на русском языке 1 412,96 1 401–1 425
Arena Score, длинные запросы 1 410,19 1 404–1 417
Arena Score, общий зачёт 1 409,91 1 406–1 414
Arena Score, программирование 1 408,98 1 402–1 416
Arena Score, сложные запросы 1 408,55 1 404–1 414
Arena Score, творческий текст 1 398,43 1 390–1 407
Arena Score, следование инструкции 1 387,31 1 381–1 393
Arena Score, работа с изображениями 1 208,77 1 201–1 216
Arena Score, понимание схем 1 203,03 1 190–1 216
Arena Score, распознавание текста на изображении 1 194,52 1 186–1 203
Fiction.LiveBench — удержание длинного контекста 94,4 % Fiction.live leaderboard
Mock AIME 2024–2025 — олимпиадные задачи 83,98 % · с подобранной обвязкой Epoch evaluations
GPQA Diamond — вопросы уровня аспирантуры 82,67 % · с подобранной обвязкой Epoch evaluations
Aider Polyglot — правки кода на шести языках 79,6 % · с подобранной обвязкой Aider LLM Leaderboards
Творческое письмо (оценка Lech Mazur) 76,9 % lechmazur/writing Github repository
ARC-AGI — обобщение на новых закономерностях 66,67 % · с подобранной обвязкой
SimpleBench — вопросы с подвохом 52,6 % SimpleBench Leaderboard
SimpleQA Verified — фактическая точность 47,9 % Epoch evaluations
DeepResearch Bench — глубокий поиск 47,9 % DeepResearchBench Leaderboard
WeirdML — необычные задачи машинного обучения 45,73 % WeirdML Leaderboard
GeoBench — определение места по фотографии 45 % GeoBench leaderboard
BALROG — игровые среды 43,6 % Balrog Leaderboard
Cybench — задачи по кибербезопасности 43 % · с подобранной обвязкой Grok 4 Model Card самоотчёт
Terminal-Bench — работа в командной строке 27,2 % · с подобранной обвязкой Terminal-Bench v2 Leaderboard
Шахматные задачи 24,24 % Epoch evaluations
GDPval — задачи реальных профессий 21,1 % усилие: high
ARC-AGI-2 15,98 %
APEX-Agents 15,2 %