OpenAI

o4 Mini 2025-04-16

Тип
языковая модель
Контекст
200K токенов
Максимум на выходе
100K
Строка для API
azure/o4-mini-2025-04-16

Цены по поставщикам

Поставщик Вход, $ за 1M Выход, $ за 1M В наших данных с
Microsoft Foundry azure/o4-mini-2025-04-16 $1,1 $4,4 31 июл 2026
OpenAI $1,1 $4,4 31 июл 2026
Microsoft Foundry azure/us/o4-mini-2025-04-16 $1,21 $4,84 31 июл 2026

Показан только базовый тариф и только потокенные цены. Батчевые, льготные и кэшированные ставки, а также цены за изображение или секунду видео в эту таблицу не идут: их нельзя ставить в одну колонку с ценой за миллион токенов.

Один поставщик встречается несколько раз, если продаёт эту модель под разными идентификаторами и по разной цене — например, в разной точности весов. Идентификатор указан рядом с названием. Одинаковые предложения, пришедшие из двух источников под разными написаниями, сведены в одну строку.

Дата в последней колонке — день, когда эта цена впервые попала в наш сбор. Цена может быть и старше: до этого дня мы её просто не записывали. Меняться она с тех пор не меняла — иначе на её месте стояла бы новая строка с новой датой.

Результаты замеров

Набор задач Результат Условия прогона Кто измерил
Arena Score, математика 1 386,94 1 376–1 398
Arena Score, программирование 1 368,52 1 362–1 375
Arena Score на английском языке 1 366,19 1 361–1 371
Arena Score на французском языке 1 359,86 1 334–1 385
Arena Score, общий зачёт 1 352,74 1 349–1 357
Arena Score, сложные запросы 1 350,98 1 346–1 356
Arena Score, многоходовый диалог 1 349,24 1 342–1 356
Arena Score на испанском языке 1 345,84 1 325–1 366
Arena Score, экспертные вопросы 1 343,59 1 331–1 356
Arena Score на русском языке 1 335,24 1 325–1 346
Arena Score, следование инструкции 1 321,33 1 315–1 327
Arena Score, длинные запросы 1 314,94 1 308–1 322
Arena Score, творческий текст 1 295,6 1 287–1 304
Arena Score, распознавание текста на изображении 1 197,64 1 189–1 206
Arena Score, понимание схем 1 197,47 1 185–1 210
Arena Score, работа с изображениями 1 194,83 1 188–1 202
MATH, пятый уровень сложности 97,83 % усилие: high · с подобранной обвязкой Epoch evaluations
Mock AIME 2024–2025 — олимпиадные задачи 81,65 % усилие: low · с подобранной обвязкой Epoch evaluations
Fiction.LiveBench — удержание длинного контекста 77,8 % усилие: medium Fiction.live leaderboard
Творческое письмо (оценка Lech Mazur) 75 % усилие: medium lechmazur/writing Github repository
GPQA Diamond — вопросы уровня аспирантуры 72,81 % усилие: low · с подобранной обвязкой Epoch evaluations
Aider Polyglot — правки кода на шести языках 72 % усилие: high · с подобранной обвязкой Aider LLM Leaderboards
GeoBench — определение места по фотографии 64 % усилие: high GeoBench leaderboard
CadEval — построение CAD-моделей кодом 62 % усилие: medium CadEval Dashboard
ARC-AGI — обобщение на новых закономерностях 58,7 % усилие: high · с подобранной обвязкой ARC Prize Leaderboard
WeirdML — необычные задачи машинного обучения 52,56 % усилие: high WeirdML Leaderboard
FrontierMath, уровни 1–3 36,14 % усилие: high Epoch evaluations
SimpleBench — вопросы с подвохом 26,44 % усилие: high SimpleBench Leaderboard
GDPval — задачи реальных профессий 25,3 % усилие: high
SimpleQA Verified — фактическая точность 23,9 % усилие: low Epoch evaluations
Шахматные задачи 22,14 % усилие: low Epoch evaluations
Humanity’s Last Exam — экспертные вопросы 13,95 % усилие: high
ARC-AGI-2 6,11 % усилие: high
FrontierMath, уровень 4 — исследовательские задачи 4,88 % усилие: high Epoch evaluations
GSO-Bench — оптимизация кода 3,6 % усилие: high GSO Leaderboard
CritPt — задачи по физике 0,6 % усилие: high