OpenAI

o3 Mini 2025-01-31

Тип
языковая модель
Контекст
200K токенов
Максимум на выходе
100K
Строка для API
azure/eu/o3-mini-2025-01-31

Цены по поставщикам

Поставщик Вход, $ за 1M Выход, $ за 1M В наших данных с
Microsoft Foundry azure/o3-mini-2025-01-31 $1,1 $4,4 31 июл 2026
OpenAI $1,1 $4,4 31 июл 2026
Microsoft Foundry azure/eu/o3-mini-2025-01-31 $1,21 $4,84 31 июл 2026

Показан только базовый тариф и только потокенные цены. Батчевые, льготные и кэшированные ставки, а также цены за изображение или секунду видео в эту таблицу не идут: их нельзя ставить в одну колонку с ценой за миллион токенов.

Один поставщик встречается несколько раз, если продаёт эту модель под разными идентификаторами и по разной цене — например, в разной точности весов. Идентификатор указан рядом с названием. Одинаковые предложения, пришедшие из двух источников под разными написаниями, сведены в одну строку.

Дата в последней колонке — день, когда эта цена впервые попала в наш сбор. Цена может быть и старше: до этого дня мы её просто не записывали. Меняться она с тех пор не меняла — иначе на её месте стояла бы новая строка с новой датой.

Результаты замеров

Набор задач Результат Условия прогона Кто измерил
MATH, пятый уровень сложности 96,49 % усилие: high · с подобранной обвязкой Epoch evaluations
Mock AIME 2024–2025 — олимпиадные задачи 76,92 % усилие: low · с подобранной обвязкой Epoch evaluations
GPQA Diamond — вопросы уровня аспирантуры 69,36 % усилие: low · с подобранной обвязкой Epoch evaluations
Творческое письмо (оценка Lech Mazur) 61,7 % усилие: high lechmazur/writing Github repository
Aider Polyglot — правки кода на шести языках 60,4 % усилие: medium · с подобранной обвязкой Aider LLM Leaderboards
CadEval — построение CAD-моделей кодом 54 % усилие: medium CadEval Dashboard
Fiction.LiveBench — удержание длинного контекста 50 % усилие: medium Fiction.live leaderboard
WeirdML — необычные задачи машинного обучения 43,7 % усилие: high WeirdML Leaderboard
ARC-AGI — обобщение на новых закономерностях 34,5 % усилие: high · с подобранной обвязкой ARC Prize Leaderboard
Cybench — задачи по кибербезопасности 22,5 % усилие: medium · с подобранной обвязкой Cybench leaderboard
FrontierMath, уровни 1–3 18,6 % усилие: high Epoch evaluations
Шахматные задачи 12,67 % усилие: low Epoch evaluations
SimpleBench — вопросы с подвохом 7,36 % усилие: high SimpleBench Leaderboard
ARC-AGI-2 2,99 % усилие: high
GSO-Bench — оптимизация кода 1,3 % усилие: low GSO Leaderboard
FrontierMath, уровень 4 — исследовательские задачи 0 % усилие: high Epoch evaluations