OpenAI

o1 2024-12-17

Тип
языковая модель
Контекст
200K токенов
Максимум на выходе
100K
Строка для API
azure/eu/o1-2024-12-17

Цены по поставщикам

Поставщик Вход, $ за 1M Выход, $ за 1M В наших данных с
Microsoft Foundry azure/o1-2024-12-17 $15 $60 31 июл 2026
OpenAI $15 $60 31 июл 2026
Microsoft Foundry azure/eu/o1-2024-12-17 $16,5 $66 31 июл 2026

Показан только базовый тариф и только потокенные цены. Батчевые, льготные и кэшированные ставки, а также цены за изображение или секунду видео в эту таблицу не идут: их нельзя ставить в одну колонку с ценой за миллион токенов.

Один поставщик встречается несколько раз, если продаёт эту модель под разными идентификаторами и по разной цене — например, в разной точности весов. Идентификатор указан рядом с названием. Одинаковые предложения, пришедшие из двух источников под разными написаниями, сведены в одну строку.

Дата в последней колонке — день, когда эта цена впервые попала в наш сбор. Цена может быть и старше: до этого дня мы её просто не записывали. Меняться она с тех пор не меняла — иначе на её месте стояла бы новая строка с новой датой.

Результаты замеров

Набор задач Результат Условия прогона Кто измерил
Arena Score, математика 1 388,33 1 378–1 399
Arena Score, длинные запросы 1 377,99 1 368–1 388
Arena Score на английском языке 1 372,18 1 367–1 378
Arena Score, сложные запросы 1 371,69 1 364–1 379
Arena Score, следование инструкции 1 367,83 1 361–1 374
Arena Score, программирование 1 367,4 1 358–1 377
Arena Score, общий зачёт 1 365,96 1 362–1 370
Arena Score, экспертные вопросы 1 361,05 1 344–1 378
Arena Score на русском языке 1 354,9 1 344–1 365
Arena Score, многоходовый диалог 1 354,76 1 346–1 364
Arena Score, творческий текст 1 347,89 1 339–1 357
Arena Score на французском языке 1 343,31 1 306–1 380
Arena Score на испанском языке 1 341,83 1 294–1 390
Arena Score, работа с изображениями 1 168,58 1 158–1 179
MATH, пятый уровень сложности 94,71 % усилие: high · с подобранной обвязкой Epoch evaluations
Fiction.LiveBench — удержание длинного контекста 83,3 % усилие: medium Fiction.live leaderboard
GeoBench — определение места по фотографии 80 % усилие: medium GeoBench leaderboard
Mock AIME 2024–2025 — олимпиадные задачи 73,31 % усилие: low · с подобранной обвязкой Epoch evaluations
Творческое письмо (оценка Lech Mazur) 70,2 % усилие: medium lechmazur/writing Github repository
GPQA Diamond — вопросы уровня аспирантуры 69,02 % усилие: low · с подобранной обвязкой Epoch evaluations
Aider Polyglot — правки кода на шести языках 61,7 % усилие: high · с подобранной обвязкой Aider LLM Leaderboards
CadEval — построение CAD-моделей кодом 56 % усилие: medium CadEval Dashboard
WeirdML — необычные задачи машинного обучения 43,82 % усилие: high WeirdML Leaderboard
ARC-AGI — обобщение на новых закономерностях 30,7 % усилие: medium · с подобранной обвязкой ARC Prize Leaderboard
SimpleBench — вопросы с подвохом 28,12 % усилие: high SimpleBench Leaderboard
Humanity’s Last Exam — экспертные вопросы 3,32 %
Шахматные задачи 2,15 % усилие: low Epoch evaluations
APEX-Agents 1,1 % усилие: high