OpenAI

GPT 5.4 2026-03-05

Тип
языковая модель
Контекст
1 050K токенов
Максимум на выходе
128K
Строка для API
azure_ai/gpt-5.4-2026-03-05

Цены по поставщикам

Поставщик Вход, $ за 1M Выход, $ за 1M В наших данных с
Microsoft Foundry azure_ai/gpt-5.4-2026-03-05 $2,5 $15 31 июл 2026
OpenAI $2,5 $15 31 июл 2026
Microsoft Foundry azure/eu/gpt-5.4-2026-03-05 $2,75 $16,5 31 июл 2026

Показан только базовый тариф и только потокенные цены. Батчевые, льготные и кэшированные ставки, а также цены за изображение или секунду видео в эту таблицу не идут: их нельзя ставить в одну колонку с ценой за миллион токенов.

Один поставщик встречается несколько раз, если продаёт эту модель под разными идентификаторами и по разной цене — например, в разной точности весов. Идентификатор указан рядом с названием. Одинаковые предложения, пришедшие из двух источников под разными написаниями, сведены в одну строку.

Дата в последней колонке — день, когда эта цена впервые попала в наш сбор. Цена может быть и старше: до этого дня мы её просто не записывали. Меняться она с тех пор не меняла — иначе на её месте стояла бы новая строка с новой датой.

Результаты замеров

Набор задач Результат Условия прогона Кто измерил
Mock AIME 2024–2025 — олимпиадные задачи 97,78 % усилие: medium · с подобранной обвязкой Epoch evaluations
ARC-AGI — обобщение на новых закономерностях 93,67 % усилие: xhigh · с подобранной обвязкой
GPQA Diamond — вопросы уровня аспирантуры 91,07 % усилие: medium · с подобранной обвязкой Epoch evaluations
Terminal-Bench — работа в командной строке 81,8 % · с подобранной обвязкой https://www.tbench.ai/leaderboard/terminal-bench/2.0
FrontierMath, уровни 1–3 78,6 % усилие: xhigh Epoch evaluations
WeirdML — необычные задачи машинного обучения 77,7 % усилие: xhigh WeirdML Leaderboard
SWE-bench Verified — исправление ошибок в репозиториях 76,86 % усилие: high · с подобранной обвязкой Epoch evaluations
ARC-AGI-2 73,95 % усилие: xhigh
FrontierMath, уровень 4 — исследовательские задачи 49 % усилие: xhigh Epoch evaluations
SimpleQA Verified — фактическая точность 44,84 % усилие: xhigh Epoch evaluations
Шахматные задачи 41,08 % усилие: medium Epoch evaluations
APEX-Agents 36 % усилие: xhigh
DeepResearch Bench — глубокий поиск 35,09 % усилие: low https://drb.futuresearch.ai/#drb самоотчёт
Humanity’s Last Exam — экспертные вопросы 33,03 % усилие: xhigh
GSO-Bench — оптимизация кода 31,37 % усилие: xhigh https://gso-bench.github.io/index.html
CritPt — задачи по физике 23,43 % усилие: xhigh