azure_ai/gpt-5.4-2026-03-05| Поставщик | Вход, $ за 1M | Выход, $ за 1M | В наших данных с |
|---|---|---|---|
Microsoft Foundry
azure_ai/gpt-5.4-2026-03-05
|
$2,5 | $15 | 31 июл 2026 |
| OpenAI | $2,5 | $15 | 31 июл 2026 |
Microsoft Foundry
azure/eu/gpt-5.4-2026-03-05
|
$2,75 | $16,5 | 31 июл 2026 |
Показан только базовый тариф и только потокенные цены. Батчевые, льготные и кэшированные ставки, а также цены за изображение или секунду видео в эту таблицу не идут: их нельзя ставить в одну колонку с ценой за миллион токенов.
Один поставщик встречается несколько раз, если продаёт эту модель под разными идентификаторами и по разной цене — например, в разной точности весов. Идентификатор указан рядом с названием. Одинаковые предложения, пришедшие из двух источников под разными написаниями, сведены в одну строку.
Дата в последней колонке — день, когда эта цена впервые попала в наш сбор. Цена может быть и старше: до этого дня мы её просто не записывали. Меняться она с тех пор не меняла — иначе на её месте стояла бы новая строка с новой датой.
| Набор задач | Результат | Условия прогона | Кто измерил |
|---|---|---|---|
| Mock AIME 2024–2025 — олимпиадные задачи | 97,78 % | усилие: medium · с подобранной обвязкой | Epoch evaluations |
| ARC-AGI — обобщение на новых закономерностях | 93,67 % | усилие: xhigh · с подобранной обвязкой | — |
| GPQA Diamond — вопросы уровня аспирантуры | 91,07 % | усилие: medium · с подобранной обвязкой | Epoch evaluations |
| Terminal-Bench — работа в командной строке | 81,8 % | · с подобранной обвязкой | https://www.tbench.ai/leaderboard/terminal-bench/2.0 |
| FrontierMath, уровни 1–3 | 78,6 % | усилие: xhigh | Epoch evaluations |
| WeirdML — необычные задачи машинного обучения | 77,7 % | усилие: xhigh | WeirdML Leaderboard |
| SWE-bench Verified — исправление ошибок в репозиториях | 76,86 % | усилие: high · с подобранной обвязкой | Epoch evaluations |
| ARC-AGI-2 | 73,95 % | усилие: xhigh | — |
| FrontierMath, уровень 4 — исследовательские задачи | 49 % | усилие: xhigh | Epoch evaluations |
| SimpleQA Verified — фактическая точность | 44,84 % | усилие: xhigh | Epoch evaluations |
| Шахматные задачи | 41,08 % | усилие: medium | Epoch evaluations |
| APEX-Agents | 36 % | усилие: xhigh | — |
| DeepResearch Bench — глубокий поиск | 35,09 % | усилие: low | https://drb.futuresearch.ai/#drb самоотчёт |
| Humanity’s Last Exam — экспертные вопросы | 33,03 % | усилие: xhigh | — |
| GSO-Bench — оптимизация кода | 31,37 % | усилие: xhigh | https://gso-bench.github.io/index.html |
| CritPt — задачи по физике | 23,43 % | усилие: xhigh | — |