azure/gpt-5.2-2025-12-11| Поставщик | Вход, $ за 1M | Выход, $ за 1M | В наших данных с |
|---|---|---|---|
| Microsoft Foundry | $1,75 | $14 | 31 июл 2026 |
| OpenAI | $1,75 | $14 | 31 июл 2026 |
Показан только базовый тариф и только потокенные цены. Батчевые, льготные и кэшированные ставки, а также цены за изображение или секунду видео в эту таблицу не идут: их нельзя ставить в одну колонку с ценой за миллион токенов.
Дата в последней колонке — день, когда эта цена впервые попала в наш сбор. Цена может быть и старше: до этого дня мы её просто не записывали. Меняться она с тех пор не меняла — иначе на её месте стояла бы новая строка с новой датой.
| Набор задач | Результат | Условия прогона | Кто измерил |
|---|---|---|---|
| Mock AIME 2024–2025 — олимпиадные задачи | 96,11 % | усилие: none · с подобранной обвязкой | Epoch evaluations |
| GPQA Diamond — вопросы уровня аспирантуры | 88,53 % | усилие: none · с подобранной обвязкой | Epoch evaluations |
| ARC-AGI — обобщение на новых закономерностях | 86,2 % | усилие: xhigh · с подобранной обвязкой | ARC Prize Leaderboard |
| SWE-bench Verified — исправление ошибок в репозиториях | 73,76 % | усилие: high · с подобранной обвязкой | Epoch evaluations |
| WeirdML — необычные задачи машинного обучения | 72,2 % | усилие: xhigh | WeirdML Leaderboard |
| FrontierMath, уровни 1–3 | 67,4 % | усилие: xhigh | Epoch evaluations |
| Terminal-Bench — работа в командной строке | 64,9 % | усилие: medium · с подобранной обвязкой | Terminal-Bench v2 Leaderboard |
| ARC-AGI-2 | 52,91 % | усилие: xhigh | — |
| GDPval — задачи реальных профессий | 49,7 % | усилие: none | — |
| Шахматные задачи | 46,34 % | усилие: none | Epoch evaluations |
| DeepResearch Bench — глубокий поиск | 41,12 % | усилие: low | https://drb.futuresearch.ai/#drb самоотчёт |
| SimpleQA Verified — фактическая точность | 38,9 % | усилие: medium | Epoch evaluations |
| SimpleBench — вопросы с подвохом | 34,96 % | усилие: high | SimpleBench Leaderboard |
| APEX-Agents | 34,4 % | усилие: xhigh | — |
| FrontierMath, уровень 4 — исследовательские задачи | 31,7 % | усилие: xhigh | Epoch evaluations |
| GSO-Bench — оптимизация кода | 27,4 % | усилие: high | GSO Leaderboard |
| Humanity’s Last Exam — экспертные вопросы | 24,16 % | — | — |
| Remote Labor Index — задачи с биржи фриланса | 2,5 % | усилие: medium | — |