OpenAI

GPT 5 2025-08-07

Тип
языковая модель
Контекст
272K токенов
Максимум на выходе
128K
Строка для API
azure/eu/gpt-5-2025-08-07

Цены по поставщикам

Поставщик Вход, $ за 1M Выход, $ за 1M В наших данных с
Microsoft Foundry azure/gpt-5-2025-08-07 $1,25 $10 31 июл 2026
OpenAI $1,25 $10 31 июл 2026
Microsoft Foundry azure/eu/gpt-5-2025-08-07 $1,375 $11 31 июл 2026

Показан только базовый тариф и только потокенные цены. Батчевые, льготные и кэшированные ставки, а также цены за изображение или секунду видео в эту таблицу не идут: их нельзя ставить в одну колонку с ценой за миллион токенов.

Один поставщик встречается несколько раз, если продаёт эту модель под разными идентификаторами и по разной цене — например, в разной точности весов. Идентификатор указан рядом с названием. Одинаковые предложения, пришедшие из двух источников под разными написаниями, сведены в одну строку.

Дата в последней колонке — день, когда эта цена впервые попала в наш сбор. Цена может быть и старше: до этого дня мы её просто не записывали. Меняться она с тех пор не меняла — иначе на её месте стояла бы новая строка с новой датой.

Результаты замеров

Набор задач Результат Условия прогона Кто измерил
MATH, пятый уровень сложности 98,13 % усилие: high · с подобранной обвязкой Epoch evaluations
Fiction.LiveBench — удержание длинного контекста 97,2 % усилие: medium Fiction.live leaderboard
Mock AIME 2024–2025 — олимпиадные задачи 91,38 % усилие: minimal · с подобранной обвязкой Epoch evaluations
Aider Polyglot — правки кода на шести языках 88 % усилие: low · с подобранной обвязкой Aider LLM Leaderboards
Творческое письмо (оценка Lech Mazur) 86 % усилие: medium lechmazur/writing Github repository
GPQA Diamond — вопросы уровня аспирантуры 81,57 % усилие: minimal · с подобранной обвязкой Epoch evaluations
GeoBench — определение места по фотографии 81 % усилие: medium GeoBench leaderboard
SWE-bench Verified — исправление ошибок в репозиториях 73,55 % усилие: high · с подобранной обвязкой Epoch evaluations
ARC-AGI — обобщение на новых закономерностях 65,7 % усилие: high · с подобранной обвязкой ARC Prize Leaderboard
WeirdML — необычные задачи машинного обучения 60,7 % усилие: high WeirdML Leaderboard
FrontierMath, уровни 1–3 55,44 % усилие: high Epoch evaluations
DeepResearch Bench — глубокий поиск 55,13 % DeepResearchBench Leaderboard
SimpleQA Verified — фактическая точность 50,6 % усилие: high Epoch evaluations
Terminal-Bench — работа в командной строке 49,6 % · с подобранной обвязкой Terminal-Bench v2 Leaderboard
SimpleBench — вопросы с подвохом 48,04 % усилие: high SimpleBench Leaderboard
GDPval — задачи реальных профессий 34,8 % усилие: medium
Шахматные задачи 33,71 % усилие: minimal Epoch evaluations
BALROG — игровые среды 32,8 % усилие: minimal Balrog Leaderboard
FrontierMath, уровень 4 — исследовательские задачи 21,95 % усилие: high Epoch evaluations
Humanity’s Last Exam — экспертные вопросы 21,56 % усилие: high
APEX-Agents 18,3 % усилие: high
CritPt — задачи по физике 12,6 % усилие: high
ARC-AGI-2 9,86 % усилие: high
GSO-Bench — оптимизация кода 6,9 % усилие: high GSO Leaderboard
Remote Labor Index — задачи с биржи фриланса 1,67 %