OpenAI

GPT 4.1 2025-04-14

Тип
языковая модель
Контекст
1 048K токенов
Максимум на выходе
33K
Строка для API
azure/gpt-4.1-2025-04-14

Поставщик объявил модель устаревшей. Она ещё отвечает, но новых проектов на ней лучше не начинать.

Цены по поставщикам

Поставщик Вход, $ за 1M Выход, $ за 1M В наших данных с
Microsoft Foundry azure/gpt-4.1-2025-04-14 $2 $8 31 июл 2026
OpenAI $2 $8 31 июл 2026
Microsoft Foundry azure/us/gpt-4.1-2025-04-14 $2,2 $8,8 31 июл 2026

Показан только базовый тариф и только потокенные цены. Батчевые, льготные и кэшированные ставки, а также цены за изображение или секунду видео в эту таблицу не идут: их нельзя ставить в одну колонку с ценой за миллион токенов.

Один поставщик встречается несколько раз, если продаёт эту модель под разными идентификаторами и по разной цене — например, в разной точности весов. Идентификатор указан рядом с названием. Одинаковые предложения, пришедшие из двух источников под разными написаниями, сведены в одну строку.

Дата в последней колонке — день, когда эта цена впервые попала в наш сбор. Цена может быть и старше: до этого дня мы её просто не записывали. Меняться она с тех пор не меняла — иначе на её месте стояла бы новая строка с новой датой.

Результаты замеров

Набор задач Результат Условия прогона Кто измерил
Arena Score, многоходовый диалог 1 396,99 1 390–1 404
Arena Score на английском языке 1 390,3 1 386–1 395
Arena Score, программирование 1 390,24 1 384–1 397
Arena Score, длинные запросы 1 382,97 1 377–1 389
Arena Score, сложные запросы 1 382,46 1 378–1 387
Arena Score, общий зачёт 1 382,06 1 378–1 386
Arena Score на французском языке 1 381,97 1 359–1 405
Arena Score на русском языке 1 373,25 1 363–1 384
Arena Score на испанском языке 1 368,54 1 349–1 388
Arena Score, математика 1 367,35 1 357–1 378
Arena Score, следование инструкции 1 366,42 1 361–1 372
Arena Score, творческий текст 1 363,66 1 356–1 371
Arena Score, экспертные вопросы 1 363,58 1 352–1 375
Arena Score, распознавание текста на изображении 1 217,28 1 209–1 226
Arena Score, понимание схем 1 214,97 1 202–1 228
Arena Score, работа с изображениями 1 209,86 1 203–1 217
MATH, пятый уровень сложности 83,01 % · с подобранной обвязкой Epoch evaluations
GeoBench — определение места по фотографии 72 % GeoBench leaderboard
Fiction.LiveBench — удержание длинного контекста 63,9 % Fiction.live leaderboard
GPQA Diamond — вопросы уровня аспирантуры 55,89 % · с подобранной обвязкой Epoch evaluations
Aider Polyglot — правки кода на шести языках 52,4 % · с подобранной обвязкой Aider LLM Leaderboards
SWE-bench Verified — исправление ошибок в репозиториях 48,54 % · с подобранной обвязкой Epoch evaluations
CadEval — построение CAD-моделей кодом 42 % CadEval Dashboard
WeirdML — необычные задачи машинного обучения 39,04 % WeirdML Leaderboard
Mock AIME 2024–2025 — олимпиадные задачи 38,27 % · с подобранной обвязкой Epoch evaluations
DeepResearch Bench — глубокий поиск 29,31 %
SimpleBench — вопросы с подвохом 12,4 % SimpleBench Leaderboard
ARC-AGI — обобщение на новых закономерностях 5,5 % · с подобранной обвязкой ARC Prize Leaderboard
Humanity’s Last Exam — экспертные вопросы 0,63 %
ARC-AGI-2 0,42 %