Anthropic

Claude 3.5 Sonnet 2024-10-22

Тип
языковая модель
Контекст
200K токенов
Максимум на выходе
8K
Строка для API
vercel_ai_gateway/anthropic/claude-3-5-sonnet-20241022

Цены по поставщикам

Поставщик Вход, $ за 1M Выход, $ за 1M В наших данных с
vercel_ai_gateway $3 $15 1 авг 2026
Amazon Bedrock $3 $15 2 авг 2026

Показан только базовый тариф и только потокенные цены. Батчевые, льготные и кэшированные ставки, а также цены за изображение или секунду видео в эту таблицу не идут: их нельзя ставить в одну колонку с ценой за миллион токенов.

Дата в последней колонке — день, когда эта цена впервые попала в наш сбор. Цена может быть и старше: до этого дня мы её просто не записывали. Меняться она с тех пор не меняла — иначе на её месте стояла бы новая строка с новой датой.

Результаты замеров

Набор задач Результат Условия прогона Кто измерил
Arena Score, программирование 1 342,87 1 337–1 348
Arena Score, многоходовый диалог 1 325,58 1 320–1 331
Arena Score, длинные запросы 1 311,8 1 306–1 317
Arena Score на английском языке 1 307,74 1 304–1 312
Arena Score, математика 1 306,76 1 300–1 313
Arena Score, сложные запросы 1 305,53 1 301–1 310
Arena Score на русском языке 1 304,29 1 297–1 311
Arena Score на французском языке 1 301,79 1 280–1 323
Arena Score, общий зачёт 1 297,79 1 295–1 301
Arena Score, следование инструкции 1 297,5 1 293–1 302
Arena Score, творческий текст 1 291,87 1 286–1 298
Arena Score на испанском языке 1 283,4 1 264–1 303
Arena Score, экспертные вопросы 1 264,39 1 255–1 274
Arena Score, распознавание текста на изображении 1 138,75 1 120–1 158
Arena Score, понимание схем 1 132,28 1 101–1 164
Arena Score, работа с изображениями 1 125,48 1 118–1 133
Творческое письмо (оценка Lech Mazur) 80,3 % lechmazur/writing Github repository
GeoBench — определение места по фотографии 62 % GeoBench leaderboard
MATH, пятый уровень сложности 56,95 % · с подобранной обвязкой Epoch evaluations
Aider Polyglot — правки кода на шести языках 51,6 % · с подобранной обвязкой Aider LLM Leaderboards
CadEval — построение CAD-моделей кодом 48 % CadEval Dashboard
GPQA Diamond — вопросы уровня аспирантуры 40,4 % · с подобранной обвязкой Epoch evaluations
WeirdML — необычные задачи машинного обучения 39,97 % WeirdML Leaderboard
BALROG — игровые среды 32,6 % Balrog Leaderboard
SimpleBench — вопросы с подвохом 29,68 % SimpleBench Leaderboard
The Agent Company — рабочие задачи в офисной среде 24 % TheAgentCompany experiment results github
Mock AIME 2024–2025 — олимпиадные задачи 8,38 % · с подобранной обвязкой Epoch evaluations
GSO-Bench — оптимизация кода 4,6 % GSO Leaderboard
Humanity’s Last Exam — экспертные вопросы 0 %