Baseten — провайдер API

Baseten — поставщик доступа к моделям через API. Здесь 17 моделей: сколько стоит типовая задача, как быстро идёт ответ и какое контекстное окно доступно.

Моделей у провайдера17
Самая дешёвая задача 1 ₽
Самая быстрая выдача 336 ток./с
МодельИнтеллектЗадача, ₽ Токенов в секундуПауза, сКонтекст
Kimi K3Kimi K3 (max)6073 ₽1041,061 млн
GLM-5.3-FlashGLM-5.3-Flash579 ₽2220,651 млн
DeepSeek V4 Pro 0813DeepSeek V4 Pro 0813 (max)5397 ₽1641,041 млн
GLM-5.2GLM-5.2 (max) (FAST)5347 ₽2681,57524 тыс.
GLM-5.2GLM-5.2 (max)5330 ₽1181,191 млн
DeepSeek V4 Flash 0731DeepSeek V4 Flash 0731 (max)5212 ₽1350,941 млн
Kimi K3Kimi K3 (low)4829 ₽940,871 млн
DeepSeek V4 ProDeepSeek V4 Pro (max)4538 ₽1440,571 млн
DeepSeek V4 ProDeepSeek V4 Pro (high)4438 ₽1460,571 млн
Kimi K2.7 CodeKimi K2.7 Code4325 ₽2070,49262 тыс.
InklingInkling4234 ₽2290,53262 тыс.
Inkling SmallInkling Small419 ₽3360,43262 тыс.
GLM-5.2GLM-5.2 (Non-reasoning) (FAST)35— ₽2161,93524 тыс.
GLM-5.2GLM-5.2 (Non-reasoning)35— ₽1051,571 млн
gpt-oss-120bgpt-oss-120b (high)244 ₽2420,23128 тыс.
gpt-oss-120bgpt-oss-120b (low)151 ₽2250,28128 тыс.
DeepSeek V4 ProDeepSeek V4 Pro (Non-reasoning)— ₽1530,561 млн

Дешевле или дороже прямого доступа

Дороже прямого доступа на 83% по 10 моделям со сравнимой ценой.

Что такое стоимость задачи

Это цена одного типового прогона, а не ставка за миллион токенов. У рассуждающих моделей она выше при той же ставке: модель тратит токены на размышления, которые вы не видите, но оплачиваете.