Wafer — провайдер API

Wafer — поставщик доступа к моделям через API. Здесь 6 моделей: сколько стоит типовая задача, как быстро идёт ответ и какое контекстное окно доступно.

Моделей у провайдера6
Самая дешёвая задача 9 ₽
Самая быстрая выдача 265 ток./с
МодельИнтеллектЗадача, ₽ Токенов в секундуПауза, сКонтекст
GLM-5.3-FlashGLM-5.3-Flash579 ₽722,261 млн
GLM-5.2GLM-5.2 (max)5331 ₽682,00205 тыс.
DeepSeek V4 Flash 0731DeepSeek V4 Flash 0731 (max) (FAST)5224 ₽2651,821 млн
GLM-5.2GLM-5.2 (Non-reasoning)35— ₽672,20205 тыс.
Qwen3.5 397B A17BQwen3.5 397B A17B3423 ₽862,95262 тыс.
Qwen3.5 397B A17BQwen3.5 397B A17B (Non-reasoning)— ₽873,00262 тыс.

Дешевле или дороже прямого доступа

Дороже прямого доступа на 83% по 2 моделям со сравнимой ценой.

Что такое стоимость задачи

Это цена одного типового прогона, а не ставка за миллион токенов. У рассуждающих моделей она выше при той же ставке: модель тратит токены на размышления, которые вы не видите, но оплачиваете.