Groq — провайдер API

Groq — поставщик доступа к моделям через API. Здесь 8 моделей: сколько стоит типовая задача, как быстро идёт ответ и какое контекстное окно доступно.

Моделей у провайдера8
Самая дешёвая задача 1 ₽
Самая быстрая выдача 957 ток./с
МодельИнтеллектЗадача, ₽ Токенов в секундуПауза, сКонтекст
Qwen3.6 27BQwen3.6 27B3823 ₽4541,25131 тыс.
Qwen3.6 27BQwen3.6 27B (Non-reasoning)3134 ₽4571,23131 тыс.
gpt-oss-120bgpt-oss-120b (high)245 ₽4730,70131 тыс.
gpt-oss-20bgpt-oss-20b (high)153 ₽9400,78131 тыс.
gpt-oss-120bgpt-oss-120b (low)152 ₽4720,70131 тыс.
Llama 4 ScoutLlama 4 Scout101 ₽4500,70131 тыс.
gpt-oss-20bgpt-oss-20b (low)— ₽9570,80131 тыс.
Llama 3.3 70BLlama 3.3 70B— ₽3030,80131 тыс.

Дешевле или дороже прямого доступа

Дороже прямого доступа на 33% по 5 моделям со сравнимой ценой.

Что такое стоимость задачи

Это цена одного типового прогона, а не ставка за миллион токенов. У рассуждающих моделей она выше при той же ставке: модель тратит токены на размышления, которые вы не видите, но оплачиваете.