Fireworks — провайдер API
Fireworks — поставщик доступа к моделям через API. Здесь 9 моделей: сколько стоит типовая задача, как быстро идёт ответ и какое контекстное окно доступно.
Моделей у провайдера9
Самая дешёвая задача
2 ₽
Самая быстрая выдача
482 ток./с
| Модель | Интеллект | Задача, ₽ | Токенов в секунду | Пауза, с | Контекст |
|---|---|---|---|---|---|
| Kimi K3Kimi K3 (max) | 60 | 166 ₽ | 112 | 0,97 | 1 млн |
| Kimi K3Kimi K3 (max) (FAST) | 60 | 186 ₽ | 111 | 0,98 | 1 млн |
| Qwen3.8 2.4T A95BQwen3.8 2.4T A95B | 58 | 62 ₽ | 118 | 1,24 | 262 тыс. |
| GLM-5.3-FlashGLM-5.3-Flash | 57 | 9 ₽ | 41 | 0,99 | 1 млн |
| DeepSeek V4 Pro 0813DeepSeek V4 Pro 0813 (max) | 53 | 30 ₽ | 85 | 1,56 | 1 млн |
| GLM-5.2GLM-5.2 (max) | 53 | 29 ₽ | 227 | 1,30 | 1 млн |
| DeepSeek V4 Flash 0731DeepSeek V4 Flash 0731 (max) | 52 | 4 ₽ | 248 | 0,62 | 1 млн |
| Nemotron 3.5 LightningNemotron 3.5 Lightning (BF16) | 24 | 2 ₽ | 482 | 0,48 | 262 тыс. |
| Llama 3.3 70BLlama 3.3 70B | — | — ₽ | — | — | 131 тыс. |
Дешевле или дороже прямого доступа
Дороже прямого доступа на 198% по 7 моделям со сравнимой ценой.
Что такое стоимость задачи
Это цена одного типового прогона, а не ставка за миллион токенов. У рассуждающих моделей она выше при той же ставке: модель тратит токены на размышления, которые вы не видите, но оплачиваете.