GMI — провайдер API
GMI — поставщик доступа к моделям через API. Здесь 23 модели: сколько стоит типовая задача, как быстро идёт ответ и какое контекстное окно доступно.
Моделей у провайдера23
Самая дешёвая задача
2 ₽
Самая быстрая выдача
309 ток./с
| Модель | Интеллект | Задача, ₽ | Токенов в секунду | Пауза, с | Контекст |
|---|---|---|---|---|---|
| GLM-5.3-FlashGLM-5.3-Flash | 57 | 6 ₽ | 46 | 4,08 | 1 млн |
| DeepSeek V4 Pro 0813DeepSeek V4 Pro 0813 (max) | 53 | 30 ₽ | 61 | 3,02 | 1 млн |
| GLM-5.2GLM-5.2 (max) (FP8) | 53 | — ₽ | — | — | 1 млн |
| DeepSeek V4 Flash 0731DeepSeek V4 Flash 0731 (max) | 52 | 6 ₽ | 123 | 3,00 | 1 млн |
| MiniMax-M3MiniMax-M3 | 45 | — ₽ | — | — | 1 млн |
| DeepSeek V4 ProDeepSeek V4 Pro (max) | 45 | — ₽ | — | — | 1 млн |
| Kimi K2.7 CodeKimi K2.7 Code (FP8) | 43 | 37 ₽ | 45 | 5,75 | 66 тыс. |
| MiMo-V2.5-ProMiMo-V2.5-Pro | 43 | — ₽ | — | — | 1 млн |
| Hy3Hy3 | 42 | 3 ₽ | 94 | 3,35 | 262 тыс. |
| Nemotron 3 UltraNemotron 3 Ultra | 38 | — ₽ | — | — | 262 тыс. |
| MiMo-V2.5MiMo-V2.5 | 38 | 2 ₽ | — | — | 1 млн |
| Qwen3.5 397B A17BQwen3.5 397B A17B (FP8) | 34 | 31 ₽ | — | — | 262 тыс. |
| Qwen3.5 122B A10BQwen3.5 122B A10B (FP8) | 33 | 22 ₽ | — | — | 262 тыс. |
| Qwen3.6 35B A3B FP8Qwen3.6 35B A3B FP8 | 32 | 16 ₽ | — | — | 262 тыс. |
| Gemma 4 31BGemma 4 31B (FP8) | 30 | 3 ₽ | — | — | 262 тыс. |
| Gemma 4 26B A4BGemma 4 26B A4B (FP8) | 26 | 3 ₽ | — | — | 1 млн |
| Qwen3.6 35B A3B (Non-reasoning) FP8Qwen3.6 35B A3B (Non-reasoning) FP8 | 25 | 36 ₽ | — | — | 262 тыс. |
| Nemotron 3.5 LightningNemotron 3.5 Lightning (BF16) | 24 | — ₽ | 309 | 1,44 | 66 тыс. |
| Qwen3 Next 80B A3BQwen3 Next 80B A3B (Reasoning) | 17 | 4 ₽ | — | — | 262 тыс. |
| DeepSeek V4 FlashDeepSeek V4 Flash (Non-reasoning) | — | — ₽ | — | — | 1 млн |
| MiMo-V2.5-ProMiMo-V2.5-Pro (Non-reasoning) | — | — ₽ | — | — | 1 млн |
| Gemma 4 26B A4BGemma 4 26B A4B (Non-reasoning) (FP8) | — | — ₽ | — | — | 1 млн |
| Qwen3 Next 80B A3BQwen3 Next 80B A3B | — | — ₽ | 186 | 2,65 | 262 тыс. |
Дешевле или дороже прямого доступа
Дороже прямого доступа на 21% по 8 моделям со сравнимой ценой.
Модели только у этого провайдера
В нашей выгрузке 2 модели доступны только здесь.
- Qwen3.6 35B A3B FP8 — 16 ₽ за задачу
- Qwen3.6 35B A3B (Non-reasoning) FP8 — 36 ₽ за задачу
Что такое стоимость задачи
Это цена одного типового прогона, а не ставка за миллион токенов. У рассуждающих моделей она выше при той же ставке: модель тратит токены на размышления, которые вы не видите, но оплачиваете.