Китайские разработчики сбивают цену: Qwen3.8-Max и DeepSeek V4-Flash
Alibaba выпустила Qwen3.8-Max — свою самую большую модель на 2,4 трлн параметров, из которых на каждый запрос работают около 95 млрд. Одновременно DeepSeek привлекла внимание ценой на V4-Flash: она ниже, чем у большинства сопоставимых систем.
Обе модели используют схему mixture-of-experts: активируется только часть сети, и стоимость запроса падает при сохранении размера.
Ценовая гонка идёт именно в этом сегменте — не за первое место в баллах, а за приемлемое качество по цене в разы ниже флагманов.
В нашей таблице DeepSeek V4 Flash обходится в 24 ₽ за миллион выходных токенов при 39,0 балла, а Qwen3.8 Max — 521 ₽ при 58,1. Разница в цене больше двадцати раз при разрыве в 19 баллов.
Смотреть в таблицах
Первоисточник: Qwen
Новости
26 августа 2026Qwen3.8-Flash-Next выдаёт 89 токенов в секунду при цене 41 ₽Alibaba выпустила Qwen3.8-Flash-Next — 55,8 балла интеллекта, 73,1 по коду, 89 токенов в секунду и 41 ₽ за миллион выходных токенов.
13 августа 2026DeepSeek V4 Pro вышла из превьюDeepSeek перевела V4 Pro в общий доступ: 53,2 балла интеллекта, 68,8 по коду, цена 115 ₽ за миллион входных токенов и 344 ₽ за миллион выходных.
7 августа 2026Alibaba хочет брать отчисления за коммерческое использование QwenAlibaba готовит новые условия для следующей открытой модели Qwen: крупным компаниям, которые зарабатывают, продавая доступ к модели как услугу, придётся заключать с ней отдельное соглашение. Об этом сообщило агентство Reuters со ссылкой на два источника.
Другие новости
11 августа 2026Nemotron 3.5 Lightning отвечает за 0,9 секундыNVIDIA выпустила Nemotron 3.5 Lightning: время до первого токена 0,9 секунды, 309 токенов в секунду, 19 ₽ за миллион выходных токенов и 23,6 балла интеллекта.
7 августа 2026Alibaba хочет брать отчисления за коммерческое использование QwenAlibaba готовит новые условия для следующей открытой модели Qwen: крупным компаниям, которые зарабатывают, продавая доступ к модели как услугу, придётся заключать с ней отдельное соглашение. Об этом сообщило агентство Reuters со ссылкой на два источника.
4 августа 2026Ling 3.0 Flash выдаёт 374 токена в секундуInclusionAI выпустила Ling 3.0 Flash: 374 токена в секунду — четвёртый результат по скорости во всей таблице — при 37,8 балла интеллекта и цене 19 ₽ за миллион выходных токенов.