Ling 3.0 Flash выдаёт 374 токена в секунду
InclusionAI выпустила Ling 3.0 Flash: 374 токена в секунду — четвёртый результат по скорости во всей таблице — при 37,8 балла интеллекта и цене 19 ₽ за миллион выходных токенов.
Быстрее только три модели, и все три заметно слабее по баллам: 21,9, 12,4 и 1,0 против 37,8 у Ling.
Индекс кода — 50,6. Для потоковой обработки текста этого хватает, для сложной разработки — нет.
Это единственная модель в таблице, которая держит выше 350 токенов в секунду и при этом набирает больше 35 баллов интеллекта.
Смотреть в таблицах
Первоисточник: InclusionAI на Hugging Face
Другие новости
7 августа 2026Alibaba хочет брать отчисления за коммерческое использование QwenAlibaba готовит новые условия для следующей открытой модели Qwen: крупным компаниям, которые зарабатывают, продавая доступ к модели как услугу, придётся заключать с ней отдельное соглашение. Об этом сообщило агентство Reuters со ссылкой на два источника.
5 августа 2026Китайские разработчики сбивают цену: Qwen3.8-Max и DeepSeek V4-FlashAlibaba выпустила Qwen3.8-Max — свою самую большую модель на 2,4 трлн параметров, из которых на каждый запрос работают около 95 млрд. Одновременно DeepSeek привлекла внимание ценой на V4-Flash: она ниже, чем у большинства сопоставимых систем.
3 августа 2026Qwen3.8 Max поднялся на восьмое местоAlibaba выпустила Qwen3.8 Max: 58,1 балла интеллекта, 71,8 по коду, цена 174 ₽ за миллион входных токенов и 521 ₽ за миллион выходных.