IBM выпустила Granite 4.2 тремя размерами
IBM выпустила Granite 4.2 в трёх размерах — 3, 8 и 30 миллиардов параметров. Старшая набрала 23,7 балла интеллекта при 75 токенах в секунду и цене 56 ₽ за миллион выходных токенов.
Младшая модель линейки быстрее всех: 219 токенов в секунду при 14,3 балла и цене 10 ₽ за миллион выходных. Разница между младшей и старшей — 9,4 балла и пятикратная цена.
Время до первого токена у всех трёх меньше секунды: 0,42, 0,58 и 0,81. Это модели не для сложных задач, а для потоковой обработки, где важнее задержка и цена.
В общем зачёте старшая Granite 4.2 стоит на 145-м месте из 445 — верхняя половина таблицы, но далеко от флагманов.
Смотреть в таблицах
Первоисточник: IBM Research
Новости
24 июля 2026Две дюжины компаний подписали письмо в защиту открытых весовОткрытое письмо в защиту моделей с открытыми весами подписали 24 компании и организации: Microsoft, Nvidia, IBM, Dell Technologies, CrowdStrike, Palantir, ServiceNow, Hugging Face, Perplexity, Mistral, Andreessen Horowitz, Y Combinator, Linux Foundation, Mozilla и другие.
Другие новости
26 августа 2026Qwen3.8-Flash-Next выдаёт 89 токенов в секунду при цене 41 ₽Alibaba выпустила Qwen3.8-Flash-Next — 55,8 балла интеллекта, 73,1 по коду, 89 токенов в секунду и 41 ₽ за миллион выходных токенов.
26 августа 2026GLM-5.3-Flash отдаёт 57,5 балла за 43 ₽ за миллион токеновZ AI выпустила GLM-5.3-Flash: 57,5 балла интеллекта при цене 13 ₽ за миллион входных токенов и 43 ₽ за миллион выходных — десятое место в зачёте.
18 августа 2026Zhipu призналась, что GLM-5.3 быстрее всего растёт там, где отставалаВ заметке о выходе GLM-5.3 пекинская компания Zhipu (она же Z.ai) написала фразу, которую почти не разобрали в обзорах: способности модели растут быстрее всего именно на тех задачах, где у неё было самое большое отставание.