Nemotron 3.5 Lightning отвечает за 0,9 секунды
NVIDIA выпустила Nemotron 3.5 Lightning: время до первого токена 0,9 секунды, 309 токенов в секунду, 19 ₽ за миллион выходных токенов и 23,6 балла интеллекта.
Модель сделана под длинные цепочки вызовов, где задержка каждого шага складывается в общее время работы агента. По баллам она на 146-м месте из 445.
Цена входа — 6 ₽ за миллион токенов. Это тот случай, когда модель берут не за качество ответа, а за то, что она не тормозит цепочку.
Выше 300 токенов в секунду в наших замерах держатся тринадцать моделей из 618, и Nemotron 3.5 Lightning — одна из них.
Смотреть в таблицах
Первоисточник: NVIDIA
Новости
24 июля 2026Две дюжины компаний подписали письмо в защиту открытых весовОткрытое письмо в защиту моделей с открытыми весами подписали 24 компании и организации: Microsoft, Nvidia, IBM, Dell Technologies, CrowdStrike, Palantir, ServiceNow, Hugging Face, Perplexity, Mistral, Andreessen Horowitz, Y Combinator, Linux Foundation, Mozilla и другие.
Другие новости
13 августа 2026DeepSeek V4 Pro вышла из превьюDeepSeek перевела V4 Pro в общий доступ: 53,2 балла интеллекта, 68,8 по коду, цена 115 ₽ за миллион входных токенов и 344 ₽ за миллион выходных.
12 августа 2026Grok 4.6 занял четвёртое место с 60,9 баллаSpaceXAI выпустила Grok 4.6: 60,9 балла интеллекта, 76,8 по коду, цена 174 ₽ за миллион входных токенов и 521 ₽ за миллион выходных.
7 августа 2026Alibaba хочет брать отчисления за коммерческое использование QwenAlibaba готовит новые условия для следующей открытой модели Qwen: крупным компаниям, которые зарабатывают, продавая доступ к модели как услугу, придётся заключать с ней отдельное соглашение. Об этом сообщило агентство Reuters со ссылкой на два источника.