Как модели ведут себя на русском
Русский понимают почти все модели, различаются они поведением. Одна отвечает по-русски на русский вопрос, другая без просьбы переходит на английский, третья вместо ответа показывает служебные рассуждения. Задания для всех одинаковые.
Замер сделан на бесплатных версиях моделей. Платные версии тех же разработчиков ведут себя иначе, поэтому таблица показывает состояние бесплатного доступа, а не качество русского языка у флагманов.
Замер 2026-09-02 · 14 моделей · задания: определение одним предложением, склонение по падежам, счёт денег
| Модель | Доля русского в ответе | Формат соблюдён | Медиана времени | Замечания |
|---|---|---|---|---|
| nemotron-3-ultra-550b-a55bnvidia/nemotron-3-ultra-550b-a55b | 100% | 3 из 3 | 1,9 с | — |
| MiniMax-M3minimax/minimax-m3 | 100% | 3 из 3 | 2,1 с | — |
| dots-3-note-previewdots-studio/dots-3-note-preview | 100% | 2 из 3 | 3,9 с | — |
| nemotron-3-nano-omni-30b-a3b-reasoningnvidia/nemotron-3-nano-omni-30b-a3b-reasoning | 100% | 2 из 2 | 6,2 с | — |
| ling-3.0-flash-fininclusionai/ling-3.0-flash-fin | 67% | 2 из 3 | 3,3 с | — |
| North Mini Codecohere/north-mini-code | 67% | 2 из 3 | 3,9 с | — |
| MiniMax-M2.7minimax/minimax-m2.7 | 67% | 2 из 3 | 4,2 с | — |
| nemotron-3-super-120b-a12bnvidia/nemotron-3-super-120b-a12b | 33% | 0 из 1 | 9,4 с | — |
| Nemotron 3.5 Lightningnvidia/nemotron-3.5-lightning | 18% | 1 из 3 | 7,4 с | служебный текст |
| freeopenrouter/free | 8% | 0 из 3 | 8,4 с | служебный текст |
| nemotron-3.5-content-safetynvidia/nemotron-3.5-content-safety | 0% | 1 из 3 | 2,8 с | — |
| LFM2.5-2.6Bliquid/lfm-2.5-2.6b | 0% | 0 из 2 | 1,5 с | — |
| laguna-xs-2.1poolside/laguna-xs-2.1 | 0% | 0 из 2 | 6,1 с | — |
| laguna-s-2.1poolside/laguna-s-2.1 | 0% | 0 из 2 | 11,7 с | — |
Что означают цифры
Доля русского — сколько кириллицы в ответе относительно латиницы. Сто процентов значит, что модель ответила по-русски целиком. Ноль означает не «не знает русского», а «на русский вопрос ответила по-английски»: понимание есть, дисциплины нет. Для работы это одинаково неудобно, но причина другая.
Формат — выполнила ли модель прямое указание: «одним предложением» значит одно предложение, «шесть форм» значит шесть строк. Это проверка на послушание, а не на эрудицию.
Служебный текст — модель показала внутренние рассуждения вида «Here's a thinking process» вместо ответа. Для человека это выглядит как сбой.
Ограничения замера
Замер короткий: три задания, один прогон. Ответ одной и той же модели меняется от запуска к запуску — в одном заходе модель отвечает по-русски целиком, в следующем полностью по-английски. Поэтому цифры показывают склонность, а не постоянное свойство.
Охват тоже узкий: четырнадцать бесплатных моделей из сотен доступных. Бесплатные версии часто урезаны — меньше размер, другой режим работы, жёсткие ограничения. Делать по ним выводы о флагманах нельзя, и мы их не делаем.
Следующий замер пойдёт по платным версиям сильнейших моделей: больше заданий и три прогона с усреднением вместо одного.