Агентный индекс: топ-30 моделей

Способность довести до конца длинную цепочку действий. Первое место — Claude Fable 5.1 от Anthropic, 61,3 балла.

Измерен у185 моделей
Первое местоClaude Fable 5.1
Лучший балл61,3
Снимок данных2 сентября 2026

Как считается

Проверяет не единичный ответ, а работу: спланировать шаги, вызвать инструменты, проверить результат, исправиться. Модель, сильная в диалоге, здесь часто рассыпается на пятом шаге.

Первая десятка

Полный список

#МодельРазработчикИнтеллектОтставаниеКод₽ / 1 млн ответаТокенов в секундуКонтекстИз России
1Claude Fable 5.1Adaptive Reasoning, Max Effort, Default FallbackAnthropic65,70,081,64 338661 млннет
2Claude Opus 5Adaptive Reasoning, Max EffortAnthropic63,1−2,678,02 169541 млннет
3GLM-5.3maxZ AI59,5−6,274,8382721 млнесть
4Grok 4.6highSpaceXAI60,9−4,876,852154500 тыс.только API
5Qwen3.8 MaxAlibaba58,1−7,671,8521411 млнесть
6GLM-5.3-FlashZ AI57,5−8,271,543411 млнесть
7GPT-5.6 SolmaxOpenAI60,9−4,877,41 735771 млннет
8Qwen3.8 2.4T A95BAlibaba57,7−8,071,9521421 млнесть
9Claude Fable 5Adaptive Reasoning, Max Effort, Opus 4.8 FallbackAnthropic62,1−3,676,54 338671 млннет
10Qwen3.8-Flash-NextAlibaba55,8−9,973,14189есть
11Kimi K3maxKimi59,7−6,076,21 301381 млн
12DeepSeek V4 Flash VisionReasoning, Max EffortDeepSeek51,5−14,265,0115109есть
13Qwen3.8 27BxhighAlibaba52,0−13,768,1260441 млнесть
14GPT-5.6 TerramaxOpenAI56,6−9,176,71 0411141 млннет
15Claude Sonnet 5Adaptive Reasoning, Max EffortAnthropic55,3−10,471,5868721 млннет
16DeepSeek V4 Pro 0813Reasoning, Max EffortDeepSeek53,2−12,568,8344541 млнесть
17Claude Opus 4.8Adaptive Reasoning, Max EffortAnthropic57,3−8,474,32 169561 млннет
18Muse Spark 1.2xhighMeta56,8−8,972,2369921 млнесть
19Grok 4.5highSpaceXAI55,8−9,972,452148500 тыс.только API
20DeepSeek V4 Flash 0731Reasoning, Max EffortDeepSeek51,8−13,969,11151081 млнесть
21GPT-5.5xhighOpenAI56,3−9,474,92 603861 млннет
22GPT-5.6 LunamaxOpenAI52,3−13,471,41041291 млннет
23Claude Opus 4.7Adaptive Reasoning, Max EffortAnthropic55,0−10,773,62 169461 млннет
24GLM-5.2maxZ AI52,6−13,168,838269256 тыс.есть
25Gemini 3.7 FlashhighGoogle56,0−9,776,13252891 млннет
26GPT-5.4xhighOpenAI53,1−12,671,11 3011381 млннет
27Agnes 2.5 Pro BetaSapiens AI49,1−16,662,326150
28Claude Sonnet 4.6Adaptive Reasoning, Max EffortAnthropic48,4−17,363,01 301541 млннет
29Gemini 3.6 FlashhighGoogle51,6−14,169,23251671 млннет
30Gemini 3.5 FlashhighGoogle52,0−13,770,17811971 млннет

Чего индекс не показывает

Сводная оценка усредняет разные способности, и высокий балл не означает, что модель подойдёт вашей задаче. Разница в один-два балла между соседями по таблице меньше, чем разброс между двумя запусками одной модели.

Другие индексы: Индекс интеллекта · Индекс кода